██████╗ ██████╗ ██╗ ███████╗ ██╗ ██╗
██╔══██╗ ██╔═══██╗ ██║ ██╔════╝ ╚██╗██╔╝
██║ ██║ ██║ ██║ ██║ █████╗ ╚███╔╝
██║ ██║ ██║ ██║ ██║ ██╔══╝ ██╔██╗
██████╔╝ ╚██████╔╝ ███████╗ ███████╗ ██╔╝ ██╗
╚═════╝ ╚═════╝ ╚══════╝ ╚══════╝ ╚═╝ ╚═╝你的AI数据分析师。 将Claude指向CSV文件的文件夹,并进行专家级分析——无需代码、无需设置、无需数据离开您的机器。
______________________________________________________________________
问题
您的桌面上有一个CSV导出文件夹。 sales-2024-Q1.csv, sales-2024-Q2.csv, customers.csv, products.csv不同时期、不同系统的松散文件。现在,将这些转化为实际的洞察力意味着两件事之一:
- Python REPL循环 --Claude编写一个脚本,运行它,得到一个错误,修复它,再次运行它,遇到一个不同的错误,最终生成一个具有默认样式的matplotlib图表,你会很尴尬地把它放在一个甲板上。
- “这是一个柱状图” --每个AI助手都会使用相同的三种图表类型,因为它们针对最可能的标记进行优化,而不是针对最具信息量的可视化。
Dolex取代了两者。没有Python。没有回复。不 import pandas不 plt.show()。没有调试依赖关系冲突。告诉克劳德: *“将所有内容加载到~/data/中,并向我显示季度趋势。”*
它到底是什么
Dolex是一个MCP服务器,为Claude提供了一个完整的数据分析工具包。它在Claude内部本地运行——你不需要知道它是如何工作的,只需安装它,Claude就会获得新的能力:
一次加载整个CSV文件文件夹 --将其指向一个目录,Dolex会加载它找到的每个CSV,自动分析每个CSV(列类型、分布、统计数据、示例值),并使它们都可查询。宽松的季度出口,每个地区单独的文件,无论你有什么,Dolex都会处理。
内置查询引擎 --聚合(总和、平均值、中位数、标准偏差、百分位数)、时间分段(按月/季度/年分组)、窗口函数(滞后、领先、排名、运行总计、占总数的百分比)、跨文件的自动连接和过滤器。处理500k+行。没有代码生成,没有沙盒——Dolex直接计算数字。
43种手工制作的可视化图案 --不是chart.js的默认值。用于排名的凹凸图、用于分布的蜂群图、用于流量的桑基图、用于比较分布的脊线图、用于两个度量比较的连通点图、用于时间模式的日历热图等等。每种模式都有选择规则,这些规则编码了真实的数据可视化专业知识。
模式智能 --Dolex不仅仅渲染图表。它分析数据的形状和意图,对所有43种模式进行评分,并推荐真正传达洞察力的模式,而不是显而易见的模式。
自动分析计划 --给它一个数据集,它就会生成一个结构化的分析计划:哪些列很重要,要探索哪些关系,要构建哪些图表,并为每个步骤准备好执行查询。
100%本地,100%离线 --你的数据永远不会离开你的机器。图表呈现为自包含的HTML。该软件包附带了33个TopoJSON地图文件。零CDN调用,零外部依赖。
安装
npm install -g @outsidedata/dolex要更新,请执行以下操作:
npm update -g @outsidedata/dolex克劳德桌面版
添加到您的配置(~/Library/Application Support/Claude/claude_desktop_config.json 在macOS上):
{
"mcpServers": {
"dolex": {
"command": "dolex"
}
}
}克劳德代码
claude mcp add dolex -- dolex任何MCP客户端
dolex查询引擎
将Claude指向CSV文件文件夹并开始提问。没有模式定义,没有导入,没有设置。Dolex加载每个文件,自动分析您的数据——列类型、分布、基数、样本值——并为Claude提供回答您问题所需的一切。
Claude从不编写代码或原始SQL。相反,它使用Dolex的内置查询语言:
聚合: sum, avg, min, max, count, count_distinct, median, stddev, p25, p75, percentile
窗口功能: lag, lead, rank, dense_rank, row_number, running_sum, running_avg, pct_of_total --具有分区和顺序控制
时光倒流:分组方式 day, week, month, quarter, year --自动日期解析
连接:同一源中跨表的内部和左连接,具有点标记字段引用和歧义检测
过滤器:聚合前(filter)之后(having),与运营商 =, !=, >, >=, <, <=, in, not_in, between, like, is_null, is_not_null
每个查询在执行前都会经过验证——字段名会根据模式进行检查,并对拼写错误给出模糊的“你是说什么?”建议。
43图案
| 类别 | 它们的用途 |
|---|---|
| 比较 (9) | 条形图、分流条形图、斜率图、连通点图、凹凸图、棒棒糖、子弹、分组条形图、瀑布 |
| 分布 (7) | 柱状图、Beeswarm图、小提琴图、Ridgeline图、条形图、箱形图、密度图 |
| 构图 (9) | 堆叠酒吧、华夫饼、树状图、日出、圆形包装、公制、甜甜圈、Marimekko、冰柱 |
| 时间 (7) | 线条、面积、小倍数、闪光网格、日历热图、流图、地平线图 |
| 关系 (5) | 散射,连通散射,平行坐标,雷达,热图 |
| 流动 (4) | 桑基,冲积,和弦,漏斗 |
| 地理 (2) | Choropleth,比例符号——33张离线地图(世界、美国、各大洲、17个国家) |
工具
| 工具 | 它做什么 |
|---|---|
load_csv | 加载CSV文件或目录 |
describe_data | 配置文件列、统计数据、示例行 |
analyze_data | 自动生成分析计划 |
query_data | 运行SQL查询(JOIN、GROUP BY、窗口函数、CTE) |
visualize | 数据→ 排名图表推荐(内联、缓存或CSV+SQL) |
refine_visualization | 在图表上迭代 |
transform_data | 使用表达式创建派生列 |
promote_columns | 将工作列持久化到磁盘 |
list_transforms | 按层列出列(源/派生/工作) |
drop_columns | 掉落衍生柱或工作柱 |
list_patterns | 浏览全部43图案 |
export_html | 获取原始HTML |
screenshot | 渲染为PNG |
server_status | 检查服务器状态 |
clear_cache | 重置 |
许可证
麻省理工学院
