解模糊获取mcp服务器
一个模型上下文协议服务器,使用 解乳房 图书馆。此服务器使LLM能够从网页中检索和处理内容,自动清理HTML并将其转换为干净、可读的标记。
比较
(使用 这个问题)
| 默认提取MCP | 解模糊提取MCP |
|---|
特性
- 更好的内容提取:使用Defuddle删除网页混乱并提取主要内容:同时保留页面标题和关键元数据等内容
- 灵活的输出:支持markdown和原始HTML输出
- 分块阅读:支持分页
start_index和max_length参数 - 元数据:提取标题、作者、出版日期、字数等信息
安装
要将此服务器与Claude Desktop应用程序一起使用,请将以下配置添加到您的“mcpServers”部分 claude_desktop_config.json:
{
"mcpServers": {
"defuddle-fetch": {
"command": "npx",
"args": [
"-y",
"defuddle-fetch-mcp-server"
]
}
}
}组件
工具
- 获取
- 从互联网上获取URL,并使用Defuddle将其内容提取为干净的标记文本 - 输入参数: - url (字符串,必填):要获取的URL - max_length (number,可选):返回的最大字符数。默认值为5000。 - start_index (数字,可选):从此字符索引开始内容。默认为0。 - raw (boolean,可选):获取原始内容,不进行markdown转换。默认为false。 - 返回已清理的内容及其元数据,包括标题、作者、发布日期、字数、域和处理时间
贡献
GitHub上欢迎拉取请求!开始:
- 安装Git和Node.js
- 克隆仓库
- 安装依赖项
npm install - 跑
npm run test运行测试 - 构建于
npm run build
要将其添加到Claude Desktop,请运行 npm run build 然后将以下配置添加到您的 claude_desktop_config.json:
{
"mcpServers": {
"defuddle-fetch": {
"command": "node",
"args": [
"/path/to/clone/defuddle-fetch-mcp-server/dist/index.js"
]
}
}
}发布
版本遵循 语义版本规范.
要发布:
- 使用
npm version升级版本 - 跑
git push --follow-tags使用标签推送 - 等待GitHub Actions发布到NPM注册表。
