剧作家获取MCP服务器
](https://github.com/ThreatFlux/playwright-fetch/releases)    ](https://www.python.org/downloads/)   
一种模型上下文协议服务器,使用Playwright提供web内容获取功能,实现浏览器自动化。此服务器使LLM能够从网页中检索和处理JavaScript渲染的内容,将HTML转换为markdown以便于使用。
作者
由...创建 Wyatt Roersma 在Claude Code的协助下。
主要特点
- 浏览器自动化:使用Playwright渲染完全支持JavaScript的网页
- 内容提取:自动识别和提取网页中的主要内容区域
- Markdown转换:将HTML转换为干净、可读的markdown
- 分页支持:通过分页处理大型内容
- Robots.txt合规性:尊重robots.txt指令进行自主获取
- 代理支持:允许通过代理服务器路由请求
- Docker就绪:可通过以下方式作为预构建的Docker镜像提供 和
可用工具
playwright-fetch-使用Playwright浏览器自动化获取URL,并将其内容提取为markdown。
- url (字符串,必填):要获取的URL - max_length (整数,可选):返回的最大字符数(默认值:5000) - start_index (整数,可选):从此字符索引开始内容(默认值:0) - raw (boolean,可选):获取原始内容而不进行markdown转换(默认值:false) - wait_for_js (boolean,可选):等待JavaScript执行(默认值:true)
提示
- 剧作家取回
- 使用Playwright获取URL并将其内容提取为markdown - 论据: - url (字符串,必填):要获取的URL
需求
- Python 3.13.2或更新版本
- 紫外线 包管理器
- 已安装Playwright浏览器
安装
1.使用紫外线进行安装(推荐)
uv pip install git+https://github.com/ThreatFlux/playwright-fetch.git
# Install Playwright browsers
uv pip exec playwright install或者,克隆存储库并安装:
git clone https://github.com/ThreatFlux/playwright-fetch.git
cd playwright-fetch
uv pip install -e .
# Install Playwright browsers
uv pip exec playwright install2.使用Docker
您可以从Docker Hub或GitHub容器注册表中使用我们预先构建的Docker镜像:
# From Docker Hub
docker pull threatflux/playwright-fetch:latest
# From GitHub Container Registry
docker pull ghcr.io/threatflux/playwright-fetch:latest或者自己建造:
docker build -t threatflux/playwright-fetch .配置
为Claude.app进行配置
添加到您的Claude设置中:
Using uvx
"mcpServers": {
"playwright-fetch": {
"command": "uvx",
"args": ["mcp-server-playwright-fetch"]
}
}Using docker
"mcpServers": {
"playwright-fetch": {
"command": "docker",
"args": ["run", "-i", "--rm", "threatflux/playwright-fetch"]
}
}配置VS代码
对于手动安装,请将以下JSON块添加到VS Code中的用户设置(JSON)文件中。
Using uvx
{
"mcp": {
"servers": {
"playwright-fetch": {
"command": "uvx",
"args": ["mcp-server-playwright-fetch"]
}
}
}
}Using Docker
{
"mcp": {
"servers": {
"playwright-fetch": {
"command": "docker",
"args": ["run", "-i", "--rm", "threatflux/playwright-fetch"]
}
}
}
}命令行选项
服务器支持以下命令行选项:
--user-agent:自定义用户代理字符串--ignore-robots-txt:忽略robots.txt限制--proxy-url:用于请求的代理URL--headless:在无头模式下运行浏览器(默认值:True)--wait-until:何时认为导航成功(选项:“加载”、“domcontentloaded”、“networkidle”、“提交”,默认值:“networkidlet”)
示例用法
# Run with default settings
uv run mcp-server-playwright-fetch
# Run with a custom user agent and proxy
uv run mcp-server-playwright-fetch --user-agent="MyCustomAgent/1.0" --proxy-url="http://myproxy:8080"
# Run with visible browser for debugging
uv run mcp-server-playwright-fetch --headless=false调试
您可以使用MCP检查器调试服务器:
npx @modelcontextprotocol/inspector uvx mcp-server-playwright-fetch与标准Fetch服务器的区别
此实现与标准的获取MCP服务器在以下方面有所不同:
- 浏览器自动化:使用Playwright渲染JavaScript繁重的页面
- 内容提取:尝试从常见页面结构中提取主要内容
- 等待选项:可配置的页面加载策略(等待加载、DOM内容、网络空闲)
- 可见浏览器选项:可以使用可见的浏览器进行调试
许可证
该项目根据MIT许可证获得许可。请参阅 许可证 文件以获取详细信息。
