Grok 4 MCP服务器
一个模型上下文协议(MCP)服务器,为AI助手提供对Grok 4功能的访问,包括聊天完成、实时搜索和模型管理。
特性
- 聊天补全:与Grok 4交互以执行对话式AI任务
- 实时搜索:具有结构化结果的实时网络搜索
- 多模型支持:支持grok-4-1-快速推理、grok-4-1-快速推理和grok-code-fast-1
- 速率限制:内置请求节流和断路器模式
- 缓存:智能响应缓存可提高性能
- 指标:用于监控和可观察性的Prometheus度量
- 安全:输入验证、净化和安全配置
支持的型号
| 模型 | 上下文窗口 | TPM | RPM | 输入价格 | 输出价格 | 用例 | ||
|---|---|---|---|---|---|---|---|---|
| grok-4-1快速推理 | 2000000 | 4M | 480 | 0.20美元/M代币 | 0.50美元/M令牌 | 一般推理任务 | ||
| grok-4-1快速推理 | 2000000 | 4M | 480 | 0.20美元/M代币 | 0.50/M代币 | 快速、直接的响应 | ||
| grok-code-fast-1 | 不适用 | 不适用 | N/A | N/A | 不适用 | 不适用 | 代码生成和分析 |
安装
先决条件
- Node.js>=18.0.0
- npm或纱线
- xAI API密钥
设置
- 克隆存储库:
git clone
cd grok-4-mcp-server- 安装依赖项:
npm install- 配置环境变量:
cp .env.example .envrc编辑 .envrc 根据您的配置:
export XAI_API_KEY="your-xai-api-key-here"
export GROK_MODEL="grok-4-1-fast-reasoning" # or grok-4-1-fast-non-reasoning, grok-code-fast-1
export GROK_BASE_URL="https://api.x.ai/v1" # Optional, defaults provided
export GROK_TEMPERATURE="0.7" # Optional, 0.0-1.0
export GROK_MAX_TOKENS="4000" # Optional
export MCP_SERVER_NAME="grok-4-mcp-server" # Optional
export MCP_SERVER_VERSION="1.0.0" # Optional- 加载环境变量:
direnv allow # If using direnv
# or
source .envrc- 构建项目:
npm run build用法
直接执行
npm start发展模式
npm run devMCP集成
服务器实现了模型上下文协议,可以与任何兼容MCP的客户端集成。它公开了以下工具:
grok_ask:向Grok提出一个带有可选上下文和搜索的问题grok_chat:与Grok的多轮对话grok_search:实时网络搜索功能grok_models:列出可用的Grok型号grok_test_connection:测试API连接grok_health:服务器健康检查和指标
MCP客户端配置示例
{
"mcpServers": {
"grok": {
"command": "node",
"args": ["dist/index.js"],
"env": {
"XAI_API_KEY": "your-key-here"
}
}
}
}配置
环境变量
| 变量 | 默认值 | 描述 |
|---|---|---|
XAI_API_KEY | *必需* | 您的xAI API密钥 |
GROK_MODEL | grok-4-1-fast-reasoning | 要使用的默认模型 |
GROK_BASE_URL | https://api.x.ai/v1 | API端点URL |
GROK_TEMPERATURE | 0.7 | 反应创造力(0.0-1.0) |
GROK_MAX_TOKENS | 4000 | 最大响应令牌数 |
LOG_LEVEL | info | 记录冗长 |
NODE_ENV | production | 环境模式 |
高级配置
该服务器包括内置的弹性功能:
- 速率限制:2个并发请求,最小间隔500ms
- 断路器:具有回退功能的自动故障处理
- 缓存:用于响应的5分钟TTL LRU缓存
- 连接池:具有保持活动连接的HTTP代理
发展
测试
npm test
npm run test:watch代码检查
npm run lint
npm run lint:fix类型检查
npm run type-check建筑
npm run build
npm run clean安全考虑
- API密钥保护:从不将API密钥提交到版本控制
- 输入验证:所有输入都经过验证和消毒
- 速率限制:防止滥用并确保公平使用
- 错误处理:敏感信息不会在错误消息中暴露
- 日志记录:可配置的日志级别可防止敏感数据泄漏
监控
服务器在以下位置公开Prometheus指标 /metrics (当调用健康端点时):
- 请求延迟直方图
- 按工具列出的请求计数器
- 错误计数器
- 缓存命中率/未命中率
故障排除
常见问题
- “找不到API密钥”:确保
XAI_API_KEY在您的环境中设置 - “连接超时”:检查网络连接和API端点URL
- “超出费率限制”:实施客户端速率限制或增加间隔
- “型号不可用”:验证型号名称是否正确且受支持
调试模式
启用详细日志记录:
export LOG_LEVEL=debug
export NODE_ENV=development健康检查
测试服务器连接:
curl -X POST localhost:3000/health贡献
- 复刻仓库
- 创建要素分支
- 进行更改
- 添加新功能的测试
- 确保所有测试通过
- 提交拉取请求
开发指南
- 遵循TypeScript的最佳实践
- 添加综合测试
- 更新API变更文档
- 使用常规提交消息
- 确保与Node.js的兼容性>=18
许可证
MIT许可证-请参阅 许可证 文件以获取详细信息。
支持
- 问题:
- 文档: 完整文档
- 社区:\[不和谐/松弛\]
更新日志
v1.0.0
- 支持Grok 4的初始版本
- MCP协议实现
- 多型号支持
- 全面的错误处理和监控
______________________________________________________________________
*内置于❤️ 对于AI社区*
