ThinkGate

Claude代理的自动推理模式选择。
______________________________________________________________________
问题
你构建了一个AI代理。它处理一切——状态检查、快速查找、复杂的架构问题、深度调试会话。但在引擎盖下,它以相同的思维设置通过相同的模型运行每一条信息。
这意味着你在燃烧“东京几点了?”的扩展思维代币,并在“帮我设计整个身份验证系统”上得到肤浅的答案
您可以手动标记请求-- ULTRATHINK: 在困难之前。但你忘了。你的用户肯定不会这样做。如果你正在为其他人构建代理,你就无法训练每个最终用户来管理思维模式。
ThinkGate在基础设施层解决了这个问题。 它位于传入消息和模型调用之间,在~200ms内对复杂性进行分类,并准确返回要使用的模型和思维深度。自动。每一次。
______________________________________________________________________
这是给谁的
- 代理商建设者 让克劳德处理简单和复杂的任务,他厌倦了一刀切的模型设置
- 运行24/7代理的团队 (WhatsApp机器人、Slack助手、Telegram代理),消息复杂性差异很大,成本/延迟实际上很重要
- 任何曾经打字的人
ULTRATHINK手动地 心想:这应该自己发生
______________________________________________________________________
运作原理
Incoming message
↓
Haiku call (~200ms, ~$0.0001)
"How complex is this?"
↓
fast → no extended thinking
think → medium effort
ultrathink → max effort
↓
Claude runs with the right settings一个廉价、快速的Haiku调用会读取您的提示,并决定它需要哪一层。然后,你的主要Claude调用以正确的努力水平运行。您几乎无需为分类付费,并在60%以上不需要扩展推理的消息上节省了真正的资金(和延迟)。
分类器是这里的IP,而不是运行它的模型。三层。系统提示在“这需要思考”和“这不需要思考”之间的边界上进行了训练。它开箱即用。
______________________________________________________________________
层级
| 级别 | 克劳德努力 | 何时 |
|---|---|---|
fast | none | 事实性、对话性、简单的编辑 |
think | medium | 架构、调试、多步骤分析 |
ultrathink | max | 系统设计、证明、开放式复杂性 |
______________________________________________________________________
用作MCP工具(克劳德桌面/Claude代码)
添加 ~/.claude/settings.json (克劳德代码)或 ~/Library/Application Support/Claude/claude_desktop_config.json (克劳德桌面):
{
"mcpServers": {
"thinkgate": {
"command": "npx",
"args": ["-y", "mcp-thinkgate"],
"env": {
"ANTHROPIC_API_KEY": "your-api-key-here"
}
}
}
}重启克劳德。现在,您可以要求它在回答之前进行分类:
在响应之前,请对此任务的复杂性进行分类:为公共API设计速率限制器
Tier: think
Effort: medium
Suggested model: claude-sonnet-4-6
Confidence: 92%
Why: Requires structured design reasoning and trade-off analysis, but has well-defined scope.______________________________________________________________________
用作库(代理框架)
安装:
npm install mcp-thinkgate导入和使用:
import { classifyPrompt, setLogLevel } from 'mcp-thinkgate';
// Optional: silence logs (default level is 'info', writes to stderr)
setLogLevel('error');
const result = await classifyPrompt(userMessage, process.env.ANTHROPIC_API_KEY!);
// result.tier → 'fast' | 'think' | 'ultrathink'
// result.effort → 'none' | 'medium' | 'max'
// result.confidence → 0.0 - 1.0
// result.reasoning → one sentence explanation
// Works without an API key too (rule-based fallback):
const quickResult = await classifyPrompt(userMessage);______________________________________________________________________
参考实施:TinyClaw
TinyClaw 是Claude的开源多代理框架。ThinkGate已连接到其 invokeAgent() 函数——在Claude CLI运行之前,每条消息都会自动分类,以及 --effort 相应地设置。
添加了三行。无需配置。每个团队中的每个代理都会自动获得正确的思维深度。
请参阅集成 src/lib/invoke.ts.
______________________________________________________________________
需求
- Node.js 20+
- Anthropic API密钥(可选-返回到基于规则的分类)
本地开发
git clone https://github.com/tjp2021/mcp-thinkgate
cd mcp-thinkgate
npm install
npm test
npm run build贡献
看 贡献.md 用于开发设置、命令和PR过程。
安全
看 安全.md 用于漏洞报告。
许可证
麻省理工学院——见 许可证
