Token导航 LogoToken导航TokenDH.com
Airlock Benchmark logo
AI代理未说明官方级别未说明来源级核验

Airlock Benchmark

MCP Server

Airlock Meta-Tools Benchmark 是一个用于比较元工具方法与传统完整工具扩展在模型上下文协议(MCP)服务器上令牌节省的工具,适用于AI代理API管理场景。

工具数

4

提示词数

0

GitHub Stars

0

资源数

0
API集成令牌优化JavaScriptClaudeClaude

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

Air-Lock-AI

提供方

Air-Lock-AI

最后核验

2026/5/17 20:20

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

详细介绍

气闸元工具基准测试

基准代币节省 气闸 元工具方法 vs传统 全工具扩展 用于MCP(模型上下文协议)服务器。

背景

当通过MCP向AI代理公开API时,有两种方法:

全面扩展(传统)

每个API端点都成为一个单独的MCP工具。对于一个拥有10个连接API的组织,平均每个API有30个端点,AI会收到 300工具定义 在每一条信息中。

元工具(气闸方法)

4工具 无论连接了多少API,都会暴露出来:

工具目的
list_services列出连接的服务和工具数量
search_tools按关键字查找工具
describe_tools获取特定工具的完整架构
execute_tool通过运行任何工具 service-slug/tool-name

快速开始

# Clone the repository
git clone https://github.com/Air-Lock-AI/airlock-benchmark.git
cd airlock-benchmark

# Install dependencies
npm install

# Run the benchmark
npm run benchmark

样本输出

📦 Meta-Tools (4 tools):
--------------------------------------------------
  list_services       :     63 tokens
  search_tools        :    130 tokens
  describe_tools      :    120 tokens
  execute_tool        :    144 tokens
--------------------------------------------------
  TOTAL               :    457 tokens

📊 Benchmark Results:
------------------------------------------------------------------------------------------------------------------------------
| Scenario                              | APIs | Tools | Meta    | Full      | Saved     | %     | $/req   | $/user/mo |
|---------------------------------------|------|-------|---------|-----------|-----------|-------|---------|-----------|
| Single API (Linear)                   | 1    | 9     | 457     | 1,091     | 634       | 58.1% | $0.0019 | $1.90     |
| Single API (GitHub)                   | 1    | 18    | 457     | 2,928     | 2,471     | 84.4% | $0.0074 | $7.41     |
| Three APIs (typical org)              | 3    | 32    | 457     | 4,878     | 4,421     | 90.6% | $0.013  | $13.26    |
| Large org (10 APIs)                   | 10   | 277   | 457     | 31,485    | 31,028    | 98.5% | $0.093  | $93.08    |

*Based on ~1,000 requests/user/month and Claude Sonnet 4.5 pricing ($3/1M input tokens)*

输出格式

# Terminal output (default)
npm run benchmark

# JSON (for programmatic use)
npm run benchmark:json

# Markdown (for documentation)
npm run benchmark:markdown

实时基准测试(针对您的气闸实例)

根据您的真实Airlock组织衡量实际令牌使用情况:

# Interactive authentication (opens browser for OAuth sign-in)
npm run benchmark:live -- --org my-org

# With token provided directly
npm run benchmark:live -- --org my-org --token $MCP_TOKEN

# Using staging environment
npm run benchmark:live -- --org my-org --env staging

# Output as JSON
npm run benchmark:live -- --org my-org --format json

认证

当你运行基准测试时,没有 --token,它使用 OAuth 2.0 使用PKCE:

  1. 使用Airlock注册临时CLI客户端
  2. 打开浏览器登录
  3. 通过本地回调接收授权码
  4. 自动交换访问令牌

无需手动复制令牌!只需登录,即可完成。

如果OAuth失败(例如,防火墙阻止本地主机),它将退回到手动令牌输入。

实时基准输出

📊 Organization: my-org
   Timestamp: 2024-01-15T10:30:00.000Z

📦 Services (3):
   • Linear: 9 tools
   • GitHub: 18 tools
   • Google Calendar: 5 tools
   Total: 32 tools

📏 Token Measurements:
   Meta-tool definitions:    457 tokens (constant)
   list_services response:   180 tokens
   search_tools response:    250 tokens
   describe_tools response:  320 tokens
   Full expansion estimate:  4,480 tokens

⚖️  Fair Comparison:
   Meta-tools workflow:  2,028 tokens
   Full expansion:       4,480 tokens
   Savings:              2,452 tokens (54.7%)

💡 🟢 Meta-tools recommended - good savings

使用自己的OpenAPI规范

将OpenAPI规范(JSON格式)添加到 src/sample-specs/:

cp your-api-spec.json src/sample-specs/
npm run benchmark

基准自动加载所有 .json 文件来自 sample-specs 目录。

公平比较

该基准考虑了 完整的工作流程开销 元工具方法:

元工具工作流程 (3个API调用):

  1. search_tools("create issue") → 返回匹配的工具(约150个令牌)
  2. describe_tools(["linear/create_issue"]) → 返回完整模式(~100个令牌)
  3. execute_tool("linear/create_issue", {...}) → 执行

完整的扩展工作流程 (1个API调用):

  1. 直接工具调用→ 执行

间接费用计算

元工具工作流程总计: (457 × 3) + 250 response tokens ≈ 1,621 tokens

场景全面扩展元工具(公平)差异$/req$/user/mo
单个API(5个工具)8591621❌ +762(元成本更高)-0.002美元-2.29美元
单个API(9个工具)10911621❌ +530(元成本更高)-0.002美元-1.59美元
单个API(18个工具)29281621✅ -1307(节省45%)0.0043.92美元
三个API(32个工具)48781621✅ -3257美元(节省67%)0.010美元9.77美元
中等组织(122个工具)146521621✅ -13031(节省89%)0.039美元39.09美元
大型组织(277种工具)314851621✅ -29864美元(节省95%)0.090美元89.59美元
企业版(865个工具)953601621✅ -93739(节省98%)0.281281.22美元

*基于约1000个请求/用户/月和Claude Sonnet 4.5定价(3/10万美元输入代币)*

盈亏平衡点:总共约12-15个工具(通常为2个API)

何时使用每种方法

场景工具建议公平比较
单个小型API<10全面扩展Meta成本增加约600个代币
单介质API10-20任一种都有效大致盈亏平衡
2-3个API20-40个元工具节省50-70%
5+API50-150元工具节省80-90%
企业级(10+API)200+元工具必不可少节省95%+

运作原理

令牌计数

基准使用 令牌。 随着 cl100k_base 用于精确令牌计数的编码。这与GPT-4和类似型号使用的标记器相同。

工具模式生成

OpenAPI规范转换为MCP工具模式:

  • operationId → 工具名称
  • descriptionsummary → 工具说明
  • 参数+请求正文→ inputSchema

贡献

欢迎投稿!思想:

  • 添加更多示例API规范
  • 可视化/图表
  • 性能基准(延迟比较)

相关

许可证

麻省理工学院

目录标签

目录标签

API集成令牌优化JavaScriptClaudeAPI管理本地部署AI代理MCP协议性能基准

支持客户端

Claude

接入字段

传输方式(transport,传输协议)

未说明

鉴权方式(authType,认证方式)

oauth

工具数量(toolCount,工具数)

4

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

未说明oauth部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

仍需确认:installCommand

来源信息

继续浏览同类 MCP