计费价格
$4.00 / 1M Tokens
输入形式
文本 / 图像 / 音频
官方模型目录与价格对比
按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。
先缩小候选,再进详情页看接口、计费和能力边界。
已收录模型
1,303
覆盖厂商
63
带价格信息
355
计费价格
$4.00 / 1M Tokens
输入形式
文本 / 图像 / 音频
计费价格
$2.50 / 1M Tokens
输入形式
文本 / 音频
计费价格
$4.00 / 1M Tokens
输入形式
文本 / 图像 / 音频
计费价格
$0.60 / 1M Tokens
输入形式
文本 / 图像 / 音频
计费价格
公开资料未说明
输入形式
文本 / 音频
计费价格
$0.60 / 1M Tokens
输入形式
文本 / 音频
计费价格
公开资料未说明
输入形式
文本 / 音频
计费价格
公开资料未说明
输入形式
文本 / 音频
计费价格
公开资料未说明
输入形式
文本 / 音频
计费价格
公开资料未说明
输入形式
文本 / 音频
计费价格
$3.50 / 1M Tokens
输入形式
音频 / 文本
Gemini 2.5 Flash Live Preview 是 Google 的实时语音模型,适合实时语音、语音助手等低延迟语音交互场景。 当前仍是预览版。
计费价格
$0.50 / 1M Tokens
输入形式
音频 / 视频 / 文本
Gemini 3.1 Flash Live Preview 是 Google 的实时语音模型,适合实时语音、语音助手等低延迟语音交互场景。 当前仍是预览版。
计费价格
$0.75 / 1M Tokens
输入形式
文本 / 图像 / 音频 / 视频
计费价格
音频 ¥0.18 / min,视频 ¥1.20 / min
输入形式
文本 / 音频 / 视频
计费价格
¥80.00 / 1M Tokens
输入形式
文本 / 音频
计费价格
公开资料未说明
输入形式
文本
Eleven v3 Conversational 是 ElevenLabs 面向实时对话的表现力语音模型,延迟约 280ms,支持 70 多种语言和上下文对话表达。
计费价格
公开资料未说明
输入形式
文本
Deepgram Flux TTS 是 2026 年 8 月发布的面向实时语音 Agent 的对话式文本转语音模型,支持跨轮上下文、打断处理和流式输出。
计费价格
公开资料未说明
输入形式
文本
计费价格
公开资料未说明
输入形式
文本 / 音频
计费价格
公开资料未说明
输入形式
文本 / 音频