Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

多模态模型火山预览版

SeedRealtime

SeedRealtime 是字节跳动 Seed 团队于 2026 年 8 月发布的音画全双工大模型,面向实时视觉理解、语音交互和主动式多模态协作。官方页面暂未公开稳定 API 模型 ID。

输入价格

公开资料未说明

输出价格

公开资料未说明

实时语音视觉理解全双工交互
语音模型火山预览版

Seed Audio 1.0

Seed Audio 1.0 是字节跳动 Seed 团队于 2026 年 7 月发布的音频创作模型,面向全场景音频生成。官方页面暂未公开稳定 API 模型 ID。

计费价格

公开资料未说明

输入形式

文本 / 音频

音频生成音乐创作音效创作
语言模型火山稳定版

Doubao Seed 2.1 Pro

Doubao Seed 2.1 Pro 是火山方舟 2026 年 6 月发布的高能力通用模型,面向复杂推理、代码和 Agent 场景。

输入价格

公开资料未说明

输出价格

公开资料未说明

复杂推理代码开发Agent
语言模型火山稳定版

Doubao Seed 2.1 Turbo

Doubao Seed 2.1 Turbo 是火山方舟 2026 年 6 月发布的高性价比通用模型,适合大规模批量部署。

输入价格

公开资料未说明

输出价格

公开资料未说明

高性价比批量处理通用问答
视频生成火山稳定版

Doubao Seedance 2.5

Doubao Seedance 2.5 是火山方舟 2026 年 6 月发布的视频生成模型,支持超长叙事和多模态参考输入。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / video_to_video

视频生成长叙事多模态参考
语音模型智谱稳定版

GLM-TTS

GLM-TTS 是智谱当前文本转语音模型,支持非流式与流式语音合成。

计费价格

公开资料未说明

输入形式

文本

语音播报有声内容语音助手
语音模型智谱稳定版

GLM-TTS-Clone

GLM-TTS-Clone 是智谱当前音色克隆模型,可用短音频快速生成专属音色。

计费价格

公开资料未说明

输入形式

文本 / 音频

音色克隆情感配音角色语音
语音模型智谱稳定版

GLM-ASR-2512

GLM-ASR-2512 是智谱当前语音识别模型,支持多语言、行业词典和实时流式转录。

计费价格

公开资料未说明

输入形式

音频

语音识别会议转写多语言
语音模型智谱稳定版

GLM-Realtime

GLM-Realtime 是智谱当前实时音视频模型,支持语音对话、视频理解和函数调用。

计费价格

音频 ¥0.18 / min,视频 ¥1.20 / min

输入形式

文本 / 音频 / 视频

实时语音视频通话多模态交互
语音模型智谱稳定版

GLM-4-Voice

GLM-4-Voice 是智谱当前端到端语音模型,可直接理解和生成中英文语音。

计费价格

¥80.00 / 1M Tokens

输入形式

文本 / 音频

语音对话中英文语音方言风格控制
视频生成火山稳定版

doubao-seedance-2-0-260128

doubao-seedance-2-0-260128 是火山方舟当前公开教程覆盖的 Seedance 2.0 标准版,支持文生视频、图生视频、视频编辑和参考音频输入。

计费价格

5 秒 16:9:480p ¥2.31 起 / 720p ¥4.97 起 / 1080p ¥12.39 起

生成形式

text_to_video / image_to_video / video_to_video

视频生成广告创意短视频素材
视频生成火山稳定版

doubao-seedance-2-0-fast-260128

doubao-seedance-2-0-fast-260128 是火山方舟当前公开教程覆盖的 Seedance 2.0 fast 版本,定位更快的视频生成与编辑。

计费价格

5 秒 16:9:480p ¥1.86 起 / 720p ¥4.00 起

生成形式

text_to_video / image_to_video / video_to_video

视频生成短视频素材高频批量生成
视频生成Meta Llama预览版

Muse Video

Muse Video 是 Meta Superintelligence Labs 预览中的视频生成模型,支持高保真视觉生成与原生音频。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video

视频生成原生音频高保真视觉
语音模型Mistral稳定版

Voxtral TTS

Our state-of-the-art text-to-speech model with zero-shot voice cloning. Supports 9 languages, streaming with ~90ms time-to-first-audio, and no transcript required for voice prompts.

计费价格

公开资料未说明

输入形式

文本

语音生成音频输出语音应用
语音模型Mistral稳定版

Voxtral Small

Our first model with audio input capabilities for instruct use cases.

计费价格

公开资料未说明

输入形式

音频

语音转写会议整理音频理解
语音模型MiniMax稳定版

MiniMax Music3

MiniMax Music3 是 MiniMax 于 2026 年 8 月公开的开放权重音乐生成模型。

计费价格

公开资料未说明

输入形式

文本 / 音频

音乐生成歌曲创作开放权重