Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

多模态模型Google预览版

Gemini Robotics-ER 1.5

Gemini Robotics-ER 1.5 是 Google 的 Gemini 多模态模型,适合具身推理、机器人控制等通用生产工作流。 当前仍是预览版。

输入价格

$0.30 / 1M Tokens

输出价格

$2.50 / 1M Tokens

具身推理机器人控制视觉理解
多模态模型Google预览版

Gemini Robotics-ER 1.6

Gemini Robotics-ER 1.6 是 Google 的 Gemini 多模态模型,适合具身推理、机器人控制等通用生产工作流。 当前仍是预览版。

输入价格

$1.00 / 1M Tokens

输出价格

$5.00 / 1M Tokens

具身推理机器人控制视觉理解
多模态模型火山预览版

SeedRealtime

SeedRealtime 是字节跳动 Seed 团队于 2026 年 8 月发布的音画全双工大模型,面向实时视觉理解、语音交互和主动式多模态协作。官方页面暂未公开稳定 API 模型 ID。

输入价格

公开资料未说明

输出价格

公开资料未说明

实时语音视觉理解全双工交互
多模态模型美团 LongCat即将下线

LongCat Flash Omni 2603

LongCat 官方更新日志显示该旧模型已于 2026 年 5 月 29 日停止调用,正式接入应迁移到 LongCat 2.0。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解语音交互多模态助手
多模态模型Black Forest Labs预览版

FLUX 3

FLUX 3 是 Black Forest Labs 的多模态基础模型,统一学习图像、视频和音频,并支持图像生成编辑、视频生成与原生音频。

输入价格

公开资料未说明

输出价格

公开资料未说明

视频生成图片生成原生音频
多模态模型NVIDIA预览版

Nemotron 3 Nano Omni Reasoning

Nemotron 3 Nano Omni Reasoning 是 NVIDIA 面向全模态推理的模型,支持图像、视频、语音和文本理解,适合多模态 Agent 与复杂场景分析。

输入价格

公开资料未说明

输出价格

公开资料未说明

多模态推理视频理解语音理解
多模态模型小米稳定版

MiMo-V2.5

MiMo 当前主力全模态理解模型,支持图像、视频、音频与文本输入,并具备原生 Agent 执行能力和 1M 上下文。

输入价格

¥2.80 / 1M Tokens

输出价格

¥14.00 / 1M Tokens

多模态问答Agent内容理解
多模态模型小米即将下线

MiMo-V2-Omni

小米 MiMo 官方模型页提示 MiMo-V2 系列已于 2026 年 6 月 30 日正式下线,原模型名称已失效,应迁移到 V2.5 系列。

输入价格

¥2.80 / 1M Tokens

输出价格

¥14.00 / 1M Tokens

视觉理解语音理解多模态助手
多模态模型Reka稳定版

Reka Edge 2

Reka Edge 2 是 Reka 当前官网列出的轻量多模态模型,面向低延迟文本、图像、视频和音频理解。

输入价格

公开资料未说明

输出价格

公开资料未说明

低延迟多模态理解成本敏感
多模态模型Reka稳定版

Reka Core

Superior capabilities for complex tasks

输入价格

公开资料未说明

输出价格

公开资料未说明

复杂任务多模态问答视频理解
多模态模型Reka稳定版

Reka Flash

Fast and cost-efficient model for most tasks

输入价格

公开资料未说明

输出价格

公开资料未说明

通用助手多模态聊天成本敏感