Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

多模态模型百度稳定版

Qwen3-VL-235B-A22B-Thinking

Qwen3-VL-235B-A22B-Thinking 是百度千帆当前模型列表公开的视觉理解模型,归属 QwenVL系列 能力线,适合通过千帆 OpenAI 兼容接口在百度智能云体系内调用。

输入价格

¥2.00 / 1M Tokens

输出价格

¥20.00 / 1M Tokens

视觉理解图文问答多模态应用
多模态模型百度稳定版

Qwen2.5-VL-32B-Instruct

Qwen2.5-VL-32B-Instruct 是百度千帆当前模型列表公开的视觉理解模型,归属 QwenVL系列 能力线,适合通过千帆 OpenAI 兼容接口在百度智能云体系内调用。

输入价格

¥8.00 / 1M Tokens

输出价格

¥24.00 / 1M Tokens

视觉理解图文问答多模态应用
多模态模型百度稳定版

Qwen2.5-VL-7B-Instruct

Qwen2.5-VL-7B-Instruct 是百度千帆当前模型列表公开的视觉理解模型,归属 QwenVL系列 能力线,适合通过千帆 OpenAI 兼容接口在百度智能云体系内调用。

输入价格

¥2.00 / 1M Tokens

输出价格

¥5.00 / 1M Tokens

视觉理解图文问答多模态应用
多模态模型百度稳定版

PaddleOCR-VL-0.9B

PaddleOCR-VL-0.9B 是百度千帆当前模型列表公开的OCR模型,归属 OCR 能力线,适合通过千帆 OpenAI 兼容接口在百度智能云体系内调用。

输入价格

公开资料未说明

输出价格

公开资料未说明

文档解析OCR票据识别
多模态模型百度稳定版

PP-StructureV3

PP-StructureV3 是百度千帆当前模型列表公开的OCR模型,归属 OCR 能力线,适合通过千帆 OpenAI 兼容接口在百度智能云体系内调用。

输入价格

公开资料未说明

输出价格

公开资料未说明

文档解析OCR票据识别
多模态模型百度稳定版

DeepSeek-OCR

DeepSeek-OCR 是百度千帆当前模型列表公开的OCR模型,归属 OCR 能力线,适合通过千帆 OpenAI 兼容接口在百度智能云体系内调用。

输入价格

¥0.30 / 1M Tokens

输出价格

¥1.20 / 1M Tokens

文档解析OCR票据识别
多模态模型百度稳定版

Qianfan-OCR

Qianfan-OCR 是百度千帆当前模型列表公开的OCR模型,归属 OCR 能力线,适合通过千帆 OpenAI 兼容接口在百度智能云体系内调用。

输入价格

¥0.45 / 1M Tokens

输出价格

¥1.80 / 1M Tokens

文档解析OCR票据识别
多模态模型百度稳定版

Qianfan-OCR-Fast

Qianfan-OCR-Fast 是百度千帆当前模型列表公开的OCR模型,归属 OCR 能力线,适合通过千帆 OpenAI 兼容接口在百度智能云体系内调用。

输入价格

¥4.85 / 1M Tokens

输出价格

¥20.00 / 1M Tokens

文档解析OCR票据识别
多模态模型阶跃稳定版

Step 3.7 Flash

Step 3.7 Flash 是阶跃星辰当前公开的旗舰多模态推理模型,支持图片、视频输入、推理强度调节、工具调用和 Agent 工作流。

输入价格

公开资料未说明

输出价格

公开资料未说明

推理多模态Agent
多模态模型阶跃稳定版

step-3

兼顾智能与效率的高性价比推理模型,典型应用场景有图片内容识别和提取、图片分析和推理、逻辑与数学问题回答、代码生成和补全、智能助手和日常问答、复杂问题调研和解答等。

输入价格

¥1.50 / 1M Tokens

输出价格

¥4.00 / 1M Tokens

推理图片理解深度推理
多模态模型阶跃稳定版

step-1o-turbo-vision

典型应用场景有社媒发帖文案创作、AI问答助手、图片与视频理解等。单次请求限制输入最多50张,总大小控制在20M以内的图片,输入视频为小于128MB的MP4文件。

输入价格

¥2.50 / 1M Tokens

输出价格

¥8.00 / 1M Tokens

图片理解视频理解文本生成
多模态模型阶跃稳定版

step-r1-v-mini

典型应用场景有图片内容识别、图片分析和推理、代码生成和补全、数学问题回答、逻辑问题解答、日常问答等。

输入价格

¥2.50 / 1M Tokens

输出价格

¥8.00 / 1M Tokens

推理图片理解代码
多模态模型阶跃稳定版

step-1o-vision-32k

典型应用场景有管家机器人、智慧座舱助手、医学影像分析助手、食物识别、图片信息判断、图片内容描述等。单次请求限制最多50张图片,总大小控制在20M以内。

输入价格

¥15.00 / 1M Tokens

输出价格

¥70.00 / 1M Tokens

图片理解文本生成视觉理解
多模态模型阶跃稳定版

step-1v-8k

典型应用场景为图片描述、食物识别、心理咨询、穿搭建议等。单次请求限制最多20张图片,总大小控制在20M以内。

输入价格

¥5.00 / 1M Tokens

输出价格

¥20.00 / 1M Tokens

图片理解短上下文视觉理解
多模态模型阶跃稳定版

step-1v-32k

典型应用场景有文献阅读助手、图片理解、角色扮演、日常问答等。单次请求限制最多50张图片,总大小控制在20M以内。

输入价格

¥15.00 / 1M Tokens

输出价格

¥70.00 / 1M Tokens

图片理解长上下文视觉理解
多模态模型Cohere稳定版

Command A Vision

Command A Vision is a powerful visual language model capable of interacting with image inputs. This document contains information about its capabilities.

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解图文问答多语言任务
多模态模型Cohere稳定版

Aya Vision 32B

Aya Vision is a state-of-the-art multimodal model excelling at a variety of critical benchmarks for language, text, and image capabilities. Serves 23 languages. This 32 billion parameter variant is focused on state-of-art multilingual performance.

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解图文问答多语言任务
多模态模型Cohere即将下线

Aya Vision 8B

Aya Vision is a state-of-the-art multimodal model excelling at a variety of critical benchmarks for language, text, and image capabilities. Serves 23 languages. This 32 billion parameter variant is focused on state-of-art multilingual performance.

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解图文问答多语言任务
多模态模型Cohere稳定版

North Micro Vision Instruct

North Micro Vision Instruct 是 Cohere 于 2026 年 8 月公开的轻量多语视觉模型,适合图像理解、视觉问答和本地部署。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解多语问答轻量部署
多模态模型腾讯稳定版

UI-Mate 9B

UI-Mate 9B 是腾讯于 2026 年 8 月发布的 GUI Agent 视觉语言模型,面向桌面操作和计算机使用任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

GUI AgentComputer Use桌面自动化