Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

多模态模型阶跃稳定版

step-1o-turbo-vision

典型应用场景有社媒发帖文案创作、AI问答助手、图片与视频理解等。单次请求限制输入最多50张,总大小控制在20M以内的图片,输入视频为小于128MB的MP4文件。

输入价格

¥2.50 / 1M Tokens

输出价格

¥8.00 / 1M Tokens

图片理解视频理解文本生成
多模态模型阶跃稳定版

step-r1-v-mini

典型应用场景有图片内容识别、图片分析和推理、代码生成和补全、数学问题回答、逻辑问题解答、日常问答等。

输入价格

¥2.50 / 1M Tokens

输出价格

¥8.00 / 1M Tokens

推理图片理解代码
多模态模型阶跃稳定版

step-1o-vision-32k

典型应用场景有管家机器人、智慧座舱助手、医学影像分析助手、食物识别、图片信息判断、图片内容描述等。单次请求限制最多50张图片,总大小控制在20M以内。

输入价格

¥15.00 / 1M Tokens

输出价格

¥70.00 / 1M Tokens

图片理解文本生成视觉理解
多模态模型阶跃稳定版

step-1v-8k

典型应用场景为图片描述、食物识别、心理咨询、穿搭建议等。单次请求限制最多20张图片,总大小控制在20M以内。

输入价格

¥5.00 / 1M Tokens

输出价格

¥20.00 / 1M Tokens

图片理解短上下文视觉理解
多模态模型阶跃稳定版

step-1v-32k

典型应用场景有文献阅读助手、图片理解、角色扮演、日常问答等。单次请求限制最多50张图片,总大小控制在20M以内。

输入价格

¥15.00 / 1M Tokens

输出价格

¥70.00 / 1M Tokens

图片理解长上下文视觉理解
图像生成阶跃稳定版

step-1x-medium

适用于需要高质量图像生成的场景,如艺术创作、游戏开发等。输入文本最大长度为1024个字符;输入图片需在10Mb以内,像素不大于2048x2048,格式为png或jpeg。单次可请求生成1张图像。

计费价格

¥0.1 / image

生成形式

text_to_image / image_edit

图片生成中文支持图像生成
图像生成阶跃稳定版

step-2x-large

新模型生成图片质感更真实,中英文文字生成能力更强。输入文本最大长度为1024个字符;输入图片需在10Mb以内,像素不大于2048x2048,格式为png或jpeg。单次可请求生成1张图像。

计费价格

限时免费

生成形式

text_to_image / image_edit

图片生成中文提示词图像生成
图像生成阶跃稳定版

step-1x-edit

模型能够理解用户的意图,并生成符合要求的图像编辑结果,适合应用于图像编辑、人像美化、艺术创作等场景。输入文本最大长度为512个字符;输入图片需在10Mb以内,像素不大于1024x1024,格式为png或jpeg。单次可请求生成1张图像。

计费价格

限时免费

生成形式

text_to_image / image_edit

图片编辑图像增强图像生成
多模态模型Cohere稳定版

Command A Vision

Command A Vision is a powerful visual language model capable of interacting with image inputs. This document contains information about its capabilities.

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解图文问答多语言任务
语言模型Cohere稳定版

Embed v4.0

A model that allows for text and images to be classified or turned into embeddings

输入价格

公开资料未说明

输出价格

公开资料未说明

语义检索RAG向量搜索
多模态模型Cohere稳定版

Aya Vision 32B

Aya Vision is a state-of-the-art multimodal model excelling at a variety of critical benchmarks for language, text, and image capabilities. Serves 23 languages. This 32 billion parameter variant is focused on state-of-art multilingual performance.

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解图文问答多语言任务
多模态模型Cohere即将下线

Aya Vision 8B

Aya Vision is a state-of-the-art multimodal model excelling at a variety of critical benchmarks for language, text, and image capabilities. Serves 23 languages. This 32 billion parameter variant is focused on state-of-art multilingual performance.

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解图文问答多语言任务
多模态模型Cohere稳定版

North Micro Vision Instruct

North Micro Vision Instruct 是 Cohere 于 2026 年 8 月公开的轻量多语视觉模型,适合图像理解、视觉问答和本地部署。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解多语问答轻量部署
视频生成快手稳定版

Kling VIDEO 3.0

Kling VIDEO 3.0 是可灵新一代视频生成模型,支持多镜头叙事、4K 输出、长时长控制和音画协同。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / video_edit / multi_shot

多镜头视频4K 视频视频叙事
图像生成快手稳定版

Kling Image 3.0 Omni

Kling Image 3.0 Omni 是可灵新一代图像生成与编辑模型,支持原生 4K、系列图像和多参考输入。

计费价格

公开资料未说明

生成形式

text_to_image / image_edit

4K 图像图像编辑系列图像
图像生成快手稳定版

MetaView

MetaView 是 Kwai-Kolors 于 2026 年 7 月发布的单图新视角生成模型,可根据目标相机姿态合成新的视角图像。

计费价格

公开资料未说明

生成形式

text_to_image / image_edit

新视角生成图像生成3D 视觉
视频生成快手稳定版

Kling Video O1

可灵当前主力视频 Omni 模型,支持图片、主体和视频参考融合生成,适合复杂创意视频与角色一致性场景。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / video_edit / multi_shot

广告素材多元素视频角色一致性
视频生成快手旧版

Kling V1.6 Video

可灵旧代视频型号,官网历史表同时保留文生视频和图生视频能力信息,适合做旧版能力对照。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video

历史兼容旧版能力对照版本迁移
图像生成快手稳定版

Kling Image O1

可灵当前主力图像 O1 型号,覆盖文生图、图生图和图片编辑,适合商品图与视觉素材生产。

计费价格

公开资料未说明

生成形式

text_to_image / image_to_image / image_edit

商品图品牌素材图片编辑
图像生成快手稳定版

Kling V3 Omni Image

可灵当前高分辨率图像主力型号,官方模型清单显示支持自定义与智能长宽比,适合高质量视觉素材。

计费价格

公开资料未说明

生成形式

text_to_image / image_to_image

高清海报品牌素材电商视觉