Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

视频生成PixVerse旧版

PixVerse V3.5

V3.5 是 PixVerse 当前仍公开可选的最早一批 legacy 视频版本,用于老链路兼容。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / transition / extend / effects

历史兼容最旧链路旧结果复现
视频生成PixVerse稳定版

PixVerse Speech Lip Sync

Speech Lip Sync 是 PixVerse 的独立视频口型同步工作流,可用外部音频或 TTS 让视频人像对口型。

计费价格

公开资料未说明

生成形式

text_to_video / video_to_video

口型同步视频配音人物说话视频
图像生成Adobe稳定版

Adobe Firefly Image Model 5

Adobe Firefly Image Model 5 是 Adobe 于 2026 年 4 月公开的新一代图像生成模型,重点提升真实感和细节表现,并支持新版 Generate Image API。

计费价格

公开资料未说明

生成形式

text_to_image / image_to_image

真实感图像营销素材商业创意
图像生成Adobe稳定版

Firefly Custom Models Image 3

Adobe Firefly 的品牌自定义图片生成能力,适合品牌风格、角色和商品视觉一致化生成。

计费价格

公开资料未说明

生成形式

text_to_image / brand_aligned_generation

品牌一致化自定义风格规模化营销素材
图像生成Adobe稳定版

Firefly Adaptive Composite

Adobe Firefly 的自适应主体合成能力,适合上下文感知的商品摆放、阴影融合和背景保留。

计费价格

公开资料未说明

生成形式

adaptive_composite

上下文感知合成产品摆放阴影与背景控制
语言模型Venice稳定版

Venice Uncensored 1.2

Venice 当前主力隐私文本模型,支持 128K 上下文、图像输入和函数调用,适合通用助手与创意任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

通用助手创意对话图像问答
语言模型Venice稳定版

Venice Role Play Uncensored

Venice 面向角色扮演与创意写作的文本模型,支持图像输入和函数调用,适合高自由度对话。

输入价格

公开资料未说明

输出价格

公开资料未说明

角色扮演创意写作多轮聊天
图像生成Recraft稳定版

Recraft V3

Recraft 的成熟栅格模型,强调写实、文本渲染和多种图像编辑工作流。

计费价格

$0.04;40 API units

生成形式

text_to_image / image_to_image / inpainting / background_replace / background_generate

图像编辑带字海报写实风格图
图像生成Recraft稳定版

Recraft V3 Vector

Recraft 的成熟矢量图模型,支持矢量生成和多种编辑工作流,适合图标、排版和品牌图形。

计费价格

$0.08;80 API units

生成形式

text_to_image / image_to_image / inpainting / background_replace / background_generate

矢量编辑品牌图形带字设计图
多模态模型InclusionAI稳定版

VISTA 4B

VISTA 4B 是 InclusionAI 于 2026 年 6 月发布的 GUI 定位视觉语言模型,可根据截图和指令输出点击坐标。

输入价格

公开资料未说明

输出价格

公开资料未说明

GUI Agent界面定位开放权重
多模态模型InclusionAI稳定版

VISTA 9B

VISTA 9B 是 InclusionAI 于 2026 年 6 月发布的 GUI 定位视觉语言模型,可根据截图和指令输出点击坐标。

输入价格

公开资料未说明

输出价格

公开资料未说明

GUI Agent界面定位开放权重
visionInclusionAI稳定版

ArmorOCR

ArmorOCR 是 InclusionAI 于 2026 年 8 月公开的视觉文档解析模型,面向 OCR、版面理解和复杂文档提取。

输入价格

公开资料未说明

输出价格

公开资料未说明

OCR文档解析版面理解
多模态模型智源 BAAI预览版

Orca 4B

Orca 4B 是 BAAI 于 2026 年 7 月发布的通用世界模型,围绕 Next-State Prediction 建模,用于理解和预测世界状态变化。

输入价格

公开资料未说明

输出价格

公开资料未说明

世界模型状态预测开放研究
图像生成智源 BAAI稳定版

URSA 1.7B

URSA 1.7B 是 BAAI 于 2026 年 4 月发布的文生图与图像编辑模型,支持基于文本提示生成和修改图像。

计费价格

公开资料未说明

生成形式

text_to_image / image_edit

图片生成图片编辑开放权重
多模态模型Liquid AI稳定版

LFM2.5 VL 1.6B Extract

LFM2.5 VL 1.6B Extract 是 Liquid AI 于 2026 年 5 月发布的视觉信息抽取模型。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉抽取文档理解端侧部署
多模态模型Liquid AI稳定版

LFM2.5-VL-1.6B

Best-in-class 1.6B vision-language model for multimodal understanding

输入价格

公开资料未说明

输出价格

公开资料未说明

图文理解视觉问答端侧多模态
多模态模型Liquid AI稳定版

LFM2.5-VL-450M

Compact 450M vision-language model with enhanced performance for edge deployment

输入价格

公开资料未说明

输出价格

公开资料未说明

图文理解视觉问答端侧多模态
多模态模型Liquid AI稳定版

LFM2-VL-3B

Highest-capacity 3B vision-language model with enhanced visual reasoning

输入价格

公开资料未说明

输出价格

公开资料未说明

图文理解视觉问答端侧多模态