Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

多模态模型Microsoft稳定版

Fara1.5-4B

Fara1.5-4B 是 Microsoft Research AI Frontiers 发布的浏览器 Computer Use Agent,通过截图理解网页并输出结构化点击、输入、滚动等动作。

输入价格

公开资料未说明

输出价格

公开资料未说明

电脑操作浏览器 Agent开放权重
多模态模型Microsoft稳定版

Fara1.5-9B

Fara1.5-9B 是 Microsoft Research AI Frontiers 发布的浏览器 Computer Use Agent,通过截图理解网页并输出结构化点击、输入、滚动等动作。

输入价格

公开资料未说明

输出价格

公开资料未说明

电脑操作浏览器 Agent开放权重
多模态模型Microsoft稳定版

Fara1.5-27B

Fara1.5-27B 是 Microsoft Research AI Frontiers 发布的浏览器 Computer Use Agent,通过截图理解网页并输出结构化点击、输入、滚动等动作。

输入价格

公开资料未说明

输出价格

公开资料未说明

电脑操作浏览器 Agent开放权重
视频生成Pika稳定版

Pika 2.5

Pika 当前公开主力视频模型,覆盖文生视频、图生视频与 Pikaframes 多关键帧工作流。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / keyframe_video

通用视频生成关键帧控制创作者短片
视频生成Pika稳定版

Pika Turbo

Pika 当前公开的 Turbo 视频型号,主要用于 Pikascenes、Pikadditions、Pikaswaps 与 Pikatwists 等高性价比工作流。

计费价格

公开资料未说明

生成形式

scene_video / addition_video / swap_video / twist_video

高性价比视频快速出片视频特效玩法
视频生成Pika稳定版

Pika Pro

Pika 当前公开的 Pro 视频型号,偏向更高质量的视频编辑、替换和扭转效果。

计费价格

公开资料未说明

生成形式

addition_video / swap_video / twist_video / template_video

高质量视频编辑角色替换重度特效
视频生成Pika稳定版

Pikaformance

Pika 当前公开的表演驱动视频模型,适合音频驱动的人像表演与角色演绎视频。

计费价格

公开资料未说明

生成形式

performance_video

数字人表演音频驱动视频角色口播
visionPaddlePaddle稳定版

PP-OCRv6

PP-OCRv6 是 PaddlePaddle 于 2026 年 6 月发布的新一代开源 OCR 模型线,覆盖文字检测与识别,适合中文文档处理和本地部署。

输入价格

公开资料未说明

输出价格

公开资料未说明

OCR文字检测本地部署
visionPaddlePaddle稳定版

HPD-Parsing

HPD-Parsing 是 PaddlePaddle 于 2026 年 7 月公开的文档解析模型,面向复杂版面、表格和视觉文档结构化提取。

输入价格

公开资料未说明

输出价格

公开资料未说明

文档解析表格理解版面分析
多模态模型零一万物 Yi稳定版

Yi Vision V2

零一万物当前公开的复杂视觉任务模型,支持单张或多张图片理解、图表分析、OCR 与视觉推理。

输入价格

公开资料未说明

输出价格

公开资料未说明

图片问答图表理解OCR
视频生成华为盘古稳定版

Pangu-MM-M2-AIGVideo

2025年4月发布的版本,图生视频支持16:9、9:16、1:1、4:3、3:4、原始比例等6种长宽比,时长5s的视频生成,视频续写支持16:9、9:16、1:1、4:3、3:4、原始比例等6种长宽比,续写96帧(24帧率的视频续写约4s),需要8个推理单元部署。

计费价格

公开资料未说明

生成形式

image_to_video / video_to_video

图生视频视频续写企业接入
图像生成华为盘古稳定版

Pangu-MM-M1-Txt2Img

2025年4月发布的版本,支持1024*1024分辨率的图像生成,支持写实、油画、动漫等数十种生成风格,需要8个推理单元部署。

计费价格

公开资料未说明

生成形式

text_to_image

图像生成海报素材视觉创作
多模态模型华为盘古稳定版

Pangu-MM-M2-Img2Txt

2026年2月发布的多模态理解大模型版本。该模型具有百亿级参数量,支持图像理解,支持预训练、微调。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解图文问答企业接入
多模态模型华为盘古稳定版

Pangu-CV-物体检测-S-V3

物体检测。从高精度、低时延、小目标检测三方面进行定向优化,为业界性价比最优检测模型。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉检测工业质检企业接入
多模态模型华为盘古稳定版

Pangu-CV-视觉交互检测-V3

视觉交互检测。盘古计算机视觉交互检测大模型,支持根据视觉提示或者文本提示进行任务目标检测,也可以基于自己场景的数据进行微调。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉检测工业质检企业接入
多模态模型华为盘古稳定版

Pangu-CV-目标跟踪-V3

目标跟踪。盘古计算机视觉目标跟踪大模型,盘古计算机视觉目标跟踪大模型,在视频中对感兴趣物体进行检测、提取、识别和跟踪,从而获得目标物体的相关参数。

输入价格

公开资料未说明

输出价格

公开资料未说明

视频分析目标跟踪企业接入
多模态模型华为盘古稳定版

Pangu-CV-万物检测-V2

万物检测。盘古计算机视觉万物检测大模型,能够识别和定位已知类别对象,同时也能处理未知类别对象的模型。具备对未知类别的泛化能力,并在面对新类别时能够做出合理的响应。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉检测工业质检企业接入
多模态模型华为盘古稳定版

Pangu-CV-物体检测-N-V2

物体检测。千万到亿级参数量物体检测,支持模型抽取,使用盘古自有海量数据进行预训练。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉检测工业质检企业接入