Token导航 LogoToken导航TokenDH.com
Google / Gemini logo
官方核验于 2026-08-22

Google / Gemini

长上下文、多模态和 Google 生态联动是主要优势,当前产品线还覆盖 Gemini 新一代 Flash、实时翻译、图像生成、Deep Research 与 Agent 工作流,适合文档分析、搜索增强、Workspace 协同和多媒体任务。

官方入口原生官方接口付费入口多模态模型

主分类:多模态模型

适合:文档分析 / 搜索增强 / 多模态

付费:Google 账号体系 / 信用卡

地区:国际可用 / 部分地区受限

接入判断

按原生接口接

Google / Gemini 适合作为官方原生入口,接入前先按文档核对鉴权方式、模型 ID 和计费口径。

协议:官方原生 API

价格:以官方价格页为准

模型:已收录 67 个

模型能力

67 个模型
多模态模型高速生成多模态理解开放权重

DiffusionGemma 26B A4B

分类:多模态模型 / 上下文:32.768K / 调用名:google/diffusiongemma-26B-A4B-it

DiffusionGemma 26B A4B 是 Google DeepMind 于 2026 年 6 月发布的多模态扩散语言模型,支持文本、图像和视频输入。

视觉推理开放权重
语音模型音乐生成实时音频开放模型

Magenta RealTime 2

分类:语音模型 / 上下文:- / 调用名:google/magenta-realtime-2

Magenta RealTime 2 是 Google DeepMind 于 2026 年 5 月发布的实时音乐生成模型。

audio_generationrealtime开放权重语音输入语音输出
视频生成视频生成视频编辑多模态创作

Gemini Omni Flash Preview

分类:视频生成 / 上下文:1.048576M / 调用名:gemini-omni-flash-preview

Gemini Omni Flash Preview 是 Google 于 2026 年 6 月发布的视频生成与编辑预览模型,支持文字和图片转视频,并可通过自然语言对话优化结果。当前已弃用。

视频生成视觉reference_input函数调用长上下文
视频生成视频生成视频编辑多模态创作

Gemini Omni Flash

分类:视频生成 / 上下文:- / 调用名:gemini-omni-flash

Gemini Omni Flash 是 Google 的视频生成与编辑预览模型,支持文字和图片转视频,并可通过对话式操作优化结果。

视频生成视觉reference_input函数调用
语音模型音乐生成歌曲创作人声

Lyria 3.5

分类:语音模型 / 上下文:- / 调用名:lyria-3.5

Lyria 3.5 是 Google DeepMind 最新音乐生成模型,重点提升音乐性、歌词和人声质量,并支持可变歌曲长度。

audio_generation音乐生成vocalslyrics语音输出
图像生成图片生成图片编辑视觉创作

Nano Banana Pro

分类:图像生成 / 上下文:65.536K / 调用名:gemini-3-pro-image

Nano Banana Pro 是 Google 当前稳定的原生图像生成与编辑模型,适合高质量视觉创作和上下文相关的图像生成。

视觉图像生成image_editreference_input结构化输出推理
图像生成图片生成视觉创作素材生产

Imagen 4

分类:图像生成 / 上下文:0.48K / 调用名:imagen-4.0-generate

Imagen 4 是 Google 当前稳定的图像生成模型,适合高质量文本生成图像和视觉内容生产。

图像生成
音乐生成音乐生成配乐创作歌曲制作

Lyria 3 Pro Preview

分类:音乐生成 / 上下文:131.072K / 调用名:lyria-3-pro-preview

Lyria 3 Pro Preview 是 Google 的音乐生成模型,面向完整歌曲、配乐和歌词驱动的音频创作。

语音输出音乐生成视觉长上下文
多模态模型低延迟成本敏感批量处理

Gemini 3.1 Flash-Lite

分类:多模态模型 / 上下文:1.048576M / 调用名:gemini-3.1-flash-lite

Gemini 3.1 Flash-Lite 是 Google 于 2026 年 5 月发布的低延迟、多模态模型,适合成本敏感和高吞吐工作流。

视觉语音输入长上下文
多模态模型通用助手低延迟视觉理解

Gemini 3.7 Flash

分类:多模态模型 / 上下文:1.048576M / 调用名:gemini-3.7-flash

Gemini 3.7 Flash 是 Google 于 2026 年 8 月发布的快速多模态模型,适合通用助手和低延迟交互。

视觉语音输入长上下文
嵌入模型多模态检索语义搜索向量召回

Gemini Embedding 2

分类:嵌入模型 / 上下文:8.192K / 调用名:gemini-embedding-2

Gemini Embedding 2 是 Google 于 2026 年 4 月发布的多模态嵌入模型,适合语义搜索、跨模态检索和向量召回。

视觉语音输入嵌入
多模态模型具身推理机器人控制视觉理解

Gemini Robotics ER 2 streaming

分类:多模态模型 / 上下文:131.072K / 调用名:gemini-robotics-er-2-preview

Gemini Robotics ER 2 streaming 是 Google 于 2026 年 7 月发布的具身推理模型,面向机器人控制、视觉理解和实时交互。

视觉语音输入推理长上下文
语言模型端侧部署低资源推理开放权重

Gemma 4 E2B

分类:语言模型 / 上下文:- / 调用名:gemma-4-e2b

Gemma 4 E2B 是 Google DeepMind Gemma 4 开放权重系列的超轻量规格,适合端侧推理、实验和高效率应用。

推理开放权重代码视觉函数调用结构化输出
多模态模型本地部署代码开发开放权重

Gemma 4 E4B

分类:多模态模型 / 上下文:- / 调用名:gemma-4-e4b

Gemma 4 E4B 是 Gemma 4 开放权重系列的小型多模态规格,适合本地运行、代码和推理任务。

视觉推理开放权重代码函数调用结构化输出
多模态模型本地部署多模态理解代码开发

Gemma 4 12B

分类:多模态模型 / 上下文:- / 调用名:gemma-4-12b

Gemma 4 12B 是 Google DeepMind 于 2026 年 4 月发布的统一多模态开放权重模型,适合笔记本和单机部署。

视觉推理开放权重代码函数调用结构化输出
多模态模型高质量推理代码开发开放权重

Gemma 4 31B

分类:多模态模型 / 上下文:- / 调用名:gemma-4-31b

Gemma 4 31B 是 Gemma 4 系列的大型 Dense 开放权重规格,面向更高质量的推理、代码和多模态任务。

视觉推理开放权重代码函数调用结构化输出
多模态模型高效推理本地部署开放权重

Gemma 4 26B A4B

分类:多模态模型 / 上下文:- / 调用名:gemma-4-26b-a4b

Gemma 4 26B A4B 是 Gemma 4 系列的 MoE 开放权重规格,总参数 26B、激活参数 4B,兼顾能力与推理效率。

视觉推理开放权重代码函数调用结构化输出
多模态模型Agent低延迟多模态理解

Gemini 3.6 Flash

分类:多模态模型 / 上下文:- / 调用名:gemini-3.6-flash

Gemini 3.6 Flash 是 Google 的 Gemini 多模态模型,适合Agent、低延迟等通用生产工作流。

$1.50 / $7.50
视觉语音输入函数调用结构化输出推理

价格记录更新时间:2026-08-23

查看模型详情
多模态模型代码开发Agent低延迟

Gemini 3.5 Flash

分类:多模态模型 / 上下文:- / 调用名:gemini-3.5-flash

Gemini 3.5 Flash 是 Google 的 Gemini 多模态模型,适合代码开发、Agent等通用生产工作流。

$1.50 / $9.00
视觉语音输入函数调用结构化输出推理

价格记录更新时间:2026-08-23

查看模型详情
多模态模型高吞吐低成本批量处理

Gemini 3.5 Flash-Lite

分类:多模态模型 / 上下文:- / 调用名:gemini-3.5-flash-lite

Gemini 3.5 Flash-Lite 是 Google 的 Gemini 多模态模型,适合高吞吐、低成本等通用生产工作流。

$0.30 / $2.50
视觉语音输入函数调用结构化输出

价格记录更新时间:2026-08-23

查看模型详情
语音模型实时翻译语音交互低延迟

Gemini 3.5 实时翻译

分类:语音模型 / 上下文:- / 调用名:gemini-3.5-live-translate-preview

Gemini 3.5 实时翻译 是 Google 的实时语音模型,适合实时翻译、语音交互等低延迟语音交互场景。 当前仍是预览版。

$3.50 / $21.00
语音输入语音输出

价格记录更新时间:2026-08-23

查看模型详情
图像生成图像生成图像编辑批量创作

Nano Banana 2

分类:图像生成 / 上下文:- / 调用名:gemini-3.1-flash-image

Nano Banana 2 是 Google 的图像生成模型,适合图像生成、图像编辑等视觉内容生产任务。

视觉图像生成
图像生成低延迟低成本图像编辑

Nano Banana 2 Lite

分类:图像生成 / 上下文:- / 调用名:gemini-3.1-flash-lite-image

Nano Banana 2 Lite 是 Google 的图像生成模型,适合低延迟、低成本等视觉内容生产任务。

视觉图像生成
语言模型深度研究多来源分析Agent

Gemini Deep Research

分类:语言模型 / 上下文:1.048576M / 调用名:deep-research-preview-04-2026

Gemini Deep Research 是 Google 面向自主多步骤调查的研究 Agent,可综合复杂信息并生成带引用的报告,支持协同规划、可视化、MCP 和 File Search。当前已弃用。

推理tool_use长上下文视觉语音输入
语言模型深度研究多来源分析Agent

Gemini Deep Research Max

分类:语言模型 / 上下文:- / 调用名:deep-research-max-preview-04-2026

Gemini Deep Research Max 是 Google 的深度研究模型,适合深度研究、多来源分析等长链路分析与研究场景。 当前仍是预览版。

推理
语言模型通用 Agent代码执行网页自动化

Antigravity Agent

分类:语言模型 / 上下文:- / 调用名:antigravity-preview-05-2026

Antigravity Agent 是 Google 的 Gemini 多模态模型,适合通用 Agent、代码执行等通用生产工作流。 当前仍是预览版。

推理代码
多模态模型本地部署视觉理解代码开发

Gemma 3 27B IT

分类:多模态模型 / 上下文:128K / 调用名:gemma-3-27b-it

Gemma 3 的 27B 指令版是 Google 当前较强的开放权重多模态模型,适合本地部署、多语言理解、视觉问答和开发类任务。

视觉函数调用长上下文开放权重
多模态模型本地部署视觉理解通用助手

Gemma 3 12B IT

分类:多模态模型 / 上下文:128K / 调用名:gemma-3-12b-it

Gemma 3 的 12B 指令版在效果和部署成本之间更均衡,适合私有化助手、视觉理解和通用开发工作流。

视觉函数调用长上下文开放权重
多模态模型轻量部署视觉理解通用助手

Gemma 3 4B IT

分类:多模态模型 / 上下文:128K / 调用名:gemma-3-4b-it

Gemma 3 的 4B 指令版更偏轻量部署,适合边缘设备上的视觉理解、小型助手和受资源约束的私有场景。

视觉函数调用开放权重长上下文
语言模型轻量部署本地助手私有化

Gemma 3 1B IT

分类:语言模型 / 上下文:32K / 调用名:gemma-3-1b-it

Gemma 3 的 1B 指令版更适合超轻量本地助手、离线文本处理和资源受限设备上的私有部署。

函数调用开放权重
多模态模型端侧部署语音输入视觉理解

Gemma 3n E4B IT

分类:多模态模型 / 上下文:32K / 调用名:gemma-3n-e4b-it

Gemma 3n E4B IT 是 Google 面向端侧的多模态开放模型,强调在移动设备上处理文本、图像和音频输入。

视觉语音输入开放权重
多模态模型端侧部署轻量助手视觉理解

Gemma 3n E2B IT

分类:多模态模型 / 上下文:32K / 调用名:gemma-3n-e2b-it

Gemma 3n E2B IT 是更轻量的端侧多模态开放模型,适合移动端本地助手、视觉问答和音频理解场景。

视觉语音输入开放权重
语言模型函数调用本地 Agent工具路由

FunctionGemma 270M IT

分类:语言模型 / 上下文:32K / 调用名:functiongemma-270m-it

FunctionGemma 270M IT 是 Google 专门为函数调用设计的小模型,适合本地 Agent 的工具选择、参数填充和结构化路由。

函数调用结构化输出开放权重
多模态模型深度推理长文问答视觉理解

Gemini 2.5 Pro

分类:多模态模型 / 上下文:1.048576M / 调用名:gemini-2.5-pro

Gemini 2.5 Pro 是 Google 的 Gemini 多模态模型,适合深度推理、长文问答等通用生产工作流。

$1.25 / $10.00
视觉语音输入函数调用结构化输出推理代码长上下文

价格记录更新时间:2026-04-20

查看模型详情
多模态模型深度研究长文问答Agent

Deep Research preview Pro

分类:多模态模型 / 上下文:1.048576M / 调用名:deep-research-pro-preview-12-2025

Deep Research preview Pro 是 Google 的深度研究模型,适合深度研究、长文问答等长链路分析与研究场景。 当前仍是预览版。

视觉语音输入推理长上下文
多模态模型通用助手低延迟视觉理解

Gemini 2.0 Flash

分类:多模态模型 / 上下文:1.048576M / 调用名:gemini-2.0-flash

Gemini 2.0 Flash 是 Google 的 Gemini 多模态模型,适合通用助手、低延迟等通用生产工作流。 当前已进入弃用阶段。

$0.10 / $0.40
视觉语音输入函数调用结构化输出代码长上下文

价格记录更新时间:2026-04-20

查看模型详情
多模态模型低延迟成本敏感批量处理

Gemini 2.0 Flash-Lite

分类:多模态模型 / 上下文:1.048576M / 调用名:gemini-2.0-flash-lite

Gemini 2.0 Flash-Lite 是 Google 的 Gemini 多模态模型,适合低延迟、成本敏感等通用生产工作流。 当前已进入弃用阶段。

$0.07 / $0.30
视觉语音输入函数调用结构化输出长上下文

价格记录更新时间:2026-04-20

查看模型详情
多模态模型浏览器操作网页自动化Agent

Gemini 2.5 Computer Use model

分类:多模态模型 / 上下文:128K / 调用名:gemini-2.5-computer-use-preview-10-2025

Gemini 2.5 Computer Use model 是 Google 的电脑操作模型,适合浏览器操作、网页自动化等浏览器自动化任务。 当前仍是预览版。

$1.25 / $10.00
视觉长上下文

价格记录更新时间:2026-04-20

查看模型详情
多模态模型通用助手低延迟视觉理解

Gemini 2.5 Flash

分类:多模态模型 / 上下文:1.048576M / 调用名:gemini-2.5-flash

Gemini 2.5 Flash 是 Google 的 Gemini 多模态模型,适合通用助手、低延迟等通用生产工作流。

$0.30 / $2.50
视觉语音输入函数调用结构化输出推理代码长上下文

价格记录更新时间:2026-04-20

查看模型详情
图像生成图像生成视觉创作素材生产

Gemini 2.5 Flash Image (Nano Banana)

分类:图像生成 / 上下文:65.536K / 调用名:gemini-2.5-flash-image

Gemini 2.5 Flash Image (Nano Banana) 是 Google 的图像生成模型,适合图像生成、视觉创作等视觉内容生产任务。 当前已进入弃用阶段。

$0.30 / $0.04
视觉结构化输出图像生成

价格记录更新时间:2026-04-20

查看模型详情
多模态模型低延迟成本敏感批量处理

Gemini 2.5 Flash-Lite

分类:多模态模型 / 上下文:1.048576M / 调用名:gemini-2.5-flash-lite

Gemini 2.5 Flash-Lite 是 Google 的 Gemini 多模态模型,适合低延迟、成本敏感等通用生产工作流。

视觉语音输入函数调用结构化输出推理代码长上下文

价格记录更新时间:2026-04-20

查看模型详情
多模态模型低延迟成本敏感批量处理

Gemini 2.5 Flash-Lite Preview

分类:多模态模型 / 上下文:1.048576M / 调用名:gemini-2.5-flash-lite-preview-09-2025

Gemini 2.5 Flash-Lite Preview 是 Google 的 Gemini 多模态模型,适合低延迟、成本敏感等通用生产工作流。 当前已进入弃用阶段。

视觉语音输入函数调用结构化输出推理代码长上下文

价格记录更新时间:2026-04-20

查看模型详情
语音模型实时语音语音助手音频对话

Gemini 2.5 Flash Live Preview

分类:语音模型 / 上下文:131.072K / 调用名:gemini-2.5-flash-native-audio-preview-12-2025

Gemini 2.5 Flash Live Preview 是 Google 的实时语音模型,适合实时语音、语音助手等低延迟语音交互场景。 当前仍是预览版。

$0.50 / $2.00
视觉语音输入语音输出函数调用推理长上下文

价格记录更新时间:2026-04-20

查看模型详情
多模态模型通用助手低延迟视觉理解

Gemini 2.5 Flash Preview

分类:多模态模型 / 上下文:1.048576M / 调用名:gemini-2.5-flash-preview-09-2025

Gemini 2.5 Flash Preview 是 Google 的 Gemini 多模态模型,适合通用助手、低延迟等通用生产工作流。 当前已进入弃用阶段。

视觉语音输入函数调用结构化输出推理代码长上下文
语音模型语音合成语音助手配音内容

Gemini 2.5 Flash Text-to-Speech

分类:语音模型 / 上下文:8.192K / 调用名:gemini-2.5-flash-preview-tts

Gemini 2.5 Flash Text-to-Speech 是 Google 的语音合成模型,适合语音合成、语音助手等语音输出场景。 当前仍是预览版。

$0.50 / $10.00
语音输出

价格记录更新时间:2026-04-20

查看模型详情
语音模型语音合成语音助手配音内容

Gemini 2.5 Pro Text-to-Speech

分类:语音模型 / 上下文:8.192K / 调用名:gemini-2.5-pro-preview-tts

Gemini 2.5 Pro Text-to-Speech 是 Google 的语音合成模型,适合语音合成、语音助手等语音输出场景。 当前仍是预览版。

$1.00 / $20.00
语音输出推理

价格记录更新时间:2026-04-20

查看模型详情
多模态模型通用助手低延迟视觉理解

Gemini 3 Flash Preview

分类:多模态模型 / 上下文:1.048576M / 调用名:gemini-3-flash-preview

Gemini 3 Flash Preview 是 Google 的 Gemini 多模态模型,适合通用助手、低延迟等通用生产工作流。 当前仍是预览版。

$0.50 / $3.00
视觉语音输入函数调用结构化输出推理代码长上下文

价格记录更新时间:2026-04-20

查看模型详情
图像生成图像生成视觉创作素材生产

Gemini 3 Pro Image Preview

分类:图像生成 / 上下文:65.536K / 调用名:gemini-3-pro-image-preview

Gemini 3 Pro Image Preview 是 Google 的图像生成模型,适合图像生成、视觉创作等视觉内容生产任务。 当前仍是预览版。

$2.00 / $12.00
视觉结构化输出推理图像生成

价格记录更新时间:2026-04-20

查看模型详情
多模态模型深度推理长文问答视觉理解

Gemini 3 Pro Preview

分类:多模态模型 / 上下文:1.048576M / 调用名:gemini-3-pro-preview

Gemini 3 Pro Preview 是 Google 的 Gemini 多模态模型,适合深度推理、长文问答等通用生产工作流。 当前已进入弃用阶段。

视觉语音输入函数调用结构化输出推理代码长上下文

价格记录更新时间:2026-04-20

查看模型详情
图像生成图像生成视觉创作素材生产

Gemini 3.1 Flash Image Preview

分类:图像生成 / 上下文:131.072K / 调用名:gemini-3.1-flash-image-preview

Gemini 3.1 Flash Image Preview 是 Google 的图像生成模型,适合图像生成、视觉创作等视觉内容生产任务。 当前仍是预览版。

$0.50 / $3.00
视觉推理图像生成长上下文

价格记录更新时间:2026-04-20

查看模型详情
多模态模型低延迟成本敏感批量处理

Gemini 3.1 Flash-Lite Preview

分类:多模态模型 / 上下文:1.048576M / 调用名:gemini-3.1-flash-lite-preview

Gemini 3.1 Flash-Lite Preview 是 Google 的 Gemini 多模态模型,适合低延迟、成本敏感等通用生产工作流。 当前仍是预览版。

$0.25 / $1.50
视觉语音输入函数调用结构化输出推理代码长上下文

价格记录更新时间:2026-04-20

查看模型详情
语音模型实时语音语音助手音频对话

Gemini 3.1 Flash Live Preview

分类:语音模型 / 上下文:131.072K / 调用名:gemini-3.1-flash-live-preview

Gemini 3.1 Flash Live Preview 是 Google 的实时语音模型,适合实时语音、语音助手等低延迟语音交互场景。 当前仍是预览版。

$0.75 / $4.50
视觉语音输入语音输出函数调用推理长上下文

价格记录更新时间:2026-04-20

查看模型详情
语音模型语音合成语音助手配音内容

Gemini 3.1 Flash TTS (Text-to-Speech) Preview

分类:语音模型 / 上下文:8.192K / 调用名:gemini-3.1-flash-tts-preview

Gemini 3.1 Flash TTS (Text-to-Speech) Preview 是 Google 的语音合成模型,适合语音合成、语音助手等语音输出场景。 当前仍是预览版。

$1.00 / $20.00
语音输出

价格记录更新时间:2026-04-20

查看模型详情
多模态模型深度推理长文问答视觉理解

Gemini 3.1 Pro Preview

分类:多模态模型 / 上下文:1.048576M / 调用名:gemini-3.1-pro-preview

Gemini 3.1 Pro Preview 是 Google 的 Gemini 多模态模型,适合深度推理、长文问答等通用生产工作流。 当前仍是预览版。

$2.00 / $12.00
视觉语音输入函数调用结构化输出推理代码长上下文

价格记录更新时间:2026-04-20

查看模型详情
嵌入模型多模态检索语义搜索向量召回

Gemini Embedding model

分类:嵌入模型 / 上下文:2.048K / 调用名:gemini-embedding-001

Gemini Embedding model 是 Google 的多模态嵌入模型,适合多模态检索、语义搜索等检索与召回场景。

$0.15 / -
嵌入

价格记录更新时间:2026-04-20

查看模型详情
嵌入模型多模态检索语义搜索向量召回

Gemini Embedding 2 model

分类:嵌入模型 / 上下文:8.192K / 调用名:gemini-embedding-2-preview

Gemini Embedding 2 model 是 Google 的多模态嵌入模型,适合多模态检索、语义搜索等检索与召回场景。 当前仍是预览版。

$0.20 / -
视觉语音输入嵌入

价格记录更新时间:2026-04-20

查看模型详情
多模态模型具身推理机器人控制视觉理解

Gemini Robotics-ER 1.5

分类:多模态模型 / 上下文:1.048576M / 调用名:gemini-robotics-er-1.5-preview

Gemini Robotics-ER 1.5 是 Google 的 Gemini 多模态模型,适合具身推理、机器人控制等通用生产工作流。 当前仍是预览版。

$0.30 / $2.50
视觉语音输入函数调用结构化输出推理代码长上下文

价格记录更新时间:2026-04-20

查看模型详情
多模态模型具身推理机器人控制视觉理解

Gemini Robotics-ER 1.6

分类:多模态模型 / 上下文:1.048576M / 调用名:gemini-robotics-er-1.6-preview

Gemini Robotics-ER 1.6 是 Google 的 Gemini 多模态模型,适合具身推理、机器人控制等通用生产工作流。 当前仍是预览版。

$1.00 / $5.00
视觉语音输入函数调用结构化输出推理代码长上下文

价格记录更新时间:2026-04-20

查看模型详情
图像生成图像生成视觉创作素材生产

Imagen 4 Fast

分类:图像生成 / 上下文:0.48K / 调用名:imagen-4.0-fast-generate-001

Imagen 4 Fast 是 Google 的图像生成模型,适合图像生成、视觉创作等视觉内容生产任务。

图像生成

价格记录更新时间:2026-04-20

查看模型详情
图像生成图像生成视觉创作素材生产

Imagen 4

分类:图像生成 / 上下文:0.48K / 调用名:imagen-4.0-generate-001

Imagen 4 是 Google 的图像生成模型,适合图像生成、视觉创作等视觉内容生产任务。

图像生成

价格记录更新时间:2026-04-20

查看模型详情
图像生成图像生成视觉创作素材生产

Imagen 4 Ultra

分类:图像生成 / 上下文:0.48K / 调用名:imagen-4.0-ultra-generate-001

Imagen 4 Ultra 是 Google 的图像生成模型,适合图像生成、视觉创作等视觉内容生产任务。

图像生成

价格记录更新时间:2026-04-20

查看模型详情
音乐生成音乐生成配乐创作内容生产

Lyria 3 Pro Preview Clip

分类:音乐生成 / 上下文:131.072K / 调用名:lyria-3-clip-preview

Lyria 3 Pro Preview Clip 是 Google 的音乐生成模型,适合音乐生成、配乐创作等配乐与音频创作场景。 当前仍是预览版。

视觉语音输出音乐生成长上下文

价格记录更新时间:2026-04-20

查看模型详情
音乐生成音乐生成配乐创作内容生产

Lyria RealTime experimental

分类:音乐生成 / 上下文:- / 调用名:lyria-realtime-exp

Lyria RealTime experimental 是 Google 的音乐生成模型,适合音乐生成、配乐创作等配乐与音频创作场景。 当前仍是预览版。

语音输出音乐生成
视频生成视频生成广告素材动态内容

Veo 2.0

分类:视频生成 / 上下文:- / 调用名:veo-2.0-generate-001

Veo 2.0 是 Google 的视频生成模型,适合视频生成、广告素材等动态内容生产任务。

视觉视频生成

价格记录更新时间:2026-04-20

查看模型详情
视频生成视频生成广告素材动态内容

Veo 3.1 Fast

分类:视频生成 / 上下文:- / 调用名:veo-3.1-fast-generate-preview

Veo 3.1 Fast 是 Google 的视频生成模型,适合视频生成、广告素材等动态内容生产任务。 当前仍是预览版。

视觉语音输出视频生成

价格记录更新时间:2026-04-20

查看模型详情
视频生成视频生成广告素材动态内容

Veo 3.1

分类:视频生成 / 上下文:- / 调用名:veo-3.1-generate-preview

Veo 3.1 是 Google 的视频生成模型,适合视频生成、广告素材等动态内容生产任务。 当前仍是预览版。

视觉语音输出视频生成

价格记录更新时间:2026-04-20

查看模型详情
视频生成视频生成广告素材动态内容

Veo 3.1 Lite Preview

分类:视频生成 / 上下文:- / 调用名:veo-3.1-lite-generate-preview

Veo 3.1 Lite Preview 是 Google 的视频生成模型,适合视频生成、广告素材等动态内容生产任务。 当前仍是预览版。

视觉语音输出视频生成

价格记录更新时间:2026-04-20

查看模型详情