详细参数
模型类型
realtime_speech_generation
适合场景
实时文本转语音
计费价格
公开资料未说明
计费方式
公开资料未说明
计费单位
未标注
输入形式
文本
输出形式
音频
Sonic-3 是 Cartesia 当前最新的流式 TTS 主力模型,强调更自然的表达、更细的情绪与速度控制,以及实时语音交互。
适合
实时文本转语音
realtime_speech_generation
价格
公开资料未说明
1M Tokens
输入
文本
可做实时交互
输出
音频
规格
支持实时
所属厂商:Cartesia
详细参数
模型类型
适合场景
计费价格
计费方式
计费单位
输入形式
输出形式
能力与信息
交互链路
实时
语音输入
语音输出
语音理解
转写
翻译
时间戳
语音生成
TTS
说话人区分
开发接入
工具调用
接入信息
调用名
API 基础地址
调用协议
主接口
接口说明
发布时间
价格与计费
计费摘要
输入价
输出价
缓存输入
币种
计费单位
单位类型
价格说明
原始价格文案
补充说明
发布时间
官方入口