详细参数
模型类型
适合场景
计费价格
计费方式
计费单位
输入形式
输出形式
真正具有声音表演能力的语音合成模型,首次将语境理解能力引入语音生成全流程。通过 Global Context(全局语境)+ Inline Context(文中语境)双档控制,配合 Zero-shot Clone,让合成语音有呼吸感、轻重主次和情绪弧线,适合有声书、短剧配音、广告旁白、情感叙事等高表现力场景。
适合
语音合成 / Contextual TTS
speech_generation
价格
¥5.8 / 10K characters
输入
文本
输出
音频
规格
speech_generation
所属厂商:阶跃星辰 StepFun
详细参数
模型类型
适合场景
计费价格
计费方式
计费单位
输入形式
输出形式
能力与信息
交互链路
实时
语音输入
语音输出
语音理解
转写
翻译
时间戳
语音生成
TTS
说话人区分
开发接入
工具调用
接入信息
调用名
API 基础地址
调用协议
主接口
接口说明
发布时间
价格与计费
计费摘要
计费价格
计费单位
单位类型
输入形式
输出形式
币种
价格说明
原始价格文案
补充说明
发布时间
官方入口
模型页
platform.stepfun.com
/docs/zh/api-reference/audio/create-audio
查看厂商官方模型介绍和版本说明
价格页
platform.stepfun.com
/docs/zh/guides/pricing/details
核对最新价格和计费单位
官方文档
platform.stepfun.com
/docs/zh/api-reference/audio/create-audio
查看接入方式、能力说明和限制
API 后台
platform.stepfun.com
/
进入厂商官方 API 平台或控制台
在线体验
stepfun.com
/
进入官方体验或 Playground
厂商页
tokendh.com
/providers/stepfun
查看本站整理的厂商入口、开通方式和可用范围