- name
- minimax
- description
- >
- version
- 1.0.0
- author
- lumina
- tags
MiniMax 多模态 Skill(Token Plan 版)
使用 MiniMax Token Plan 额度进行语音合成和图片生成。
环境配置
MINIMAX_API_KEY: MiniMax API 密钥(必填,从 Token Plan 页面获取)MINIMAX_REGION:cn国内 /int国际(默认cn)
语音模块
同步 TTS
python3 scripts/speech.py tts "欢迎使用" -v female-tianmei -o hello.mp3参数:
text: 要转换的文本voice_id: 音色 ID(见下方内置音色表)output_file: 输出路径model: 模型,默认speech-2.8-hdformat: 音频格式,默认mp3sample_rate: 采样率,默认32000bitrate: 比特率,默认128000
异步 TTS
python3 scripts/speech.py tts-async "长文本内容" -v female-tianmei
# 返回 task_id,再用 query 命令查询
python3 scripts/speech.py query <task_id>音色克隆
python3 scripts/speech.py clone <音频文件路径> -t "我的音色"内部自动完成两步:1) 上传音频到 /v1/files;2) 调用 /v1/voice_clone 复刻音色。 模型:speech-2.0-turbo(默认)。克隆后返回 voice_id,可用于 TTS。
音色设计
python3 scripts/speech.py design "年轻女性,活泼开朗" -s custom音色管理
python3 scripts/speech.py list # 列出可用音色
python3 scripts/speech.py delete <voice_id> # 删除音色内置音色
| voice_id | 描述 |
|---|---|
| female-tianmei | 女声甜美 |
| male-yunyang | 男声播音 |
| female-badu | 女声巴度 |
图片模块
文生图
python3 scripts/image.py generate "日出海边风景" -o sunset.png -r 16:9参数:
prompt: 图片描述output_file: 输出路径(必填)aspect_ratio: 宽高比,1:1/16:9/9:16/4:3/3:4(默认1:1)response_format: 返回格式,url(默认)或base64
图生图(编辑)
python3 scripts/image.py edit "把猫变成老虎" -i cat.png -o tiger.png -r 1:1支持本地文件路径或 URL。
Python 函数调用
语音
from scripts.speech import text_to_speech, clone_voice, design_voice, list_voices
# TTS
text_to_speech("你好世界", voice_id="female-tianmei", output_file="hello.mp3")
# 音色克隆
voice_id = clone_voice("my_voice.mp3", title="我的音色")
# 音色设计
voice_id = design_voice("年轻男性,沉稳专业", style="custom")
# 音色列表
voices = list_voices()图片
from scripts.image import generate_image, generate_image_from_image, download_image
# 文生图
generate_image("日出海边", output_path="sunset.png", aspect_ratio="16:9")
# 图生图
generate_image_from_image("添加中国风元素", image_file="photo.png", output_path="result.png")
# 下载图片
download_image("https://example.com/image.png", "local.png")