======================================== MiniMax 语音大模型 - 计费规则 ======================================== MiniMax 语音大模型能够根据上下文,智能预测文本的情绪、语调等信息, 并生成超自然、高保真、个性化的语音。在社交、播客、有声书、新闻资讯、 教育、数字人等多种场景中展现出强大的实力。 一、同步语音合成 (T2A) ---------------------------------------- 支持音量、语调、语速调整和混音功能, 支持比特率、采样率相关参数调整特性, 支持音频时长、音频大小等返回参数。 适用于需要短文本快速得到结果的场景,比如闲聊、对话等场景。 模型 单价 ────────────────────────────────────── speech-2.8-hd 3.5 元/万字符 speech-2.6-hd 3.5 元/万字符 speech-02-hd 3.5 元/万字符 ────────────────────────────────────── speech-2.8-turbo 2 元/万字符 speech-2.6-turbo 2 元/万字符 speech-02-turbo 2 元/万字符 二、异步长文本语音合成 (T2A Async) ---------------------------------------- 支持基于文本到语音的异步生成, 单次文本生成传输最大支持 100 万字符, 生成的完整音频结果支持异步的方式进行检索。 模型 单价 ────────────────────────────────────── speech-2.8-hd 3.5 元/万字符 speech-2.6-hd 3.5 元/万字符 speech-02-hd 3.5 元/万字符 ────────────────────────────────────── speech-2.8-turbo 2 元/万字符 speech-2.6-turbo 2 元/万字符 speech-02-turbo 2 元/万字符 三、音色设计 (Voice Design) ---------------------------------------- 支持基于用户输入的声音描述 prompt,来生成音色(voice_id); 并支持使用该生成的音色(voice_id)在同步语音合成、 异步长文本语音合成接口中进行语音合成。 模型 单价 ────────────────────────────────────── 所有模型 9.9 元/音色 注意: - 调用本接口获得新设计的音色时,不会立即收取音色设计费用。 - 音色生成费用将在首次使用此音色进行语音合成时收取。 - 本接口内的试听语音合成会收取 2 元/万字符的费用。 四、快速复刻 (Voice Cloning) ---------------------------------------- 基于大语言模型的音色克隆更加精准快速, 无需数小时时长的超高质量原音频、无需传统 TTS 的超长工期, 可以在极短时间内完成音色复刻,并通过大语言模型加持, 使复刻后的音色与原音色进行高质量还原。 模型 单价 ────────────────────────────────────── 所有模型 9.9 元/音色 注意: - 调用本接口获得复刻音色时,不会立即收取音色复刻费用。 - 音色的复刻费用将在首次使用此复刻音色进行语音合成时收取。 - 试听字符根据选择的试听模型收费。 ======================================== 计费汇总 ======================================== 类别 HD系列 Turbo系列 ────────────────────────────────────── 同步语音合成 3.5 元/万字符 2 元/万字符 异步长文本合成 3.5 元/万字符 2 元/万字符 音色设计 9.9 元/音色 快速复刻 9.9 元/音色