版本可追溯的全球AI模型资料库

音频与语音 AI模型

用于语音识别、语音合成、音乐与音频生成的模型。

47 个已核对模型12 家厂商 官方来源 版本状态
选模型先问四件事
  1. 任务需要多强的推理?
  2. 输入输出是否包含图片、音频或视频?
  3. 走API、云产品还是本地部署?
  4. 旧版本是否已经预告弃用?
MODEL INDEX

音频与语音模型

共 2 条
M
当前可用完整度 100/100

MiniMax Speech 2.8

MiniMax Speech 2.8模型资料:精确版本、开放状态、输入输出、上下文、适用任务、限制和官方来源。

厂商
MiniMax
输入
文本、音色参数
获取
MiniMax API
发布
2026-01-23
适合:中文语音合成、配音、情绪语音与声音产品
M
当前可用完整度 100/100

MiniMax Music 2.6

MiniMax Music 2.6模型资料:精确版本、开放状态、输入输出、上下文、适用任务、限制和官方来源。

厂商
MiniMax
输入
歌曲描述、歌词、参考音频
获取
MiniMax API、订阅计划
发布
2026-04
适合:歌曲生成、翻唱实验、器乐创作和内容配乐