NOTES · 期刊
限时免费的 AI 配音模型MiMo V2.5 TTS 测试
发布于 2026/10/10 21:41 · 更新于 2026/10/10 21:41

限时免费的 AI 配音模型MiMo V2.5 TTS 测试

如果你在找中文配音、短视频旁白,或可定制的角色声音,这组模型值得先收藏。小米官方目前把三款 MiMo V2.5 TTS API 标为“限时免费”;但“官方标免费”和“我们已完成 API 实测”是两件事,下面把证据与测试进度讲清楚。
3 款语音生成 API
限时免费以官方当日规则为准
3 / 3 成功真实 API WAV 生成测试
免费入口在哪里?不在 Token Plan
看免费标注:打开官方“按量 API 定价”页,向下找到“模型国内定价”或“模型海外定价”里的 TTS 系列,三款模型旁会标注“限时免费”。
去哪里注册:登录 Xiaomi MiMo API 开放平台后,在控制台的 API Keys 创建 API Key。Token Plan 是另一种订阅套餐页;要试这三款 TTS,请从按量 API / API Keys 入口开始,不要先购买 Token Plan。
打开定价页,查看 TTS 免费标注 ↗打开 API 控制台 ↗
Registration / 注册与 API Key
从小米账号到 API Key:完整注册步骤
使用这三款 TTS 模型走 按量 API 的账号入口。官方文档说明平台使用小米账号登录,并在控制台的 API Keys 页面创建按量 API Key。
01
登录或注册小米账号
已有小米账号直接登录;还没有账号,可先到 id.mi.com 注册,再进入 Xiaomi MiMo API 开放平台。
02
打开 API 控制台
点击下方“开放平台 / API Keys”链接。若系统要求登录,使用刚才的小米账号完成登录。
03
创建按量 API Key
在控制台打开 API Keys,点击创建并按页面提示命名。复制新生成的 Key 并妥善保管;不要把 Key 发给别人或贴进公开网页。
04
确认选的是 TTS 限时免费型号
回到官方按量 API 定价页,在“TTS 系列”确认 mimo-v2.5-tts、mimo-v2.5-tts-voicedesign 或 mimo-v2.5-tts-voiceclone 仍标注限时免费。Token Plan 是单独的订阅套餐,测试这些模型不需要先购买套餐。
05
第一次调用前核对用量
用一小段非敏感文本做试调用,再到控制台用量页查看请求记录和费用。免费条件可能变化,先确认当日官方标注及账号显示。
mimo.mi.com/docs · 官方首次调用 API 指引
Xiaomi MiMo / 文档 / 快速开始
首次调用 API
调用前准备 → 登录 Xiaomi MiMo API 开放平台
小米账号登录→控制台→API Keys→创建 API Key
按量 API Key 格式为 sk-…;Token Plan Key 是 tp-…,两种入口和凭证不要混用。
官方指引页面中的账号与凭证路径图解(界面示意,非登录后个人控制台截图)。实际页面布局可能随官方改版变化。
小米账号注册 ↗打开 API Keys ↗打开用量记录 ↗官方首次调用指引 ↗
01 / What you get
三款模型,分别解决三种配音需求
它不是用来聊天或写代码的通用大模型,而是一组文字转语音(TTS)模型。区别主要在“声音从哪里来”。
♫
标准语音合成
mimo-v2.5-tts
选内置音色,把文字读出来;可用自然语言描述语速、情绪和语气,也支持唱歌模式。
✳
文字设计音色
mimo-v2.5-tts-voicedesign
用文字描述想要的声音,例如“沉稳、温暖的中年男声”,不需要上传参考音频。
◉
参考音频克隆
mimo-v2.5-tts-voiceclone
提供一段参考音频来复刻音色,再让生成语音按要求表达。使用他人声音前先取得授权。
文输入文本与表达要求✦选择模型与音色来源)))生成可播放语音
选内置声音、文字定制音色,或用授权音频作参考。
02 / Test notes
测试记录:3 次真实调用,均生成有效 WAV
以下结果来自 Xiaomi MiMo API 的实际请求。接口连通与音频文件结构可复核;主观音质没有由多人盲听评分,因此不把“请求成功”包装成音质结论。
API 实测2026 年 10 月 3 日 · 顺序请求 3 次
- ✓免费状态:小米官方定价页仍将 TTS、VoiceDesign、VoiceClone 标注为“限时免费”。
- ✓请求成功率:HTTP 200 为 3/3;返回模型均为
mimo-v2.5-tts,结束状态均为stop。 - ✓音频校验:3/3 文件均可解析为 WAV、24 kHz、单声道、16-bit PCM;时长分别为 10.88 秒、11.20 秒、10.88 秒。
- ✓响应耗时:2,860.5 ms、2,739.8 ms、2,771.6 ms;平均 2,790.6 ms,中位数 2,771.6 ms,范围 2,739.8–2,860.5 ms。样本量只有 3,不代表长期性能。
- …费用核账:检查控制台时显示累计消费 ¥0.00,但近实时列表只显示 1 次请求 / 237 tokens,与第三次响应 usage 相符。控制台说明近实时统计可能延迟最多 5 分钟,因此暂不能据此确认另外两次已全部入账为零。
- —音质评价:已生成可试听样音;本轮未做盲听、发音准确率或 MOS 评分,不给出主观音质分数。
测试方法与边界
- 模型与参数:
mimo-v2.5-tts
,内置音色“冰糖”,请求 WAV;用同一段中文文本、同一表达要求,顺序调用 3 次,未自动重试。
- 固定样本:
“清晨的阳光落在窗边,街道慢慢苏醒。今天,我们用同一段文字,听听不同音色怎样表达温柔、清晰和自然。”表达要求为“请用自然、清晰、语速平稳的普通话播报。”
- 验收项目:
记录 HTTP 状态、返回模型、结束状态、客户端总耗时;解析 WAV 文件头并核对声道、采样率、位深和时长。没有把生成成功等同于发音准确或音质优秀。
- 费用核对规则:
控制台当时仅出现 1 次记录,且官方注明近实时数据存在延迟。页面累计消费显示 ¥0.00 是当时的账户快照,不足以证明 3 次调用全部完成计费结算;建议稍后刷新用量页复核。
实际调用 3 次 · 成功 3 次 · WAV 样音 3 段 · 费用等待完整对账
试听本轮样音
第 1 次返回 WAV,10.88 秒。浏览器支持时可直接播放;另外两次样音保存在文章同目录。
下载样音 2 · 下载样音 3
结论边界
本测试证明了这组凭据在测试时可以调用标准 TTS 并返回结构有效的 WAV。是否仍免费、账户最终如何计费,以官方定价说明和控制台最终账单为准;本轮尚未完成 3 次请求的逐笔费用对账。
03 / Best fit
适合谁用?先看你的声音需求
适合尝试
- 短视频、课程、播客的旁白草稿
- 产品演示、语音原型与交互播报
- 需要调整情绪、语速或角色感的配音
- 用文字快速探索新音色,或做授权声音复刻
先确认再投入
- 要求长期稳定、无限量、生产级 SLA 的服务
- 需要语音识别、实时通话完整方案或通用聊天
- 没有取得授权,却打算克隆真实人物声音
- 需要精确确认商用许可、隐私保留或免费额度上限
简单选择:只想快速配音,先试 mimo-v2.5-tts;想从一句描述开始创造声音,试 voicedesign;已有明确授权的参考声音,再考虑 voiceclone。
04 / Start here
开始前的三步检查
看官方按量 API 定价页:在“TTS 系列”找到“限时免费”标注;不要把 Token Plan 订阅页当作 TTS 免费说明页。
走 API Keys 入口:用小米账号登录开放平台,在控制台创建 API Key;Token Plan 是独立订阅,不是这三款 TTS 的免费标注入口。
先用非敏感文本试一次:听过生成效果、确认账户费用为零,再决定是否放进自己的工作流。
想看今天还有哪些新发现?
点击每日更新页,查看新增模型、免费额度变化和下线记录。
打开 FreeLLM 每日更新 ↗
查看 MiMo 免费入口与接入信息
信息来源
- Xiaomi MiMo API 官方定价页(查看 TTS 限时免费标注)
- 官方首次调用 API 指引(小米账号、API Keys 与用量路径)
- Xiaomi MiMo V2.5 TTS 官方使用文档
- MiMo V2.5 TTS 系列介绍
免费政策和模型能力以官方页面最新说明为准。本文所称“免费”指官方当前标注的限时免费,不代表永久免费或无调用限制。实测为 3 次顺序 API 调用,均返回有效 WAV;控制台快照显示累计消费 ¥0.00,但当时只同步显示 1 次请求,因此另外两次费用仍待完整对账。测试密钥未写入本文、样音或其他交付文件。