MyVocal AI

0.80
一个 AI 声音克隆工具,通过短时间录音复制用户音色,再用于文字转语音或 AI 演唱。
Advertisement 728 × 90
公司MyVocal AI
发布日期2023
更新日期2026-09-02

MyVocal AI 概述

MyVocal 的使用流程主要分成两部分:先克隆声音,再拿克隆后的声音生成内容。

第一次训练时,需要按照页面提示朗读 25 个预设句子。

这些录音会被用来分析音色、语调和发音特点,训练完成后得到一个个人声音模型。

之后可以输入文字,让 AI 用这个声音生成旁白或口播;也可以使用 AI Singer,让克隆声音演唱歌曲。

所以它和普通 TTS 最大的区别,不是单纯把文字念出来,而是可以先做一个接近本人音色的声音模型。

MyVocal 也提供 REST API,开发者可以把语音合成和声音克隆接进自己的应用。

产品早期曾因运营主体、备案和数据安全问题受到质疑。后续运营方逐渐明确,也提供了开发者文档和 API,但声音本身属于比较敏感的数据,使用前仍然值得先看隐私政策。

MyVocal AI 定价

套餐价格说明
Free 免费版 免费 每月约 2,000 字符,单次最多约 500 字符,可体验基础声音克隆和语音生成。
Pro 专业版 价格以官网为准 每月约 120,000 字符,单次最多约 1,500 字符;公开资料中的价格跨度较大。
Business 企业版 定制价格 面向 API、商业授权和更大规模使用,具体价格需咨询。

MyVocal 采用免费版加订阅的模式,TTS 套餐主要按每月可生成字符数划分。

目前公开渠道里的历史价格差异比较大,更适合作为参考,不宜直接当作现行官网价格。

部分历史资料还出现过 $9.99/月、$99.99/年,以及中文渠道约 10 元/月、30 元/月的方案。

因此准备付费时,最好直接看当前官网,不要按旧文章里的价格做预算。

语言支持也经历过变化。

早期网页版本主要支持英语,部分付费方案增加德语、西班牙语、葡萄牙语等语言。较新的 V3 API 资料显示可支持 98 种语言,其中包括中文,但 API 能力是否全部同步到网页端,需要实际确认。

MyVocal AI 主要功能

  1. AI 声音克隆
    按照提示朗读 25 个预设句子,训练一个接近本人音色的声音模型。
  2. AI Singer
    使用克隆后的声音演唱歌曲,是 MyVocal 相比普通 TTS 工具更有辨识度的功能。
  3. 文字转语音
    输入文本后,用已经训练好的声音生成旁白、口播或其他语音内容。
  4. 情绪与语气标签
    部分语音模型支持使用 [happy]、[sad]、[laughter] 等标签调整表达方式。
  5. 开发者 API
    提供 REST API,可将声音克隆和语音合成能力接入网站、应用或自动化流程。

MyVocal AI 编辑实测

注册以后进入 Voice Clone,页面会让你依次录完 25 个句子。

整个采集过程不长。

我录完并提交后,大约等了半小时,声音模型训练完成。

真正开始生成时,最明显的问题是语言支持。

一开始想直接测试中文,但网页端提示不支持。后来查资料才发现,MyVocal 早期确实主要围绕英语做,其他语言逐步放到付费版本和后续模型里。

现在 V3 API 虽然已经列出中文在内的 98 种语言,但网页产品能不能直接用到同样的模型,不能只看 API 文档判断。

英文测试相对顺利。

我放进去一段普通文本,生成声音的音色确实能听出和原声有些接近,整体也比较流畅。

但长句一多,AI 味就明显起来了。

停顿、重音和情绪变化没有真人那么自然,尤其是需要明显情感起伏的句子,更像是在把文字顺畅念完,而不是正常聊天。

所以声音“像不像”和“自然不自然”其实是两回事。

MyVocal 在前者上能做到一定程度,后者还会暴露不少合成痕迹。

隐私问题比生成速度更值得注意。

MyVocal 早期曾被媒体质疑运营信息不透明。现在已经能查到运营主体,但克隆声音意味着要把一组能识别个人音色的录音交给平台。

如果只是娱乐测试,风险判断可能比较简单。

涉及工作录音、客户资料或者长期商业使用时,就应该先确认录音保存方式、删除机制和授权范围,再决定要不要上传。

优缺点

优点

  • 克隆流程短。 录完 25 句话就可以开始训练,不需要准备大量音频。
  • AI Singer 有辨识度。 除了普通 TTS,还能让克隆声音唱歌。
  • 免费版可以试完整流程。 适合先判断声音还原度。
  • 提供 API。 开发者可以把语音生成能力接进自己的产品。
  • 操作门槛不高。 不需要专业录音或语音模型知识。

缺点

  • 中文网页端支持不够明确。 API 已经扩展语言范围,但网页端能力需要另外确认。
  • 自然度有限。 长句、停顿和情绪表达仍容易听出合成感。
  • 历史价格比较混乱。 不同时期和渠道的数据差异很大。
  • 声音数据涉及隐私。 使用克隆功能前需要认真看数据和授权条款。
  • 专业控制能力有限。 对语速、停顿和细节表达的控制不如专业语音平台。

适合谁 / 不适合谁

适合:

  • 想体验声音克隆的人。 想知道 AI 模仿自己的声音能做到什么程度。
  • 对 AI 唱歌感兴趣的人。 AI Singer 是比较直接的娱乐玩法。
  • 需要快速做声音 Demo 的创作者。 可以先用克隆声音测试旁白和内容节奏。
  • 需要语音 API 的开发者。 想快速接入声音克隆或 TTS 功能。

不太适合:

  • 主要制作专业中文配音的人。 中文支持和实际效果需要先单独验证。
  • 对声音数据安全要求很高的人。 上传个人声音前需要确认平台的数据处理方式。
  • 需要广播级成品的人。 自然度和情绪控制还不能完全替代真人配音。
  • 需要精细语音控制的团队。 如果每一句都要调整停顿、语速和语调,MyVocal 的控制深度可能不够。

总结

MyVocal 最容易让人记住的还是两件事:25 句话克隆声音,以及让这个声音去唱歌。

整个流程不复杂,免费版也足够先判断克隆效果。

但“听起来像本人”并不等于已经能替代真人录音。长句、情绪和自然停顿仍然会露出合成痕迹,中文网页端的支持也需要实际测试。

另外,声音克隆和普通 AI 生图不太一样。

上传的是个人声音数据,决定长期使用之前,除了比较效果和价格,也应该确认隐私政策、授权范围以及录音能否删除。

如果只是想体验自己的 AI 声音,先用免费额度录完 25 句话就够了。实际效果能接受,再考虑要不要继续付费。

评论(0)

发表评论

Advertisement 728 × 90

类似工具

相关新闻