Toolso.AI
Toolso.AI
所有工具分类热门榜单最新工具价格博客
Toolso.AI
Toolso.AI

💌订阅 AI 工具周报

每周精选最新、最热门的AI工具和行业动态,直达您的邮箱 订阅

Toolso.AI
Toolso.AI

发现最好的AI工具,提升你的工作效率

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

热门分类

  • AI写作
  • AI图像
  • AI视频
  • AI编程
  • 更多分类

探索发现

  • 最新收录
  • 热门推荐
  • 更多工具
  • 提交工具
  • 价格

关于

  • 关于我们
  • 联系我们
  • 博客
  • 更新日志

法律

  • Cookie政策
  • 隐私政策
  • 服务条款
  • 退款政策
© 2026 Toolso.AI 保留所有权利
限时推广限时推广加速推广24h 优先审核 · 无需反链 · 30 天推荐展示$29.90到期后 $59.9010月31日后涨价至 $59.90距结束--:--:--立即提交
  1. 首页
  2. 所有工具
  3. 效率工具
  4. Luvvoice
Luvvoice界面预览
Luvvoice标志

Luvvoice

Luvvoice 可把文本以及 PDF、TXT 文档转成 MP3 语音,覆盖 70 多种语言,并提供音色克隆与电子书转有声书功能。面向需要快速配音的创作者与学生,设有免费档,付费方案月付 8 美元起。

效率工具语音生成音频生成#文字转语音#免费#多语言
免费试用
收藏
访问次数
浏览次数
定价
免费增值
发布日期
2026年8月22日
域名
luvvoice.com
用户评分

用过这个工具吗?给它评分

为这个工具评分

Luvvoice 工具信息

免费试用
工具信息
收藏
访问次数
浏览次数
定价
免费增值
发布日期
2026年8月22日
域名
luvvoice.com
用户评分

用过这个工具吗?给它评分

为这个工具评分

推荐工具

相关工具推荐

免费试用

Luvvoice 是什么?

Luvvoice 是一个在线文字转语音服务,把书面文本变成可下载的音频。它的自述很直白:一个免费的在线文字转语音(TTS)工具,把你的文本转成自然的人声——粘贴或输入文本,选一个音色,然后下载生成的 MP3 或直接在浏览器里试听。官网主打的卖点是规模:70 多种语言、200 个以上音色。

产品运行在 luvvoice.com,运营主体是 Soundsynth Tech LLC,而这个信息在任何营销页面上都找不到。它出现在服务条款的赔偿条款里,并由 App Store 的卖家信息独立佐证。对这个体量的产品来说,两个独立来源在运营主体上互相印证是值得一提的——不少小型 TTS 站点根本不披露任何公司主体。

注册前最该弄清楚的一件事

站点的页面标题写的是 「免费在线文字转语音,无字数限制」。这句话是产品的主要钩子,但它经不起和站点自身文档的对照。

每一档都有硬性字符上限。定价页写明免费方案为每月 10,000 字符。而同一站点的首页 FAQ 写的是免费方案每月 20,000 字符。这两个数字互相矛盾,且都与「无字数限制」相冲突。

还有第二个更紧、在日常使用中影响更大的限制:单次转换字符数。免费档是 3,000 字符——未登录时首页编辑器上明晃晃地显示着 0 / 3000 计数器。付费档把它提到单次 20,000。作为参照,3,000 字符大约是一段三分钟的脚本,再长就必须切块。

这些都不能说明 Luvvoice 是个差工具,它说明的是营销口径不准确,也意味着你该按真实数字而不是按标题来规划。本页通篇采用有文档依据的数字。

这些音色究竟从哪来

这是营销页面同样不会说的另一件事,而它在服务条款里被坦白写出:Luvvoice 目前通过微软 Azure AI Speech(含 Azure 神经网络文字转语音技术)、Google Cloud Text-to-Speech 以及 Luvvoice 自有语音模型提供语音合成。 具体用哪个模型或供应商,随所选音色、语言、功能与可用性而变化。

换句话说,音色库中相当一部分是包了层更友好界面的 Azure 与谷歌云 TTS,另有一部分自研模型。这也就解释了一个小体量团队何以能提供 200 多个音色、70 多种语言——那些音色库属于微软和谷歌。

由此有两个实际影响。其一,主流语言的音质大体上会与直接使用 Azure 或谷歌相当,因为很多情况下它就是同一个引擎。其二,Luvvoice 真正增加的价值在于封装:一个不需要云账号、不需要 API 密钥的浏览器界面,加上文档上传、停顿控制、可试听的音色库与 MP3 下载。对很多用户来说这层封装值得付费;对已经有 Azure 账号的开发者来说则未必。

在条款里把这件事说清楚,是这家公司值得肯定的地方——不少 TTS 转售方并不会这么做。

核心功能

文字转语音,可调语速与音调

作为一款 AI 语音生成工具,核心流程很简单:粘贴文本、选语言和音色、生成、下载 MP3。在基础转换之外,有两项控制对你打算公开发布的内容真正重要。

语速与音调可通过设置按钮调节,教学类内容可以放慢,短视频则可以提速。

停顿对登录用户开放,通过工具栏的 Pauses 按钮插入 0.5 秒至 5 秒不等的间隔。官方建议单次转换不超过 20 个停顿。停顿控制正是「可用的旁白」与「一堵不换气的语音墙」之间的分水岭,光为这一项就值得注册账号。但请注意限制章节里的一条提醒:至少有一位付费用户反映,自定义克隆音色上无法使用停顿。

文档转语音

你可以上传文档而不必粘贴文本。支持 PDF 与 TXT 等常见格式,官方称可上传包含数十万字符的文档并转为 AI 语音。

把它和单次转换上限放在一起看,图景就清楚了:上传器接受大文档,但转换仍然按你的月度字符额度计量。一份 20 万字符的书稿,在 Lite 档 70 万字符的月额度里一次就吃掉将近三分之一。

官方对一个失败情形很诚实:只含图片或由扫描生成的 PDF 可能无法正常提取文字。如果你的原始素材是扫描版书籍,得先做 OCR,Luvvoice 才有东西可处理。

语音克隆

音色克隆是有独立页面、独立额度池与独立条款约束的一等功能。流程分三步:

  1. 上传或录制语音样本。 官方指引是音频长度最好超过 10 秒。
  2. AI 处理。 系统分析并学习该声音的特征。
  3. 生成语音。 输入文本,以克隆出的音色产出音频。

克隆的语言覆盖明显窄于 TTS 侧:官方点名支持英语、日语、韩语、中文、法语、德语、阿拉伯语与西班牙语等主要语言。如果你需要的克隆语种不在这个范围内,购买前务必先确认。

克隆音色消耗的是独立的自定义额度池,而非标准字符额度。免费档只允许创建 1 个自定义音色、500 自定义额度——够试一次,不够用起来。付费档则是自定义音色数量不限,月度自定义额度 1 万到 20 万不等。

官网还展示了公开的精选自定义音色——如 Wesley Ford、Clara Vale、Asher Lane 这类现成可用的音色,同样消耗自定义额度池。

电子书转有声书

一项较新的能力可把电子书转成章节化的有声书,且四个档位包括免费档全部包含。考虑到免费档每月 1 万字符的上限,这里的「包含」更接近一次演示而非一条工作流——一本典型小说动辄几十万字符。到 Lite 档及以上才真正可用。

开发者接入

对这个体量的消费级工具而言,开发者接入面出乎意料地宽。存在三条独立通路:带公开文档的 REST API、可挂接支持 Model Context Protocol 的 AI 客户端的 MCP Server,以及 AI Skill。API 访问权限限 Plus 与 Enterprise 两档,免费档与 Lite 档不含。

输出与存储

音频以 MP3 下载,官方特意选它是因为多数设备无需转换即可播放。生成的音频在服务端保留 72 小时。这个留存窗口很短——把 Luvvoice 当作生成器而不是存储,生成后随手下载。

使用场景

YouTube 与 TikTok 的视频旁白

官方点名的目标渠道是 YouTube、TikTok、播客、教育与电视。短视频是最贴合的场景:一段 60 秒的脚本连免费档 3,000 字符的单次上限都塞得下,停顿控制让你能按剪辑点卡节奏,MP3 直接丢进任何剪辑软件。

播客制作与音频草稿

对播客作者而言,实际用途是片头、片尾、口播广告,以及在正式录制前用来检查节奏的旁白草稿。付费档单次 20,000 字符的上限,一次大约能覆盖 20 分钟的片段。

把文档与学习材料转成音频

对学生和任何有大量阅读负担的人来说,PDF 与 TXT 上传器是最有吸引力的功能——把讲义或论文转成音频,通勤路上听。有两个约束:扫描版 PDF 不做 OCR 用不了;月度字符额度才是真正的预算。

在线课程与教学素材

课程作者能在脚本变更时获得跨模块一致的旁白,而不必重新约配音演员。多语言覆盖让同一门课做本地化版本变得可行;可调语速在这个场景里比多数场景更重要——教学音频通常需要比日常对话更慢。

无障碍与朗读

把书面内容转成音频,服务于视障用户以及任何更擅长用耳朵接收信息的人。官网自己的用户评价里正好提到了这个用途。

语言学习

在 70 多种语言里听到正确发音,是庞大音色库的一个真实用途;可调语速则让学习者能把陌生语言放慢到跟得上的节奏。

用克隆做个人或品牌音色

对于想用自己的声音做旁白、却没时间录制的创作者,克隆是最关键的功能——但有一条重要的法律前提:你必须拥有或已获得所克隆声音的完整权利。详见限制章节。

如何使用 Luvvoice

第一步:先试用,再注册

首页编辑器无需登录即可使用,单次上限 3,000 字符。用它在目标语言里逐个试听音色,先判断音质是否达到你的标准,再决定是否继续投入。

第二步:为了停顿控制去注册账号

停顿功能在登录之后才开放,而停顿控制是旁白质量最大的一个杠杆。登录之后如果订阅,单次上限也会随之提高。

第三步:先选语言,再选音色

音色库覆盖 70 多种语言,但各语言的质量并不均匀。主流语言背后是成熟的 Azure 与谷歌神经网络音色;小语种可选项则可能少得多。请在你的具体语言里多试几个音色,不要按名字挑。

第四步:为耳朵写稿,而不是为眼睛

由于停顿是手动插入而非从标点推断的,请把句子写短一些,并在自然换气处刻意放置停顿。同时守住官方建议的单次不超过 20 个停顿。

第五步:留意数字、日期和网址怎么读

这是 TTS 最容易出错的地方,而这个服务恰好有一个有据可查的案例:有用户反映引擎把网址中的 /pay 读成了 /privacy。发布前务必完整听一遍输出,尤其注意缩写、网址、货币与日期。哪个词读错了,就在原文里按发音改写。

第六步:把长内容切块

免费档单次 3,000 字符、付费档 20,000 字符,做长内容就意味着要切块。请按章节或段落边界切,而不是按字符数硬切,好让每段的开头和结尾都是干净的。

第七步:立刻下载

文件只保留 72 小时。把下载这一步写进你的工作流,而不是把这个服务当图书馆。

第八步:订阅前先测,并且记住退款窗口

退款政策罕见地具体,值得刻意利用:一个字符都没用过时,可在 30 天内申请退款;使用少于 1,000 字符时,可在 7 天内申请。超过 1,000 字符就不退了。所以如果你是为了评估付费音质而订阅,请在这 1,000 字符的窗口内把评估做完。

使用技巧与最佳实践

  • 按字符而不是按分钟做预算。 这个平台上的一切都以字符计量。粗略换算,1,000 字符约合一分钟语音,所以免费档每月 1 万字符大致是十分钟量级的音频。
  • 投入额度前先测自定义音色质量。 有付费用户反映,即便用高质量降噪耳机录制样本,克隆出的音色仍明显不如平台现成音色。除非个人音色是刚需,否则现成音色是更稳妥的默认选择。
  • 别默认停顿到处都能用。 停顿工具栏是面向登录用户的文档化功能,但有付费客户反映自定义音色上无法使用停顿。在把工作流建立在这个功能上之前,先在自己账号里验证一遍。
  • 克隆样本不是越长越好。 同一位评论者观察到,长样本产出的效果反而不如短样本。建议从官方建议的 10 秒下限附近开始,做对比测试。
  • 禁用翻译类扩展。 官方承认浏览器扩展、尤其是翻译插件,可能导致生成失败并报「Something went wrong」错误。
  • 扫描版 PDF 先做 OCR。 纯图片构成的 PDF 提取不出文字。
  • 按你实际所在的档位核对商用权利。 首页 FAQ 对商用问题给的是笼统的「可以」,但定价对比表里「无限商用」只在 Plus 与 Enterprise 两档打勾。在免费档或 Lite 档上发布营收内容之前,请先看限制章节。
  • 先确认支付方式真的能用。 有用户反映官网宣称支持 PayPal,实际结账时只能刷信用卡。付款由 Stripe 处理。

适用人群

做短视频的内容创作者是最贴合的人群。脚本长度落在单次上限之内,主流 Azure 与谷歌音色的质量对社媒内容而言绰绰有余,入门成本为零。

学生与自学者能用上文档上传——这恰恰是不少工具要另外收费的功能。把阅读材料转成音频是实打实的时间回收,前提是守住月度字符预算。

教师与课程搭建者受益于一致的旁白与多语言本地化,无需重录。可调语速在这里也格外重要。

播客作者更适合把它用于辅助音频——片头、口播广告、节奏草稿,而不是整集旁白。

想在应用里接入简单 TTS 的开发者由 Plus 及以上档位的 API 与 MCP 服务器覆盖,但需要注意没有公开的速率限制与 SLA,且底层可能是在为 Azure 或谷歌付一层加价。

不太适合的是:专业有声书与商业配音制作方。72 小时留存窗口、单次转换上限、克隆质量的用户反馈,以及缺乏独立验证,都决定了这是一个做日常实用音频的工具,而非制作高端出版级作品的工具。需要顶级表现力合成的人应当去看专业厂商。

同样不合适的还有:需要用小语种做克隆的人。克隆支持的语言列表远比 TTS 列表短。

支持平台

网页端是主平台,地址 luvvoice.com,普通浏览器即可使用,无需安装。生成器、音色库、历史记录与定价都在这里。

iOS 有原生应用 LuvVoice: AI Text to Speech,发行方 Soundsynth Tech LLC,免费下载含内购。撰写时版本为 1.3,发布于 2026 年 7 月 7 日,要求 iOS 17.0 及以上。苹果把它归入「摄影与录像」主分类、「效率」次分类,年龄分级 4+。

安卓端在 Google Play 上架为 Luvvoice AI Voice,含内购,内容分级 Everyone,下载量区间显示为 1,000+。安卓端描述把产品概括为「文字转语音、语音克隆与有声书三合一」。

API 与 MCP 在 Plus 与 Enterprise 档提供程序化访问。其中 MCP 服务器值得一提——它让支持 Model Context Protocol 的 AI 助手可以直接调用语音生成。

请留意安卓端 1,000+ 的下载区间与官网「Trusted by 100,000+ users」自述之间的落差。如果两者都准确,那么绝大部分使用发生在网页端而非移动端。该用户数为厂商自报,未经独立审计。

价格与套餐

四个档位

套餐月付年付(折合每月)标准字符/月自定义额度/月
Free0 美元—10,000500
Lite8 美元4.75 美元(年计 57 美元)700,00010,000
Plus13 美元7.75 美元(年计 93 美元)1,500,00030,000
Enterprise45 美元27 美元(年计 324 美元)6,000,000200,000

官网标注年付省 40%。另有一次性购买选项,可在不订阅的情况下购买额度。付款由 Stripe 处理。

各档位真正的差别

功能FreeLitePlusEnterprise
单次转换字符数3,00020,00020,00020,000
自定义音色数量1无限无限无限
可用音色数200+300+300+300+
语言70+70+70+70+
无广告 / 无验证码—有有有
无限商用——有有
API 访问——有有
文件转写———有
文件存储—72 小时72 小时72 小时

这张表里有三行值得注意。

单次转换字符数是你每天都会感受到的约束。从免费档升到任意付费档,这个数字提高了近七倍。

广告与验证码在免费档是存在的。对免费服务来说这很正常,但如果你频繁生成,它会影响效率。

无限商用只出现在 Plus 与 Enterprise。Lite 虽然是付费档,却没有打勾。这与首页 FAQ 对商用问题不加限定的肯定回答之间存在张力,详见限制章节。

免费档的真实边界

直说:

  • 定价页写的是每月 10,000 字符(首页 FAQ 写的是 20,000——站点自相矛盾)
  • 单次 3,000 字符
  • 200 个以上音色,付费档为 300 个以上
  • 1 个自定义音色,配 500 自定义额度
  • 有广告与验证码
  • 无 API 访问
  • 含电子书转有声书,但字符预算限制了它的实际意义
  • 对比表中文件存储一栏免费档未打勾

退款政策很具体,订阅前请读一遍

这是同类产品中写得较为精确的一份退款政策,生效日期为 2026 年 6 月 6 日:

  • 一个字符未使用:扣费后 30 天内可退
  • 使用少于 1,000 字符:扣费后 7 天内可退
  • 使用超过 1,000 字符:不退,且完全不提供部分退款
  • 超过 30 天:一律不退
  • 每账户仅一次退款。 达到两次后,平台保留禁止该账户后续购买订阅的权利
  • 通过邮件提交请求,7 个工作日内处理
  • iOS 端购买由苹果退款,而非 Luvvoice。取消订阅或删除账号本身不会触发退款

实际结论是:你的评估窗口就是最初的 1,000 字符,请刻意用好它。

替代方案

ElevenLabs 是表现力质量上的参照物,在克隆与情感范围上更强,价格也更高。它在 Trustpilot 上是 3.1 分、约一千条评论——样本量远大于 Luvvoice 现有的任何数据。

微软 Azure AI Speech 与 Google Cloud Text-to-Speech 值得单独点名,因为 Luvvoice 正是跑在它们之上。如果你已有云账号且能处理 API 密钥,直连可以省掉中间层。你放弃的是界面、文档上传、音色试听与停顿工具——而这恰恰是 Luvvoice 收费的部分。

NaturalReader 面向相同的朗读与无障碍场景,在文档朗读上资历更久。

Fish Audio 是同一市场层级的另一家较小的参与者。

Luvvoice 作为免费 TTS 有竞争力的地方:低价位上的语言覆盖广度、一个确实可用的免费档、不设付费墙的文档上传,以及一份罕见地清晰的退款政策。不占优的地方:顶端的表现力质量、按用户反馈来看的克隆音色保真度,以及任何形式的独立验证。

限制与注意事项

「无字数限制」并不准确

站点自己的标题承诺无字数限制,而它的定价表与 FAQ 都给出了硬性上限。免费档在定价页是每月 1 万字符、在首页 FAQ 是 2 万字符——内部不一致——无论哪个口径,单次都是 3,000 字符。请按定价表来规划,并在账号内确认你的实际额度。

商用权利取决于你在哪一档

首页 FAQ 说:你拥有生成音频文件的完整所有权,可自由用于 YouTube 视频、播客、社交媒体内容或任何其他商业项目,只要合规。但定价对比表里,「无限商用」只在 Plus 与 Enterprise 两档打勾。

最自洽的解读是:产出物的所有权是普遍的,而无限商用是一项付费权益——但站点并没有把这两句话对齐,而「无限」这个词在做着未加解释的工作。如果你要发布营收内容,稳妥的做法是选 Plus,或者发邮件让支持团队就你的具体情况给出书面确认。

引擎相当程度上是第三方的

语音合成通过 Azure AI Speech、Google Cloud Text-to-Speech 与自有模型提供,随音色和语言而变。两点含义:主流语言的音质应当与那两个平台看齐;而 Luvvoice 的路线图部分取决于它无法控制的供应商。如果某家供应商变更条款或定价,下游受影响是有可能的。在条款里披露这一点,已经比多数转售方透明。

用户反馈稀薄,且现有的偏负面

任何地方都没有足够大或足够可靠的样本:

  • Trustpilot:2.2 分(满分 5 分),但只有 10 条评论——远低于让分数有意义的门槛。该档案未认领,且无邀请评价记录。作为参照,整个品类在该平台分数都低:ElevenLabs 3.1、Fish Audio 2.3、NaturalReader 1.6。
  • App Store:4.65 分,但仅 17 条评分——同样太小,不足以下结论。
  • Google Play:5.0 分、110 条评论,下载量 1,000+。

Google Play 上的满分 5.0 与 Trustpilot 上的 2.2 分差异极大。两个样本都不足以支撑一个确定的判断,这里把它们都如实列出,好让你自己权衡,而不是去相信某个单一数字。

比分数更有用的是具体、可核对的投诉。一位为商业用途购买了自定义额度的用户反映:

  • 自定义音色不支持插入停顿,导致节奏与语速难以控制
  • 克隆音色朗读出错,把网址片段 /pay 读成了 /privacy——读出了脚本里根本没有的内容
  • 即便用高质量降噪耳机录制,自定义音色的质量仍明显逊于平台现成音色,而且系统在长克隆样本上的表现似乎还不如短样本
  • 提交的工单完全没有得到回复

另一位评论者反映官网宣传支持 PayPal,实际结账却只接受信用卡。

这些是功能层面的具体描述而非情绪宣泄,所以尽管样本很小仍值得权衡。浮现出来的规律是:现成音色是这个产品的强项,克隆音色则是最该降低预期的地方。

不存在独立媒体报道

未能检索到任何权威科技媒体的报道或实测评估。检索结果由 SEO 内容站、工具推荐博客与竞品自撰的对比文章构成,均不构成独立验证。因此「200+ 音色」「100,000+ 用户」这类说法目前只有厂商一方的口径。这并不意味着它们是假的,只意味着没有人核查过。

语音克隆:法律风险全在你这边

条款写得很明确。你只能克隆自己拥有、或已取得全部权利、许可、授权与同意的声音。你不得把合成音频冒充某个真人的真实录音,除非依法有权且语境不具误导性;在法律、平台政策或合理受众预期要求披露时,你必须披露。

关键在于:除非另有书面说明,Luvvoice 不核验你是否已就语音克隆取得必要的权利或同意。 这里没有任何授权核验关卡。你须对所有语音样本、文本、生成音频、克隆音色模型及其下游分发承担全部责任,并就由此产生的索赔向 Luvvoice 与 Soundsynth Tech LLC 作出赔偿。

禁止用途范围很广

条款禁止欺诈、诈骗、钓鱼、身份盗用、社会工程、虚假代言与误导性广告;禁止骚扰、威胁、勒索与诽谤;禁止政治操纵、选民压制、欺骗性自动电话与妨碍紧急服务。执法手段包括移除内容、限制或终止账号、撤销对克隆音色与生成音频的访问权,严重或反复违规可不经警告直接永久封禁。

你授予了一项范围很宽的处理许可

你拥有自己的文本与音频产出,但你同时授予 Luvvoice 一项有限的、全球范围的非独占许可,用于托管、存储、传输、处理、复制、分析你的文本、音频、语音样本、克隆音色模型、生成音频、提示词与元数据,并创建技术衍生品——范围限于提供、维护、保障、排障、改进、计费与执行服务之合理必要。其中「改进」是值得留意的那个词。隐私政策没有就输入是否用于训练通用模型作出单独的明示声明,因此本页也不对此下任何方向的断言。

留存期为 72 小时

生成的音频保留 72 小时,请及时下载。

已知的技术性失败情形

官方记录了两项:扫描版或纯图片 PDF 可能提取不出文字;浏览器扩展、尤其是翻译插件,可能导致生成报错。

终止是双向且即时的

任何一方均可随时通知对方终止协议,终止后访问权即告结束。服务与生成音频按现状提供,在法律允许的范围内不作担保。

常见问题(FAQ)

Q1. Luvvoice 真的免费且无字数限制吗?

它确实可以免费使用,但「无字数限制」不准确。定价页写明免费方案每月 10,000 字符,而首页 FAQ 写的是 20,000——站点自相矛盾。无论哪个口径,都另有一个更紧的限制:免费档单次转换 3,000 字符,在编辑器上以 0 / 3000 的计数器显示。付费档把单次提到 20,000,月度额度提到 70 万至 600 万字符不等。

Q2. 生成的音频可以商用吗?

首页 FAQ 给的是不加限定的肯定:你拥有生成文件,可用于 YouTube 视频、播客、社交媒体或任何商业项目,只要合规。但定价对比表把「无限商用」只标在 Plus 与 Enterprise 两档。看起来产出物所有权是普遍的,而无限商用是付费权益,站点并未把两者对齐。对于营收内容,选 Plus 或让支持团队书面确认是稳妥路径。

Q3. 支持多少语言和音色,质量如何?

70 多种语言,免费档 200 个以上音色、付费档 300 个以上。质量的背景很重要:条款披露语音由微软 Azure AI Speech、Google Cloud Text-to-Speech 与自有模型生成,随音色和语言而变。主流语言下你听到的很大程度上就是 Azure 与谷歌的神经网络音色,水准不错。定下来之前,请在你的具体目标语言里试听。

Q4. 语音克隆要多少钱,效果怎么样?

克隆使用独立的自定义额度池:免费档 500 额度、1 个自定义音色;Lite、Plus、Enterprise 分别为 1 万、3 万、20 万额度且音色数量不限。流程需要一段最好超过 10 秒的音频样本。关于效果请降低预期——有付费用户反映,即便用高质量录音,克隆音色也明显不如平台现成音色,并反映自定义音色上无法使用停顿。克隆的语言支持也比 TTS 窄:官方点名的主要语言是英语、日语、韩语、中文、法语、德语、阿拉伯语与西班牙语。

Q5. 可以转换 PDF 等文档吗?

可以。支持 PDF、TXT 等常见格式,官方称可上传数十万字符的文档。两个约束:转换仍然消耗你的月度字符额度;扫描版或纯图片 PDF 可能提取不出文字,这类需要先做 OCR。

Q6. 文件会保存多久?

生成的音频保存 72 小时。请随生成随下载,不要把这个服务当图书馆用。

Q7. 如果不合用,能退款吗?

可以,但边界划得很紧。一个字符未使用:30 天内可退。使用少于 1,000 字符:7 天内可退。超过 1,000 字符不退,且完全不提供部分退款。超过 30 天一律不退。每账户仅一次退款,达到两次可能被禁止后续购买。iOS 端购买由苹果退款,取消订阅或删除账号本身不会产生退款。请在最初 1,000 字符内完成评估。

Q8. 有 API 吗?

有,但仅限 Plus 与 Enterprise。此外还有面向支持 Model Context Protocol 的 AI 客户端的 MCP Server,以及 AI Skill。撰写时未能取得公开的速率限制与服务等级保证,因此在构建任何依赖它的系统前,请先与支持团队确认需求。

Q9. 有移动应用吗?

两个平台都有。iOS 端为 Soundsynth Tech LLC 发行的 LuvVoice: AI Text to Speech,免费含内购,要求 iOS 17.0 及以上,分级 4+。安卓端为 Google Play 上的 Luvvoice AI Voice,含内购,分级 Everyone,显示下载量 1,000+。

Q10. 用它克隆别人的声音安全吗?

只有在你获得对方许可并依法有权时才可以。条款要求你对所克隆的任何声音拥有或持有全部必要的权利与同意,不得把合成音频冒充某个真人的真实录音,并在法律或平台政策要求时披露 AI 生成。重要的是,Luvvoice 不核验你是否取得了这些同意——没有任何关卡阻止滥用,这意味着包括向该公司作出赔偿在内的全部法律风险都落在你身上。

发现类似工具?
如果你知道其他优秀的AI工具,欢迎提交给我们