Toolso.AI
Toolso.AI
所有工具分类热门榜单最新工具价格博客
Toolso.AI
Toolso.AI

💌订阅 AI 工具周报

每周精选最新、最热门的AI工具和行业动态,直达您的邮箱 订阅

Toolso.AI
Toolso.AI

发现最好的AI工具,提升你的工作效率

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

热门分类

  • AI写作
  • AI图像
  • AI视频
  • AI编程
  • 更多分类

探索发现

  • 最新收录
  • 热门推荐
  • 更多工具
  • 提交工具
  • 价格

关于

  • 关于我们
  • 联系我们
  • 博客
  • 更新日志

法律

  • Cookie政策
  • 隐私政策
  • 服务条款
  • 退款政策
© 2026 Toolso.AI 保留所有权利
限时推广限时推广加速推广24h 优先审核 · 无需反链 · 30 天推荐展示$29.90到期后 $59.9010月31日后涨价至 $59.90距结束--:--:--立即提交
  1. 首页
  2. 所有工具
  3. 语音技术
  4. Speechgen.io
Speechgen.io界面预览
Speechgen.io标志

Speechgen.io

基于浏览器的文字转语音工具,提供 5,000 多种音色、多人对话、与字幕同步的音频、声音克隆和 API,通过一年有效的点数包付费,而不是按月订阅。

语音技术语音生成音频生成#文字转语音#声音克隆#转录
查看定价
收藏
访问次数
浏览次数
定价
付费
发布日期
2026年10月5日
域名
speechgen.io
用户评分

用过这个工具吗?给它评分

为这个工具评分

Speechgen.io 工具信息

查看定价
工具信息
收藏
访问次数
浏览次数
定价
付费
发布日期
2026年10月5日
域名
speechgen.io
用户评分

用过这个工具吗?给它评分

为这个工具评分

推荐工具

相关工具推荐

查看定价

Speechgen.io 是什么?

Speechgen.io(自家页面上也写作 SpeechGen.io 和 SpeechGen)自称是拥有 5,000 多种逼真音色的在线 AI 语音生成器。在网页编辑器中输入的文字,或取自文档、字幕文件的文字,都会转成可下载的音频。

网站称支持 150 种语言,可导出 MP3、WAV 和 FLAC。点数包一次性付费,没有订阅也不自动续费,这是它与按月计费的文字转语音套餐的主要区别。

支持页面列出的是 Bueno Limited,收款地址位于香港北角。隐私政策则把数据控制者称为「the Operator」(运营方),正文中没有写出公司名称。

免费额度、退款规则和最大文本长度在不同页面上说法不一,这些出入在「价格套餐」和「注意事项」中说明。

核心功能

Speechgen.io 把旁白、对话、时间控制和音乐控制集中在同一个浏览器编辑器里。

音色与质量档位

  • 三个档位:音色可按性别、口音以及 Standard、HD 或 PRO 质量档位筛选,每个档位消耗点数的速率不同。
  • 免费试听:可用自己的文字预览音色、语速和音高的组合,网站称试听样本不扣字符。
  • 语调曲线:音色库中超过一半的音色(含普通音色和 PRO 音色)提供语调曲线,拖动曲线上的点即可升高或降低所选词语的音高。
  • 具名角色音色:类型页面涵盖恐怖、儿童和卡通风格;网站称其 Brian 音色是由 IVONA 创建、后来被 Amazon Polly 收购的英式 Brian 音色的「现代 AI 对应版本」。

在本轮查看的页面中,Speechgen.io 没有说明各档位背后使用的语音引擎。

编辑器控制

  • 语速与音高:语速范围为 x0.1 至 x2.2,音高为 -20 至 +20,步长为 2。
  • 停顿:句间和段间的默认停顿可分别设为 150 毫秒至 30 秒。
  • 多位说话人:可用名称标签为不同段落指定不同音色,访谈或多角色内容可导出为单个文件。
  • 背景音乐:可从内置 AI 音乐库选曲,或上传自己的音乐,不离开编辑器就能混在人声下方。

长文本与字幕工具

  • 分章文件:在单独一行输入分割标签,每一段都会导出为单独的音频文件。
  • 分段上限:单次生成最多允许 1,000 个短分段或 500 个长分段,更长的书需要分多次生成。
  • 字幕定时音频:上传的 SRT 或 VTT 文件会按每行的精确时间码逐行配音,生成的音频放进视频编辑器时已经同步。

智能缓存

每个已生成的句子会在缓存中保留 7 天,重新生成时只对新增或修改的句子计费。因此在长脚本中改一个词,只需支付该句的费用,而不是整篇文本。

声音克隆

用 10 到 60 秒的清晰语音即可建立个人声音模型,支持 15 种语言:九种标记为稳定,六种为实验性。

转写

首页称音频转写支持 140 种语言,带说话人标签和时间戳。价格页则为同一功能列出最大 1 GB 或 3 小时的上传、「150+」种语言以及 SRT 或 VTT 字幕导出,两个页面的语言数量不一致。

使用指南

在 Speechgen.io 中在线文字转语音要按固定顺序操作,因为有些修改会再次消耗字符。

  1. 先选语言。 官方指南要求先选择文本语言,之后才会打开该语言的音色列表。
  2. 选择音色。 做多语言内容时,Ava_US、Ava_ES 这类编码的音色能在不同语言中保持同一个可辨识的声音,对对话项目有帮助。
  3. 粘贴或上传文本。 可输入纯文本、DOCX、PDF 和 SRT 文件。
  4. 首次生成前定好语速和音高。 调整语速或音高会触发完整的重新生成,并再次消耗字符额度。相比之下,句间和段间停顿可以修改而不消耗额度。
  5. 生成前选好输出格式。 默认下载 MP3;如需 WAV、OPUS 或其他采样率,必须先选择并重新生成语音,才能下载该文件。

使用场景与示例

首页用客户示例说明其市场。这些是厂商描述的案例,并非独立测试。

  • 电话菜单与 IVR:一个例子是为亚特兰大一家拥有五家诊所的兽医连锁机构制作英语和西班牙语双语电话菜单,以 64 kbps MP3 交付,约 30 秒即可完成更新。
  • 按渠道选择码率:网站的质量指南将 8–64 kbps 对应电话、IVR 和标牌,64–128 kbps 对应 YouTube、播客和在线学习,192–320 kbps 对应广播用途。
  • 在线学习练习:一个西班牙语双语练习在同一段录音中混合英语和西班牙语,并按课程从单个脚本拆分为 50 个 MP3 文件。
  • 工作场所安全警报:另一个案例通过 API 为一座 15,000 m² 的仓库触发六种语言的广播安全警报。
  • 本地化语音导览:一个展览语音导览通过一次 SRT 上传本地化为五种语言,每种语言选用不同音色。

适用人群

Speechgen.io 适合音频需求集中爆发的买家。价格页问道「既然不是每月都用,为什么要按月付费?」,并称点数包最长可保持一年有效。

可能适合

  • 视频创作者:网站称 AI 配音文件可通过 Premiere Pro、DaVinci Resolve 和 CapCut 等编辑器用于 YouTube、TikTok 或 Reels 项目。
  • 预算有限的多语言项目:Standard 音色被描述为最经济、覆盖语言范围最广的档位。

不太适合

  • 想克隆声音的未成年人:声音克隆要求用户年满 18 岁,即使有家长同意也不行。
  • 以模仿真实公众人物为核心的项目:「注意事项」中的内容规则限制政治人物和公众人物的声音。
  • 需要宽泛退款保障的买家:退款条款很窄,而且官方页面之间说法不一。

支持平台

  • 网页编辑器:Speechgen.io 在浏览器中运行,无需安装软件。
  • 移动浏览器:声音克隆工具可在桌面、平板和手机的浏览器中使用。在本轮查看的页面中,没有提供原生桌面或移动应用。
  • REST API:使用 API 需要付费账户。/text 方法对最多 2,000 个字符立即返回音频,/longtext 则通过轮询任务 ID 处理最多 1,000,000 个字符。
  • 时间戳:/subs 方法与 /longtext 类似,但还会返回字幕时间戳,用于让音频与视频或幻灯片对齐。
  • 无代码自动化:REST API 通过一次 HTTP 调用返回音频 URL,据网站称可与 n8n、Make 和 Zapier 配合使用。
  • WordPress:一款免费插件可为 WordPress 网站上的文章配音,但只能通过压缩包安装,不在 WordPress 插件目录中,且需要 Speechgen 的 token 才能运行。

价格套餐

Speechgen.io 出售六种一次性点数包,从 $4.99 的 25,000 点到 $599.99 的 10,000,000 点。

点数包价格页面显示的标签估算 AI 语音时长
25,000 点$4.99无约 60 分钟
65,000 点$9.99划线价 $13,23% 折扣约 155 分钟
200,000 点$24.99划线价 $40,38% 折扣约 476 分钟
500,000 点$49.99划线价 $100,50% 折扣约 1,190 分钟
2,000,000 点$149.99划线价 $400,63% 折扣约 4,762 分钟
10,000,000 点$599.99划线价 $2000,70% 折扣约 23,810 分钟

页面没有解释划线参考价代表什么。分钟估算以平均每分钟约 140 个单词的英文文本为前提。

  • 换算比例:1 点可换 2 个字符的 Standard 语音、1 个字符的 Pro 语音或 0.5 个字符的 HD 语音。
  • 计费单位:按字符计费,空格和标点也计算在内。
  • 有效期:点数自购买起一年有效;再次购买会叠加剩余余额,并重新开始一年计时。
  • 每个点数包都包含:商用授权、API 访问、全部音色、智能缓存和 30 天历史记录。
  • 同一余额:同一份点数可用于文字转语音、转写或两者兼用。
  • 付款与发票:接受 Stripe 和 PayPal,发票可自定义公司名称、地址和增值税号。

免费额度

首页描述了三级免费阶梯:未注册账户可用 1,000 个字符,免费注册时再得 2,000 个,之后 7 天内每天 3,000 个字符。隐私政策则描述了 5 Limits 的测试资费,以及用 gmail.com、yahoo.com 或 hotmail.com 地址注册后获得 1,000 个免费 Limits。页面没有调和这两种说法。

声音克隆费用

创建一个克隆需 2,000 点,存储每天 250 点,合成按 HD 费率计费。声音克隆没有免费档;删除克隆即停止收取存储费用。

Speechgen.io 的替代方案

Speechgen.io 把自己的点数包与按月计费的套餐对比,称那些套餐无论是否使用都要每月 $22–$99。在一个产品发现平台上与它并列的两款订阅产品,展示了这种取舍的另一面。

  • ElevenLabs:ElevenLabs 提供按月或按年计费的套餐,包括每月 $0 的 Free 套餐。其 Starter 套餐被列为包含 Free 的全部内容,外加商用授权和即时声音克隆,而 Speechgen.io 的免费使用也附带商用授权。
  • Wondercraft:Wondercraft 提供 AI 播客生成器,可策划、录制并自动剪辑带音乐和章节的节目。它按月或按年计费,有每月 $0、含 150 点数的 Free 套餐。

Speechgen.io 适合需要点数长期可用的不定期批量任务;订阅产品适合稳定的按月产出或播客式剪辑。

注意事项

若干关键限制来自 Speechgen.io 自家页面之间的相互矛盾。

相互冲突的数字

  • 最大文本长度:首页称可粘贴最多 1,000,000 个字符,也可上传 DOCX、PDF 或 SRT 文件。
  • 别处的更高上限:分步指南写明每次生成最多 2,000,000 个字符。
  • 音色数量:首页一段简介仍称提供数十种音色和语言,与其他地方使用的 5,000+ 数字不符。

输入与输出限制

  • 符号:指南提醒,表情符号和颜文字可能干扰音频生成。
  • SSML 支持范围:不同音色支持的 SSML 标签集合不同。

退款、账户与可靠性

  • 退款页面:退款政策页面称未使用的 token 不予退款。
  • 隐私政策中的例外:但隐私政策允许在购买后 24 小时内申请退货,前提是使用量不超过 3,000 个字符。
  • 单一账户:禁止创建多个账户。
  • 服务中断:该公司在第三方点评平台上的回复中称,2025 年 9 月的一次故障导致网站无法访问,后来又称 3 天内已运行精简版本,5 天内恢复全部功能。
  • 用户评分:据 2026 年 10 月 5 日的抓取,一个第三方点评平台显示公司层面 21 条评价的平均分为 3.0,其中 53% 为五星、14% 为一星;样本这么小只能作为方向参考。

法律文本缺口

  • 未找到主条款:声音克隆条款把适用法律交由「SpeechGen 主服务条款」规定。在本轮查看的页面中(包括网站的站点地图),没有找到单独的通用条款页面,而克隆条款自身的链接又指回克隆条款。
  • 提到另一个域名:DMCA 页面提到的是发布在 naturalvoice.io 上的内容,而不是 speechgen.io 上的内容。
  • 核验:克隆条款称,该服务不会预先核验上传的音频、用户身份或所声称的同意。声音克隆页面则把「需要年龄验证」的未满 18 岁用户列入禁止事项。

隐私与权利

  • 商业使用:Speechgen.io 称所有免费和付费方案都附带商用授权,用户拥有自己生成的音频文件。
  • 文本版权:隐私政策对配音文件的使用(包括商业用途)不设限制,但仍须尊重源文本的版权。
  • 政治人物声音:不得使用该服务模拟政治人物或政府官员的声音或形象,即使获得其同意也不行。
  • 其他禁止用途:规则禁止在未获明确许可的情况下冒充任何人,也禁止用于色情露骨的应用。
  • 收集的数据:隐私政策将电子邮件地址列为个人数据,并称会通过 Google Analytics 等统计服务收集匿名访客数据。在本轮查看的页面中,它没有说明提交的文本是否用于训练模型。
  • 文件保留:注册用户的文件保留 30 天,未注册用户的文件保留 24 小时,之后历史记录会被不可恢复地删除。
  • 收藏:指南列出 7 天句子缓存、30 天项目历史和收藏文件永久保存,而隐私政策的 30 天删除规则没有提到这一点。

声音克隆规则

  • 同意:克隆他人声音需要明确、知情并留有记录的书面同意,且须在克隆存续期间及删除后至少两年内保存。
  • 应要求提供证明:Speechgen.io 可能要求出示同意证明,若 7 天内未提供有效文件,将删除该克隆。
  • 受限声音:不得克隆现任国家元首、高级官员、法官、选举候选人、未获遗产管理方授权的已故人士,以及克隆可能被理解为背书、冒充或诽谤的公众人物。
  • 所有权:用户保留其上传样本以及用其声音模型合成的音频的所有权。
  • 授权范围:用户授予 Speechgen.io 使用样本和模型的许可,仅用于为其运营服务,包括改进其本人的声音模型。
  • 训练禁令:克隆条款禁止使用生成的音频训练或改进第三方声音模型或竞争产品。
  • 处理地点:声音样本和模型可能在 Speechgen.io 选定的任何司法管辖区的服务器上处理。
  • 删除时间:克隆条款规定,已删除的模型会在 30 天内从活动系统中移除,备份按标准轮换清除。声音克隆页面则称删除是即时的,并会永久移除模型。

FAQ

Q1. Speechgen.io 的音频可以商用吗?

可以,据网站所说:免费和付费使用都包含商用授权,隐私政策还补充说仍须尊重源文本的版权。

Q2. Speechgen.io 的点数会过期吗?

会。点数自购买起有效一年,再购买一个点数包会结转剩余余额并重新计时。

Q3. 我可以克隆别人的声音吗?

只有取得对方留有记录的书面同意才可以,而且不能克隆现任国家元首、法官或选举候选人等受限群体。用户必须年满 18 岁。

发现类似工具?
如果你知道其他优秀的AI工具,欢迎提交给我们