免费文本转语音,采用自然 AI 语音

将任何文本转换为自然流畅的语音,并下载为MP3、M4A或WAV。免费、无限制、在线使用,支持31种语言和10个AI声音。

  1. 1编写你的脚本
  2. 2选择语音
  3. 3获取音频

已选择:女性声音 1

在上面写入或粘贴你的脚本,然后按"生成"。

生成配音需要一次性下载 232.1 MB 的语音模型。它会存储在你的设备上,之后生成配音时会跳过下载步骤。
0 / 20,000

像"ADA: 你好"这样的行会使用各自的语音。

免费文本转语音,自然 AI 声音

SubtitleKit的文本转语音工具可以用自然的AI语音朗读你粘贴的任何内容,并为你提供音频文件。输入或粘贴你的文本,选择31种语言中的一种和10个声音中的一个,然后将结果下载为MP3、M4A或WAV。一切都在你的浏览器中运行,这就是为什么它是免费且无限制的,无需账户,无字符配额限制。

文本转语音在这里的工作原理

你的文本被分成几行,每一行由在你自己的机器上运行的 AI 语音模型朗读。然后这些行首尾相连,中间有短暂停顿,你留下的空行处有更长的停顿,所以你输入的段落换行变成你听到的呼吸空间。完成的音频在浏览器标签页中组装,直接交给你作为 MP3、M4A 或 WAV 文件。

免费、无限、无需注册、无水印。唯一的等待是第一次运行,当时 383 MB 的 AI 语音模型下载一次并被缓存。之后的每次访问都会立即开始,生成语音时无需互联网连接。

如何将文本转换为语音

  • 粘贴你的文本。最多 20,000 个字符,约 24 分钟的语音。
  • 选择语言和声音。31种语言和10个AI声音,每个都可以在提交前预览。
  • 生成语音。第一次运行需要下载一次 383 MB 的 AI 语音模型。之后一切都可以离线工作。
  • 下载音频。默认为 MP3,或先切换到 M4A 或 WAV。

什么是文本转语音转换器?

文本转语音转换器使用合成语音将书面文字转换为语音。大多数在线转换器限制你只能使用几千个字符,在免费层上加水印,并要求你在交付 MP3 之前创建账户。这个转换器在你的浏览器中运行语音模型,这就是为什么没有注册、没有按字符计量,也没有你下载的文件上的水印。

31种语言的文本转语音

每个语音都支持所有语言,因此叙述者的选择永远不会受到你所选语言的限制。31种语言涵盖拉丁文、西里尔文、希腊文、阿拉伯文、梵文、日文和韩文字符,在欧洲有深度覆盖,同时支持阿拉伯文、印地文、印尼文、越南文、日文和韩文。所选语音无法读取的文本(例如英文语音下的西里尔文文本)会在生成前被标记,而不是之后被转换成乱码。

一个文件中的多个声音

在一行的开头以名字和冒号开头,如 ADA: Good morning.,该名字被视为一个角色。每个角色自动获得自己的声音,在男性和女性之间交替,所以两个说话者听起来永远不会相同,你可以在生成前重新分配任何一个。名字本身不会被朗读。它也适用于括号标记([ADA]),并且需要至少两个名字在两行上各出现一次,然后才能决定你的文本是脚本而不是散文。

你会得到什么

  • 你的文本朗读的 MP3,随时可以使用。
  • M4A,如果你想要相同质量的较小文件。
  • WAV,如果你需要未压缩的音频以供进一步编辑。

为什么这个文本转语音工具与众不同

大多数免费文本转语音网站是围绕付费云 API 的薄包装,这就是注册墙、字符限制和水印的来源。这个没有服务器账单要转嫁。

  • 无注册、无配额、无水印。没有账户要创建,也没有按字符计量运行。
  • 31种语言,包括德语、印地语、日语和阿拉伯语。每种语言都有全套10个声音,每个都可以下载为MP3。
  • 10 个自然 AI 声音。5 个女性声音,5 个男性声音,每个都可以在生成任何内容前预览。
  • 多个声音的对话。具有命名部分的脚本会自动投射,每个角色一个声音。
  • 设置后可离线工作。一旦一次性语音模型下载完成,你可以完全不需要互联网连接生成语音。

预期什么

唯一真正的成本是第一次运行。383 MB 的 AI 语音模型必须在生成任何语音之前下载,在慢速连接上需要几分钟。之后它会被缓存,所以之后的每次访问都会立即开始。生成本身很快但不是瞬间的,长脚本在旧笔记本电脑或手机上比在台式机上需要更长时间。20,000 字符的限制存在是为了让单个文件舒适地保持在浏览器标签页一次可以呈现的范围内。

谁使用这个工具

内容创作者和播客

将书面脚本转换为旁白音轨,无需预订录音棚,或生成初稿旁白来测试节奏,然后再进行正式录音。

无障碍访问

为偏好或需要听觉的人生成文章、说明或任何书面材料的语音版本。

语言学习者

听由母语级别的声音用31种语言中的任何一种朗读文本,然后下载MP3离线再听一遍。

作家和编辑

听你自己的初稿被朗读出来。尴尬的句子和重复用耳朵比用眼睛更容易发现。

常见问题

这个文本转语音工具真的免费吗,使用它需要多少费用?

它是免费的、无限制的,没有水印或账户。没有服务器在工作,所以没有计量,也没有按字符或按分钟的价格。唯一的成本是第一次使用时的一次性383 MB语音模型下载。

它可以说哪些语言?

31种语言,涵盖拉丁文、西里尔文、希腊文、阿拉伯文、梵文、日文和韩文字符,在欧洲有深度覆盖,同时支持阿拉伯文、印地文、印尼文、越南文、日文和韩文。所有10个语音都可用于这些语言中的每一种。

我可以将语音下载为MP3吗?

可以。每个生成的内容都可以下载为MP3,如果你需要较小的文件或未压缩的音频,M4A或WAV也可用。没有水印,没有下载限制,这使得这个工具既是文本转MP3转换器,也是阅读器。

文本可以有多长?

每个文件最多20,000个字符,大约24分钟的语音。对于更长的内容,请分割并生成两个文件。

我可以为不同的角色使用不同的声音吗?

可以。在每一行前加上名称和冒号,所以一行读"ADA: Good morning."会将ADA作为一个角色,每个名称都会自动获得自己的声音。你可以在生成前更改任何一个,名称本身不会被朗读。

我需要安装任何东西吗?

不需要。它在浏览器标签页内运行,所以没有程序要下载,也没有什么需要保持更新。Windows、macOS、Linux、ChromeOS和现代移动浏览器都可以工作,尽管长脚本在笔记本电脑上的渲染速度比在手机上快。

我可以商业使用音频吗?

可以。你生成的任何内容都是你的,可以按任何方式使用,包括商业用途。SubtitleKit对其不主张任何权利。

获得最佳效果的提示

使用空白行来暂停。段落之间的空白行在音频中会产生更长的停顿,这是控制节奏的最简单方法。

拼写出你想要以特定方式说出的任何内容。如果应该这样发音,写"twenty twenty six"而不是"2026"。

在生成长脚本之前预览一个声音。试听只需一秒钟,完整渲染则不然。

写对话?在每一行前加上角色名称和冒号,每个部分会自动分配给自己的声音。