SRT 转音频转换器,配备免费 AI 语音

4.4 · 18 条评分

将 SRT 字幕文件转换为带有自然 AI 语音的语音音频,并选择格式:MP3、M4A 或 WAV。免费、无限制、无需注册。

将字幕文件拖放到这里

或点击浏览

支持的格式: SRT, VTT, ASS, SSA, SBV, SUB, SMI, SAMI, LRC, TTML, ITT, DFXP

已选择:女性声音 1

拖放一个 SRT 或 VTT 文件来生成配音。

生成配音需要一次性下载 232.1 MB 的语音模型。它会存储在你的设备上,之后生成配音时会跳过下载步骤。
SubtitleKit mascot

工作原理

  1. 1放入 SRT 或 VTT 字幕文件。
  2. 2选择语言和语音。在提交前预览任何语音或任何单行。
  3. 3生成,然后将配音下载为 MP3、M4A 或 WAV。

完全在你的浏览器中运行。

SRT 转音频转换器,采用免费 AI 语音

将任何 SRT 字幕文件转换为语音音频,直接在浏览器中完成,然后选择适合你的输出格式,无论是 MP3、M4A 还是 WAV。上传你的文件,选择语言和 10 个 AI 语音中的一个,每个字幕条都会大声朗读并与原始时间同步。免费、无限制,无需安装任何软件。

什么是 SRT 转音频转换器?

SRT 转音频转换器用合成语音大声朗读字幕文件的字幕条,生成独立的音频轨道而不是屏幕上的文本,输出格式由你选择而不是固定为一种编码。SubtitleKit 使用单个 AI 语音进行每次导出(一种"旁白员"风格,类似于纪录片和有声书),与每个字幕条的原始时长同步,由在浏览器内运行的语音模型生成,这就是为什么在工作时没有按字符计费的计量器。

SRT 转音频转换的工作原理

你的 SRT 文件的字幕条(文本和时间)逐个传递给浏览器标签页内运行的 AI 语音模型。每个字幕条的旁白会被拉伸或压缩以适应原始字幕条的时长,因此完成的音频从头到尾都与源字幕保持一致。由于模型在这里运行而不是在租用的服务器上,两小时的字幕文件的成本与两分钟的完全相同。

免费、无限制、无需账户。唯一需要计划的是首次运行:一个 383 MB 的 AI 语音模型会下载一次,然后保存在缓存中,因此之后的每次转换都会立即开始,无需互联网连接。

如何将 SRT 转换为音频

  • 首先选择你的输出格式(MP3、M4A 或 WAV),然后上传你的 SRT 文件。VTT、ASS、SBV 和 SUB 也可以使用。
  • 设置语言和语音。选择旁白语言和 10 个 AI 语音中的一个,并在生成之前在真实字幕条上预览。
  • 生成音频。首次运行时会下载一个一次性的 383 MB 语音模型;之后你的浏览器会朗读每个字幕条,与其时间同步。
  • 以你选择的格式下载。MP3 用于通用播放,M4A 用于较小的 Apple 友好文件,或 WAV 用于无损质量。

你需要什么

只需要 SRT 文件。其他一切,包括你最终使用的音频格式,都在工具内决定。

字幕文件

  • SRT 是主要格式,但 VTT、ASS、SBV 和 SUB 字幕文件的工作方式完全相同。
  • 不需要视频或音频文件,只需要字幕条文本和时间。
  • 支持31种语言的朗读,涵盖拉丁文、西里尔文、希腊文、阿拉伯文、梵文、日文和韩文字符,在欧洲有深度覆盖,同时支持阿拉伯文、印地文、印尼文、越南文、日文和韩文。

你的音频格式选择

  • MP3 用于最广泛的兼容性,M4A 用于较小的 Apple 友好文件,或 WAV 用于无损质量。
  • 每个字幕条都与其原始字幕时长相匹配,无论你导出哪种格式。

为什么这个 SRT 转音频转换器与众不同

大多数 SRT 转音频服务将你限制在一种输出格式,按字符计费,并在免费层上添加水印。

  • 三种格式,一次转换。将相同的旁白导出为 MP3、M4A 或 WAV,无需重做任何工作。
  • 10 个自然 AI 语音,五个女性和五个男性,在真实字幕条上进行了试听,然后再提交完整文件。
  • 字幕条精确时间。旁白节奏自动适应每个字幕条的原始时长。
  • 免费无上限。无需账户、无按字符计费、无水印,转换文件数量无限制。

谁使用这个工具

视频编辑

从字幕文件生成 WAV 格式的草稿旁白轨道用于无损编辑,或 MP3 用于快速审查。相同的转换,不同的输出。

内容创作者和播客主

将你已有的 SRT 脚本转换为旁白音频,快速从现有字幕生成配音或播客剧集。

无障碍访问

为依赖音频而不是阅读字幕的人制作字幕内容的仅音频版本,使用你需要的语言和格式。

语言学习者

将字幕文本转换为语音音频,按自己的节奏练习听力理解,缓存语音模型后可离线使用。

常见问题

这个 SRT 转音频转换器免费吗?

是的,完全免费,无水印、无账户、无按字符或按分钟计费。它在你的浏览器中运行,唯一的成本是首次使用时一次性下载 383 MB 的语音模型。

我应该选择哪种音频格式?

MP3 可在任何地方使用,是最安全的默认选择。选择 M4A 用于较小的 Apple 友好文件,或 WAV 用于无损质量以进行进一步编辑。

我需要安装 SRT 转音频转换器程序吗?

不需要。这是一个在浏览器标签页内运行的在线转换器,因此无需下载或安装任何东西。Windows、macOS、Linux 和 ChromeOS 的行为方式完全相同。

有多少种语言和语音可用?

10个AI语音,5个女性和5个男性,覆盖31种语言,涵盖拉丁文、西里尔文、希腊文、阿拉伯文、梵文、日文和韩文字符,在欧洲有深度覆盖。每个语音都可以在真实字幕上预览。

音频仍然会与我的字幕对齐吗?

是的。每个字幕条都被朗读以适应其自己的开始和结束时间,因此导出的轨道和原始 SRT 保持同步。如果一行会超过其时间槽,旁白会略微收紧而不是偏离。

SRT 转音频和 SRT 转 MP3 有什么区别?

只是输出格式。SRT 转 MP3 页面是相同的转换,MP3 预先选定;这里你在下载之前在 MP3、M4A 和 WAV 之间选择。

获得最佳效果的提示

不确定选择哪种格式?MP3 是最安全的默认选择;只有在你计划稍后重新编码音频时才选择 WAV。

在转换之前先清理 SRT 中的拼写错误或尴尬措辞。AI 语音会精确朗读写入的内容。

在生成完整文件之前,在真实字幕条上预览语音,这样你就不会等待一个需要重做的转换。

长字幕条听起来可能很仓促。缩短一行可以保持旁白节奏自然,无论输出格式如何。