← 返回科研导航

TextToSpeech 文字转语音

浏览器语音合成 · 多语言发音人 · 语速音调可调

English 简体 繁體

文本

0 / 2,500 字符

语言与发音人

语言列表来自你的浏览器与操作系统实际提供的语音;不同浏览器给的不一样,Chrome 有 Google 网络语音,Edge 与 Windows 自带自然语音。

选中语言后可用的发音人会列在这里。带云端标记的发音人由浏览器自己的服务合成,本站不经手任何文本。

朗读参数

1.00×

0.5 到 2 倍速。听外语材料时 0.8 左右最清楚,赶进度可以 1.5。

1.0

0 低、1 原调、2 尖。多数发音人在 0.8 ~ 1.2 之间最自然。

100%

该发音人的输出音量,与系统音量相乘。

试听

准备就绪:选好发音人,点「生成朗读」即可。

Web Speech API 不把合成后的音频暴露给网页,所以本工具只能播放、不能导出 MP3;需要音频文件请找带服务端合成的站点(如参考的 crikk.com)。

这是什么工具

TextToSpeech 对标 crikk.com/text-to-speech,把「贴文本 → 选发音人 → 出语音」这条流搬进了浏览器:输入或粘贴最长 2500 字符的文字,从当前浏览器提供的发音人里挑一个(中文、英文以及其它系统已装语言),再调语速、音调和音量,点「生成朗读」就能把文本读出来,中途可以暂停、继续或停止。长文会按句号、问号等标点自动切成小段逐段朗读,避开 Chrome 读长句读到一半静音的老毛病。

与参考站最大的不同是「引擎」:Crikk 用自己的服务器合成音频再给下载,本站则完全调用浏览器自带的 Web Speech API——发音人来自你的浏览器与操作系统,合成在本地或浏览器自己的云端完成,文本不经过本站服务器,因此没有配额、不限次数、也不支持导出 MP3(网页拿不到这条音频流)。换来的是零等待、零上传、打开即用。

功能

怎么用

  1. 把要朗读的文本粘贴进输入框,或点「示例」按钮先试一段。
  2. 选语言(列表里只有你浏览器真实装有的语言),再在该语言下挑一位发音人。
  3. 需要的话调语速、音调、音量,然后点「生成朗读」。
  4. 朗读中可暂停/继续;想换发音人直接点「停止」再重新生成。

常见问题

为什么我这里的发音人和别人不一样?
发音人不是本站提供的,而是你的浏览器与操作系统给的:Chrome 会带一组 Google 网络语音(需联网),Edge 和 Windows 自带「自然语音」离线包,macOS/iOS 在辅助功能里下载精选语音后也会出现在这里。所以同一页面在不同设备上看到的声音池不同。
为什么没有中文发音人?
说明这台设备的浏览器/系统还没装中文语音包。Windows:设置 → 时间和语言 → 语音 → 添加语音,装「中文」后刷新本页;Chrome 若只有本地语音被关,检查系统语音设置;macOS:辅助功能 → 内容朗读 → 管理声音。装好后本站语言列表会自动出现 zh-CN / zh-TW 等条目。
能下载 MP3 吗?
不能。Web Speech API 的设计是把音频直接送到扬声器,网页拿不到合成后的音频流,因此本站无法提供「Download as MP3」。参考站 crikk.com 用服务端合成所以可以导出。若你需要文件,可用系统立体声混录把播放录成音频,或改用带下载功能的 TTS 服务。
读长文为什么会自己停?
Chrome 对超过约 15 秒的单条语音有中途停发的老 bug。本站的对策是把长文按句切成不超过 240 字的小段逐段入队,并在朗读期间每 8 秒发一次保活心跳(resume),两条一起基本消除了静音。若仍被打断,通常是切到后台标签页或系统省电策略掐了音频。
我输入的文本会被上传吗?
不会经过本站。页面纯静态、没有后端接口,文本只送到浏览器自己的合成引擎:本地语音完全在你的设备上合成;Google 网络语音会由 Chrome 发往 Google 的语音服务——那是浏览器与它之间的事,本站不收集、不留存任何文本。

站内其他工具

纯前端实现 · 零依赖 · 免费 · 支持中/繁/英