← 返回科研導航

TextToSpeech 文字轉語音

瀏覽器語音合成 · 多語言發音人 · 語速音調可調

English 简体 繁體

文本

0 / 2,500 字符

語言與發音人

語言列表來自你的瀏覽器與作業系統實際提供的語音;不同瀏覽器給的不一樣,Chrome 有 Google 網絡語音,Edge 與 Windows 自帶自然語音。

選中語言後可用的發音人會列在這裏。帶雲端標記的發音人由瀏覽器自己的服務合成,本站不經手任何文本。

朗讀參數

1.00×

0.5 到 2 倍速。聽外語材料時 0.8 左右最清楚,趕進度可以 1.5。

1.0

0 低、1 原調、2 尖。多數發音人在 0.8 ~ 1.2 之間最自然。

100%

該發音人的輸出音量,與系統音量相乘。

試聽

准备就绪:选好发音人,点「生成朗读」即可。

Web Speech API 不把合成後的音頻暴露給網頁,所以本工具只能播放、不能導出 MP3;需要音頻文件請找帶服務端合成的網站(如參考的 crikk.com)。

這是什麼工具

TextToSpeech 對標 crikk.com/text-to-speech,把「貼文本 → 選發音人 → 出語音」這條流搬進了瀏覽器:輸入或貼上最長 2500 字符的文字,從當前瀏覽器提供的發音人裏挑一個(中文、英文以及其它系統已裝語言),再調語速、音調和音量,點「生成朗讀」就能把文本讀出來,中途可以暫停、繼續或停止。長文會按句號、問號等標點自動切成小段逐段朗讀,避開 Chrome 讀長句讀到一半靜音的老毛病。

與參考站最大的不同是「引擎」:Crikk 用自己的伺服器合成音頻再給下載,本站則完全調用瀏覽器自帶的 Web Speech API——發音人來自你的瀏覽器與作業系統,合成在本地或瀏覽器自己的雲端完成,文本不經過本站伺服器,因此沒有配額、不限次數、也不支持導出 MP3(網頁拿不到這條音頻流)。換來的是零等待、零上傳、打開即用。

功能

怎麼用

  1. 把要朗讀的文本貼進輸入框,或點「示例」按鈕先試一段。
  2. 選語言(列表裏只有你瀏覽器真實裝有的語言),再在該語言下挑一位發音人。
  3. 需要的話調語速、音調、音量,然後點「生成朗讀」。
  4. 朗讀中可暫停/繼續;想換發音人直接點「停止」再重新生成。

常見問題

為什麼我這裏的發音人和別人不一樣?
發音人不是本站提供的,而是你的瀏覽器與作業系統給的:Chrome 會帶一組 Google 網絡語音(需聯網),Edge 和 Windows 自帶「自然語音」離線包,macOS/iOS 在輔助功能里下載精選語音後也會出現在這裏。所以同一頁面在不同設備上看到的聲音池不同。
為什麼沒有中文發音人?
說明這台設備的瀏覽器/系統還沒裝中文語音包。Windows:設置 → 時間和語言 → 語音 → 添加語音,裝「中文」後刷新本頁;Chrome 若只有本地語音被關,檢查系統語音設置;macOS:輔助功能 → 內容朗讀 → 管理聲音。裝好後本站語言列表會自動出現 zh-CN / zh-TW 等條目。
能下載 MP3 嗎?
不能。Web Speech API 的設計是把音頻直接送到揚聲器,網頁拿不到合成後的音頻流,因此本站無法提供「Download as MP3」。參考站 crikk.com 用服務端合成所以可以導出。若你需要文件,可用系統立體聲混錄把播放錄成音頻,或改用帶下載功能的 TTS 服務。
讀長文為什麼會自己停?
Chrome 對超過約 15 秒的單條語音有中途停發的老 bug。本站的對策是把長文按句切成不超過 240 字的小段逐段入隊,並在朗讀期間每 8 秒發一次保活心跳(resume),兩條一起基本消除了靜音。若仍被打斷,通常是切到後台標籤頁或系統省電策略掐了音頻。
我輸入的文本會被上傳嗎?
不會經過本站。頁面純靜態、沒有後端接口,文本只送到瀏覽器自己的合成引擎:本地語音完全在你的設備上合成;Google 網絡語音會由 Chrome 發往 Google 的語音服務——那是瀏覽器與它之間的事,本站不收集、不留存任何文本。

站內其他工具

純前端實現 · 零依賴 · 免費 · 支持中/繁/英