AI 文字轉語音

SpeechGen

SpeechGen 是一個 AI 文字轉語音與語音生成平台,可用於製作多語言的逼真音訊,並支援下載檔案。

SpeechGen logo

SpeechGen

前往網站

什麼是 SpeechGen?

SpeechGen 是一個線上 AI 語音生成器與文字轉語音平台,可將書面文字轉換為自然逼真的口語音訊。它支援多種聲音、語言選擇、SSML 控制、字幕同步、背景音樂,以及可供個人與商業用途的可下載音訊格式。

SpeechGen 與相似工具比較

計價模式免費, 付費免費免費, Freemium免費, Freemium
免費額度
主要功能
  • 5,000+ AI 聲音
  • 150 種語言
  • 文字轉語音轉換
  • 完全基於瀏覽器;無需上傳至伺服器
  • 使用 ONNX Runtime Web 進行本地推論
  • 支援多種 TTS 模型
  • 從照片建立 AI 主持人
  • 從 PDF、網址、筆記、音訊匯入內容
  • 自動腳本生成
  • 附有來源連結和覆蓋率計量的引用答案
  • 從任何頁面生成多種格式的播客
  • 支援間隔重複和 Anki 匯出的閃卡
優點
  • 擁有 5,000+ 選項的大型聲音庫
  • 支援 150 種語言
  • 注重隱私:所有處理均在本地進行
  • 完全免費且開源
  • 快速將任何內容轉變為播客
  • 易於使用,無需錄音設備
  • 自帶金鑰和儲存選項,注重隱私
  • 引用答案確保透明度
缺點
  • 以字元計價,對某些使用者來說較難直接比較
  • 進階功能可能需要學習 SSML 與格式標籤
  • 需要支援 WebAssembly 的現代瀏覽器
  • 與雲端 TTS 相比,語音品質可能有所差異
  • 依賴 AI 語音,可能缺乏人性化觸感
  • 進階編輯功能有限
  • 免費版可能有使用限制
  • 自託管儲存需要初始設定
適合對象
  • 內容創作者
  • 影片剪輯師
  • 注重隱私的使用者
  • 測試 TTS 模型的開發者
  • 內容創作者
  • 教育工作者
  • 研究人員和學生
  • 知識工作者

如何使用 SpeechGen?

  1. 1在編輯器中輸入或貼上你的文字。
  2. 2選擇聲音、語言,並在需要時調整語速、音高或音量。
  3. 3加入 SSML 標籤、說話者標籤或切割標記,以便停頓與多聲音輸出。
  4. 4點擊 Convert to Speech。
  5. 5以你偏好的格式下載完成的音訊,例如 MP3、WAV、FLAC、OGG 或 OPUS。

SpeechGen 主要功能

  • 5,000+ AI 聲音
  • 150 種語言
  • 文字轉語音轉換
  • MP3、WAV、FLAC、OGG 和 OPUS 下載
  • 支援 SSML
  • 單一檔案支援多位說話者
  • 字幕與音訊同步
  • 可重複生成相同文字的智慧快取
  • 支援背景音樂
  • 支援 DOCX、PDF 和 SRT 上傳
  • 包含商業授權
  • API 存取

SpeechGen 使用情境

  • 行銷影片旁白
  • 線上學習與訓練音訊
  • 商務電話選單與 IVR
  • 語音導覽與博物館導覽
  • 工業安全公告
  • 多語言在地化
  • 有聲書與逐章旁白
  • 字幕同步影片配音

SpeechGen 價格與免費點數

SpeechGen 目前採用 免費, 付費 模式。

免費方案免費額度

Free

$0

無需註冊即可立即開始使用 1,000 個字元。免費註冊可提高每日額度,且首次免費使用不會加上浮水印。

付費方案

Pay-as-you-go

From $4.99

按需購買點數,並依自己的節奏使用。方案包含商業授權、歷史紀錄、智慧快取,以及所有聲音的存取權。

Voice quality tiers

STD / PRO / HD

Standard 每字元 0.5,Pro 每字元 1,HD 每字元 2,提供更高品質的合成選項。

Free

$0

無需註冊即可立即開始使用 1,000 個字元。免費註冊可提高每日額度,且首次免費使用不會加上浮水印。

Pay-as-you-go

From $4.99

按需購買點數,並依自己的節奏使用。方案包含商業授權、歷史紀錄、智慧快取,以及所有聲音的存取權。

Voice quality tiers

STD / PRO / HD

Standard 每字元 0.5,Pro 每字元 1,HD 每字元 2,提供更高品質的合成選項。

SpeechGen 優缺點

優點

  • 擁有 5,000+ 選項的大型聲音庫
  • 支援 150 種語言
  • 前 1,000 個字元無需註冊
  • 包含商業授權
  • 智慧快取可在文字未變更時免費重新生成
  • 支援多種輸出格式與字幕同步

缺點

  • 以字元計價,對某些使用者來說較難直接比較
  • 進階功能可能需要學習 SSML 與格式標籤
  • 超長專案可能需要較長處理時間

SpeechGen 最適合哪些用途?

  • 內容創作者
  • 影片剪輯師
  • 線上學習團隊
  • 小型企業
  • 在地化團隊
  • Podcast 製作人
  • 博物館與導覽業者

SpeechGen 常見問題

SpeechGen 的免費替代工具

T

一個由AI驅動的服務,可將X(Twitter)貼文轉換為具有新聞語調的旁白新聞,提供精選頻道和可自訂的電台。

免費
Veform logo

一個引導式語音日記,透過每日AI語音對話幫助你反思、追蹤情緒,並隨著時間發現模式。

免費
LOVO logo

LOVO 是一個 AI 聲音生成器與文字轉語音平台,可用於製作逼真的旁白、影片配音,以及支援 100+ 種語言的聲音克隆。

免費
1minAI logo

1minAI 是一款一站式 AI 應用,支援聊天、寫作、圖片、音訊、影片與文件任務,可跨 Web、行動裝置、桌面與瀏覽器使用。

免費
Noiz AI logo

Noiz AI 是一個 AI 語音平台,提供文字轉語音、聲音克隆、聲音設計、配音,以及情感控制旁白功能。

免費

SpeechGen 的最佳替代 AI 工具

IT

在瀏覽器中將文字轉換為自然語音 — 無需上傳伺服器,使用 ONNX Runtime Web 和 Inflect TTS v2。

PodcastorAI logo

PodcastorAI 是一個 AI 驅動的平台,可將文字、PDF、網址和音訊轉換為專業的影片播客,並提供可自訂的 AI 主持人與語音。

Notebooker logo

將你收藏的內容轉化為你所知的知識。Notebooker 保存你收集的一切,回答關於它的問題,以播客形式朗讀,並將其轉變為學習材料。

The Daily FM logo

The Daily FM 每日從你選擇的來源創建播客摘要,提供簡潔的音頻簡報,讓你隨時掌握資訊。

T

一個由AI驅動的服務,可將X(Twitter)貼文轉換為具有新聞語調的旁白新聞,提供精選頻道和可自訂的電台。

免費
Veform logo

一個引導式語音日記,透過每日AI語音對話幫助你反思、追蹤情緒,並隨著時間發現模式。

免費
SpeechifyAI Research Lab logo

SpeechifyAI 是一個研究實驗室,致力於打造人類般的語音 AI,專注於語音合成、語音克隆、情感表達和多語言音頻生成。

e3d-pod2vid logo

AI驅動的開源管道,可將經過說話者分離的音訊(播客、訪談)轉換為準備上傳至YouTube的MP4,包含語義相關的B-roll、內嵌字幕,以及可選的語音合成。