AI 影片生成器
e3d-pod2vid
AI驅動的開源管道,可將經過說話者分離的音訊(播客、訪談)轉換為準備上傳至YouTube的MP4,包含語義相關的B-roll、內嵌字幕,以及可選的語音合成。
e3d-pod2vid
什麼是 e3d-pod2vid?
e3d-pod2vid 是一個開源的 AI 管道,可將經過說話者分離的音訊檔案(例如 NotebookLM、播客、訪談)轉換為可直接上傳至 YouTube 的影片,包含針對每個語句的語義匹配 Pexels B-roll、內嵌字幕,以及可選的 OpenAI TTS 語音替換。它還支援根據即時訊號自動生成 YouTube Short,並一鍵發布到多個社交平台。
e3d-pod2vid 與相似工具比較
| 計價模式 | 免費 | 免費, 免費試用, 客製化定價 | 客製化定價 | 免費, Freemium |
| 免費額度 | ||||
| 主要功能 |
|
|
|
|
| 優點 |
|
|
|
|
| 缺點 |
|
|
|
|
| 適合對象 |
|
|
|
|
如何使用 e3d-pod2vid?
- 1克隆儲存庫並安裝 Python/Node 依賴項。
- 2將 .env.example 複製為 .env 並填入您的 API 金鑰(AssemblyAI、OpenAI、Pexels 等)。
- 3執行 `python3 pod2vid.py input.m4a output.mp4` 將音訊轉換為影片。
- 4可選:執行 `python3 tts_replace.py` 以自訂 OpenAI TTS 語音替換原聲。
- 5執行 `node yt_upload.js output.mp4 "標題"` 上傳至 YouTube。
- 6使用 `python3 make_short.py` 生成 YouTube Short。
- 7使用 `node announce.js` 發布至社交平台(Discord、Telegram、X、LinkedIn)。
e3d-pod2vid 主要功能
- 使用 GPT-4o-mini 查詢為每個語句匹配語義相關的 Pexels B-roll
- 無需 ffmpeg libass 的內嵌字幕(純 Pillow)
- 可選的 OpenAI TTS 語音替換(每名說話者可自訂語音)
- 上傳至 YouTube 並更新描述和縮圖
- 一鍵多平台社交發布(Discord, Telegram, X, LinkedIn)
- 從即時 E3D Maps 訊號自動生成 YouTube Short
- 快取 API 結果以快速重新執行
- 可自訂字幕標籤、語音選擇和影片參數
e3d-pod2vid 使用情境
- 將播客集數轉換為附有吸引人 B-roll 的 YouTube 影片
- 建立帶有自動生成字幕的訪談精華片段
- 根據趨勢訊號自動化每日 YouTube Short
- 以自然語音的 TTS 替換 AI 語音(例如 NotebookLM)
- 同時發布影片內容至多個社交頻道
e3d-pod2vid 價格與免費點數
e3d-pod2vid 目前採用 免費 模式。
e3d-pod2vid 優缺點
優點
- 開源且可自訂
- 從音訊到社交發布的端到端管道
- 支援多個社交平台
- 語義 B-roll 選擇提升觀眾參與度
- 快取降低重新執行時的 API 成本
缺點
- 需要多個付費 API 訂閱
- 僅命令列介面(無圖形介面)
- 設定需要程式設計知識(Python、Node.js、環境變數)
- B-roll 品質取決於 Pexels 的可用性和 GPT 查詢品質
e3d-pod2vid 最適合哪些用途?
- 希望擴展到 YouTube 的播客創作者
- 自動化影片製作的內容創作者
- 建構 AI 驅動媒體管道的開發者
- 重新利用音訊內容的社交媒體管理者