AI 비디오 생성기
e3d-pod2vid
오디오(팟캐스트, 인터뷰)를 대화자별로 구분하여 유튜브용 MP4로 변환하는 AI 기반 오픈소스 파이프라인입니다. 의미 기반 B-롤, 자막, 선택적 음성 합성을 지원합니다.
e3d-pod2vid
e3d-pod2vid란?
e3d-pod2vid는 대화자 구분된 오디오 파일(예: NotebookLM, 팟캐스트, 인터뷰)을 유튜브용 비디오로 변환하는 오픈소스 AI 파이프라인입니다. 각 발화에 의미적으로 일치하는 Pexels B-롤, 내장 자막, 선택적 OpenAI TTS 음성 대체를 제공합니다. 또한 라이브 신호에서 자동으로 유튜브 쇼츠를 생성하고 여러 플랫폼에 한 번에 게시할 수 있습니다.
e3d-pod2vid vs 유사 도구
| 가격 모델 | 무료 | 무료, 무료 체험, 맞춤형 요금제 | 맞춤형 요금제 | 무료, 프리미엄 무료 |
| 무료 크레딧 | ||||
| 주요 기능 |
|
|
|
|
| 장점 |
|
|
|
|
| 단점 |
|
|
|
|
| 추천 대상 |
|
|
|
|
e3d-pod2vid 사용 방법
- 1저장소를 클론하고 Python/Node 종속성을 설치합니다.
- 2.env.example을 .env로 복사하고 API 키(AssemblyAI, OpenAI, Pexels 등)를 입력합니다.
- 3`python3 pod2vid.py input.m4a output.mp4`를 실행하여 오디오를 비디오로 변환합니다.
- 4선택적으로 `python3 tts_replace.py`를 실행하여 사용자 지정 OpenAI TTS로 음성을 대체합니다.
- 5`node yt_upload.js output.mp4 "제목"`을 실행하여 유튜브에 업로드합니다.
- 6`python3 make_short.py`를 사용하여 유튜브 쇼츠를 생성합니다.
- 7`node announce.js`를 사용하여 소셜 플랫폼(Discord, Telegram, X, LinkedIn)에 게시합니다.
e3d-pod2vid 주요 기능
- GPT-4o-mini 쿼리를 사용한 발화별 의미 기반 Pexels B-롤
- ffmpeg libass 없이 순수 Pillow로 구현된 내장 자막
- 선택적 OpenAI TTS 음성 대체 (화자별 맞춤 음성)
- 설명 및 썸네일 업데이트를 포함한 유튜브 업로드
- 한 번의 명령으로 여러 소셜 플랫폼 게시 (Discord, Telegram, X, LinkedIn)
- 실시간 E3D Maps 신호로 자동 유튜브 쇼츠 생성
- 재실행 시 API 결과 캐싱
- 자막 레이블, 음성 선택, 비디오 매개변수 사용자 정의
e3d-pod2vid 사용 사례
- 팟캐스트 에피소드를 흥미로운 B-롤이 포함된 유튜브 비디오로 변환
- 인터뷰 하이라이트 영상을 자동 생성 자막과 함께 제작
- 트렌드 신호로 일일 유튜브 쇼츠 자동화
- NotebookLM 등 AI 음성을 자연스러운 TTS로 대체
- 여러 소셜 채널에 동시에 비디오 콘텐츠 게시
e3d-pod2vid 가격 및 무료 크레딧
e3d-pod2vid의 가격 모델은 무료입니다.
e3d-pod2vid 장점과 단점
장점
- 오픈소스이며 사용자 정의 가능
- 오디오에서 소셜 게시까지 종단간 파이프라인
- 여러 소셜 플랫폼 지원
- 의미 기반 B-롤 선택으로 시청자 참여 향상
- 캐싱으로 재실행 시 API 비용 절감
단점
- 여러 유료 API 구독 필요
- 명령줄 인터페이스만 제공 (GUI 없음)
- 설정에 프로그래밍 지식 필요 (Python, Node.js, 환경 변수)
- B-롤 품질이 Pexels 가용성과 GPT 쿼리 품질에 의존
e3d-pod2vid은 어떤 용도에 가장 적합한가요?
- 유튜브로 확장하려는 팟캐스터
- 비디오 제작을 자동화하려는 콘텐츠 제작자
- AI 기반 미디어 파이프라인을 구축하는 개발자
- 오디오 콘텐츠를 재활용하는 소셜 미디어 관리자