harry0703/MoneyPrinterTurbo
주제나 키워드 하나만 입력하면 대본, 영상 소재, 자막, 배경음악까지 자동으로 붙여 짧은 영상 하나를 완성해주는 오픈소스 도구
MoneyPrinterTurbo는 주제나 키워드를 입력하면 AI 대형언어모델로 영상 대본을 쓰고, 그에 맞는 영상 소재를 찾고, 자막과 배경음악을 붙여 고화질 짧은 영상을 만들어주는 파이썬 프로젝트다. 대본 작성용 AI 모델, 목소리를 입히는 음성합성, 무료 영상소스 사이트, 자막 생성 방식 등을 상황에 맞게 골라 쓸 수 있다. 웹 화면, API, 명령줄, AI 에이전트까지 네 가지 방식으로 쓸 수 있고 완성된 영상은 TikTok, Instagram, YouTube Shorts에 자동으로 올릴 수도 있다.
무엇을 하는 레포인가
- 주제나 키워드만 주면 AI가 영상 대본을 자동으로 쓰거나, 직접 쓴 대본을 넣어 쓸 수도 있다
- 세로형(1080x1920)과 가로형(1920x1080) 고화질 영상을 지원하고 여러 개를 한 번에 만들어 마음에 드는 것을 고를 수 있다
- 목소리는 무료인 Edge TTS를 비롯해 Azure, Google Gemini, ElevenLabs 등 여러 음성합성 서비스 중에서 고를 수 있고, 자막은 음성 타임스탬프를 쓰는 빠른 방식과 로컬에서 오디오를 직접 받아쓰는 whisper 방식 중에서 고를 수 있다
- Kimi, OpenAI, Gemini, DeepSeek, 통이치엔원 등 다양한 대형언어모델 서비스와 연동되고, Pexels·Pixabay·Coverr 같은 무료 소재 사이트나 직접 준비한 로컬 영상도 쓸 수 있다
- 완성한 영상을 TikTok, Instagram, YouTube Shorts에 한 번의 설정으로 자동 업로드할 수 있고, Windows 원클릭 실행 파일, Docker, uv 기반 설치 등 여러 설치 방법을 제공한다
왜 중요한가
영상 편집 경험이 없어도 문장 하나로 짧은 영상을 자동으로 만들 수 있어 콘텐츠 제작의 진입장벽을 크게 낮춘다. 대본 작성, 소재 검색, 음성, 자막, 업로드까지 한 파이프라인으로 묶어놓아 여러 AI 서비스를 조합하는 작업 흐름의 실제 사례로도 참고할 만하다.
이 레포의 용어
- 대형언어모델(LLM) · 대량의 글을 학습해 사람처럼 문장을 만들어내는 AI 모델
- TTS(음성합성) · 글자를 사람 목소리처럼 들리는 소리로 바꿔주는 기술
- whisper · 음성을 텍스트로 받아쓰는 오픈소스 AI 모델, 여기선 자막 타이밍을 정확히 맞추는 데 쓰인다
- WebUI · 브라우저에서 클릭만으로 조작할 수 있게 만든 화면
- API · 다른 프로그램이 이 도구의 기능을 코드로 호출해 쓸 수 있게 열어둔 통로
레포 원문 소개 (영문)
利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。Generate HD short videos from a topic or keyword with an automated AI workflow.
GitHub에서 보기주목받는 레포
- cathrynlavery/diagram-designAI 코딩 도구가 그리는 다이어그램을 흔한 둥근 사각형 대신 잡지 느낌 편집 디자인으로 바꿔주는 스킬
- public-apis/public-apis세상의 모든 무료 API를 한곳에 모아둔 목록 저장소
- semantica-agi/semanticaAI 에이전트가 왜 그런 결정을 내렸는지 그래프로 증명하는 오픈소스 인프라
- cactus-compute/needle14메가바이트짜리 AI 모델로 스마트폰과 웨어러블에서 인터넷 없이 도구 호출하기
- unslothai/unsloth코딩 없이 내 컴퓨터에서 AI 모델을 돌리고 학습시키는 데스크톱 앱
- macro-inc/macro이메일, 채팅, 문서, 업무관리, CRM을 하나로 묶고 AI가 팀 전체 기억을 공유하는 업무 플랫폼
- basecamp/omarchyDHH가 만든, 미리 취향껏 세팅된 리눅스 배포판
- mattpocock/skillsAI 코딩 에이전트가 삼천포로 빠지지 않게 잡아주는 재사용 가능한 '스킬' 모음집