2.0 — 3-파이프라인 아키텍처 + 다국어 웹 UI

3-파이프라인 아키텍처 + 다국어 웹 UI

메이저출시일 2026년 6월 16일GitHub에서 보기

새로운 기능

新しい機能と改善

  • 공통 기반을 가진 세 가지 태스크 유형 — 심플 비디오(단일 프롬프트→Agnes Video API로 단일 비디오, t2v/i2v/ti2vid/keyframes), 크리에이티브 비디오(AI 시나리오 작가→스토리보드→씬별 비디오→edge_tts 내레이션→정밀 자막→연결), 원고 비디오(긴 텍스트 분할→AI 씬 프롬프트→세그먼트별 비디오→통합 TTS+자막→연결).
  • 다국어 웹 UI — 3탭 단일 페이지 프런트엔드(심플/크리에이티브/원고)와 中文 / English / Русский / 日本語 / 한국어 / Bahasa Melayu / Bahasa Indonesia i18n 지원.
  • 실시간 진행 상황 — WebSocket으로 파이프라인 진행 상황을 푸시. 태스크 일시정지·재개·중지 지원.
  • 정밀 자막 시스템 — edge_tts 타임스탬프 기반 단어 수준 SRT 그룹화, CJK 여러 줄 줄바꿈, method="caption" 렌더링(테두리/배경/위치 커스터마이즈).

리팩토링 및 최적화

  • 4계층 아키텍처core/api(Agnes Chat/Image/Video 래퍼, 재시도+폴링), core/audio(edge_tts + SRT + moviepy 오버레이), core/compositor(연결/스케일링/프레임 추출), core/pipelines(3개 파이프라인 구현).
  • Pydantic v2 데이터 모델 — 영구 상태 직렬화와 이전 버전 호환 태스크 로딩을 갖춘 타입화된 태스크 서브클래스.
  • 2단계 원고 생성 — 비디오 생성의 A/B 분할로 병렬화하고 완료를 가속화.

버그 수정

  • 자막 bg_color/position의 MoviePy 2.x 호환성. TTS 볼륨 자동 부스트.
  • 기존 태스크용 CJK 폰트 폴백. 안정적 렌더링을 위해 폰트 번들 제공.
  • 비디오 프레임 상한을 Agnes API 제한(720p에서 409)에 맞추고 일시적 실패는 자동 재시도.
  • 원고 파이프라인에서 단일 연속 TTS + SRT를 사용해 세그먼트별 패딩 드리프트 제거.
  • 호환성/설정 변경 안내: v1.0의 start.sh 원클릭 시작에 venv 생성과 의존성 설치가 내장. 업그레이드 후 첫 실행 시 환경이 자동 준비됩니다.

Agnes Video Generator 소개

완전 무료·오픈소스 AI 비디오 생성기: 텍스트를 내레이션과 자막이 포함된 멀티씬 AI 비디오로 변환합니다.

  • 완전 무료·오픈소스, 고성능 GPU 불필요
  • 텍스트-비디오, 이미지-비디오, 디지털 앵커, 이미지 생성 지원
  • 무료 Agnes AI 모델 기반, 모든 비디오는 클라우드에서 생성
  • Web UI, Docker, npm으로 실행 가능하며 자체 호스팅 지원

관련 페이지

신뢰할 수 있는 이유

이 글은 주관적인 인상에 의한 결론이 아니라 arXiv 논문, 제조업체 기술 보고서 및 Stanford AI Index와 같은 1차 출처를 교차 확인하여 작성한 일선 실무자에 의해 작성되었다.

S

SandGrid@lcy362

Agnes Video Generator 개발자 · 풀스택 개발자

독립 개발자이자 오픈 소스 AI 비디오 생성 도구인 Agnes Video Generator의 저자입니다. 이 프로젝트는 Agnes AI의 완전 무료 비디오 모델을 기반으로 하며, MIT 프로토콜은 오픈 소스이며, 이미 1,000명 이상의 크리에이터가 무료 비용으로 AI 비디오를 제작할 수 있도록 도왔다. 비디오 생성 모델의 엔지니어링화와 보급에 오랫동안 관심을 기울여 왔으며, 글의 내용은 모두 일선 실천과 직접 연구에서 나왔다

GitHub에서 보기

최종 업데이트2026-08-21

지금 시작할 준비가 되셨나요?

"세계적 수준의 AI를 모든 사람의 것으로 만들자." - 브루스 양. 완전 무료, 신용 카드, 고성능 그래픽 카드 없음, 비용 제로로 첫 AI 비디오를 만들어보세요. Agnes AI의 무료 비디오 모델을 사용하시겠습니까? 여기서부터 시작하면 됩니다.

GitHub 리포지토리를 클론하고 2분 안에 실행