6.3.0 — 릴리스 노트

Agnes Video Generator 버전 변경 기록: 각 버전의 새로운 기능, 개선 사항, 버그 수정.

마이너출시일 2026년 8월 30일GitHub에서 보기

새로운 기능

新しい機能と改善

  • v6 최적화 로드맵 완전 완료(29/29 항목) — v6 로드맵의 모든 배치가 출시되었습니다:
  • 성능(배치 2): 최종 합성 체인이 ffmpeg 기반으로 전환 — 동일 파라미터 장면 연결에 -c copy를 사용하고, 오디오 정렬/볼륨/무음 패딩은 단일 필터 패스로 통합되며, 자막은 항목별 스타일을 지원하는 ASS 경로로 렌더링됩니다(AGNES_SUBTITLE_ASS, moviepy 경로로 자동 폴백). 시(詩) 비디오는 장면별 재인코딩 대신 모든 장면을 한 번에 합성합니다. 전용 인코딩 스레드 풀을 새로 도입해 무거운 ffmpeg/moviepy 작업을 API 요청과 분리했고, 토큰 버킷 레이트 리미터에 네이티브 비동기 경로가 추가되어 레이트 리밋 대기 중에도 작업이 즉시 중단됩니다.
  • 신뢰성 및 엔지니어링(배치 1): 작업 상태는 작업별 잠금이 있는 단일 작성자(single-writer) 원칙을 따릅니다. 재개 시 저장된 단어 수준 TTS 큐를 지원(재합성 불필요). 비디오 폴링은 적응형으로 바뀌고 다중 장면 대기는 동시 실행됩니다. 작업 목록은 인덱싱되어 limit/offset/status 페이지네이션을 지원하며, 오래된 산출물/오류 로그도 관리 대상이 되었습니다. 프런트엔드는 백그라운드 탭에서 폴링을 중단하고 지수 백오프와 연결 끊김 배너를 추가했습니다.
  • 프런트엔드 및 i18n: 번역이 언어별 지연 로딩 청크로 분할되어 첫 화면 JS 번들이 ~721 kB에서 ~305 kB로 감소했습니다(gzip 226 kB → 97 kB, -58%). 폼 제출/확인/토스트 흐름을 공유 composable로 통일하고, 모바일 레이아웃, 포커스 트랩 모달, prefers-reduced-motion 지원, 폼 임시 저장을 추가했습니다.
  • 관측성 및 운영(배치 3): GET /api/healthGET /api/metrics 엔드포인트, 선택적 로테이션 파일 로깅(AGNES_LOG_FILE), Docker HEALTHCHECK가 추가되었습니다. 런타임 설정은 타입이 지정된 pydantic-settings(.env 지원)로 통합되어 동시성 제한이 API 키 수에 따라 동적으로 확장됩니다.
  • 긴급 결함 수정(배치 0): 중지가 재시도 백오프 없이 즉시 취소되고, 이벤트 루프 차단(워터마크 재인코딩, 동기 다운로드)이 루프 밖으로 이동했으며, 다중 키 삭제가 올바르게 작동하고, 프런트엔드 v-html XSS 벡터가 차단되었으며, 이미지 생성에 중복 제출 방지 가드가 추가되었습니다.
  • 아랍어 포함 22개 언어 완전 지원 — UI는 이미 22개 언어를 지원했으며, 이번 릴리스로 모든 언어의 음성 카탈로그가 완성되었습니다. 아랍어 UI가 완전히 지원되고(PR #32), 8개 UI 언어(터키어, 베트남어, 태국어, 타갈로그어, 힌디어, 페르시아어, 벵골어, 우르두어)에 원어 음성 이름 표시가 있는 edge_tts 음성 그룹, 문자 감지 정규식(타이 문자/데바나가리/벵골 문자), 문자별 자막 폰트 폴백(새로 번들된 Noto 폰트; 페르시아어/우르두어는 아랍어 reshape+bidi 파이프라인 재사용)이 추가되었습니다.
  • 투명한 분석 공개 및 프라이버시 제어 — 설정 패널에 수집되는 사용 통계를 정확히 나열하는 접을 수 있는 프라이버시 카드가 표시됩니다(업로드되지 않는 항목도 명시: 프롬프트, 원고, 시, API 키, 참조 이미지는 보고 전에 익명화). 분석은 패널에서 완전히 끌 수 있습니다.
  • 피드백 보고서에 완전한 오류 트레이스백 — 파이프라인 실패 시 전체 traceback이 작업 상태에 저장됩니다. 진단 엔드포인트와 앱 내 피드백 보고서에 포함되어 서버 콘솔을 확인하지 않고도(환경 수준의 [WinError 2] 등) 완전한 오류 세부 정보를 GitHub 이슈에 바로 붙여넣을 수 있습니다.

리팩토링 및 최적화

  • ffmpeg 우선 합성 체인 — 크리에이티브/원고/앵커/시 비디오의 최종 조립 경로가 3-4회 전체 재인코딩에서 copy-concat + 단일 필터 패스로 재설계되었습니다(기존 moviepy 경로로의 우아한 폴백 포함). v6 라인에서 가장 큰 성능 향상으로, 일반적인 출력에서 최종 조립 시간이 약 3-10배 단축됩니다.
  • 전용 인코딩 스레드 풀을 통한 비동기 레이트 리밋 — 토큰 버킷이 중단을 인식하는 네이티브 비동기 획득 경로를 제공하고, 무거운 인코딩은 전용 실행자에서 실행되어 긴 인코딩 작업이 요청 경로를 굶기지 않습니다.

버그 수정

  • 중지 동작 수정 — 작업 취소가 더 이상 재시도 백오프(최대 약 2분)를 유발하지 않고, 재개 가능한 video_id를 삭제하지 않습니다.
  • 다중 키 설정 수정 — 키 ID가 실제 키에서 해시되므로 여러 설정된 키 중 하나를 삭제하면 정확히 그 키만 제거됩니다.
  • 이벤트 루프 정지 수정 — 워터마크 재인코딩과 동기 다운로드가 더 이상 전체 서비스를 차단하지 않으며, 낮은 레이트 리밋 설정에서 동시성 상한을 영구적으로 깨뜨릴 수 있었던 세마포어 해제 버그가 수정되었습니다.
  • 프런트엔드 문제 수정 — 이스케이프되지 않은 v-html을 통한 저장형 XSS 벡터가 차단되고, 가드 없는 이미지 생성 중복 제출이 방지되며, fetch 오류가 조용한 실패 대신 읽기 쉬운 백엔드 메시지를 표시합니다.
  • 설정 변경은 필요하지 않습니다. 기존 작업은 계속 재개 가능하며, 작업 상태 파일 형식은 변경되지 않았습니다.

Agnes Video Generator 소개

완전 무료·오픈소스 AI 비디오 생성기: 텍스트를 내레이션과 자막이 포함된 멀티씬 AI 비디오로 변환합니다.

  • 완전 무료·오픈소스, 고성능 GPU 불필요
  • 텍스트-비디오, 이미지-비디오, 디지털 앵커, 이미지 생성 지원
  • 무료 Agnes AI 모델 기반, 모든 비디오는 클라우드에서 생성
  • Web UI, Docker, npm으로 실행 가능하며 자체 호스팅 지원

관련 페이지

신뢰할 수 있는 이유

이 글은 주관적인 인상에 의한 결론이 아니라 arXiv 논문, 제조업체 기술 보고서 및 Stanford AI Index와 같은 1차 출처를 교차 확인하여 작성한 일선 실무자에 의해 작성되었다.

S

SandGrid@lcy362

Agnes Video Generator 개발자 · 풀스택 개발자

독립 개발자이자 오픈 소스 AI 비디오 생성 도구인 Agnes Video Generator의 저자입니다. 이 프로젝트는 Agnes AI의 완전 무료 비디오 모델을 기반으로 하며, MIT 프로토콜은 오픈 소스이며, 이미 1,000명 이상의 크리에이터가 무료 비용으로 AI 비디오를 제작할 수 있도록 도왔다. 비디오 생성 모델의 엔지니어링화와 보급에 오랫동안 관심을 기울여 왔으며, 글의 내용은 모두 일선 실천과 직접 연구에서 나왔다

GitHub에서 보기

최종 업데이트2026-08-21

지금 시작할 준비가 되셨나요?

"세계적 수준의 AI를 모든 사람의 것으로 만들자." - 브루스 양. 완전 무료, 신용 카드, 고성능 그래픽 카드 없음, 비용 제로로 첫 AI 비디오를 만들어보세요. Agnes AI의 무료 비디오 모델을 사용하시겠습니까? 여기서부터 시작하면 됩니다.

GitHub 리포지토리를 클론하고 2분 안에 실행