3.0.0 — 자막과 내레이션 독립 제어 + AI 자막 스타일링 + 디지털 앵커 + 이미지 생성
자막과 내레이션 독립 제어 + AI 자막 스타일링 + 디지털 앵커 + 이미지 생성
새로운 기능
新しい機能と改善
- 자막과 내레이션 독립 제어 —
SubtitleConfig를AudioConfig와 동급으로 승격하고 각각 독립된enabled토글을 제공합니다. 4가지 조합 모드(내레이션+자막, 내레이션만, 자막만, 무음)를 지원합니다. 크리에이티브·원고 엔드포인트에subtitle_enabled파라미터를 추가합니다. - AI 자막 스타일링(LLM 모드) —
style_mode에"fixed"(전역 스타일) 또는"llm"(자막별 위치/색상/글꼴 크기를 LLM이 결정)을 지원합니다.style_hints는 자연어 지침(예: "핵심 문장은 빨간색, 요약은 노란색")을 받습니다.generate_subtitle_styles()는 모든 자막을 한 번에 LLM으로 보내고 sidecarsubtitle_styles.json으로 렌더링합니다. - 디지털 앵커(디지털 인물 방송) 태스크 유형 — t2i 또는 i2i(사용자 업로드 참조 사진)로 AI 발표자를 생성합니다. 원고를 5~12초 단락으로 나누고 각각 다른 제스처/표정의 고유 i2v 클립을 생성합니다. 통합 TTS + LLM 최적화 자막 오버레이. 오디오는 모델 또는 연결 후 생성됩니다.
POST /api/tasks/anchor. - 간단한 이미지 생성 — 새로운 다섯 번째 탭. 경량
SimpleImageTask. 시스템 프롬프트 지원.GET /api/image/{id}로 결과를 가져옵니다. - 시스템 프롬프트 지원 — 간단한 비디오·이미지 태스크에서 선택적 시스템 프롬프트를 최종 프롬프트 앞에 추가합니다.
리팩토링 및 최적화
- 파이프라인 단계 분리 — 크리에이티브·원고 파이프라인에서
_step_audio_subtitle을 독립된_step_audio+_step_subtitle로 교체했습니다. - 자막 렌더링 개선 — 0.3초 오버랩 다중 행 표시, 0.8초 전환 오버랩, 2패스
extend-end타이밍, 안전 여백 넘침 보호, LLM 수직 영역 배치로 시각적 다양성 제공.
버그 수정
subprocess.run에stdin=DEVNULL을 추가해 백그라운드 프로세스의 SIGTTIN 멈춤을 방지합니다.SilentTTSEngine.generate()가None을 반환하는 문제 → 빈dict반환으로 수정, 자막 전용 모드 SRT 생성 수정.- SRT 타임라인을 추정 비디오 길이가 아닌 실제 오디오 길이 기준으로 생성.
- 이미지 생성 실패 시 구체적인 오류(HTTP status + body + traceback)를 출력.
- 디지털 앵커 파이프라인의 방어적 UTF-8 인코딩 수정. 실제 오디오 길이를 얻기 위해 TTS를 먼저 생성.
Agnes Video Generator 소개
완전 무료·오픈소스 AI 비디오 생성기: 텍스트를 내레이션과 자막이 포함된 멀티씬 AI 비디오로 변환합니다.
- 완전 무료·오픈소스, 고성능 GPU 불필요
- 텍스트-비디오, 이미지-비디오, 디지털 앵커, 이미지 생성 지원
- 무료 Agnes AI 모델 기반, 모든 비디오는 클라우드에서 생성
- Web UI, Docker, npm으로 실행 가능하며 자체 호스팅 지원
관련 페이지
릴리스 노트
Agnes Video Generator 버전 변경 기록: 각 버전의 새로운 기능, 개선 사항, 버그 수정.
온라인 데모 | Agnes Video
프롬프트를 입력하고 AI 비디오와 이미지를 생성하세요
텍스트 투 비디오 API — 무료 AI 비디오 생성 API | Agnes Video
Agnes AI 무료 비디오 모델의 프로그램적 호출: 텍스트 변환 비디오, 이미지 변환 비디오, 내레이션 생성 등 REST API 전체 커버리지, 요청 매개변수, Bearer 인증, 작업 상태 폴링 및 전체 코드 예제(Python/cURL/HTTP)를 포함합니다. 개발자에게 친화적이고 비용이 전혀 들지 않으며 고성능 그래픽 카드가 필요하지 않습니다.
신뢰할 수 있는 이유
이 글은 주관적인 인상에 의한 결론이 아니라 arXiv 논문, 제조업체 기술 보고서 및 Stanford AI Index와 같은 1차 출처를 교차 확인하여 작성한 일선 실무자에 의해 작성되었다.
SandGrid@lcy362
Agnes Video Generator 개발자 · 풀스택 개발자
독립 개발자이자 오픈 소스 AI 비디오 생성 도구인 Agnes Video Generator의 저자입니다. 이 프로젝트는 Agnes AI의 완전 무료 비디오 모델을 기반으로 하며, MIT 프로토콜은 오픈 소스이며, 이미 1,000명 이상의 크리에이터가 무료 비용으로 AI 비디오를 제작할 수 있도록 도왔다. 비디오 생성 모델의 엔지니어링화와 보급에 오랫동안 관심을 기울여 왔으며, 글의 내용은 모두 일선 실천과 직접 연구에서 나왔다
GitHub에서 보기최종 업데이트:2026-08-21