4.6.0 — 시(詩) 영상 태스크 유형 + 멀티씬 파이프라인 리팩토링
시(詩) 영상 태스크 유형 + 멀티씬 파이프라인 리팩토링
새로운 기능
新しい機能と改善
- 시(詩) 영상 태스크 유형 — 새
POST /api/tasks/poetry: LLM이 시를 여러 장면(원문 줄 | 화면 설명 형식)으로 나누고, 각 줄을 TTS 내레이션으로 읽으며, 장면을 t2v 클립으로 생성하고, 자막을 내레이션에 시간 정렬해 연결합니다. - 시 장면 설정을 크리에이티브 영상과 정렬 — 장면별 길이 모델 및 길이 추출 모드; 장면 수/워터마크/내레이션 속도 옵션.
- 2단계 시 생성 — 장면을 일괄 제출하고 병렬 대기하여 더 빨리 완료.
리팩토링 및 최적화
- MultiScenePipeline 기본 클래스 — 크리에이티브/원고/앵커/시 장편 영상 파이프라인이 하나의 템플릿 메서드 기본 클래스(
build_scenes → build_reference_images → generate_videos → audio+subtitle → composite)를 공유해 파이프라인별 중복 로직을 제거. - 시 생성이 기본 생성기 재사용 — 영상 생성이
MultiScenePipeline._generate_videos로 승격.
버그 수정
- 시 영상에서 장면별 TTS 오디오가 잘림(앞부분만 들림).
- 재개 시 오디오 트랙이 없는 오래된
final_clip.mp4를 재사용. - 시 진행 단계 표시기가 표시되지 않음.
switchTaskType에 닫는 중괄호가 없어 페이지 전체 JS가 비활성화됨.
Agnes Video Generator 소개
완전 무료·오픈소스 AI 비디오 생성기: 텍스트를 내레이션과 자막이 포함된 멀티씬 AI 비디오로 변환합니다.
- 완전 무료·오픈소스, 고성능 GPU 불필요
- 텍스트-비디오, 이미지-비디오, 디지털 앵커, 이미지 생성 지원
- 무료 Agnes AI 모델 기반, 모든 비디오는 클라우드에서 생성
- Web UI, Docker, npm으로 실행 가능하며 자체 호스팅 지원
관련 페이지
릴리스 노트
Agnes Video Generator 버전 변경 기록: 각 버전의 새로운 기능, 개선 사항, 버그 수정.
온라인 데모 | Agnes Video
프롬프트를 입력하고 AI 비디오와 이미지를 생성하세요
텍스트 투 비디오 API — 무료 AI 비디오 생성 API | Agnes Video
Agnes AI 무료 비디오 모델의 프로그램적 호출: 텍스트 변환 비디오, 이미지 변환 비디오, 내레이션 생성 등 REST API 전체 커버리지, 요청 매개변수, Bearer 인증, 작업 상태 폴링 및 전체 코드 예제(Python/cURL/HTTP)를 포함합니다. 개발자에게 친화적이고 비용이 전혀 들지 않으며 고성능 그래픽 카드가 필요하지 않습니다.
신뢰할 수 있는 이유
이 글은 주관적인 인상에 의한 결론이 아니라 arXiv 논문, 제조업체 기술 보고서 및 Stanford AI Index와 같은 1차 출처를 교차 확인하여 작성한 일선 실무자에 의해 작성되었다.
SandGrid@lcy362
Agnes Video Generator 개발자 · 풀스택 개발자
독립 개발자이자 오픈 소스 AI 비디오 생성 도구인 Agnes Video Generator의 저자입니다. 이 프로젝트는 Agnes AI의 완전 무료 비디오 모델을 기반으로 하며, MIT 프로토콜은 오픈 소스이며, 이미 1,000명 이상의 크리에이터가 무료 비용으로 AI 비디오를 제작할 수 있도록 도왔다. 비디오 생성 모델의 엔지니어링화와 보급에 오랫동안 관심을 기울여 왔으며, 글의 내용은 모두 일선 실천과 직접 연구에서 나왔다
GitHub에서 보기최종 업데이트:2026-08-21