4.6.0 — 시(詩) 영상 태스크 유형 + 멀티씬 파이프라인 리팩토링

시(詩) 영상 태스크 유형 + 멀티씬 파이프라인 리팩토링

마이너출시일 2026년 7월 12일GitHub에서 보기

새로운 기능

新しい機能と改善

  • 시(詩) 영상 태스크 유형 — 새 POST /api/tasks/poetry: LLM이 시를 여러 장면(원문 줄 | 화면 설명 형식)으로 나누고, 각 줄을 TTS 내레이션으로 읽으며, 장면을 t2v 클립으로 생성하고, 자막을 내레이션에 시간 정렬해 연결합니다.
  • 시 장면 설정을 크리에이티브 영상과 정렬 — 장면별 길이 모델 및 길이 추출 모드; 장면 수/워터마크/내레이션 속도 옵션.
  • 2단계 시 생성 — 장면을 일괄 제출하고 병렬 대기하여 더 빨리 완료.

리팩토링 및 최적화

  • MultiScenePipeline 기본 클래스 — 크리에이티브/원고/앵커/시 장편 영상 파이프라인이 하나의 템플릿 메서드 기본 클래스(build_scenes → build_reference_images → generate_videos → audio+subtitle → composite)를 공유해 파이프라인별 중복 로직을 제거.
  • 시 생성이 기본 생성기 재사용 — 영상 생성이 MultiScenePipeline._generate_videos로 승격.

버그 수정

  • 시 영상에서 장면별 TTS 오디오가 잘림(앞부분만 들림).
  • 재개 시 오디오 트랙이 없는 오래된 final_clip.mp4를 재사용.
  • 시 진행 단계 표시기가 표시되지 않음.
  • switchTaskType에 닫는 중괄호가 없어 페이지 전체 JS가 비활성화됨.

Agnes Video Generator 소개

완전 무료·오픈소스 AI 비디오 생성기: 텍스트를 내레이션과 자막이 포함된 멀티씬 AI 비디오로 변환합니다.

  • 완전 무료·오픈소스, 고성능 GPU 불필요
  • 텍스트-비디오, 이미지-비디오, 디지털 앵커, 이미지 생성 지원
  • 무료 Agnes AI 모델 기반, 모든 비디오는 클라우드에서 생성
  • Web UI, Docker, npm으로 실행 가능하며 자체 호스팅 지원

관련 페이지

신뢰할 수 있는 이유

이 글은 주관적인 인상에 의한 결론이 아니라 arXiv 논문, 제조업체 기술 보고서 및 Stanford AI Index와 같은 1차 출처를 교차 확인하여 작성한 일선 실무자에 의해 작성되었다.

S

SandGrid@lcy362

Agnes Video Generator 개발자 · 풀스택 개발자

독립 개발자이자 오픈 소스 AI 비디오 생성 도구인 Agnes Video Generator의 저자입니다. 이 프로젝트는 Agnes AI의 완전 무료 비디오 모델을 기반으로 하며, MIT 프로토콜은 오픈 소스이며, 이미 1,000명 이상의 크리에이터가 무료 비용으로 AI 비디오를 제작할 수 있도록 도왔다. 비디오 생성 모델의 엔지니어링화와 보급에 오랫동안 관심을 기울여 왔으며, 글의 내용은 모두 일선 실천과 직접 연구에서 나왔다

GitHub에서 보기

최종 업데이트2026-08-21

지금 시작할 준비가 되셨나요?

"세계적 수준의 AI를 모든 사람의 것으로 만들자." - 브루스 양. 완전 무료, 신용 카드, 고성능 그래픽 카드 없음, 비용 제로로 첫 AI 비디오를 만들어보세요. Agnes AI의 무료 비디오 모델을 사용하시겠습니까? 여기서부터 시작하면 됩니다.

GitHub 리포지토리를 클론하고 2분 안에 실행