3.0.0 — Независимое управление субтитрами и озвучкой + ИИ-стилизация субтитров + Цифровой ведущий + Генерация изображений

Независимое управление субтитрами и озвучкой + ИИ-стилизация субтитров + Цифровой ведущий + Генерация изображений

ОсновнаяВыпущена 21 июня 2026 г.Смотреть на GitHub

Что нового

Новые функции и улучшения

  • Независимое управление субтитрами и озвучкойSubtitleConfig повышен до уровня AudioConfig, у каждого свой переключатель enabled; четыре режима комбинации (озвучка+субтитры, только озвучка, только субтитры, без звука); новый параметр subtitle_enabled в креативных и сценарных эндпоинтах.
  • ИИ-стилизация субтитров (режим LLM)style_mode "fixed" (глобальный стиль) или "llm" (позиция/цвет/размер каждой субтитры решает LLM); style_hints принимает указания на естественном языке («ключевые строки красным, сводки жёлтым»); generate_subtitle_styles() отправляет все субтитры LLM одним вызовом и рендерит через sidecar subtitle_styles.json.
  • Тип задачи «Цифровой ведущий» — ИИ-ведущий через t2i или i2i (загруженная пользователем фотография); сценарий делится на абзацы по 5–12 секунд, каждый генерирует уникальный i2v-клип с разными жестами/выражениями; унифицированное TTS + оптимизированные LLM субтитры; аудио из модели или после склейки; POST /api/tasks/anchor.
  • Простая генерация изображений — новая пятая вкладка; лёгкий SimpleImageTask; поддержка системного промпта; GET /api/image/{id} для получения результата.
  • Поддержка системного промпта — опциональный системный промпт для простых видео- и изображений-задач, добавляемый перед итоговым промптом.

Рефакторинг и оптимизация

  • Разделение шагов конвейера_step_audio_subtitle заменён независимыми _step_audio + _step_subtitle в креативном и сценарном конвейерах.
  • Улучшения рендеринга субтитров — многострочный вывод с перекрытием 0,3 с, переходным перекрытием 0,8 с, двухпроходным extend-end таймингом, защитой от выхода за безопасные поля, вертикальным зонированием через LLM для визуального разнообразия.

Исправление ошибок

  • subprocess.run теперь получает stdin=DEVNULL, предотвращая зависание фоновых процессов из-за SIGTTIN.
  • SilentTTSEngine.generate() возвращает None → пустой dict, исправляя генерацию SRT в режиме только субтитров.
  • Таймлайн SRT основан на фактической длительности аудио, а не на расчётной длительности видео.
  • При сбое генерации изображения выводится конкретная ошибка (HTTP status + body + traceback).
  • Защитная обработка UTF-8 в конвейере цифрового ведущего; TTS генерируется заранее для получения фактической длительности аудио.

Об Agnes Video Generator

Полностью бесплатный генератор AI-видео с открытым исходным кодом: превращайте текст в многосценные AI-видео с озвучкой и субтитрами.

  • Полностью бесплатно и с открытым кодом — без оплаты и мощной видеокарты
  • Текст в видео, изображение в видео, цифровой ведущий и генерация изображений
  • Работает на бесплатных моделях Agnes AI, видео генерируется в облаке
  • Web UI, Docker, npm — несколько способов запуска, включая самостоятельное развёртывание

Похожие страницы

Почему этому можно доверять

Эта статья была написана специалистами-практиками на переднем крае. При написании она была перекрестно проверена из первичных источников, таких как статьи arXiv, технические отчеты производителей и Стэнфордский индекс искусственного интеллекта, а не на основе субъективных впечатлений.

S

SandGrid@lcy362

Автор Agnes Video Generator · Full-stack разработчик

Независимый разработчик, автор инструмента генерации видео с открытым исходным кодом Agnes Video Generator. Проект основан на совершенно бесплатной видеомодели Agnes AI с открытым исходным кодом по протоколу MIT и помог более 1000 создателям создавать видео с искусственным интеллектом без нулевых затрат. Долгое внимание уделяется разработке и популяризации моделей генерации видео, содержание статей взято из передовой практики и исследований из первых рук.

Открыть на GitHub

Последнее обновление2026-08-21

Готовы начать создавать?

«Пусть ИИ мирового класса принадлежит каждому», — Брюс Янг. Совершенно бесплатно, без кредитной карты или высокопроизводительной видеокарты, сделайте свое первое видео с искусственным интеллектом без затрат. Хотите использовать бесплатные видеомодели от Agnes AI? Просто начни здесь.

Клонируйте GitHub репозиторий и запустите за 2 минуты