3.0.0 — Независимое управление субтитрами и озвучкой + ИИ-стилизация субтитров + Цифровой ведущий + Генерация изображений
Независимое управление субтитрами и озвучкой + ИИ-стилизация субтитров + Цифровой ведущий + Генерация изображений
Что нового
Новые функции и улучшения
- Независимое управление субтитрами и озвучкой —
SubtitleConfigповышен до уровняAudioConfig, у каждого свой переключательenabled; четыре режима комбинации (озвучка+субтитры, только озвучка, только субтитры, без звука); новый параметрsubtitle_enabledв креативных и сценарных эндпоинтах. - ИИ-стилизация субтитров (режим LLM) —
style_mode"fixed"(глобальный стиль) или"llm"(позиция/цвет/размер каждой субтитры решает LLM);style_hintsпринимает указания на естественном языке («ключевые строки красным, сводки жёлтым»);generate_subtitle_styles()отправляет все субтитры LLM одним вызовом и рендерит через sidecarsubtitle_styles.json. - Тип задачи «Цифровой ведущий» — ИИ-ведущий через t2i или i2i (загруженная пользователем фотография); сценарий делится на абзацы по 5–12 секунд, каждый генерирует уникальный i2v-клип с разными жестами/выражениями; унифицированное TTS + оптимизированные LLM субтитры; аудио из модели или после склейки;
POST /api/tasks/anchor. - Простая генерация изображений — новая пятая вкладка; лёгкий
SimpleImageTask; поддержка системного промпта;GET /api/image/{id}для получения результата. - Поддержка системного промпта — опциональный системный промпт для простых видео- и изображений-задач, добавляемый перед итоговым промптом.
Рефакторинг и оптимизация
- Разделение шагов конвейера —
_step_audio_subtitleзаменён независимыми_step_audio+_step_subtitleв креативном и сценарном конвейерах. - Улучшения рендеринга субтитров — многострочный вывод с перекрытием 0,3 с, переходным перекрытием 0,8 с, двухпроходным
extend-endтаймингом, защитой от выхода за безопасные поля, вертикальным зонированием через LLM для визуального разнообразия.
Исправление ошибок
subprocess.runтеперь получаетstdin=DEVNULL, предотвращая зависание фоновых процессов из-за SIGTTIN.SilentTTSEngine.generate()возвращаетNone→ пустойdict, исправляя генерацию SRT в режиме только субтитров.- Таймлайн SRT основан на фактической длительности аудио, а не на расчётной длительности видео.
- При сбое генерации изображения выводится конкретная ошибка (HTTP status + body + traceback).
- Защитная обработка UTF-8 в конвейере цифрового ведущего; TTS генерируется заранее для получения фактической длительности аудио.
Об Agnes Video Generator
Полностью бесплатный генератор AI-видео с открытым исходным кодом: превращайте текст в многосценные AI-видео с озвучкой и субтитрами.
- Полностью бесплатно и с открытым кодом — без оплаты и мощной видеокарты
- Текст в видео, изображение в видео, цифровой ведущий и генерация изображений
- Работает на бесплатных моделях Agnes AI, видео генерируется в облаке
- Web UI, Docker, npm — несколько способов запуска, включая самостоятельное развёртывание
Похожие страницы
История версий
Журнал изменений Agnes Video Generator: новые функции, улучшения и исправления для каждого релиза.
Демо | Agnes Video
Введите промпт и создавайте AI-видео и изображения
API текст в видео — бесплатный API генерации AI-видео | Agnes Video
Программный вызов бесплатной видеомодели Agnes AI: полное покрытие REST API, такое как текст в видео, изображение в видео, генерация повествования и т. д., включая параметры запроса, аутентификацию носителя, опрос состояния задачи и полные примеры кода (Python/cURL/HTTP). Дружелюбный к разработчикам, нулевая стоимость, для доступа не требуется высокопроизводительная видеокарта.
Почему этому можно доверять
Эта статья была написана специалистами-практиками на переднем крае. При написании она была перекрестно проверена из первичных источников, таких как статьи arXiv, технические отчеты производителей и Стэнфордский индекс искусственного интеллекта, а не на основе субъективных впечатлений.
SandGrid@lcy362
Автор Agnes Video Generator · Full-stack разработчик
Независимый разработчик, автор инструмента генерации видео с открытым исходным кодом Agnes Video Generator. Проект основан на совершенно бесплатной видеомодели Agnes AI с открытым исходным кодом по протоколу MIT и помог более 1000 создателям создавать видео с искусственным интеллектом без нулевых затрат. Долгое внимание уделяется разработке и популяризации моделей генерации видео, содержание статей взято из передовой практики и исследований из первых рук.
Открыть на GitHubПоследнее обновление:2026-08-21
Готовы начать создавать?
«Пусть ИИ мирового класса принадлежит каждому», — Брюс Янг. Совершенно бесплатно, без кредитной карты или высокопроизводительной видеокарты, сделайте свое первое видео с искусственным интеллектом без затрат. Хотите использовать бесплатные видеомодели от Agnes AI? Просто начни здесь.
Клонируйте GitHub репозиторий и запустите за 2 минуты