3.0.0 — Unabhängige Steuerung von Untertiteln & Erzähler + KI-Untertitelstil + Digitaler Moderator + Bildgenerierung
Unabhängige Steuerung von Untertiteln & Erzähler + KI-Untertitelstil + Digitaler Moderator + Bildgenerierung
Was ist neu
Funktionen & Verbesserungen
- Unabhängige Steuerung von Untertiteln & Erzähler —
SubtitleConfigwird zu einem gleichrangigen Pendant vonAudioConfigmit eigenemenabled-Schalter; vier Kombinationsmodi (Erzähler+Untertitel, nur Erzähler, nur Untertitel, stumm); neuer Parametersubtitle_enabledfür kreative und Manuskript-Endpunkte. - KI-Untertitelstil (LLM-Modus) —
style_mode"fixed"(globaler Stil) oder"llm"(Position/Farbe/Schriftgröße je Untertitel vom LLM entschieden);style_hintsakzeptiert natürlichsprachige Vorgaben („Schlüsselzeilen rot, Zusammenfassungen gelb“);generate_subtitle_styles()sendet alle Untertitel in einem Aufruf an das LLM und rendert über die Sidecar-Dateisubtitle_styles.json. - Aufgabentyp „Digitaler Moderator“ — KI-Moderator per t2i oder i2i (vom Nutzer hochgeladenes Referenzfoto); Manuskript wird in 5–12-Sekunden-Absätze geteilt, jeder erzeugt einen einzigartigen i2v-Clip mit unterschiedlichen Gesten/Ausdrücken; vereinheitlichtes TTS + LLM-optimierte Untertitelüberlagerung; Audio aus dem Modell oder nach der Zusammenführung;
POST /api/tasks/anchor. - Einfache Bildgenerierung — neue fünfte Registerkarte; leichtgewichtiger
SimpleImageTask; System-Prompt-Unterstützung;GET /api/image/{id}zum Abrufen der Ergebnisse. - System-Prompt-Unterstützung — optionaler System-Prompt für einfache Video- und Bildaufgaben, dem endgültigen Prompt vorangestellt.
Refactoring & Optimierungen
- Aufteilung der Pipeline-Schritte —
_step_audio_subtitlewird durch unabhängige_step_audio+_step_subtitlein kreativen und Manuskript-Pipelines ersetzt. - Verbesserungen beim Untertitel-Rendering — mehrzeilige Anzeige mit 0,3 s Überlappung, 0,8 s Übergangsüberlappung, zweipassigem
extend-end-Timing, Überlaufschutz für sichere Ränder, LLM-gestützter vertikaler Zonenplatzierung für visuelle Abwechslung.
Fehlerbehebungen
subprocess.runerhält jetztstdin=DEVNULL, um SIGTTIN-Hänger von Hintergrundprozessen zu verhindern.SilentTTSEngine.generate()gibtNone→ leeresdictzurück und behebt damit die SRT-Erzeugung im Nur-Untertitel-Modus.- SRT-Zeitachse basiert auf der tatsächlichen Audiolänge statt der geschätzten Videolänge.
- Bei fehlgeschlagener Bildgenerierung wird ein konkreter Fehler ausgegeben (HTTP-Status + Body + Traceback).
- Defensive UTF-8-Kodierungsbehandlung in der Digital-Moderator-Pipeline; TTS wird zuerst erzeugt, um die tatsächliche Audiolänge zu erhalten.
Über Agnes Video Generator
Ein komplett kostenloser Open-Source-KI-Videogenerator: Text wird zu mehrszenigen KI-Videos mit Erzählstimme und Untertiteln.
- Kostenlos und Open Source – ohne Zahlung, ohne leistungsstarke GPU
- Text-zu-Video, Bild-zu-Video, digitaler Moderator und Bildgenerierung
- Basiert auf kostenlosen Agnes-KI-Modellen, Videos werden komplett in der Cloud erzeugt
- Läuft per Web-UI, Docker oder npm, unterstützt Self-Hosting
Verwandte Seiten
Versionshinweise
Versionshistorie von Agnes Video Generator: neue Funktionen, Verbesserungen und Fehlerbehebungen pro Version.
Online-Demo testen | Agnes Video
Geben Sie einen Prompt ein und generieren Sie sofort KI-Videos und -Bilder
Text-zu-Video-API — Kostenlose KI-Videogenerierungs-API, keine GPU | Agnes Video
Programmatischer Aufruf des kostenlosen Videomodells von Agnes AI: Text in Video, Bild in Video, Erzählgenerierung usw. vollständige Abdeckung der REST-API, einschließlich Anforderungsparameter, Bearer-Authentifizierung, Aufgabenstatusabfrage und vollständigen Codebeispielen (Python/cURL/HTTP). Entwicklerfreundlich, ohne Kosten und ohne Hochleistungs-Grafikkarte zum Zugriff.
Warum Sie dem vertrauen können
Dieser Artikel wurde von Praktikern an vorderster Front geschrieben. Beim Schreiben wurden Quellen aus erster Hand wie arXiv-Papiere, technische Berichte der Hersteller und der Stanford AI Index überprüft. Er basierte nicht auf Schlussfolgerungen aus subjektiven Eindrücken.
SandGrid@lcy362
Autor von Agnes Video Generator · Full-Stack-Entwickler
Unabhängiger Entwickler und Autor von Agnes Video Generator, einem Open-Source-Tool zur KI-Videogeneration. Das Projekt basiert auf dem völlig kostenlosen Videomodell von Agnes AI und dem Open-Source-MIT-Protokoll. Es hat mehr als 1.000 Schöpfern dabei geholfen, KI-Videos ohne Kosten zu erstellen. Ich achte seit langem auf die Konstruktion und Popularisierung von Modellen zur Videogenerierung, und der Inhalt des Artikels stammt aus der Praxis an vorderster Front und der Forschung aus erster Hand.
Auf GitHub ansehenZuletzt aktualisiert:2026-08-21
Bereit zum Erstellen?
„Lassen Sie Weltklasse-KI jedem gehören. “– Bruce Yang. Völlig kostenlos, ohne Kreditkarte oder Hochleistungs-Grafikkarte, erstellen Sie Ihr erstes KI-Video ohne Kosten. Möchten Sie kostenlose Videomodelle von Agnes AI verwenden? Fangen Sie hier an.
Klonen Sie das GitHub-Repo und starten Sie in 2 Minuten