3.0.0 — Unabhängige Steuerung von Untertiteln & Erzähler + KI-Untertitelstil + Digitaler Moderator + Bildgenerierung

Unabhängige Steuerung von Untertiteln & Erzähler + KI-Untertitelstil + Digitaler Moderator + Bildgenerierung

HauptVeröffentlicht am 21. Juni 2026Auf GitHub ansehen

Was ist neu

Funktionen & Verbesserungen

  • Unabhängige Steuerung von Untertiteln & ErzählerSubtitleConfig wird zu einem gleichrangigen Pendant von AudioConfig mit eigenem enabled-Schalter; vier Kombinationsmodi (Erzähler+Untertitel, nur Erzähler, nur Untertitel, stumm); neuer Parameter subtitle_enabled für kreative und Manuskript-Endpunkte.
  • KI-Untertitelstil (LLM-Modus)style_mode "fixed" (globaler Stil) oder "llm" (Position/Farbe/Schriftgröße je Untertitel vom LLM entschieden); style_hints akzeptiert natürlichsprachige Vorgaben („Schlüsselzeilen rot, Zusammenfassungen gelb“); generate_subtitle_styles() sendet alle Untertitel in einem Aufruf an das LLM und rendert über die Sidecar-Datei subtitle_styles.json.
  • Aufgabentyp „Digitaler Moderator“ — KI-Moderator per t2i oder i2i (vom Nutzer hochgeladenes Referenzfoto); Manuskript wird in 5–12-Sekunden-Absätze geteilt, jeder erzeugt einen einzigartigen i2v-Clip mit unterschiedlichen Gesten/Ausdrücken; vereinheitlichtes TTS + LLM-optimierte Untertitelüberlagerung; Audio aus dem Modell oder nach der Zusammenführung; POST /api/tasks/anchor.
  • Einfache Bildgenerierung — neue fünfte Registerkarte; leichtgewichtiger SimpleImageTask; System-Prompt-Unterstützung; GET /api/image/{id} zum Abrufen der Ergebnisse.
  • System-Prompt-Unterstützung — optionaler System-Prompt für einfache Video- und Bildaufgaben, dem endgültigen Prompt vorangestellt.

Refactoring & Optimierungen

  • Aufteilung der Pipeline-Schritte_step_audio_subtitle wird durch unabhängige _step_audio + _step_subtitle in kreativen und Manuskript-Pipelines ersetzt.
  • Verbesserungen beim Untertitel-Rendering — mehrzeilige Anzeige mit 0,3 s Überlappung, 0,8 s Übergangsüberlappung, zweipassigem extend-end-Timing, Überlaufschutz für sichere Ränder, LLM-gestützter vertikaler Zonenplatzierung für visuelle Abwechslung.

Fehlerbehebungen

  • subprocess.run erhält jetzt stdin=DEVNULL, um SIGTTIN-Hänger von Hintergrundprozessen zu verhindern.
  • SilentTTSEngine.generate() gibt None → leeres dict zurück und behebt damit die SRT-Erzeugung im Nur-Untertitel-Modus.
  • SRT-Zeitachse basiert auf der tatsächlichen Audiolänge statt der geschätzten Videolänge.
  • Bei fehlgeschlagener Bildgenerierung wird ein konkreter Fehler ausgegeben (HTTP-Status + Body + Traceback).
  • Defensive UTF-8-Kodierungsbehandlung in der Digital-Moderator-Pipeline; TTS wird zuerst erzeugt, um die tatsächliche Audiolänge zu erhalten.

Über Agnes Video Generator

Ein komplett kostenloser Open-Source-KI-Videogenerator: Text wird zu mehrszenigen KI-Videos mit Erzählstimme und Untertiteln.

  • Kostenlos und Open Source – ohne Zahlung, ohne leistungsstarke GPU
  • Text-zu-Video, Bild-zu-Video, digitaler Moderator und Bildgenerierung
  • Basiert auf kostenlosen Agnes-KI-Modellen, Videos werden komplett in der Cloud erzeugt
  • Läuft per Web-UI, Docker oder npm, unterstützt Self-Hosting

Verwandte Seiten

Warum Sie dem vertrauen können

Dieser Artikel wurde von Praktikern an vorderster Front geschrieben. Beim Schreiben wurden Quellen aus erster Hand wie arXiv-Papiere, technische Berichte der Hersteller und der Stanford AI Index überprüft. Er basierte nicht auf Schlussfolgerungen aus subjektiven Eindrücken.

S

SandGrid@lcy362

Autor von Agnes Video Generator · Full-Stack-Entwickler

Unabhängiger Entwickler und Autor von Agnes Video Generator, einem Open-Source-Tool zur KI-Videogeneration. Das Projekt basiert auf dem völlig kostenlosen Videomodell von Agnes AI und dem Open-Source-MIT-Protokoll. Es hat mehr als 1.000 Schöpfern dabei geholfen, KI-Videos ohne Kosten zu erstellen. Ich achte seit langem auf die Konstruktion und Popularisierung von Modellen zur Videogenerierung, und der Inhalt des Artikels stammt aus der Praxis an vorderster Front und der Forschung aus erster Hand.

Auf GitHub ansehen

Zuletzt aktualisiert2026-08-21

Bereit zum Erstellen?

„Lassen Sie Weltklasse-KI jedem gehören. “– Bruce Yang. Völlig kostenlos, ohne Kreditkarte oder Hochleistungs-Grafikkarte, erstellen Sie Ihr erstes KI-Video ohne Kosten. Möchten Sie kostenlose Videomodelle von Agnes AI verwenden? Fangen Sie hier an.

Klonen Sie das GitHub-Repo und starten Sie in 2 Minuten