6.3.0 — Versionshinweise
Versionshistorie von Agnes Video Generator: neue Funktionen, Verbesserungen und Fehlerbehebungen pro Version.
Was ist neu
Funktionen & Verbesserungen
- v6-Optimierungs-Roadmap vollständig abgeschlossen (29/29 Punkte) — alle Batches der v6-Roadmap sind jetzt ausgeliefert:
- Leistung (Batch 2): Die finale Kompositionskette basiert jetzt auf ffmpeg — Szenen mit identischen Parametern werden per
-c copyzusammengefügt, Audio-Ausrichtung/Lautstärke/Stummpadding laufen in einem einzigen Filterdurchlauf zusammen, und Untertitel werden über den ASS-Pfad mit Stilen pro Eintrag gerendert (AGNES_SUBTITLE_ASS, mit automatischem Fallback auf den moviepy-Pfad). Gedicht-Videos komponieren alle Szenen in einem Durchgang statt pro Szene neu zu kodieren. Ein dedizierter Encoding-Threadpool isoliert schwere ffmpeg/moviepy-Arbeit von API-Anfragen, und der Token-Bucket-Rate-Limiter hat einen nativen asynchronen Pfad erhalten, sodass das Stoppen einer Aufgabe während Wartezeiten durch das Ratenlimit sofort wirkt. - Zuverlässigkeit & Engineering (Batch 1): Der Aufgabenstatus folgt dem Single-Writer-Prinzip mit Sperre pro Aufgabe, Fortsetzen unterstützt persistierte TTS-Cues auf Wortebene (keine erneute Synthese beim Fortsetzen), Video-Polling ist adaptiv und Multi-Szenen-Wartezeiten laufen parallel, die Aufgabenliste ist mit
limit/offset/status-Paginierung indiziert, veraltete Artefakte/Fehlerprotokolle werden verwaltet, und das Frontend stoppt das Polling in Hintergrund-Tabs mit exponentiellem Backoff und einem Verbindungsverlust-Banner. - Frontend & i18n: Übersetzungen sind in lazy-geladene Chunks pro Sprache aufgeteilt — das JS-Bundle des ersten Bildschirms sinkt von ~721 kB auf ~305 kB (gzip 226 kB → 97 kB, -58 %). Formular-Abläufe für Senden/Bestätigen/Toasts wurden in gemeinsame Composables vereinheitlicht; dazu kamen Mobile-Layout, Modals mit Fokus-Falle,
prefers-reduced-motion-Unterstützung und Formular-Entwürfe. - Beobachtbarkeit & Betrieb (Batch 3): neue Endpunkte
GET /api/healthundGET /api/metrics, optionales rotierendes Datei-Logging (AGNES_LOG_FILE) und ein Docker-HEALTHCHECK. Laufzeiteinstellungen sind jetzt über typisiertespydantic-settingszusammengeführt (mit.env-Unterstützung), sodass Parallelitätsgrenzen dynamisch mit der Anzahl der API-Keys skalieren. - Sofortige Fehlerbehebungen (Batch 0): Stoppen bricht jetzt sofort ab, ohne Retry-Backoff; Event-Loop-Blockaden (Wasserzeichen-Re-Encoding, synchrone Downloads) wurden aus dem Loop verlagert; das Löschen aus mehreren Keys funktioniert korrekt; eine Frontend-
v-html-XSS-Schwachstelle wurde geschlossen; die Bilderzeugung erhielt einen Schutz vor doppeltem Absenden. - Volle Unterstützung von 22 Sprachen inkl. Arabisch — die UI hatte bereits 22 Sprachen; dieses Release vervollständigt den Stimmenkatalog für alle. Die arabische UI wird vollständig unterstützt (PR #32), und 8 UI-Sprachen (Türkisch, Vietnamesisch, Thailändisch, Tagalog, Hindi, Persisch, Bengalisch, Urdu) erhalten edge_tts-Stimmgruppierungen mit Anzeige nativer Stimmnamen, Regexes zur Schrift-Erkennung (Thai/Devanagari/Bengalisch) und Untertitel-Font-Fallback pro Schrift (neue mitgelieferte Noto-Fonts; Persisch/Urdu nutzen die arabische Reshape+Bidi-Pipeline).
- Transparente Analytics-Offenlegung & Datenschutzkontrollen — das Einstellungsfenster zeigt jetzt eine klare, einklappbare Datenschutz-Karte, die genau auflistet, welche Nutzungsstatistiken gemeldet werden (und was nie hochgeladen wird: Prompts, Manuskripte, Gedichte, API-Keys und Referenzbilder werden vor der Meldung anonymisiert). Analytics lässt sich in der Karte vollständig deaktivieren.
- Vollständige Fehler-Tracebacks im Feedback-Bericht — Pipeline-Fehler speichern jetzt das vollständige
tracebackim Aufgabenstatus; der Diagnose-Endpunkt und der In-App-Feedbackbericht enthalten ihn, sodass Sie vollständige Fehlerdetails (z. B. Umgebungsfehler wie[WinError 2]) ohne Blick auf die Serverkonsole direkt in GitHub-Issues einfügen können.
Refactoring & Optimierungen
- FFmpeg-first-Kompositionskette — der finale Assembler-Pfad für Kreativ-/Manuskript-/Anchor-/Gedicht-Videos wurde von 3-4 vollständigen Re-Encodes auf Copy-Concat + einen einzigen Filterdurchlauf umgestellt (mit sanitem Fallback auf den bisherigen moviepy-Pfad). Dies ist der größte Leistungsgewinn der v6-Linie und verkürzt die finale Assemblierungszeit bei typischen Ausgaben um grob das 3-10-Fache.
- Asynchrones Rate-Limiting mit dediziertem Encoding-Threadpool — der Token Bucket bietet jetzt einen nativen, stoppbaren asynchronen Acquire-Pfad, und schweres Encoding läuft in einem dedizierten Executor, sodass lange Encoding-Jobs den Anfragepfad nicht mehr aushungern.
Fehlerbehebungen
- Stoppen-Verhalten behoben — das Abbrechen einer Aufgabe löst kein Retry-Backoff (bis zu ~2 Minuten) mehr aus und löscht keinen fortsetzbaren
video_idmehr. - Multi-Key-Konfiguration behoben — Key-IDs werden jetzt aus dem tatsächlichen Key gehasht, sodass das Löschen eines Keys aus mehreren konfigurierten Keys genau diesen Key entfernt.
- Event-Loop-Einfrieren behoben — Wasserzeichen-Re-Encoding und synchrone Downloads blockieren nicht mehr den ganzen Dienst; ein Semaphore-Release-Bug, der bei niedrigen Rate-Limit-Einstellungen das Parallelitätslimit dauerhaft zerstören konnte, ist behoben.
- Frontend-Probleme behoben — eine Stored-XSS-Schwachstelle über uneskapiertes
v-htmlist geschlossen, doppeltes Absenden der Bilderzeugung ohne Schutz wird verhindert, und Fetch-Fehler zeigen jetzt lesbare Backend-Meldungen statt stiller Fehlschläge. - Keine Konfigurationsänderungen erforderlich. Bestehende Aufgaben bleiben fortsetzbar; das Format der Aufgabenzustandsdateien ist unverändert.
Über Agnes Video Generator
Ein komplett kostenloser Open-Source-KI-Videogenerator: Text wird zu mehrszenigen KI-Videos mit Erzählstimme und Untertiteln.
- Kostenlos und Open Source – ohne Zahlung, ohne leistungsstarke GPU
- Text-zu-Video, Bild-zu-Video, digitaler Moderator und Bildgenerierung
- Basiert auf kostenlosen Agnes-KI-Modellen, Videos werden komplett in der Cloud erzeugt
- Läuft per Web-UI, Docker oder npm, unterstützt Self-Hosting
Verwandte Seiten
Versionshinweise
Versionshistorie von Agnes Video Generator: neue Funktionen, Verbesserungen und Fehlerbehebungen pro Version.
Online-Demo testen | Agnes Video
Geben Sie einen Prompt ein und generieren Sie sofort KI-Videos und -Bilder
Text-zu-Video-API — Kostenlose KI-Videogenerierungs-API, keine GPU | Agnes Video
Programmatischer Aufruf des kostenlosen Videomodells von Agnes AI: Text in Video, Bild in Video, Erzählgenerierung usw. vollständige Abdeckung der REST-API, einschließlich Anforderungsparameter, Bearer-Authentifizierung, Aufgabenstatusabfrage und vollständigen Codebeispielen (Python/cURL/HTTP). Entwicklerfreundlich, ohne Kosten und ohne Hochleistungs-Grafikkarte zum Zugriff.
Warum Sie dem vertrauen können
Dieser Artikel wurde von Praktikern an vorderster Front geschrieben. Beim Schreiben wurden Quellen aus erster Hand wie arXiv-Papiere, technische Berichte der Hersteller und der Stanford AI Index überprüft. Er basierte nicht auf Schlussfolgerungen aus subjektiven Eindrücken.
SandGrid@lcy362
Autor von Agnes Video Generator · Full-Stack-Entwickler
Unabhängiger Entwickler und Autor von Agnes Video Generator, einem Open-Source-Tool zur KI-Videogeneration. Das Projekt basiert auf dem völlig kostenlosen Videomodell von Agnes AI und dem Open-Source-MIT-Protokoll. Es hat mehr als 1.000 Schöpfern dabei geholfen, KI-Videos ohne Kosten zu erstellen. Ich achte seit langem auf die Konstruktion und Popularisierung von Modellen zur Videogenerierung, und der Inhalt des Artikels stammt aus der Praxis an vorderster Front und der Forschung aus erster Hand.
Auf GitHub ansehenZuletzt aktualisiert:2026-08-21
Bereit zum Erstellen?
„Lassen Sie Weltklasse-KI jedem gehören. “– Bruce Yang. Völlig kostenlos, ohne Kreditkarte oder Hochleistungs-Grafikkarte, erstellen Sie Ihr erstes KI-Video ohne Kosten. Möchten Sie kostenlose Videomodelle von Agnes AI verwenden? Fangen Sie hier an.
Klonen Sie das GitHub-Repo und starten Sie in 2 Minuten