2.0 — Drei-Pipeline-Architektur + mehrsprachige Web-UI

Drei-Pipeline-Architektur + mehrsprachige Web-UI

HauptVeröffentlicht am 16. Juni 2026Auf GitHub ansehen

Was ist neu

Funktionen & Verbesserungen

  • Drei Aufgabentypen mit gemeinsamer Basis — Einfaches Video (ein Prompt → ein Video über die Agnes-Video-API, t2v/i2v/ti2vid/keyframes), Kreatives Video (KI-Drehbuchautor → Storyboards → Szenenvideos → edge_tts-Erzählung → fein granulierte Untertitel → Zusammenführung), Manuskript-Video (Aufteilung langer Texte → KI-Szenenprompts → Segmentvideos → einheitliches TTS + Untertitel → Zusammenführung).
  • Mehrsprachige Web-UI — einseitiges Frontend mit drei Registerkarten (Einfach/Kreativ/Manuskript) mit i18n für 中文 / English / Русский / 日本語 / 한국어 / Bahasa Melayu / Bahasa Indonesia.
  • Echtzeit-Fortschritt — WebSocket-Push des Pipeline-Fortschritts; Aufgaben pausieren, fortsetzen und stoppen.
  • Fein abgestimmtes Untertitel-System — wortgenaue SRT-Gruppierung aus edge_tts-Zeitstempeln, CJK-Mehrzeilenumbruch, method="caption"-Rendering mit anpassbarer Kontur/Hintergrund/Position.

Refactoring & Optimierungen

  • Vierschichtige Architekturcore/api (Agnes Chat/Image/Video-Wrapper mit Retry + Polling), core/audio (edge_tts + SRT + moviepy-Overlay), core/compositor (Zusammenführung/Skalierung/Frameextraktion), core/pipelines (drei Pipeline-Implementierungen).
  • Pydantic-v2-Datenmodelle — typisierte Aufgaben-Unterklassen mit Serialisierung des persistenten Zustands und abwärtskompatiblem Aufgabenladen.
  • Zweiphasige Manuskript-Generierung — A/B-Aufteilung der Videogenerierung für Parallelität und schnellere Fertigstellung.

Fehlerbehebungen

  • MoviePy-2.x-Kompatibilität für Untertitel-bg_color/position; TTS-Lautstärke automatisch verstärkt.
  • CJK-Schriftart-Fallback für ältere Aufgaben; gebündelte Schriften für zuverlässiges Rendering.
  • Video-Frame-Obergrenze am Agnes-API-Limit (409 bei 720p) mit Auto-Retry bei vorübergehenden Fehlern.
  • Ein einzelnes kontinuierliches TTS + SRT für die Manuskript-Pipeline, wodurch Padding-Drift pro Segment entfällt.
  • Hinweis zu Kompatibilität/Konfigurationsänderung: Der Ein-Klick-Start start.sh von v1.0 enthält bereits venv-Erstellung und Abhängigkeitsinstallation; nach dem Upgrade bereitet der erste Start die Umgebung automatisch vor.

Über Agnes Video Generator

Ein komplett kostenloser Open-Source-KI-Videogenerator: Text wird zu mehrszenigen KI-Videos mit Erzählstimme und Untertiteln.

  • Kostenlos und Open Source – ohne Zahlung, ohne leistungsstarke GPU
  • Text-zu-Video, Bild-zu-Video, digitaler Moderator und Bildgenerierung
  • Basiert auf kostenlosen Agnes-KI-Modellen, Videos werden komplett in der Cloud erzeugt
  • Läuft per Web-UI, Docker oder npm, unterstützt Self-Hosting

Verwandte Seiten

Warum Sie dem vertrauen können

Dieser Artikel wurde von Praktikern an vorderster Front geschrieben. Beim Schreiben wurden Quellen aus erster Hand wie arXiv-Papiere, technische Berichte der Hersteller und der Stanford AI Index überprüft. Er basierte nicht auf Schlussfolgerungen aus subjektiven Eindrücken.

S

SandGrid@lcy362

Autor von Agnes Video Generator · Full-Stack-Entwickler

Unabhängiger Entwickler und Autor von Agnes Video Generator, einem Open-Source-Tool zur KI-Videogeneration. Das Projekt basiert auf dem völlig kostenlosen Videomodell von Agnes AI und dem Open-Source-MIT-Protokoll. Es hat mehr als 1.000 Schöpfern dabei geholfen, KI-Videos ohne Kosten zu erstellen. Ich achte seit langem auf die Konstruktion und Popularisierung von Modellen zur Videogenerierung, und der Inhalt des Artikels stammt aus der Praxis an vorderster Front und der Forschung aus erster Hand.

Auf GitHub ansehen

Zuletzt aktualisiert2026-08-21

Bereit zum Erstellen?

„Lassen Sie Weltklasse-KI jedem gehören. “– Bruce Yang. Völlig kostenlos, ohne Kreditkarte oder Hochleistungs-Grafikkarte, erstellen Sie Ihr erstes KI-Video ohne Kosten. Möchten Sie kostenlose Videomodelle von Agnes AI verwenden? Fangen Sie hier an.

Klonen Sie das GitHub-Repo und starten Sie in 2 Minuten