6.0.0 — Modo manual: pausar, refinar y continuar en cada punto de control

Modo manual: pausar, refinar y continuar en cada punto de control

MayorPublicado el 17 de agosto de 2026Ver en GitHub

Novedades

Modo manual (puntos de control humano-en-el-bucle)

  • Pausa en puntos de control — el pipeline se detiene en un punto de control después de producir los artefactos, espera tu acción y continúa desde la última etapa confirmada.
  • Puntos de pausa finos (creativo) — hasta 10 etapas: análisis de imagen, historia, guion y narración, referencia de personaje, prompts de imagen final, generación de imagen final, videos, audio, subtítulos y composición final.
  • Puntos de pausa estándar (manuscrito / poesía / avatar) — 6 etapas: escenas, referencias, videos, audio, subtítulos y final.
  • Puntos de pausa predeterminados rellenados — se completan automáticamente según el tipo de tarea al crear (editables; los puntos no marcados se pasan automáticamente).
  • No compatible — los videos simples (toma única) y las tareas de imagen simples solo muestran la lista de artefactos al completarse.

Cuatro formas de refinar artefactos

  • 🤖 Edición asistida por IA — describe tu cambio (p. ej. "haz que la escena 2 sea más cinematográfica") y el modelo integrado reescribe el artefacto; revisa el diff antes de aplicar.
  • ✏️ Editar localmente — copia la ruta del artefacto y edita el archivo directamente (JSON / SRT / imágenes / videos), luego haz clic en "modificado, continuar".
  • 🤝 Agente externo — copia un prompt de colaboración listo y entrega el artefacto a un agente local más capaz (p. ej. opencode / CodeBuddy CLI / ffmpeg / PIL), luego rellena el resultado.
  • 💻 Edición en línea — edita artefactos de texto (guion / narración / subtítulos) en un diálogo en la página con comparación lado a lado con el original.

Grafo de dependencias a nivel de artefacto (volver a ejecutar solo lo que cambió)

  • Editar narración → vuelve a ejecutar solo audio / subtítulos / final.
  • Editar descripciones de escenas → vuelve a ejecutar solo imágenes de referencia / videos / final.
  • Un prompt "antes de la modificación" enumera exactamente qué artefactos se regenerarán frente a los que se conservarán.

Cambiar entre modos automático y manual en cualquier momento

  • Cambia una tarea automática a manual mientras se ejecuta: se pausa en el siguiente punto de control seguro.
  • Cambia una tarea manual de vuelta a automática mientras está en pausa: se borran los puntos de pausa y se ejecuta hasta el final.

Otras funciones y mejoras

  • Página de progreso de tarea dedicada — una vista de progreso de página completa y enfocada con línea de tiempo de pasos y estado en vivo.
  • Página de detalle de tarea — se abre en una nueva pestaña con enlaces al sitio oficial y guía de soporte.
  • Fijación de tarjetas de proyecto — fija una tarjeta de tarea al principio de la lista; las vistas previas de artefactos se expanden automáticamente.
  • Botón "continuar sin cambios" en cada punto de pausa: omitir revisión en cualquier canal.
  • Scripts de inicio bilingües — los prompts se adaptan a la configuración regional del sistema.
  • i18n completo en 22 idiomas — traducciones faltantes completadas, más un nuevo verificador de completitud de idiomas como puerta de regresión de versión y un selector de idioma en el encabezado de progreso.

Refactorización y optimizaciones

  • Mecanismo de puntos de control unificado entre pipelines — el mismo sistema de puntos de control MultiScenePipeline ahora impulsa tareas creativas, de manuscrito, poesía y avatar, con matrices de artefactos por tipo.
  • Grafo de dependencias de artefactos independientecore/dependency_graph.py es un módulo puro y declarativo de tabla de aristas (nivel de producto + nivel de parámetro) compartido por la predicción de impacto, el manejo de aprobaciones y el resaltado del frontend; completamente probado por unidades.
  • Manifiestos de artefactos estandarizados — listas checkpoint.json por punto de control y MANIFEST.md en el directorio de tareas hacen que cada artefacto intermedio sea descubrible, legible y rellenable.
  • Reanudar omite los pasos de construcción de escenas completados — evita llamadas LLM duplicadas al reanudar tareas de Creativo / Avatar / Poesía.

Correcciones de errores

  • Corregido un botón de "abrir ventana de edición" no clicable causado por un desajuste de nombres de campos de artefactos del punto de control.
  • Corregidas las indicaciones de puerto en uso multi-PID para que el comando kill se emita como una sola línea copiable.
  • Correcciones del flujo de control de progreso: la UI de pausa se limpia inmediatamente después de reanudar, y las tareas en cola/ejecución ahora muestran mensajes de progreso en tiempo real.
  • La generación de la imagen de referencia del personaje se movió a la fase de referencias para un orden correcto.
  • Pulido de la UI del modo manual: estados deshabilitados visibles, compatibilidad del filtro de artefactos, plegado automático de etapas anteriores y reanudación de tareas inacabadas inactivas.

Acerca de Agnes Video Generator

Un generador de video con IA completamente gratuito y de código abierto: convierte texto en videos IA de varias escenas con narración y subtítulos.

  • Gratis y de código abierto: sin pagos, sin GPU de alta gama
  • Texto a video, imagen a video, presentador digital y generación de imágenes
  • Impulsado por los modelos gratuitos de Agnes AI, videos generados íntegramente en la nube
  • Funciona con Web UI, Docker o npm, admite autoalojamiento

Páginas relacionadas

Por qué puedes confiar

Este artículo fue escrito por profesionales de primera línea. Al escribirlo, se verificaron fuentes de primera mano, como artículos de arXiv, informes técnicos de fabricantes y Stanford AI Index, y no se basaron en conclusiones basadas en impresiones subjetivas.

S

SandGrid@lcy362

Autor de Agnes Video Generator · Desarrollador Full-Stack

Desarrollador independiente y autor de Agnes Video Generator, una herramienta de generación de vídeo con IA de código abierto. El proyecto se basa en el modelo de video completamente gratuito de Agnes AI y el protocolo MIT es de código abierto. Ha ayudado a más de 1.000 creadores a producir videos de IA a costo cero. He estado preocupado durante mucho tiempo por la ingeniería y la popularización de modelos de generación de video, y el contenido de los artículos proviene de la práctica de primera línea e investigación de primera mano.

Ver en GitHub

Última actualización2026-08-21

¿Listo para empezar?

“Que la IA de clase mundial pertenezca a todos.” – Bruce Yang. Completamente gratis, sin tarjetas de crédito ni tarjetas gráficas de alto rendimiento, haz tu primer video de IA a costo cero. ¿Quieres usar los modelos de vídeo gratuitos de Agnes AI? Simplemente comience aquí.

Clona el repositorio de GitHub y lanza en 2 minutos