Rotuladores y pizarra blanca
Dibujo lineal
Ilustración en color
Negocios y diagramas
Pizarras oscuras
Iniciar sesión con email
Para qué sirven los modelos de vídeo generativo, dónde se quedan cortos al enseñar y explicar, y cuándo encaja mejor un vídeo de pizarra blanca narrado. Todos los datos proceden de las páginas de los proveedores, comprobadas el 23 de septiembre de 2026.
Los modelos de vídeo generativo convierten un prompt en un clip corto con aspecto de grabación y sonido. Cada generación dura segundos, no minutos: 8 segundos en Veo 3.1, 15 en Kling VIDEO 3.0 y MiniMax H3, y 30 en Seedance 2.5. Un vídeo explicativo suele tener varios minutos de narración, y cada imagen debe corresponderse con la frase que se está diciendo. Crear uno a partir de clips implica escribir un prompt para cada plano, mantener una apariencia coherente, unir los clips y sincronizar la voz en off por tu cuenta. Un generador de vídeo de pizarra blanca parte del guion y dibuja una imagen para cada frase mientras se narra. StrokeVideo es un generador de vídeo de pizarra blanca; no es uno de estos modelos ni da acceso a ninguno de ellos.
OpenAI lanzó Sora 2 el 30 de septiembre de 2025 como un modelo de vídeo con diálogos y efectos de sonido sincronizados, junto con una app de Sora. El centro de ayuda de OpenAI indica ahora que las experiencias web y la app de Sora se cancelaron el 26 de abril de 2026, y que la API de Sora se cancelará el 24 de septiembre de 2026; su documentación de API marca sora-2 y sora-2-pro como obsoletos. Mientras funcionaba, la API creaba clips de hasta 20 segundos, ampliables hasta seis veces, hasta llegar a 120 segundos, y rechazaba personas reales, personajes protegidos por derechos de autor y música protegida. Si hoy eliges una herramienta para crear videos explicativos, Sora no es una opción. Fuentes, comprobadas el 23 de septiembre de 2026: https://openai.com/index/sora-2/ ; https://help.openai.com/en/articles/20001152-what-to-know-about-the-sora-discontinuation ; https://developers.openai.com/api/docs/guides/video-generation
Google DeepMind llama a Veo 3.1 su principal modelo de generación de vídeo, con audio generado de forma nativa y diálogos incluidos, y lo ofrece en la app de Gemini, Google Flow, Google Vids, Google AI Studio y la API de Gemini. La documentación de la API de Gemini indica duraciones de 4, 6 u 8 segundos (1080p y 4K solo a 8 segundos), y un vídeo de Veo puede ampliarse 7 segundos hasta 20 veces, con un máximo de 148 segundos. No es gratuito: la página de precios de la API de Gemini indica «Nivel gratuito: no disponible» para Veo 3.1, Veo 3.1 Fast y Veo 3.1 Lite, con precios desde 0,05 hasta 0,60 dólares por segundo de vídeo según la variante y la resolución. Además, la página de planes de Google AI incluye la generación de vídeo en la app de Gemini dentro de los planes de pago Plus, Pro y Ultra, no en el gratuito. Google también afirma que el audio hablado natural y coherente, especialmente en frases cortas, aún está en desarrollo. Fuentes, comprobadas el 23 de septiembre de 2026: https://deepmind.google/models/veo/ ; https://ai.google.dev/gemini-api/docs/veo ; https://ai.google.dev/gemini-api/docs/pricing ; https://gemini.google/subscriptions/
La guía de Kling para VIDEO 3.0, publicada el 6 de febrero de 2026, indica que cada generación dura entre 3 y 15 segundos. El modo de varios planos planifica los cortes y los ángulos de cámara; la vinculación de elementos mantiene la coherencia del personaje principal entre planos, y el audio nativo incluye diálogos en chino, inglés, japonés, coreano y español. También es el único proveedor de esta comparación que afirma algo sobre el texto: el modelo conserva de forma coherente el texto de una imagen subida, como un letrero, un subtítulo o un logotipo. La página de membresías de Kling incluye un plan Basic gratuito; quitar la marca de agua, usar el contenido con fines comerciales y generar en 1080p o 4K aparecen entre las ventajas de los planes de pago. Fuentes, comprobadas el 23 de septiembre de 2026: https://kling.ai/quickstart/klingai-video-3-model-user-guide ; https://kling.ai/app/membership/membership-plan
ByteDance describe Seedance 2.5 como un modelo de audio y vídeo creado para contar historias de 30 segundos: permite generar hasta 30 segundos de una vez, ampliarlos dos veces, editar el vídeo generado y controlarlo mediante un vídeo de referencia. BytePlus, que vende la API, indica duraciones de 4 a 30 segundos en 480p o 720p, mediante planes prepago, y hasta 50 imágenes, vídeos y clips de audio de referencia. No encontramos ningún nivel gratuito indicado en ninguna de las dos páginas. Fuentes, comprobadas el 23 de septiembre de 2026: https://seed.bytedance.com/en/seedance2_5 ; https://www.byteplus.com/en/product/seedance
La página de Hailuo AI para MiniMax H3, que también llama Hailuo 3, ofrece clips de 5 a 15 segundos a 24 fotogramas por segundo, con sonido estéreo nativo, salida de hasta 1440p y edición para sustituir o eliminar personas y objetos, o cambiar el diálogo de un clip existente. Esa página no ofrece un plan gratuito permanente; incluye una promoción para nuevos usuarios que, cuando la comprobamos, daba 3 pruebas gratuitas de H3 y 3.000 créditos para descargar la app MiniMax Design. Fuente, comprobada el 23 de septiembre de 2026: https://hailuoai.video/tools/minimax-h3
Hay tres obstáculos. Duración: una clase de cinco minutos requiere decenas de generaciones independientes. Texto: ninguna de las páginas que consultamos para Sora 2, Veo 3.1, Seedance 2.5 o MiniMax H3 indica con qué fiabilidad aparecen legibles las palabras, etiquetas o fórmulas escritas en un prompt. La afirmación de Kling se refiere al texto tomado de una imagen subida, así que debes hacer pruebas antes de depender de ella. Coherencia y coste: mantener iguales un personaje o un diagrama entre planos requiere configurar imágenes o elementos de referencia, y cada segundo tiene un coste, incluidos los intentos que descartas. Usa un modelo generativo cuando el espectador necesite ver algo real o cinematográfico: un producto en movimiento, un lugar, una introducción breve o un personaje que habla. Usa un vídeo de pizarra blanca cuando la explicación sea lo importante. Con StrokeVideo pegas tu guion o escribes un tema y la herramienta lo redacta; dibuja una imagen para cada frase, trazo a trazo y al ritmo de la narración en 14 idiomas, y permite descargar un MP4 sin marca de agua. Puedes crear 1 vídeo al día gratis, de hasta 4 minutos, y un plan permite hasta 15 minutos por vídeo. No crea imágenes realistas, personajes en movimiento ni diálogos sincronizados con los labios.
La ha escrito el equipo de StrokeVideo, que crea vídeos de pizarra blanca, así que tenlo en cuenta al leer la recomendación. Todas las afirmaciones sobre Sora 2, Veo, Kling, Seedance y Hailuo proceden de las páginas web o la documentación de los propios proveedores, consultadas el 23 de septiembre de 2026; las direcciones aparecen en cada sección. Cuando las páginas de un proveedor no indicaban algo, como la existencia de un nivel gratuito para Seedance 2.5 o el rendimiento de cualquier modelo con texto escrito en un prompt, lo decimos en lugar de tomar cifras de reseñas o clasificaciones de terceros. Estos productos cambian cada pocos meses, así que avísanos si algo de esta página ha quedado desactualizado.
| Modelo | Generación individual más larga (dato del proveedor) | Opción gratuita (según el proveedor) | Texto legible en la imagen | Más adecuado para |
|---|---|---|---|---|
| Sora 2 (OpenAI) | 20 segundos en la API, ampliable hasta 120 segundos | Cancelado: la app cerró el 26 de abril de 2026 y la API cierra el 24 de septiembre de 2026 | No encontramos afirmaciones sobre la calidad del texto en las páginas de OpenAI | No disponible para trabajos nuevos |
| Veo 3.1 (Google) | 8 segundos; ampliable en intervalos de 7 segundos hasta 148 segundos en la API | No: la generación de vídeo aparece en los planes de Google AI de pago y la API no tiene nivel gratuito | No encontramos afirmaciones sobre la calidad del texto en las páginas de Google | Escenas realistas o cinematográficas con efectos de sonido y diálogos |
| Kling VIDEO 3.0 | 15 segundos | Sí, plan Basic gratuito; quitar la marca de agua y usar el contenido con fines comerciales son ventajas de los planes de pago | Afirma conservar el texto de una imagen subida, como un letrero o logotipo; no afirma lo mismo sobre el texto escrito en un prompt | Escenas cortas con varios planos, personajes coherentes y diálogos |
| Seedance 2.5 (ByteDance) | 30 segundos, ampliable dos veces | Las páginas consultadas no indican que haya un nivel gratuito | No encontramos afirmaciones sobre la calidad del texto en las páginas de ByteDance | Escenas individuales más largas e historias de 30 segundos guiadas por imágenes, vídeo y audio de referencia |
| Hailuo (MiniMax H3) | 15 segundos | Promoción para nuevos usuarios, no un plan gratuito permanente | No encontramos afirmaciones sobre la calidad del texto en las páginas de MiniMax | Clips cortos con sonido estéreo y edición de personas, objetos o diálogos en un clip |
| StrokeVideo (vídeo de pizarra blanca, este sitio) | Hasta 15 minutos de narración en un solo vídeo | 1 vídeo al día, de hasta 4 minutos y sin marca de agua | Las etiquetas cortas se dibujan en las imágenes y una palabra dibujada puede salir mal; revisa las importantes | Clases, videos explicativos y formación a partir de un guion, narrados en 14 idiomas |
Ya no. OpenAI cerró la app y el sitio web de Sora el 26 de abril de 2026 y afirma que la API de Sora cierra el 24 de septiembre de 2026. Mientras funcionaba, cada generación duraba como máximo 20 segundos, por lo que una clase requería unir muchos clips y añadir la narración por tu cuenta.
No, según las propias páginas de Google consultadas el 23 de septiembre de 2026. La página de precios de la API de Gemini no ofrece un nivel gratuito para Veo 3.1, Veo 3.1 Fast ni Veo 3.1 Lite, y la página de planes de Google AI incluye la generación de vídeo en la app de Gemini dentro de los planes de pago Plus, Pro y Ultra. Las ofertas cambian, así que consulta la página de planes de Google.
Depende de lo que el espectador necesite ver. Para una escena realista, una imagen de producto o una introducción cinematográfica, un modelo generativo como Veo 3.1, Kling, Seedance o Hailuo está diseñado para eso. Para explicar un proceso, un concepto o una lección durante varios minutos de narración, un generador de vídeos de pizarra blanca que dibuja una imagen por cada frase del guion es más rápido de crear y más fácil de seguir. Algunas personas usan ambos: un clip corto generado para abrir el vídeo y un vídeo de pizarra blanca para la explicación.
Por generación, según los proveedores: Veo 3.1 permite hasta 8 segundos, Kling VIDEO 3.0 y MiniMax H3 hasta 15 segundos, y Seedance 2.5 hasta 30 segundos. Veo y Seedance pueden ampliar un clip; en la API de Gemini, un vídeo de Veo puede alcanzar 148 segundos. Un vídeo de pizarra blanca de StrokeVideo puede incluir hasta 15 minutos de narración de una sola vez.
Ninguna de las páginas oficiales que consultamos sobre Sora 2, Veo 3.1, Seedance 2.5 o MiniMax H3 indica con qué fiabilidad aparece legible el texto escrito en un prompt. La guía de Kling afirma que VIDEO 3.0 mantiene coherente el texto de una imagen subida, como un cartel o un logotipo. Si tus videos explicativos dependen de etiquetas, fórmulas o subtítulos, haz una prueba primero o añade el texto después en un editor.
No. StrokeVideo no usa ni proporciona acceso a ninguno de los modelos de esta página. Crea un solo tipo de vídeo: un vídeo explicativo de pizarra blanca dibujado a mano, trazo a trazo y al ritmo de la narración.