Elige el nivel según la fase
Explora con Lite, afina con Fast y reserva Quality para el plano que saldrá publicado. El mismo prompt sirve en los tres, así que cambiar de nivel no obliga a reescribirlo.
BestAIVideo
Veo 3.1 es el modelo de vídeo de Google que genera diálogos, efectos y ambiente a la vez que la imagen. Empieza con un prompt, anima un fotograma inicial o aporta hasta tres imágenes de referencia; después elige el nivel Lite, Fast o Quality y consulta el coste exacto en créditos antes de generar.
Veo 3.1 está pensado para clips breves y muy cuidados, con audio incluido. El generador ofrece tres niveles para que ajustes el coste a la fase del proyecto.
Lite es la opción más económica, Fast es el nivel equilibrado por defecto y Quality está pensado para los renders finales. Los tres ofrecen 720p, 1080p y 4K, y 1080p viene preseleccionado.
Cada clip llega con diálogos, efectos de sonido y sonido ambiente generados. No hay interruptor de audio, así que escribe en el prompt el sonido que quieres.
Anima un fotograma inicial, añade un fotograma final si lo necesitas o usa Omni Reference con una a tres imágenes en los niveles Lite y Fast para mantener la coherencia de un personaje o un producto.
Elige 4, 6 u 8 segundos, con 8 como valor por defecto, y una relación de aspecto de 16:9, 9:16 o automática para clips panorámicos, verticales o guiados por el fotograma.
La guía de prompts de Google para Veo 3.1 divide un buen prompt en varias partes. Úsalas como lista de comprobación, no como plantilla que copiar.
Combina cinematografía, sujeto, acción, contexto, y estilo y atmósfera. Empezar por el tipo de plano y el movimiento de cámara hace que el encuadre sea intencionado y no casual.
Escribe los diálogos entre comillas e indica quién habla; por ejemplo, una mujer dice una frase corta. Mantén las líneas habladas lo bastante breves para que quepan en un clip de pocos segundos.
Añade indicaciones como SFX para un efecto y Ambient noise para la sala o el paisaje. Nombrar el sonido aparte de la acción evita que se ignore.
Un prompt puede señalar momentos, como los dos primeros segundos y los tres siguientes. Es texto sin más, así que funciona en este único cuadro de prompt.
Un gato naranja plegado avanza con paso suave por un camino de piedra junto a árboles de papel, una rosa y una valla blanca, con un sonido ambiente a juego. Muestra cómo un prompt puede fijar el material de todo un mundo y, aun así, pedir un movimiento natural y con peso.
Un piloto de rojo se inclina en una curva mientras polvo brillante y luces flotantes llenan el encuadre. Los prompts estilizados como este funcionan mejor cuando nombran un solo sujeto y un solo movimiento y dejan que el entorno aporte el espectáculo.
Un travelling lateral sigue a un jinete con sombrero de ala ancha por una hierba luminosa, con el sol bajo al fondo. El prompt que hay detrás de un plano así concreta la posición de la cámara, la dirección de la luz y los sonidos tranquilos de la escena.
Explora con Lite, afina con Fast y reserva Quality para el plano que saldrá publicado. El mismo prompt sirve en los tres, así que cambiar de nivel no obliga a reescribirlo.
Si un plano depende de un producto o un personaje coherente, elige Lite o Fast para usar Omni Reference, porque el nivel Quality no tiene modo de referencia.
Ocho segundos son pocos. Un único sujeto que hace una sola cosa, con un único movimiento de cámara, se lee mucho mejor que una lista de sucesos.
Produce versiones en 16:9 y 9:16 de un spot breve sin una pasada de sonido aparte.
Anima una foto de producto desde un fotograma inicial y añade un fotograma final para que el plano termine en la pose que necesita tu diseño.
Usa de una a tres imágenes de referencia con el nivel Lite o Fast para llevar un personaje o un producto a varios clips.
Explora en 720p con Lite por 24 créditos y renderiza la idea elegida con Fast o Quality.
Sube la resolución a 4K en cualquier nivel cuando el clip vaya a una pantalla grande o a un montaje final.
Escribe una línea entre comillas con ambiente y efectos para prototipar una escena antes de un rodaje o una grabación de voz.
Veo 3.1 es el modelo de generación de vídeo de Google DeepMind. Crea clips breves a partir de texto, imágenes o referencias y genera el audio al mismo tiempo que la imagen.
Lite es el más barato, Fast es el nivel equilibrado por defecto y Quality es el de mayor coste, pensado para los renders finales. Google indica que Lite cuesta menos de la mitad que Veo 3.1 Fast, y en este sitio Quality cuesta unas cuatro veces más que Fast en 720p.
El precio es por vídeo y no cambia con la duración ni con la relación de aspecto. En 720p son 24 créditos en Lite, 48 en Fast y 200 en Quality. En 1080p son 28, 52 y 204, y el 4K parte de 120 créditos en Lite.
720p, 1080p o 4K en todos los niveles, y clips de 4, 6 u 8 segundos. Los valores por defecto son 1080p y 8 segundos.
Texto a vídeo, generación por fotogramas con un fotograma inicial obligatorio y uno final opcional, y Omni Reference. Omni Reference admite de una a tres imágenes y está disponible en Lite y Fast, no en Quality.
Sí, siempre. Los diálogos, los efectos y el ambiente se generan junto con el vídeo, y los controlas desde el prompt.
Pon las palabras habladas entre comillas e indica quién habla. Mantén las frases cortas, porque un clip dura solo unos segundos.
16:9, que es la predeterminada, 9:16 y automática.
Sí. Los prompts se traducen al inglés antes de generar, así que puedes escribir en el idioma con el que te sientas más cómodo. Procura que los términos clave, como los movimientos de cámara, queden claros.
Un prompt puede tener hasta 20 000 caracteres. Se aceptan imágenes de fotograma inicial, final y de referencia en formatos habituales como JPG, PNG y WebP, de menos de 30 MB cada una.
Fíjate primero en el sujeto y la acción, y después en el movimiento de cámara y la luz. Por último, escucha con los ojos cerrados: el ritmo de las voces y el ambiente se juzgan mejor cuando no estás mirando.
Elige tu nivel, escribe el prompt con su sonido y consulta el coste en créditos antes de generar.