
Veo
Modelo de vídeo de Google DeepMind que genera clips a partir de texto
¿Qué es Veo?
Veo es la familia de modelos de generación de vídeo desarrollada por Google DeepMind. Convierte descripciones de texto, y en algunos casos imágenes de referencia, en clips de vídeo con movimiento de cámara y estilo visual coherentes. Se utiliza sobre todo para prototipar ideas audiovisuales, crear piezas cortas para redes y explorar conceptos creativos sin necesidad de rodaje ni equipo de producción.

¿Para qué sirve Veo?
- Generar clips cortos para redes sociales a partir de texto
- Prototipar planos y storyboards antes de un rodaje real
- Crear recursos visuales de relleno para vídeos y presentaciones
- Explorar estilos visuales y encuadres para una campaña
- Producir piezas creativas sin equipo ni localizaciones
Características principales
- Generación de vídeo a partir de descripciones de texto
- Control del estilo visual y del movimiento de cámara
- Salida en alta resolución según el plan disponible
- Integración con las herramientas experimentales de Google
- Soporte de imagen de referencia como punto de partida
Ventajas
- Respaldado por la investigación de Google DeepMind
- Buena coherencia temporal entre fotogramas del mismo clip
- Entiende indicaciones descriptivas relativamente complejas
Inconvenientes
- El acceso puede estar limitado por región o lista de espera
- La duración de los clips generados es corta
- El control fino sobre el resultado sigue siendo limitado
Precio de Veo
| Plan | Precio | Para quién |
|---|---|---|
| Google AI Plus | 4,99 €/mes | Entrada de gama con acceso básico a generación de vídeo y 400 GB de almacenamiento. |
| Google AI Pro | 21,99 €/mes | Para uso creativo habitual: generación de vídeo ampliada, prueba limitada de Veo 3.1 Lite, 1.000 créditos mensuales de Flow y 5 TB. |
| Google AI Ultra | 99,99 €/mes o 219,99 €/mes | Para producción intensiva: límites 5x o 20x, 10.000-25.000 créditos de Flow y acceso anticipado a funciones avanzadas. |
| API Veo 3.1 (estándar) | 0,40 $/segundo (720p y 1080p), 0,60 $/segundo (4K) | Uso por Gemini API para integrarlo en productos propios. |
| API Veo 3.1 Fast | 0,10 $/segundo (720p), 0,12 $/segundo (1080p), 0,30 $/segundo (4K) | Variante rápida y más barata para volumen. |
| API Veo 3.1 Lite | 0,05 $/segundo (720p), 0,08 $/segundo (1080p) | La opción más económica por API, sin 4K. |
Veo no se vende suelto: se accede vía suscripciones Google AI (precios en euros para España, tomados de gemini.google/subscriptions) o vía Gemini API pagando por segundo de vídeo generado (precios en dólares). La documentación de la Gemini API indica expresamente 'no disponible' para Veo en el nivel gratuito, y solo se cobra si el vídeo se genera correctamente. El modelo vigente es Veo 3.1.
Precios consultados en agosto de 2026 en la web oficial de Veo. Pueden cambiar sin previo aviso.
Alternativas a Veo
Otras herramientas de Video que puedes comparar con Veo:
Comparativas con Veo
Preguntas frecuentes sobre Veo
¿Qué es Veo?
Veo es un modelo de inteligencia artificial de Google DeepMind capaz de generar vídeo a partir de descripciones de texto. Se usa para crear clips cortos, prototipar ideas audiovisuales y explorar estilos visuales sin necesidad de rodar con cámara ni contratar producción.
¿Veo es gratis?
Suele existir un acceso gratuito con límites de uso a través de las herramientas de Google, mientras que las funciones más avanzadas se reservan a planes de pago. La disponibilidad varía según el país.
¿Veo funciona en español?
Las indicaciones suelen entenderse mejor en inglés, aunque los modelos de Google admiten instrucciones en varios idiomas. Si buscas resultados más precisos, conviene escribir la descripción en inglés y revisar el resultado antes de publicarlo.
¿Buscas algo parecido? Explora todas las herramientas de Generativa.