# Prompts Para Vídeos Con IA Que Aguantan Pasados 3 Segundos

URL: https://prexi.art/es/journal/prompts-videos-ia
Type: blog
Locale: es
Published: 2026-10-05
Updated: 2026-10-05

---

> Deja de describir imágenes y dirige la escena: cinco casillas, lenguaje real de cámara y una línea de bloqueo, más tres prompts para copiar en Veo, Kling o Runway.

Escribiste "un plano cinematográfico impactante de una ciudad de noche" y obtuviste ocho segundos de sopa de neón derretida. Bienvenido al club. Los buenos **prompts para videos con ia** no describen una imagen. Dirigen una escena: quién hace qué, adónde se mueve la cámara, cuánto dura, qué queda congelado. Aquí abajo tienes la estructura de cinco partes que robamos de cada prompt que funciona, más ejemplos listos para copiar que puedes soltar en Veo, Kling o Runway hoy mismo.

## Por qué tu prompt se derrite después de dos segundos

Un prompt de imagen estática describe un fotograma. Un prompt de vídeo tiene que describir tiempo. Esa es toda la diferencia, y es la razón por la que un hábito de Midjourney se desmorona en cuanto presionas el botón de vídeo.

Cuando solo describes una estética, el modelo tiene que inventar el movimiento. Elige la opción más perezosa: un zoom lento, una cara a la deriva, un fondo que se reorganiza en silencio. Pediste una atmósfera y obtuviste un protector de pantalla.

La solución es obvia y funciona. Nombra el **sujeto**, una **acción**, el **movimiento de cámara**, la **luz** y una cosa que debe **permanecer igual**. Cinco casillas. Pierde una y el modelo la completa por ti, casi siempre mal.

La propia [guía de prompts de Veo de Google](https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide) llega al mismo esqueleto: sujeto, acción, estilo, posición y movimiento de cámara, composición, atmósfera. Solo lo simplificamos para que puedas mantenerlo en tu cabeza mientras escribes.

## La fórmula de cinco casillas, con un prompt para robar

Aquí está el marco. Escríbelo en este orden, en una o dos frases claras, y mantente por debajo de unos 60 palabras en el primer intento.

- 
**Sujeto**: una frase nominal con dos especificidades. "Un repartidor con chaqueta amarilla de lluvia", no "una persona".

- 
**Acción**: un verbo, un momento. "Cruza la calle y se detiene bajo un cartel parpadeante".

- 
**Cámara**: tamaño de plano más movimiento. "Ángulo bajo, impulso lento hacia adelante".

- 
**Luz y grado**: "luz de sodio, asfalto mojado, grano de película de 35 mm".

- 
**Bloqueo**: qué permanece fijo. "La cartelería de fondo permanece estática, sin personajes extra".

Roba este:

> Un repartidor con chaqueta amarilla de lluvia cruza una calle vacía por la noche y se detiene bajo un cartel parpadeante. Ángulo bajo, impulso lento hacia adelante, grano de película de 35 mm, luz de sodio reflejada en asfalto mojado. La cartelería y los edificios permanecen estáticos, sin personajes extra, sin texto.

Nota qué falta. No hay "épico", no hay "obra maestra", no hay "8K ultra detallado". Esas palabras son residuos de la era de modelos de imagen y añaden ruido, no dirección. Gasta esos tokens en la cámara en lugar de eso.

![Cámara vintage en un carril deslizante de trípode en un estudio oscuro, lista para un movimiento lento de dolly](https://fdzlnqpwsaniezitwiuw.supabase.co/storage/v1/object/public/cms-media/prexi/2026-10/d651e0-img1.webp)

## Lenguaje de cámara: tu mejora más barata

Si solo corriges una casilla, corrígela esta. Los modelos han visto millones de videoclips etiquetados con vocabulario cinematográfico, así que los términos de cámara reales tiran del comportamiento real. Los vagas tiran del promedio.

Una hoja de trucos corta que realmente cambia los resultados:

- 
**Impulso hacia adelante / retroceso**: los movimientos más seguros. Empieza aquí.

- 
**Plano de seguimiento**: la cámara sigue al sujeto lateralmente o por detrás. Perfecto para escenas de caminata.

- 
**Órbita / arco**: poderoso, también el movimiento más probable para deformar caras. Mantén el clip corto.

- 
**Fijo bloqueado**: subestimado. Un plano de trípode con solo el sujeto moviéndose es lo más estable que puedas pedir.

- 
**Mano sostenida**: añade vida, añade temblor. Di "sutil" o tendrás cámara de terremoto.

Un movimiento por clip. Dos movimientos simultáneos ("órbita mientras haces zoom y alzas la toma") es donde muere la física. Si quieres una revelación compleja, constrúyela como planos separados y únelos en edición.

## Prompts de imagen a vídeo: describe el movimiento, no la imagen

Comenzar desde una imagen estática es el código de trucos silencioso de toda esta profesión. Fijas el aspecto con un modelo de imagen primero, luego animas. El prompt de vídeo deja de ser una descripción y se convierte en una acotación escénica.

La imagen ya contiene el sujeto, la luz y la paleta. Repetirlas desperdicia palabras y a veces choca con el fotograma. Escribe solo qué **se mueve**:

> La mujer gira la cabeza lentamente hacia la ventana. Las cortinas se alzan con una brisa ligera. La cámara permanece fija. Todo lo demás en el fotograma permanece exactamente como está.

Esa última frase importa más de lo que parece. "Todo lo demás permanece como está" es un bloqueo barato contra los fondos a la deriva que delatan el metraje de IA.

Si estás construyendo referencias en Midjourney o Flux primero, mantén la composición simple: un sujeto claro, espacio alrededor para que la cámara se mueva. Una imagen estática abarrotada no le da nada seguro al modelo de vídeo en qué empujar.

![Línea de tiempo de edición de vídeo borrosa en un monitor por encima de un cuaderno de esquemas de ángulos de cámara](https://fdzlnqpwsaniezitwiuw.supabase.co/storage/v1/object/public/cms-media/prexi/2026-10/f643a9-img2.webp)

## Prompts que valen la pena copiar: tres escenas, tres trabajos

Las librerías de prompts aman el volumen. Nosotros preferimos darte tres que cada una enseña un reflejo diferente. Remixea libremente, pero comienza desde estos.

**El golpe de producto.** Corto, controlado, sin humanos para deformar.

> Plano macro de una taza de cerámica mate sobre un mostrador de piedra al amanecer. El vapor se eleva lentamente. Un retroceso lento revela una cocina iluminada por el sol. Luz suave de ventana, profundidad de campo reducida. La forma de la taza y el mostrador permanecen inalterados. Sin manos, sin texto.

**La pieza de atmósfera.** Un personaje, un gesto, mucha atmósfera.

> Una figura solitaria con paraguas camina alejándose por un callejón mojado de neón de noche. Plano amplio bloqueado, destello anamórfico, lluvia fuerte, reflejos mojados, grano de película de 35 mm. La figura sigue caminando a un ritmo constante. Sin cortes.

**El bucle.** Para fondos, secciones de héroe, publicaciones de redes sociales que necesitan reproducirse sin costuras.

> Nubes a la deriva lentamente sobre una cresta de montaña en la hora dorada, cámara estática, paralaje suave en el pasto de primer plano. Grado de película suave. El movimiento es sutil y continuo, los fotogramas de inicio y final se ven igual.

Cada uno sigue las cinco casillas. Cada uno termina con un bloqueo. Ese es el patrón, y es por eso que se mantienen unidos después del tercer segundo.

![Una figura solitaria con paraguas que camina alejándose por un callejón mojado de neón de noche, fotograma cinematográfico](https://fdzlnqpwsaniezitwiuw.supabase.co/storage/v1/object/public/cms-media/prexi/2026-10/bfc6da-img3.webp)

## Sonido, duración y relación de aspecto: las configuraciones que la gente olvida

Tres detalles se sientan fuera de las cinco casillas y aún arruinan clips cuando se ignoran.

**Duración.** Los clips cortos se mantienen unidos, los largos se desmoronan. Si un modelo ofrece cinco a ocho segundos, pide un momento y detente. ¿Necesitas treinta segundos? Planifica seis tomas, no una generación heroica. Los editores han cortado en la acción durante un siglo por una razón.

**Relación de aspecto.** Decide antes de escribir, porque la composición depende de ella. Un impulso lento hacia adelante por un pasillo se ve hermoso en 16:9 y se siente apretado en 9:16. Para vertical, coloca el sujeto en el tercio central y deja espacio de cabeza para cromo de interfaz. Di la relación en el prompt si la herramienta te lo permite.

**Sonido.** Algunos modelos ahora generan audio con la imagen. Si el tuyo lo hace, escribe el sonido como escribes la toma: "zumbido distante de tráfico, lluvia en un toldo de metal, una sirena amortiguada". Omite solicitudes de música a menos que realmente las necesites. Querrás puntuarla tú mismo de todos modos.

Aquí hay una versión del prompt del repartidor con sonido añadido:

> Un repartidor con chaqueta amarilla de lluvia cruza una calle vacía y se detiene bajo un cartel parpadeante. Ángulo bajo, impulso lento hacia adelante, grano de película de 35 mm, 16:9. Sonido ambiental: lluvia constante, tráfico distante, zumbido eléctrico débil del cartel. Sin diálogo, sin texto.

Las mismas cinco casillas, una línea extra. Ese es el upgrade completo.

## ¿Qué modelo para qué prompt?

Mismo prompt, modelo diferente, resultado diferente. No esperes que un prompt maestro viaje bien. Algunas generalizaciones honestas, ningún benchmark pretendido:

Veo maneja bien oraciones largas, descriptivas y cinematográficas y puede llevar pistas de diálogo y sonido cuando las escribes. Kling tiende a recompensar la acción física clara e instrucciones de cámara, y es un hogar cómodo para imagen-a-vídeo. Runway le gustan los prompts apretados y restringidos y te da más control manual una vez que estás iterando.

Si prefieres no hacer malabarismos con tres pestañas, Higgsfield pone varios modelos de vídeo detrás de un espacio de trabajo. Eso es útil cuando quieres ejecutar el mismo prompt a través de dos motores y comparar, que es la forma más rápida de aprender en qué se enfoca realmente cada uno.

Nuestra posición: elige un modelo, aprende sus peculiaridades durante una semana, luego ramifícate. Cambiar de motor cada vez que un clip decepciona no te enseña nada.

## Omite estos hábitos (te cuestan créditos)

Algunos consejos circulan porque suenan inteligentes. No lo son. Omite:

- 
**Pilas de palabras de calidad.** "Ultra realista, 8K, obra maestra, ganador de premio" no hace un vídeo mejor. Diluye la instrucción.

- 
**Prompts largos tipo novela.** Después de aproximadamente 100 palabras, los modelos pierden detalles iniciales. Corto y específico vence largo y poético.

- 
**Pedir texto en el fotograma.** Los signos, subtítulos y logos generalmente se distorsionan a mitad del clip. Añade títulos en tu editor.

- 
**Cinco acciones en un clip.** Cinco segundos caben en un momento. Divide el resto en generaciones separadas.

- 
**Reescribir desde cero cada vez.** Mantén un prompt que funcione, cambia una casilla, compara. Eso es un experimento real.

## Cómo iterar sin quemar tus créditos

Trata cada generación como una prueba, no como un boleto de lotería. Cambia una casilla a la vez. Si el movimiento es incorrecto, toca la línea de acción. Si el aspecto se desmorona, aprieta el bloqueo. Si la cámara flota, cambia "órbita" por "impulso lento hacia adelante".

Mantén una nota ejecutándose de qué funcionó, en cualquier formato que realmente volverás a abrir. Las tableros Are.na funcionan bien para esto, al igual que un archivo de texto simple. El punto es que tu tercer prompt debe comenzar desde el ganador del segundo prompt, no desde cero.

Y revisa los clips silenciados primero. Juzga el movimiento por su cuenta antes de dejar que una bonita banda sonora lo perdone.

## Qué probar esta noche

Elige una escena de las tres anteriores, ejecútala en un solo modelo, y cambia solo la línea de cámara. Ejecútala tres veces: estática, impulso hacia adelante, seguimiento. Coloca los clips uno al lado del otro. Aprenderás más de ese experimento de diez minutos que de cualquier lista de cien prompts.

Copia el prompt, suéltalo adentro, y mira qué se quiebra. Luego dinos qué casilla arreglarias primero.

## FAQ

### ¿Qué hace que un prompt de vídeo de IA sea bueno?

Un buen prompt de vídeo de IA nombra un sujeto, una acción, un movimiento de cámara, la luz y una línea de bloqueo para lo que debe permanecer sin cambios. Describe tiempo y movimiento, no solo un fotograma único.

### ¿Cuán largo debe ser un prompt de vídeo de IA?

Apunta a 40 a 80 palabras en el primer intento. Pasadas aproximadamente 100 palabras, la mayoría de los modelos comienzan a soltar detalles iniciales, así que corto y específico vence largo y poético.

### ¿Necesito prompts diferentes para Veo, Kling y Runway?

Sí, espera ajustes. Veo maneja bien oraciones cinematográficas largas y pistas de sonido, Kling recompensa la acción física clara, y Runway le gustan los prompts apretados. Mantén las cinco casillas y reformula el resto.

### ¿Cómo escribo prompts de imagen a vídeo?

Omite describir la imagen, ya que ya contiene sujeto, luz y paleta. Escribe solo lo que se mueve, nombra el comportamiento de la cámara, y añade que todo lo demás permanece exactamente como está.

### ¿Cuál es la diferencia entre un prompt de imagen y uno de vídeo?

Un prompt de imagen describe un fotograma estático. Un prompt de vídeo describe tiempo y movimiento. Necesita sujeto, acción, movimiento de cámara, luz y una línea de bloqueo para lo que debe permanecer igual.

### ¿Cuántas acciones puedo incluir en un prompt de vídeo?

Una acción por clip. Dos acciones simultáneas casi siempre resultan en deformaciones y artefactos. Si necesitas más, divide el contenido en varios clips y únelos en edición.

### ¿Cómo evito que los fondos se desmoronen o cambien en mis vídeos de IA?

Usa una línea de bloqueo clara al final de tu prompt: 'El fondo permanece estático' o 'Todo lo demás en el fotograma queda exactamente como está'. Esta es la técnica más efectiva.