Blog
Cómo escribir indicaciones de vídeo de IA que realmente funcionen (Guía del pilar 2026)
La mayoría de las "guías rápidas de IA" están escritas por personas que han generado quizás diez videos. Te dicen que seas específico. Te dicen que agregues "4K cinematográfico". Luego te dejan varado en el momento en que el sujeto se transforma en un boceto de Cronenberg en el tercer intento.
Por Gürsu Yaman · Fundador, muvi.video ·
Cómo escribir mensajes de vídeo con IA que realmente funcionen
La mayoría de las "guías rápidas de IA" están escritas por personas que han generado quizás diez videos. Te dicen que seas específico. Te dicen que agregues "4K cinematográfico". Luego te dejan varado en el momento en que el sujeto se transforma en un boceto de Cronenberg en el tercer intento.
Un mensaje de vídeo de IA que funciona hace cuatro cosas a la vez. Nombra un tema claro. Pone ese tema en una escena con geografía real. Le dice a la cámara qué hacer. Y especifica un estado de ánimo o estilo al que el modelo puede aferrarse. Sáltate cualquiera de esos y tendrás esperanza. Golpea los cuatro y estarás dirigiendo.
Esta guía es la versión larga. Vamos a desglosar la anatomía de un buen mensaje, los patrones que funcionan en Veo 3.1, Seedance 2.0 y Kling 3.0, los errores que arruinan sus resultados, el bucle de iteración que realmente se compone y las plantillas que puede utilizar para cortos de TikTok, tomas de héroes de productos, escenas de diálogo y B-roll. Sin tonterías, sin "desbloquear la creatividad", sin ejemplos falsos. Justo lo que hemos aprendido al enviar miles de clips de IA.
Si eres nuevo, comienza primero con cómo hacer videos de IA. Si desea recomendaciones de plataformas, consulte nuestro desglose de los mejores generadores de videos con IA. De lo contrario, entremos en ello.
La anatomía de un mensaje de trabajo
Todo buen mensaje de vídeo de IA se basa en los mismos seis ingredientes. Puedes dejar uno de vez en cuando, pero las indicaciones más fuertes las incluyen todas y las colocas aproximadamente en este orden:
1. Sujeto, quién o qué está en el cuadro 2. Escena, dónde están, qué hay a su alrededor, la geografía 3. Acción/Movimiento, qué está pasando, quién se mueve y cómo 4. Cámara, ángulo, distancia, movimiento, lente 5. Iluminación, dirección, color, estado de ánimo 6. Estilo, referencia visual o señal estética
Aquí hay un mensaje débil: "Un chef cocinando".
Aquí está la misma idea construida a partir de los seis ingredientes:
"Un chef de mediana edad con un desgastado delantal azul marino se encuentra frente a una estufa de acero inoxidable en un izakaya de Tokio con poca luz. Da la vuelta a un pequeño trozo de pescado en una sartén de hierro fundido humeante; el pescado hace un arco una vez y aterriza plano. Primer plano medio a la altura del pecho, la cámara empuja lentamente la sartén. Una cálida luz de tungsteno desde arriba se mezcla con el frío brillo azul de una ventana detrás de él. Lente cinematográfica, anamórfica, ligero grano de película."
La primera versión hace que el modelo adivine todo. El segundo le dice exactamente dónde colocar la cámara, cómo se ilumina el chef y cómo se ve la acción paso a paso. Los modelos como Veo 3.1 no recompensan las tonterías detalladas, pero sí recompensan este tipo de especificidad en capas.
La regla general de 30 a 80 palabras
Apunte a entre 30 y 80 palabras para la mayoría de las tomas. Por debajo de 30 estás subdireccionando. Por encima de 100, comienzas a sentir fatiga inmediata, los modelos eliminan los elementos que escribiste más adelante en la oración. Si su escena realmente necesita más, divídala en dos clips y únalos.
Patrones rápidos que funcionan en todos los modelos
Algunas estructuras rápidas se generalizan. Trabajan en Veo 3.1, trabajan en Seedance 2.0, trabajan en Kling 3.0. Memorízalos y tendrás una base para el 80% de las tomas que necesites escribir.
Patrón 1: Asunto, Acción, Escenario, Cámara, Estilo
El valor predeterminado para todo uso. Utilízalo cuando no estés seguro de por dónde empezar.
"Un labrador negro (sujeto) corre por un callejón de adoquines húmedos (acción + escenario), plano de seguimiento bajo desde un costado al nivel del suelo (cámara), reflejos de neón en los charcos, paleta de colores ciberpunk de mal humor (estilo)".
Patrón 2: establecer, mover, revelar
Es mejor cuando quieres que la cámara haga el trabajo de contar historias.
"Toma aérea amplia de un pueblo de montaña nevado dormido al amanecer. La cámara desciende lentamente y avanza por la calle principal, revelando finalmente una única ventana iluminada donde un panadero está amasando masa. Luz rosada suave del amanecer, nevadas suaves."
Patrón 3: Mantener, Disparar, Reacción
La fórmula diálogo/momento personaje. Fuerte en Veo 3.1, maneja bien escenas de múltiples ritmos y genera de forma nativa audio ambiental y de diálogo junto con el video (según la documentación del producto de Google, verifique en la plataforma).
"Primer plano de una mujer leyendo una carta en una mesa de madera de la cocina. Termina de leer, exhala y se le llenan los ojos de lágrimas. La cálida luz de la tarde entra por una ventana detrás de ella. Cámara estática, lente de 35 mm, poca profundidad de campo."
Patrón 4: Héroe del producto
El caballo de batalla del comercio electrónico. Funciona igual de bien como mensaje de texto a video o como mensaje de imagen a video con una foto del producto adjunta.
"Foto de estudio de un estuche para auriculares inalámbricos de color negro mate sobre un pedestal de concreto pulido. El estuche gira lentamente 90 grados mientras la cámara orbita en la dirección opuesta. Luz suave desde la parte superior izquierda, luz sutil en el borde desde atrás, sombra profunda. Estética limpia, minimalista y premium."
Patrón 5: Textura B-Roll
Para cortes y tomas de atmósfera que completan una edición más larga.
"Foto macro de espresso llenando lentamente una pequeña taza de cerámica blanca. El vapor se eleva. Cálida luz de la mañana desde la ventana izquierda. Poca profundidad de campo, ligero grano de película, sin música."
Patrón 6: Estilizado / Animado
Cuando no quieres fotorrealismo.
"Animación 2D dibujada a mano, estilo Studio Ghibli. Una joven con un impermeable amarillo salta en un charco en una calle lluviosa de un pueblo. El agua salpica en cámara lenta. Fondos de acuarela suaves, paleta de colores pastel apagados, textura suave pintada a mano."
Patrón 7: Ritmo de diálogo (modelos con audio)
Para Veo 3.1 y cualquier modelo que tenga audio nativo.
"Dos amigos se sientan uno frente al otro en un reservado de un restaurante. El de la izquierda dice en voz baja: 'Vas a estar bien'. El otro asiente pero no habla. Luz cenital suave y cálida. Cámara estática de dos planos medianos. Ruido ambiental del restaurante, charla baja, tintineos de cubiertos distantes".
Elija un patrón, complete los espacios en blanco, genere. Iterar desde allí.
Matices de indicaciones específicos del modelo
Los patrones se generalizan. Pero cada modelo tiene su propia personalidad y las indicaciones que lo impulsan hacia un gran trabajo difieren. Esto es lo que hemos aprendido del uso diario intenso de los tres.
Veo 3.1, premia el lenguaje cinematográfico
Veo 3.1 se entrenó con una gran cantidad de metraje filmado profesionalmente y se nota. Cuando escribes en términos cinematográficos, "lente anamórfica", "enfoque en rack", "dolly in", "luz clave a 3/4", "poca profundidad de campo", Veo lo traduce sorprendentemente literalmente. También es el único modelo convencional que ofrece buen audio nativo, por lo que si su toma tiene algún diseño de sonido (diálogo, ambiente, SFX), Veo es el indicado. Resista la tentación de sobrecargar el mensaje con adjetivos; Veo prefiere una dirección estructurada y específica a un muro de vibraciones. Para obtener información detallada sobre Veo 3.1, consulte nuestra guía completa de Veo 3.1.
Seedance 2.0, premia las tomas continuas más largas
Seedance 2.0 admite cualquier duración de clip entera de 4 a 15 segundos, el rango más amplio en el catálogo de muvi.video. Cuando una escena necesita un arco de movimiento sostenido que el techo de 8 segundos de Veo 3.1 no puede encajar, Seedance es la ruta. También admite seis relaciones de aspecto (1:1, 9:16, 16:9, 4:3, 3:4, 21:9) frente a las 16:9/9:16 de Veo únicamente, por lo que para formatos verticales plus, cuadrados o ultraanchos ofrece más margen de composición. La resolución tiene un límite de 720p (1440p en la variante de cuadro inicial/final), así que reserve Seedance para escenas donde la duración y la flexibilidad de la relación de aspecto importan más que la fidelidad a nivel de píxeles. La variante Omni-Reference acepta hasta nueve referencias de imágenes, tres de vídeo y tres de audio, lo que resulta útil para la continuidad de los personajes en una serie de clips.
Kling 3.0, premia la brevedad y la claridad
Kling es rápido, lo que significa que es perfecto para la iteración. Pero funciona peor que Veo o Seedance cuando las indicaciones se vuelven largas o técnicas. Reduce el vocabulario cinematográfico, mantén tus indicaciones en menos de 50 palabras y apóyate en descripciones visuales simples. Kling brilla especialmente en sujetos humanos, rostros expresivos y clips rápidos de formato social. Si su mensaje necesita tres comas para describir la iluminación, está escribiendo para Veo, no para Kling. Hay tres variantes disponibles: Texto a vídeo, Imagen a vídeo y Kling O3.
Un atajo: crea un prototipo de tu disparo en Kling porque es barato y rápido. Una vez que el encuadre y el movimiento sean correctos, regenere la versión final en Veo 3.1 usando el mensaje que ahora ha refinado. El flujo de trabajo de dos modelos le ahorra horas.
Errores comunes al escribir mensajes (y cómo solucionarlos)
Estos son los patrones que vemos una y otra vez en indicaciones que no funcionan. Cada uno viene con una mala versión y una reescritura.
Error 1: tema vago
Malo: "Una persona caminando por una calle."
Solución: "Una mujer de unos treinta años con una gabardina larga beige camina por una calle estrecha parisina con las manos en los bolsillos".
El modelo necesita una cara para renderizar. "Una persona" no le da nada, elegirá lo que sugiera el promedio del conjunto de datos, y el promedio rara vez es interesante.
Error 2: No hay geografía de escena
Malo: "Un perro corriendo en un parque."
Solución: "Un golden retriever corre desde el lado izquierdo del cuadro hacia la derecha, a través de un amplio césped salpicado de hojas de otoño y árboles altos al fondo".
Si el modelo no sabe dónde está el sujeto en el espacio, éste termina flotando. Dale a la cámara una idea de dónde están las cosas entre sí.
Error 3: Sin dirección de movimiento
Malo: "El auto se aleja."
Solución: "El auto rojo se aleja de la cámara, acelera en la distancia y la carretera se curva ligeramente hacia la derecha".
"Se aleja" es ambiguo. ¿Hacia la cámara? ¿Lejos de eso? ¿Oblicuo? Dile al modelo el vector.
Error 4: apilar adjetivos en lugar de especificar
Malo: "Un vídeo hermoso, cinematográfico, impresionante y profesional de una puesta de sol."
Solución: "Una toma estática amplia del sol poniéndose detrás de una hilera de pinos en una ladera, el cielo cambiando de dorado a magenta intenso, time-lapse, 4K."
El apilamiento de adjetivos no agrega información. Las modelos no pueden distinguir "hermoso" de "deslumbrante". Pueden distinguir una toma amplia de un primer plano.
Error 5: señales de estilo contradictorias
Malo: "Anime fotorrealista en un estilo documental negro de los años 50".
Solución: Elige uno. Negro fotorrealista. O anime de inspiración noir. No mezcles estéticas incompatibles, el modelo las promedia y obtendrás confusión visual.
Error 6: ignorar la relación de aspecto en el mensaje
Malo: "Una toma vertical estilo TikTok, pero generada en 16:9 y luego recortada".
Solución: Genera la relación de aspecto en la que publicarás. El modelo compone la toma para el lienzo que le asignas. Una toma de 16:9 recortada a 9:16 siempre pierde al sujeto.
Error 7: Sin dirección de audio (en modelos con capacidad de audio)
Malo: "Una escena de cafetería". (en Veo 3.1)
Solución: "Escena de una cafetería. Charla ambiental, máquina de espresso silbando de fondo, jazz suave sonando bajo".
Veo 3.1 genera audio ya sea que lo dirijas o no. Si no lo especifica, obtendrá una cama ambiental genérica. Dedica dos segundos a decirle cómo suena la habitación.
El bucle de iteración (cómo se construyen realmente las buenas indicaciones)
Nadie escribe un gran mensaje en el primer intento. Los creadores que obtienen resultados consistentemente buenos no son más talentosos, sino que iteran con disciplina. Aquí está el bucle que funciona.
Paso 1: escriba su mensaje de referencia
Utilice uno de los patrones de la Sección 3. No optimice todavía. Simplemente toma los seis ingredientes.
Paso 2: generar una vez en un modelo rápido
Utilice Kling 2.0 u otro modelo rápido. No estás intentando producir el clip final, estás probando si el modelo entendió la escena.
Paso 3: diagnosticar, no reescribir
Mire el resultado y pregunte: ¿en qué se equivocó el modelo? ¿Fue el tema? ¿La cámara se mueve? ¿La iluminación? Sea específico. "No es lo que quería" no es un diagnóstico.
Paso 4: cambie una variable a la vez
Esta es la disciplina que la mayoría de la gente omite. Si la cámara estaba equivocada, cambie solo la línea de la cámara. Si la iluminación fue incorrecta, cambie solo la línea de iluminación. Si reescribe todo el mensaje, no podrás saber qué cambio solucionó el problema y volverás a cometer el mismo error en la siguiente toma.
Paso 5: Mantenga estable el andamio
Guarde las indicaciones que funcionan en un documento, organizadas por tipo, tomas de productos, escenas de diálogo, paisajes y momentos de los personajes. Cuando aparece una escena similar más adelante, se empieza desde un andamio conocido en buen estado en lugar de desde cero. Después de algunas semanas, tendrá una biblioteca rápida que hará la mayor parte del trabajo pesado por usted.
Paso 6: promocionar al ganador
Una vez que un mensaje produzca resultados confiablemente buenos en el modelo rápido, regenere la versión final en Veo 3.1 Standard con el mismo mensaje. La cinematografía sigue siendo la misma; la calidad de la producción salta.
Este bucle suena lento. No lo es. Una vez que haya realizado tres o cuatro iteraciones en un proyecto, es más rápido que adivinar, y la calidad se agrava porque su andamiaje mejora cada semana.
Plantillas de mensajes específicos de formato
Diferentes entregables, diferentes andamios rápidos. Cópielos, modifique los corchetes.
TikTok / Reels (9:16, 5-15 s)
"[El sujeto con un atuendo interesante] realiza [una sola acción clara] en [un entorno urbano o natural reconocible]. Encuadre vertical estilo teléfono, ambiente enérgico, luz diurna brillante, [paleta de colores de tendencia]. Cámara rápida, sin cámara lenta."
Notas: Los modelos verticales se componen mejor cuando nombras explícitamente el formato. Mantenga las acciones simples, los clips verticales no tienen espacio para escenas de múltiples tiempos.
Toma del héroe de YouTube (16:9, 5-10s)
"Toma cinematográfica panorámica de [sujeto] en [entorno]. Cámara lentamente [empujar hacia adentro / plataforma rodante / órbita]. Luz de hora dorada, lente anamórfica, poca profundidad de campo, 4K. Diseño de sonido ambiental sutil."
Notas: 16:9 es donde brilla Veo 3.1. Utilice este formato para aperturas, tomas de héroes y B-roll.
Héroe del producto (1:1 o 16:9, 5-8 s)
"Foto de estudio de [producto] en [superficie]. Producto lentamente [gira/levanta/se ilumina]. Luz de tecla suave desde [dirección], luz del borde desde atrás, caída profunda de sombras. Premium, estética minimalista, sin personas, fondo limpio."
Notas: Consulte aquí la imagen del vídeo para obtener tomas precisas de la marca. Bloquee el fondo: los entornos simples y concurridos distraen la atención del producto.
Escena de diálogo (16:9 o 4:3, 5-10s)
"[Dos planos o primer plano] de [Personaje A] y [Personaje B] en [escenario]. El personaje A dice, '[línea]'. Personaje B [reacción]. [Iluminación]. Cámara estática, lente de 35 mm. Ambiente [tono de la habitación]."
Notas: Solo Veo 3.1. Otros modelos fingen mal el diálogo. Mantenga las líneas cortas, las líneas largas no están sincronizadas.
B-Roll/corte de textura (cualquier proporción, 3-5 s)
"Macro/primer plano de [objeto texturizado o detalle]. Sutil [movimiento: vapor, ondulación, parpadeo, balanceo]. [Hora del día]. Poca profundidad de campo. Sin música, solo ambiente."
Notas: Los clips cortos se ven más nítidos. No alargues una toma B-roll más allá de los 5 segundos, la IA comenzará a inventar el movimiento.
Indicaciones reales, resultados reales
A continuación se muestran cinco mensajes que hemos probado en muvi.video usando Veo 3.1, Seedance 2.0 y Kling 3.0. Las descripciones de los resultados son cualitativas, su generación variará según la versión del modelo, el matiz del mensaje y la fecha, así que trátelas como ilustrativas del tipo de resultado que produce el mensaje, no como resultados garantizados.
Ejemplo 1, paisaje cinematográfico (Veo 3.1)
"Amplia toma aérea de un lago alpino cristalino al amanecer, niebla flotando a baja altura sobre el agua, picos nevados reflejados en la superficie. La cámara se retira lentamente y se inclina hacia arriba para revelar la cadena montañosa. Luz azul suave y fría que cambia hacia un rosa cálido. Cine 4K, anamórfico, sin música, viento ambiental".
Tipo de resultado: Una toma de un paisaje cinematográfico limpio. El retroceso y la inclinación generalmente funcionan bien en Veo. El movimiento de la niebla parece natural.
Ejemplo 2, Rotación de productos (Kling 2.0, imagen a video)
"Rotación lenta de 360 grados. Iluminación de estudio, superficie de concreto pulido, luz suave desde la parte superior izquierda, borde sutil desde atrás. Sin movimiento de la cámara, marco central del producto." (Adjunto: foto del producto de un reloj)
Tipo de resultado: una rotación confiable de héroes del comercio electrónico. Kling maneja rotaciones cortas limpiamente cuando el mensaje es breve.
Ejemplo 3, Momento del personaje (Veo 3.1)
"Una mujer joven con un largo abrigo rojo camina por una plaza nevada de la ciudad por la noche, mientras la nieve cae intensamente. Se detiene, mira hacia arriba y sonríe. El brillo suave y cálido de una farola, fondo azul frío. Toma de seguimiento medio desde un costado, luego se gira y la cámara sostiene. Lente de 35 mm, poca profundidad de campo".
Tipo de resultado: Momento de carácter de múltiples tiempos. El techo de clip de 8 segundos de Veo 3.1 se ajusta a la secuencia de "caminar, detenerse, mirar hacia arriba, sonreír" con espacio para aterrizar en cada ritmo, y el audio ambiental nativo (nevada ligera, tono de ciudad distante) se imprime junto con el video sin un pase de partitura separado.
Ejemplo 4, primer plano de comida (Veo 3.1)
"Foto macro de chocolate amargo derretido que se vierte lentamente sobre una fresa fresca sobre mármol blanco. Luz cálida en el techo, ligero vapor que se eleva. Poca profundidad de campo, reflejo brillante en el chocolate. Sonido sutil al vertido, sin música."
Tipo de resultado: trago de comida crujiente. El movimiento de vertido y la superficie reflectante del chocolate son donde el motor de física de Veo 3.1 da sus frutos.
Ejemplo 5, animación estilizada (Kling 3.0)
"Animación 2D pintada a mano, estilo acuarela. Un pequeño zorro entra cautelosamente en un claro en un bosque profundo al atardecer. Las luciérnagas flotan a su alrededor. Paleta apagada, contornos suaves, textura suave dibujada a mano, viento ambiental e insectos distantes."
Tipo de resultado: un clip estilizado con líneas consistentes. Kling 3.0 maneja una estética de movimiento estilizada, la textura de acuarela pintada a mano aterriza de manera más confiable aquí que en los modelos fotorrealistas.
Una nota sobre la reproducibilidad: los modelos de vídeo de IA cambian con frecuencia, y la misma ejecución del mensaje en el mismo modelo con seis meses de diferencia puede producir resultados notablemente diferentes. Trate las indicaciones como armazones, no como recetas exactas.
Preguntas frecuentes sobre las indicaciones de vídeo de IA
P1: ¿Debo escribir mensajes de vídeo de IA de la misma manera que escribo mensajes de Midjourney? No. Las indicaciones de Midjourney funcionan como listas de etiquetas separadas por comas ("mujer, abrigo rojo, cinemática, 4k, --ar 16:9"). A los modelos de video les va mucho mejor con oraciones completas que describen la acción, el movimiento y el tiempo. Escriba mensajes de vídeo de la misma manera que describiría una toma a un director de fotografía, no como etiquetaría una imagen fija.
P2: ¿Por qué mi mensaje produce resultados diferentes cada vez que lo genero? Los modelos de video de IA usan semillas aleatorias, por lo que cada generación es una nueva tirada de dados con su mensaje como restricción. Incluso ejecutar exactamente el mismo mensaje dos veces producirá resultados diferentes. La mayoría de las plataformas le permiten bloquear una semilla si necesita reproducibilidad, lo que resulta útil cuando desea probar cambios rápidos sin que el ruido de la semilla se interponga.
P3: ¿Cuánto tiempo debe durar un mensaje de vídeo de IA? Entre 30 y 80 palabras es el punto ideal para la mayoría de los modelos. Si tienes menos de 30 años y no estás bien dirigido, el modelo llena los vacíos con valores predeterminados genéricos. Más de 100 y llegas a la fatiga inmediata, donde el modelo comienza a ignorar elementos (generalmente los que escribiste en último lugar). Para Kling 3.0, manténgase cerca de 30 a 50 palabras. Para Veo 3.1 y Seedance 2.0, puedes acercarte a 80.
P4: ¿Debo incluir el idioma de la cámara en mis mensajes? Sí, especialmente en Veo 3.1. "Dolly in", "enfoque en rack", "ángulo bajo", "lente de 35 mm", "anamórfico", todos estos se traducen en el comportamiento real de la cámara que el modelo puede representar. Kling responde menos al vocabulario cinematográfico, por lo que en Kling, limítese a descripciones más simples como "la cámara se mueve lentamente hacia el sujeto".
P5: ¿Las indicaciones negativas funcionan en modelos de vídeo con IA? A veces. Veo 3.1 y Seedance 2.0 responden a una simple negación ("sin gente en el fondo", "sin texto en pantalla", "sin música"). No responden de manera confiable a negaciones abstractas como "no borroso" o "sin artefactos", son aspiracionales, no dirigibles. Utilice negativos con moderación y para cosas específicas que pueda nombrar.
P6: ¿Puedo reutilizar el mismo mensaje en diferentes modelos? Mayormente, sí. Los patrones de la Sección 3 son independientes del modelo. Pero obtendrá mejores resultados si modifica por modelo, elimina el vocabulario cinematográfico para Kling 3.0, se inclina hacia la flexibilidad de duración y relación de aspecto para Seedance 2.0, agrega dirección de audio y términos cinematográficos para Veo 3.1. Mismo andamio, ediciones ligeras.
P7: ¿Existe una manera "correcta" de combinar mensajes de texto a video e imagen a video? Para la conversión de imagen a video, el mensaje solo necesita describir el movimiento que desea; la identidad visual ya está en la imagen. Mantenga las indicaciones de imagen a video breves (de 10 a 30 palabras) y céntrese en lo que debe cambiar o moverse. Las indicaciones descriptivas largas en la conversión de imagen a video pueden luchar contra la imagen de referencia y producir resultados confusos.
Cree una biblioteca de mensajes, no un gran mensaje
Los creadores que obtienen una excelente producción de video con IA no están escribiendo mensajes mágicos. Están usando los mismos seis ingredientes, el mismo puñado de patrones y la disciplina de cambiar una variable a la vez. Eso es todo. Una vez que haya creado una biblioteca de indicaciones personal, unas pocas docenas de estructuras organizadas por tipo de toma, dejará de empezar desde cero y la calidad de su resultado aumentará semana tras semana.
Abra muvi.video, elija un modelo, escriba un mensaje usando uno de los patrones anteriores e itere. El primero no será perfecto. El décimo será genial. El centésimo estará en tu biblioteca y nunca más lo escribirás desde cero.
Última actualización: mayo de 2026. Actualizamos esta guía a medida que cambian los modelos y aprendemos nuevos patrones del trabajo de producción.
Related Guides
Cómo escribir indicaciones de vídeo de IA que realmente funcionen (Guía del pilar 2026)
La mayoría de las "guías rápidas de IA" están escritas por personas que han generado quizás diez videos. Te dicen que seas específico. Te dicen que agregues "4K cinematográfico". Luego te dejan varado en el momento en que el sujeto se transforma en un boceto de Cronenberg en el tercer intento.