prompt-video-anuncio
Generates professional, production-ready prompts for AI ads and short videos (optimized for Google's Veo 3), following a fixed studio structure: style, protagonist or mascot, timestamped sequence, lip-synced dialogue, on-screen text, closing logo, audio mood, camera work and negative prompt.
© IT Innova Business SASource: itinnovabusiness.com
---
name: prompt-video-anuncio
description: >-
Genera prompts profesionales y detallados para anuncios y videos cortos
generados con IA (optimizados para Veo 3 de Google), siguiendo una estructura
fija de productora: Estilo, Protagonista/Mascota, Secuencia con timestamps,
Diálogo con lip-sync, Texto en pantalla, Cierre/Logo, Audio/mood, Cámara y
Negative prompt. Úsalo SIEMPRE que el usuario quiera "un prompt para un
video", "un prompt para Veo / Sora / Kling", "el guion de un anuncio con IA",
"un comercial animado", "un spot", "un video promocional", "una mascota que
hable a cámara", o describa un producto/marca y un concepto de video que
quiere convertir en un prompt listo para generar. Dispara aunque el usuario no
diga literalmente "prompt": si describe una idea de video publicitario,
personajes, escenas por segundos, o un anuncio animado para redes, asume que
quiere este formato. También aplica para reels, TikToks o shorts verticales
con narrativa y voz.
---
# Generador de prompts para anuncios de video (estilo Veo 3)
## Qué hace este skill
Convierte una idea de anuncio —marca, producto, mensaje, tono— en un **prompt
único, estructurado y autocontenido** listo para pegar en un generador de video
por IA (optimizado para **Veo 3**, compatible con Sora/Kling/Higgsfield con
ajustes menores). El prompt resultante es lo bastante específico para que el
modelo no improvise: define estética, personaje, beats por segundo, diálogo con
lip-sync, audio, cámara, texto en pantalla y un negative prompt.
La meta es que el usuario reciba un bloque copiable y profesional, no una
conversación sobre el video. Pero **un buen prompt depende de un buen brief**:
no generes a ciegas. Primero recoge contexto con una ronda de preguntas clave, y
solo después escribe el prompt.
## Paso 1 (obligatorio): pedir contexto antes de generar
Antes de escribir cualquier prompt, **haz una ronda corta de preguntas clave**.
Esto evita prompts genéricos y le da al usuario el control sobre lo que importa.
Hazlo siempre que el usuario solo haya dado una idea suelta ("quiero un anuncio de
mi cafetería") o un brief parcial.
**Excepción — brief ya completo:** si el usuario ya entregó un brief detallado
(marca, propuesta de valor, tono, protagonista, escenas o claims), **no preguntes:
genera el prompt directamente**. Pedir contexto que ya está sería redundante y
molesto. Solo lanza una pregunta puntual si falta un dato verdaderamente crítico
(p. ej. no se entiende qué hace el producto). En la duda entre preguntar de más o
generar, con un brief rico genera.
Cómo preguntar:
- Si tienes la herramienta `AskUserQuestion`, úsala para presentar las preguntas
como opciones de selección (más rápido para el usuario). Si no, pregunta en
texto, agrupadas y numeradas, en una sola tanda.
- Pregunta **solo lo que falte**. Si el usuario ya dio marca, tono y duración en
su mensaje, no lo vuelvas a preguntar; confírmalo y pregunta el resto.
- Para cada dato, **propón un valor por defecto sensato** para que el usuario
pueda responder rápido o simplemente decir "como quieras".
Datos clave a cubrir (prioriza los 4–6 primeros; el resto puedes inferirlos):
1. **Marca / producto y propuesta de valor**: ¿qué es y qué problema resuelve en
una frase? (Imprescindible — si no lo sabes, pídelo.)
2. **Objetivo y CTA**: ¿qué debe sentir o hacer quien lo ve? (ej. registrarse,
comprar, escribir por WhatsApp).
3. **Tono**: cómico, épico, emotivo, elegante, energético… (default: el que
encaje con la marca; si dudas, propón cómico para redes).
4. **Protagonista**: ¿mascota que habla a cámara, persona, o solo el producto con
voz en off? Si no lo dan y encaja, propón una mascota (rinden muy bien con
lip-sync) y descríbela.
5. **Duración y formato**: default ~30 s y 9:16 vertical para redes (16:9 si es
para YouTube/web).
6. **Paleta / identidad visual**: colores o logo de la marca, si los hay
(respétalos; pide hex si los tienen).
7. **Claims / mensajes** que deben aparecer como texto en pantalla.
8. **Idioma de la voz**: default español neutro.
Tras recibir las respuestas (o un "como quieras"), **confirma en una línea el
brief que vas a usar** y pasa a generar el prompt. No alargues el intercambio:
una ronda de preguntas bien hecha basta.
## Paso 2: diseña la narrativa (con el contexto ya recogido)
Diseña una **mini narrativa con arco**, no una lista de features. La fórmula que
mejor funciona en anuncios cortos:
1. **Gancho** (primeros 3–5 s): algo que detiene el scroll. Una situación, un
problema cómico, una pregunta, el personaje mirando a cámara.
2. **Problema / tensión**: muestra el dolor o la carencia que resuelve el
producto, idealmente de forma exagerada o divertida.
3. **Giro / solución**: aparece el producto como el "héroe" que transforma la
situación. Este es el clímax visual (efecto, transformación, "boom").
4. **Demostración del beneficio**: enseña el producto en acción y el resultado
feliz.
5. **Cierre de marca**: logo, tagline y CTA con un remate memorable.
Reparte estos beats en segmentos. **Veo 3 genera clips de ~8 segundos**, así que
divide el anuncio en bloques de 4–8 s (p. ej. 0–4 s, 4–9 s, 9–14 s…). Cada
bloque debe poder generarse y entenderse casi por sí solo. Para un anuncio de
40 s, eso son ~6–8 segmentos.
## Paso 3: estructura de salida (usa SIEMPRE este formato)
Entrega el prompt con este esqueleto y estos encabezados, en el idioma que use
el usuario (por defecto **español neutro**). Mantén el título arriba con marca,
concepto, tono y duración.
```
Prompt — [Marca] · "[Concepto/título]" ([tono], ~[N]s)
Estilo: [Técnica de animación o filmación, referencias visuales, textura,
iluminación, profundidad de campo, transiciones]. Paleta dominante: [colores con
hex si los hay]. [Formato: 9:16 / 16:9], ~[N] segundos, 4K, [24/30/60]fps.
Protagonista/Mascota: [Descripción física detallada, personalidad, cómo se
mueve, rol en el anuncio. Si habla, indica "habla a cámara con lip-sync" y el
estilo de actuación].
Secuencia:
([0–4s]) [Acción, encuadre, qué pasa, reacciones]. (habla)
([4–9s]) [Beat siguiente].
([9–14s]) [Beat siguiente].
... (un beat por bloque de 4–8 s hasta cubrir la duración)
Diálogo del [personaje] ([estilo de voz]; lip-sync; [idioma]):
([0–4s]) "[Línea exacta, una idea, 3–6 s al hablar.]"
([Xs–Ys]) "[Siguiente línea.]"
... (solo en los bloques marcados con "(habla)")
Texto en pantalla ([tipografía], [color]):
"[Claim 1]"
"[Claim 2]"
...
Cierre: "[Marca]" + "[Tagline / CTA]"
Audio/mood: [Música por fases que sigue el arco; efectos de sonido concretos
ligados a la acción; ambiente; jerarquía: la voz primero, la música por debajo].
Cámara: [Movimientos y encuadres concretos ligados a cada momento clave:
planos, paneos, cámara lenta, zooms, parallax, orbit final].
Negative prompt:
[lista de lo que NO debe aparecer]
```
## Reglas específicas de Veo 3 (importan mucho para la calidad)
Veo 3 genera **video y audio nativo en una sola pasada** (voz, efectos,
música), así que el audio no es un adorno al final: es una capa de la escena que
debes dirigir desde el inicio.
- **Diálogo entre comillas dobles.** Veo sincroniza los labios con lo que está
entre `"..."`. Escribe `El loro dice: "..."`. Esto produce el lip-sync.
- **Una idea por línea, de 3–6 s al hablar.** Frases largas o trabalenguas
rompen la articulación. Si el personaje habla en varios bloques, dale una
línea corta por bloque.
- **Evita subtítulos quemados.** Añade `(sin subtítulos)` junto al diálogo o en
el negative prompt; Veo tiende a "quemar" texto si no se lo dices. El texto en
pantalla intencional se describe aparte, en su sección.
- **Jerarquía de audio:** voz primero, efectos después, ambiente, y música al
final. Indica que **la música baja (ducks) por debajo de la voz** cuando el
personaje habla, para que se entienda.
- **Ata cada sonido a su causa.** No escribas "con sonido"; escribe "grillos
cuando hay silencio incómodo", "fanfarria al aplastar el botón", "ding de
notificación cada vez que sube el marcador".
- **Texto en pantalla legible.** Pide tipografía sans-serif bold, alto
contraste, y en el negative prompt incluye "texto borroso o ilegible".
## Cómo escribir cada sección bien
**Estilo** — sé concreto y visual. En vez de "animación bonita", di "3D estilo
Pixar, squash-and-stretch, iluminación de show, profundidad de campo,
transiciones con motion-blur". Da referencias y materiales. Fija paleta con hex
cuando exista identidad de marca, porque mantiene coherencia entre segmentos.
**Protagonista/Mascota** — la cara del anuncio. Describe rasgos memorables
(color, ojos, accesorios) y, sobre todo, **personalidad y manera de moverse**,
porque eso guía la actuación. Si habla, deja claro el registro (teatral, tierno,
sarcástico).
**Secuencia** — un beat por bloque temporal. Cada beat dice **qué pasa, cómo se
encuadra y qué reacción provoca**. Marca con `(habla)` los bloques donde hay
diálogo para que coincidan con la sección de diálogo. Mantén continuidad: el
personaje y el set deben sentirse el mismo a lo largo de los segmentos.
**Diálogo** — solo en los bloques marcados. Líneas cortas, naturales, con el CTA
o el nombre de marca en el momento de clímax. Indica idioma y estilo de voz.
**Texto en pantalla** — 3–5 claims máximo, cortos y vendedores, que refuercen el
mensaje sin tapar la acción. Termina con marca + tagline/CTA.
**Audio/mood** — la música debe seguir el arco (intro → clímax → resolución
festiva). Lista efectos concretos por momento. Recuerda la jerarquía de Veo 3.
**Cámara** — movimientos al servicio de la emoción: gancho con plano que detiene
el scroll, whip-pan a una reacción, cámara lenta épica en el clímax, orbit final
alrededor del producto/logo.
**Negative prompt** — defiende la calidad. Base recomendada, que puedes ampliar
según el caso:
```
texto borroso o ilegible, lip-sync desincronizado, subtítulos quemados, logos de
marcas reales con copyright, marcas de agua, manos o dedos deformes, personajes
perturbadores, colores fuera de paleta, fondo recargado, parpadeo (flicker), baja
resolución, artefactos, distorsión facial
```
Ajusta el negative prompt al concepto (p. ej. si es cómico, añade "tono serio o
aburrido"; si la mascota es estilizada, añade "versión realista de aspecto raro").
## Si el anuncio supera ~8 s (casi siempre)
Veo 3 no genera 40 s de una sola vez. Entrega el prompt completo como guion
maestro **y** ofrece dividirlo en sub-prompts por bloque de 4–8 s que el usuario
pueda generar uno por uno y luego unir en edición. Para cada sub-prompt repite el
Estilo y la descripción del personaje (para mantener consistencia) y añade solo
el beat, el diálogo y la cámara de ese bloque. Menciona esta opción al final; no
la fuerces si el usuario solo quería el guion maestro.
## Ejemplo de referencia (estructura y nivel de detalle)
Este ejemplo muestra el formato y el grado de concreción que buscamos. No lo
copies literal: adáptalo a la marca de cada caso.
```
Prompt — LoroAPI · "Got Talent: tu IA al escenario" (comedia, ~40s)
Estilo: Anuncio 3D cómico y enérgico estilo Pixar/cortometraje, animación
exagerada con squash-and-stretch y timing de comedia, set de programa de talentos
con escenario, luces y público, destellos verdes, iluminación de show, profundidad
de campo, transiciones dinámicas con motion-blur. Paleta dominante: verde esmeralda
(#16a34a), blanco y negro suave. Vertical 9:16, ~40 segundos, 4K, 60fps.
Protagonista/Mascota: un loro 3D carismático y payaso, plumaje verde brillante con
pico naranja, ojos enormes y muy expresivos, animación tipo Pixar. Es el
juez-estrella: dramático, vanidoso y graciosísimo, con acceso al botón dorado.
Habla a cámara con lip-sync y sobreactuación cómica.
Secuencia:
(0–4s) Escenario de show de talentos, focos y público expectante. El loro-juez,
repantingado con gafas de sol, aburrido, se abanica con un ala y mira a cámara.
(habla)
(4–9s) Sube el primer concursante: un robot-IA tímido etiquetado "Claude";
carraspea y solo le sale un "bip" microscópico. Grillos. El loro arquea una ceja.
(9–14s) Segundo concursante, "n8n", hace malabares con engranajes y se le caen
encima ("clonc, clonc"). El público hace "ooh". El loro se tapa los ojos. (habla)
(14–19s) Tercer concursante, "Tu Agente", tropieza y se enreda en el cable del
micro. Los tres robots, derrotados, se miran tristes. Al loro se le ilumina la cara.
(19–25s) ¡EL BOTÓN DORADO! El loro se lanza en cámara lenta épica y lo aplasta.
¡BOOM! Confeti verde y fanfarrias. Un haz de luz verde con el ícono de WhatsApp
envuelve a los robots y los transforma: ahora brillan, seguros. (habla)
(25–31s) Los robots se lanzan dentro de chats de WhatsApp, enviando texto, imagen
y notas de voz a personas reales. El público enloquece, emojis volando.
(31–36s) Zoom-out triunfal: decenas de conversaciones conectadas por hilos verdes;
un marcador de "Mensajes enviados" sube con un "ding". El loro levanta un trofeo.
(habla)
(36–40s) Todo salta al centro y se forma el logo: cuadrado verde redondeado con el
loro blanco y "LoroAPI". El loro guiña un ojo y tira un beso. Destello final.
Diálogo del loro (voz cómica, teatral, juguetona; lip-sync; español neutro; sin
subtítulos):
(0–4s) "Bienvenidos a 'Tu IA tiene talento'… a ver qué me traen hoy."
(9–14s) "Ay, no, no, no… ¡así no van a hablar con NADIE!"
(19–25s) "¡Esperen! Yo sé qué les falta…" (aplasta el botón) "¡EL CANAL!"
(31–36s) "Claude, n8n, tu propio bot… ¡estrellas del chat!"
Texto en pantalla (sans-serif bold, blanca):
"Tu IA tiene mucho que decir"
"Dale el escenario: WhatsApp"
"Conecta Claude, n8n y más"
Cierre: "LoroAPI" + "Conecta WhatsApp con tus agentes de IA, sin fricción."
Audio/mood: música de show de talentos (intro pomposa → fanfarria del botón dorado
→ pop alegre y festivo); efectos cómicos (grillos, "clonc", redoble, confeti,
"boing", "ding" de WhatsApp); aplausos del público. La voz del loro al frente; la
música baja por debajo cuando habla.
Cámara: muy dinámica; planos de escenario, whip-pans a las reacciones del loro,
cámara lenta épica en el botón dorado, zooms cómicos a las caras, parallax entre
capas del set, orbit final alrededor del loro con el trofeo.
Negative prompt:
texto borroso o ilegible, lip-sync desincronizado, subtítulos quemados, logos de
marcas reales con copyright, marcas de agua, manos deformes, personajes
perturbadores, colores fuera de paleta, fondo recargado, parpadeo, baja resolución,
loro realista de aspecto raro, tono serio o aburrido.
```
## Cierre
Tras entregar el prompt, ofrece de forma breve: (1) dividirlo en sub-prompts de
8 s para Veo 3, (2) una variante de tono o formato, o (3) ajustar la paleta/voz.
No expliques de más: el valor está en el prompt listo para usar.
Bundle files
Files included in the skill's folder on GitHub. Only SKILL.md is hosted here — get the full bundle from the source repository.
- SKILL.md
