Imagen, video y audio · Septiembre 2026

IA generativa en vivo: lo que aguanta una activación de marca real

Un fotomatón con IA o una pantalla DOOH no perdonan: cola, luz, red y moderación fallan a la vista de todos. Esta es nuestra guía para diseñar el flujo, elegir modelos, pedir el consentimiento correcto y medir sin inventar resultados.

2 ago. 2026 rige el etiquetado del AI ActUSD 0,067 por imagen 1K en Nano Banana 211 s a 6 min latencia de Veo 3.1 en pico
En resumen

En una activación en vivo, la IA generativa compite con la cola: cada segundo de generación, cada imagen rechazada por un filtro y cada caída de red se ven. Los modelos de imagen actuales (Nano Banana 2 y Pro de Google, GPT Image 2.5 de OpenAI) transforman selfies con buena calidad, pero con límites de latencia, de referencias de identidad y de uso en Europa que hay que probar antes de prometer.

Un rostro procesado para identificar a alguien es un dato biométrico: sensible en Colombia (Ley 1581) y de categoría especial en la Unión Europea (artículo 9 del RGPD). Desde el 2 de agosto de 2026, el artículo 50 del AI Act exige además etiquetar los deepfakes. Nuestra regla: consentimiento explícito antes de la foto, moderación automática y humana, borrado programado y métricas de embudo reales.

Por qué el vivo es un entorno difícil

Seis restricciones que no aparecen en una demo de oficina.

Guía de diseño de Slash para activaciones; los datos de latencia son de la documentación de OpenAI y Google (septiembre de 2026).
RestricciónQué pasa en el sitioCómo la diseñamos
LatenciaOpenAI advierte que un prompt complejo puede tardar hasta 2 minutos; Google da de 11 s a 6 min para Veo 3.1 en horas picoImagen primero, video solo como entrega diferida; prompts cortos y probados
RendimientoUna cola de 200 personas multiplica cada segundo extraColas asíncronas, varios proveedores y límites de tasa verificados
ModeraciónLos filtros del proveedor pueden rechazar una foto legítimaPlan B visual y revisión humana antes de la pantalla
LuzContraluces y sombras degradan la transformación del rostroIluminación controlada y guía de encuadre en la cámara
RedEl wifi del evento suele saturarse en los picosConexión dedicada y reintentos; nunca un solo enlace
Filas y abandonoSi nadie ve un resultado rápido, la gente se vaQR en el celular del asistente para esperar fuera de la fila

La conclusión práctica: gana el modelo que entrega en el tiempo que tu público acepta esperar, con una tasa de rechazo que puedas absorber, no el más impresionante.

El flujo, paso a paso

Siete etapas; si una falla, se cae toda la experiencia.

  1. Captura. La cámara del celular del asistente (vía QR) o una cámara fija con luz controlada. Guía de encuadre y control de calidad antes de enviar.
  2. Consentimiento. Antes de la foto, no después: finalidad, uso en pantalla pública, plazo de conservación y una casilla aparte para comunicaciones de marca. Sin aceptación, no hay captura.
  3. Generación. Un prompt fijo y probado por estilo, con referencias de marca; el asistente elige entre pocas opciones en lugar de escribir texto libre.
  4. Moderación. Primero automática (filtros del proveedor y los tuyos), luego humana para todo lo que vaya a una pantalla pública. Un rechazo debe devolver una alternativa, no un error.
  5. Exhibición. Pantalla, mosaico o DOOH, con la etiqueta de contenido generado por IA visible desde la primera exposición.
  6. Impresión o envío. Descarga, impresión en sitio o correo; logotipos, textos legales y precios se componen encima, nunca se generan.
  7. Borrado. El selfie original se elimina en cuanto existe el resultado, y el resultado al vencer el plazo anunciado. Guarda la prueba del consentimiento, no la cara.

Qué modelos probar para rostros y estilos

Opciones verificadas a septiembre de 2026; ninguna reemplaza tu prueba con fotos reales del público.

Documentación y precios de Google y OpenAI, y licencias publicadas en Hugging Face, consultados en septiembre de 2026. Costo por 1.000 imágenes a precio de lista, sin reintentos.
ModeloFortaleza para una activaciónLímite a tener en cuentaCosto de lista
Nano Banana 2 (Google, GA 28 may. 2026)Hasta 14 referencias, 4 de personaje y 3 de estiloPrueba la consistencia del rostro con tus fotosUSD 0,067 por imagen 1K (USD 67 por 1.000)
Nano Banana 2 Lite (GA 30 jun. 2026)La opción más barata de Google, con latencia ultrabaja según la empresaSolo 1K y sin referencias de personaje ni de estiloUSD 0,0336 por imagen (USD 33,60 por 1.000)
Nano Banana Pro (GA 28 may. 2026)Calidad de estudio y 4K; hasta 5 referencias de personajeMás caro: para piezas de exhibición más que para volumenUSD 0,134 (1K o 2K) y USD 0,24 (4K)
GPT Image 2.5 Sunburst y Flare (OpenAI, 8 sept. 2026)Sunburst para edición precisa, Flare para generación rápida; hasta 3840 pxOpenAI reconoce que un prompt complejo puede tardar hasta 2 minutos y que un personaje recurrente puede perder consistenciaPor tokens: USD 8 por millón de entrada de imagen y USD 30 por millón de salida
Qwen-Image (Alibaba)Pesos abiertos con licencia Apache 2.0, uso comercial permitidoAutoalojado: tú operas GPU, cola y moderaciónTu infraestructura
FLUX.2 [dev] y HunyuanImage 3.0Pesos abiertos popularesFLUX.2 [dev] tiene licencia no comercial; la de HunyuanImage 3.0 excluye la UE, el Reino Unido y Corea del SurNo aptos sin la licencia adecuada

Dos lecciones de este cuadro. La primera: la opción más barata (Nano Banana 2 Lite) no admite referencias de personaje, justo lo que necesita un face swap; para transformaciones que conservan la identidad, la comparación real está entre Nano Banana 2, Pro y GPT Image 2.5. La segunda: los modelos cambian rápido. El Nano Banana original se apaga el 2 de octubre de 2026 y OpenAI cerró la API de Sora el 24 de septiembre, así que tu flujo debe poder cambiar de proveedor sin rehacer la experiencia.

Para video, Veo 3.1 genera clips de 4, 6 u 8 segundos y en la UE, el Reino Unido, Suiza, Oriente Medio y el Norte de África solo permite personas adultas (allow_adult); Gemini Omni Flash no permite editar videos subidos en el EEE, Suiza ni el Reino Unido y allí restringe las imágenes con menores. En vivo, usa el video como entrega diferida por correo, no como resultado en pantalla.

Un selfie es un dato personal. Se vuelve biométrico cuando se procesa con medios técnicos que permiten identificar a la persona de forma única: el considerando 51 del RGPD lo dice así para las fotografías. Un face swap que extrae la geometría o un vector del rostro para trasladar la identidad se acerca mucho a esa línea; por eso nuestra regla es tratarlo siempre como dato biométrico.

Unión Europea. El artículo 9 del RGPD prohíbe tratar datos biométricos dirigidos a identificar de manera unívoca a una persona, salvo excepciones como el consentimiento explícito (artículo 9.2.a). Un tratamiento a gran escala de estas categorías exige además una evaluación de impacto (artículo 35). Y si la experiencia infiere emociones o clasifica a las personas por rasgos biométricos, el artículo 50(3) del AI Act obliga a informarles.

Colombia. La Ley 1581 de 2012 clasifica los datos biométricos como sensibles (artículos 5 y 6) y exige autorización explícita para tratarlos, además de una autorización previa e informada que puedas probar (artículo 9). La Circular 002 de 2024 de la SIC pide un estudio de impacto de privacidad antes de desplegar IA de alto riesgo, y las multas llegan a 2.000 salarios mínimos mensuales, con posible cierre de las operaciones con datos sensibles.

  • Menores: nuestra regla es dejarlos fuera de las transformaciones faciales, salvo autorización de su representante legal en el sitio. Algunos proveedores ya lo restringen: Gemini Omni Flash limita las imágenes con menores en el EEE, Suiza y el Reino Unido.
  • Conservación: anuncia plazos cortos y cúmplelos con borrado automático. Google, por ejemplo, borra de sus servidores los videos de Veo a los 2 días; tus copias en galerías, CRM o pantallas son responsabilidad tuya.
  • Transferencias: si el proveedor de IA está fuera de Colombia o de la UE, firma el contrato de transmisión o las cláusulas que correspondan antes del evento, no después.

Seguridad de marca y etiquetado del contenido

Desde el 2 de agosto de 2026, el artículo 50 del AI Act reparte el trabajo: los proveedores deben marcar sus salidas de forma legible por máquina, y quien despliega un deepfake debe revelarlo. Un retrato realista de una persona real, transformado y proyectado en público, puede ser un deepfake en el sentido de la norma; si la obra es evidentemente artística o de ficción, el deber se aligera, pero no desaparece.

El código de buenas prácticas de la Comisión, finalizado el 10 de junio de 2026, concreta cómo: un ícono o etiqueta perceptible desde la primera exposición, sin que el usuario haga nada (por ejemplo, arriba a la derecha), al inicio y a intervalos regulares en los videos, y válido también fuera de línea, es decir, en tus pantallas físicas. Para obras evidentemente creativas, el ícono puede ir en notas o créditos, pero debe percibirse desde la primera exposición. La UE publicó íconos opcionales el 24 de septiembre de 2026.

La procedencia técnica ayuda, pero no alcanza sola: las imágenes de los modelos de Google llevan SynthID y OpenAI Media Service está certificado por C2PA, pero ningún operador de publicidad exterior figura en la lista de productos conformes de C2PA a septiembre de 2026. En Francia, además, la ley de influencers exige la mención «Images virtuelles» en contenido comercial con rostros o siluetas generados por IA.

Riesgo de reputación

Nuestra lectura: etiquetar cuesta poco y el riesgo real está en la ejecución. Según IAB, el 73 % de los consumidores Gen Z y millennials dice que la divulgación aumentaría o no cambiaría su probabilidad de compra, y McDonald's Países Bajos retiró en diciembre de 2025 un anuncio navideño hecho con IA tras críticas que lo llamaban «AI slop».

Qué hemos construido en Slash

Seis proyectos y lo que cada uno enseña sobre el flujo en vivo.

  • L'Oréal Guardians: face swap con IA generativa en Celebrate Consumer Care (eliges un Guardian y tu selfie se vuelve un avatar de marca) y, como pieza central, un mosaico gigapixel en Three.js donde cientos de avatares forman el logo, navegable en 3D para demos y lobbies.
  • Nigloland × Supersonic / L'Oréal: un recuerdo fotográfico estilo Belle Époque en el parque, con recorrido por QR, mapa de atracciones, selfie en escena, captura de correo y composición con IA en francés e inglés, sin cabina pesada.
  • Peoplesnap: la app web de fotomatón en marca blanca de Slash Experience. El celular del asistente es la activación: QR, selfie, edición con IA (más de 100 parámetros, moderación incluida), redes, impresión y mosaicos en pantallas DOOH, con captura de datos propios hacia el CRM.
  • Alain Afflelou · Magic Sunny: prueba virtual de gafas de sol con cuatro selfies, aceptación de condiciones al inicio y una pantalla clara de permisos de cámara antes de compartir o guardar.
  • Cartier · Trinity 100: fotomatón de marca en centros comerciales premium, tres fotos por las tres bandas del anillo, impresión en sitio y datos hacia el CRM; lo replicamos en Bogotá, Panamá y São Paulo.
  • JCDecaux × Transmilenio: datos en vivo en más de 3.000 tótems digitales de Bogotá. No es IA generativa, pero muestra lo que exige el DOOH a escala: una arquitectura que empuja contenido a miles de pantallas con baja latencia.

El patrón común: el celular del asistente como puerta de entrada, consentimiento y permisos antes de la cámara, y un resultado que sale del teléfono hacia una pantalla, una impresión o el CRM.

Cómo medir y checklist para tu equipo

No publicamos tasas de conversión genéricas: dependen del lugar, del público y de la mecánica. Mide el embudo completo con eventos propios, del primer escaneo al CRM, y compara con una activación sin IA cuando puedas.

  • Participación: escaneos, consentimientos, capturas y resultados aprobados; la caída entre pasos muestra dónde se rompe el flujo.
  • Tiempo: espera en cola, tiempo hasta el resultado y permanencia frente a la pantalla.
  • UGC: descargas, envíos, impresiones y publicaciones con la mención de la marca.
  • CRM: registros con autorización de comunicaciones, separada del consentimiento de la foto.
  • Calidad y costo: rechazos de moderación, reintentos por imagen y costo por participante.

Checklist para planear una activación

  1. Define el objetivo (datos, alcance o experiencia) y la métrica que lo prueba.
  2. Prueba dos o tres modelos con fotos reales: tonos de piel, edades, gafas y la luz del lugar.
  3. Mide latencia y rechazos en condiciones de pico, no en la oficina.
  4. Redacta el consentimiento con tu área legal: finalidad, pantalla pública, plazos, menores y transferencias.
  5. Diseña la moderación: filtro automático, revisión humana y plan B visual.
  6. Prevé la etiqueta de IA en pantallas e impresos desde la primera exposición.
  7. Asegura red dedicada, un proveedor alternativo y captura sin conexión.
  8. Programa el borrado y verifica después del evento que se cumplió.

Lo esencial

  • En vivo gana el modelo que entrega en el tiempo que tu público espera, no el más vistoso en una demo.
  • Nano Banana 2 Lite es el más barato de Google, pero no admite referencias de personaje: para face swaps, compara Nano Banana 2, Pro y GPT Image 2.5.
  • Trata todo face swap como dato biométrico: consentimiento explícito antes de la foto, menores fuera y borrado programado.
  • Desde el 2 de agosto de 2026, los deepfakes se etiquetan desde la primera exposición, también en pantallas físicas.
  • Mide el embudo completo, del escaneo al CRM, antes de prometer cifras.

Fuentes

  1. Image generation (Nano Banana models) · Google Gemini API documentation, 2026-09
  2. Gemini API pricing · Google, 2026-09
  3. Generate videos with Veo 3.1 · Google Gemini API documentation, 2026-09
  4. Gemini Omni Flash · Google Gemini API documentation, 2026-09
  5. Image generation guide · OpenAI, 2026-09
  6. API deprecations · OpenAI, 2026-09
  7. Article 50: transparency obligations for providers and deployers · AI Act Service Desk, European Commission, 2026-08-02
  8. Code of Practice on transparency of AI-generated content · European Commission, 2026-06-10
  9. EU icons for labelling AI-generated content · European Commission, 2026-09-24
  10. Regulation (EU) 2016/679 (GDPR) · EUR-Lex, 2016-04-27
  11. Circular Externa 002 de 2024: datos personales en sistemas de inteligencia artificial · Superintendencia de Industria y Comercio, 2024-08-21
  12. The AI Ad Gap Widens · IAB, 2026-01-15

Nota editorial: este análisis refleja la información pública disponible en la fecha de revisión. Modelos, precios y normas cambian rápido; cada dato de terceros enlaza a su fuente y nuestras opiniones se presentan como tales. ¿Ves un error? Escríbenos a contact@slash-digital.io.

Preguntas frecuentes

Las preguntas que escuchamos a menudo

¿Un face swap en un evento es un dato biométrico?

Una foto es un dato personal; según el considerando 51 del RGPD, se vuelve biométrica cuando se procesa con medios técnicos que permiten identificar a la persona de forma única. Como un face swap trabaja con los rasgos del rostro, recomendamos tratarlo como dato biométrico: en Colombia es un dato sensible (Ley 1581) y en la UE una categoría especial (artículo 9 del RGPD).

¿Qué modelo de imagen conviene para un fotomatón con IA?

Depende de la latencia y de la identidad que necesites conservar. A septiembre de 2026 probaríamos Nano Banana 2 (USD 0,067 por imagen 1K), Nano Banana Pro para piezas de exhibición y GPT Image 2.5 Sunburst para edición precisa, siempre con fotos reales de tu público.

¿Hay que etiquetar las imágenes generadas en una pantalla DOOH?

En la UE, si la imagen es un deepfake, sí: el artículo 50 del AI Act lo exige desde el 2 de agosto de 2026 y el código de buenas prácticas pide un ícono visible desde la primera exposición, también fuera de línea. En Colombia no hay una norma equivalente, pero recomendamos etiquetar igual.

¿Se puede usar video generado en vivo?

Rara vez como resultado inmediato: Google indica latencias de Veo 3.1 de 11 segundos a 6 minutos en horas pico. Funciona mejor como entrega diferida por correo. Además, Veo solo permite personas adultas en la UE y Gemini Omni Flash no edita videos subidos en el EEE, Suiza ni el Reino Unido.

¿Cuánto tiempo puedo guardar las fotos de los asistentes?

Solo el necesario para la finalidad anunciada. Nuestra recomendación: borrar el selfie original en cuanto existe el resultado y el resultado al vencer el plazo informado, conservando solo la prueba del consentimiento.

Hablar con Slash

Pongámoslo en producción

Cuéntanos tu reto. Respondemos en menos de 24 horas laborales con una primera lectura honesta: si podemos ayudarte, te diremos cómo; si no, te diremos quién puede.

Contesto personalmente. Sin formularios eternos ni respuestas automáticas.

Escribirle a Esteban