AudioStack lleva la producción de audio publicitario a un modelo basado en agentes de IA

AudioStack ha actualizado su plataforma de producción de audio con nuevas soluciones multiagente, una arquitectura con la que busca automatizar una parte más amplia del proceso creativo para publicidad y medios. La compañía plantea que la inteligencia artificial intervenga ya no solo en la generación de una voz, sino también en la interpretación del briefing, el desarrollo del guion, el casting, la selección musical, el diseño de sonido y la preparación final de la pieza. La propuesta parte de una diferencia que AudioStack considera fundamental. Convertir texto en voz es una tarea relativamente sencilla con las tecnologías actuales; el reto está en tomar un objetivo de comunicación y transformarlo en una pieza preparada para su emisión, tomando durante el proceso una serie de decisiones creativas y técnicas.

Con la actualización, la compañía quiere trasladar parte de esas decisiones a un sistema formado por varios agentes especializados que analizan el briefing antes de iniciar la producción. El objetivo es que el resultado dependa del contexto de la marca, el producto, la audiencia y los objetivos de la campaña, en lugar de partir únicamente de plantillas predefinidas. Según AudioStack, el proceso puede completarse desde el briefing hasta una primera pieza revisable en cuestión de minutos. La actualización introduce cuatro cambios principales dentro del flujo de trabajo. Antes de comenzar a escribir el guion, el sistema analiza la marca, obtiene información sobre el producto e interpreta tanto la audiencia como el objetivo de la comunicación. A partir de esta información genera una propuesta de texto adaptada a la duración y estructura necesarias. El casting y la dirección se realizan posteriormente en función de ese guion. La plataforma selecciona elementos como la voz, el estilo de interpretación, la música o la estructura de la pieza con el propósito de mantener coherencia entre las distintas decisiones de producción. AudioStack señala además que cada una de estas elecciones queda registrada dentro del sistema. Esta trazabilidad permite conservar información sobre las decisiones tomadas durante cada producción y utilizarla como contexto en futuros procesos. Antes de generar el archivo definitivo, los materiales pasan también por comprobaciones vinculadas a los estándares de emisión. La intención es reducir el trabajo necesario entre la creación de una primera versión y la obtención de una pieza susceptible de ser utilizada en canales profesionales de audio. El cambio reside, por tanto, en que diferentes agentes participan de forma coordinada en distintas fases de la producción, en lugar de limitar el uso de IA a una herramienta concreta, como la síntesis de voz.

Para la compañía, la principal oportunidad de este tipo de sistemas no está únicamente en reducir los tiempos de producción. “Gran parte de la industria habla de la IA como una forma de avanzar más rápido. Creemos que el verdadero valor está en el criterio: la capacidad de razonar sobre un briefing como lo haría un estratega humano, pero a la velocidad a la que puede operar la IA”, explica Erik Barraud, Chief Product Officer de AudioStack. Según el profesional, la evolución de la plataforma supone pasar de ofrecer herramientas de IA capaces de producir audio a utilizar agentes que intentan comprender “un briefing, su contexto y su audiencia” antes de actuar. Este planteamiento acerca la producción de audio a una tendencia que ya empieza a aparecer en otras áreas del marketing y el AdTech: el paso desde herramientas generativas que responden a una instrucción concreta hacia sistemas agénticos capaces de encadenar tareas y tomar decisiones dentro de un flujo de trabajo. En el caso de AudioStack, esas decisiones se concentran en las diferentes etapas necesarias para producir una creatividad de audio. AudioStack asegura haber diseñado la actualización alrededor de situaciones habituales entre sus clientes. Entre ellas se encuentran agencias que necesitan disponer rápidamente de una pieza de demostración para presentar un pitch, equipos de producción que no cuentan en un momento determinado con algún especialista o marcas y publishers que necesitan reaccionar con rapidez ante cambios del mercado. En estos casos, la compañía plantea un flujo en el que el usuario introduce un briefing y recibe una primera versión razonada y preparada para su revisión, reduciendo la dependencia de una cadena de producción secuencial.

La automatización no implica necesariamente eliminar la revisión humana. El sistema está planteado para producir un activo que pueda ser revisado o utilizado posteriormente según las necesidades de cada equipo. La diferencia está en cuánto trabajo puede realizarse antes de esa intervención. Este punto puede ser especialmente relevante en publicidad, donde la adaptación de una misma campaña a diferentes audiencias, mercados, duraciones o contextos puede multiplicar rápidamente el número de piezas necesarias. Los clientes actuales de AudioStack no tendrán que realizar ninguna migración ni contratar un nuevo producto para acceder a las nuevas capacidades. La compañía mantiene su planteamiento model-agnostic, que busca evitar la dependencia de un único modelo de inteligencia artificial, y asegura que las nuevas funcionalidades se desplegarán directamente sobre la plataforma existente. También se conservarán los controles que ya utilizan las marcas sobre aspectos como voz y tono. La evolución de AudioStack muestra cómo la IA generativa empieza a desplazarse hacia una fase distinta dentro de la producción publicitaria. Generar una voz, una imagen o un texto se ha convertido rápidamente en una capacidad disponible para numerosos proveedores. La siguiente competencia está en decidir qué sistemas pueden coordinar esas capacidades, interpretar correctamente un briefing y convertirlo en un activo terminado con menos intervención entre cada paso.

En audio, AudioStack quiere que esa unidad de automatización deje de ser la voz generada y pase a ser la producción completa.

Puntos clave:

  • AudioStack incorpora una arquitectura multiagente que interpreta el briefing antes de producir, coordinando guion, casting, voz, música, diseño de sonido y mezcla dentro de un mismo flujo.

  • La propuesta busca ir más allá de generar audio más rápido: la compañía pone el foco en que los agentes tomen decisiones según la marca, la audiencia y el objetivo, dejando además registro de cada elección.

  • El objetivo es reducir la producción a cuestión de minutos, entregando piezas listas para revisión o emisión sin exigir migraciones ni cambios contractuales a los clientes actuales.

Este resumen lo ha creado una herramienta de IA basándose en el texto del artículo, y ha sido chequeado por un editor de PROGRAMMATIC SPAIN.

 
Anterior
Anterior

El Retail Media mira al 2028 con la integración como principal reto

Siguiente
Siguiente

Prime Video amplía su apuesta por las compras dentro del contenido