A AudioStack leva a produção de áudio publicitário para um modelo baseado em agentes de IA

AudioStack atualizou a sua plataforma de produção de áudio com novas soluções multiagente, uma arquitetura com a qual procura automatizar uma parte mais abrangente do processo criativo para publicidade e media. A empresa propõe que a inteligência artificial intervenha já não apenas na geração de uma voz, mas também na interpretação do briefing, no desenvolvimento do guião, no casting, na seleção musical, no design de som e na preparação final da peça. A proposta parte de uma diferença que a AudioStack considera fundamental. Converter texto em voz é uma tarefa relativamente simples com as tecnologias atuais; o desafio está em pegar num objetivo de comunicação e transformá-lo numa peça preparada para emissão, tomando, durante o processo, uma série de decisões criativas e técnicas.

Com a atualização, a empresa pretende transferir parte dessas decisões para um sistema composto por vários agentes especializados que analisam o briefing antes de iniciar a produção. O objetivo é que o resultado dependa do contexto da marca, do produto, da audiência e dos objetivos da campanha, em vez de partir apenas de templates predefinidos. Segundo a AudioStack, o processo pode ser concluído desde o briefing até à primeira peça passível de revisão em questão de minutos. A atualização introduz quatro mudanças principais no fluxo de trabalho. Antes de começar a escrever o guião, o sistema analisa a marca, obtém informação sobre o produto e interpreta tanto a audiência como o objetivo da comunicação. A partir desta informação, gera uma proposta de texto adaptada à duração e estrutura necessárias. O casting e a direção são realizados posteriormente com base nesse guião. A plataforma seleciona elementos como a voz, o estilo de interpretação, a música ou a estrutura da peça, com o objetivo de manter a coerência entre as diferentes decisões de produção. A AudioStack salienta ainda que cada uma destas escolhas fica registada no sistema. Esta rastreabilidade permite conservar informação sobre as decisões tomadas durante cada produção e utilizá-la como contexto em processos futuros. Antes de gerar o ficheiro definitivo, os materiais passam também por verificações relacionadas com os padrões de emissão. A intenção é reduzir o trabalho necessário entre a criação de uma primeira versão e a obtenção de uma peça suscetível de ser utilizada em canais profissionais de áudio. A mudança reside, assim, no facto de diferentes agentes participarem de forma coordenada em diferentes fases da produção, em vez de limitar a utilização de IA a uma ferramenta específica, como a síntese de voz.

Para a empresa, a principal oportunidade deste tipo de sistemas não está apenas na redução dos tempos de produção. “Grande parte da indústria fala da IA como uma forma de avançar mais rapidamente. Acreditamos que o verdadeiro valor está no critério: na capacidade de raciocinar sobre um briefing como faria um estratega humano, mas à velocidade a que a IA consegue operar”, explica Erik Barraud, Chief Product Officer da AudioStack. Segundo o responsável, a evolução da plataforma representa uma passagem de ferramentas de IA capazes de produzir áudio para agentes que procuram compreender “um briefing, o seu contexto e a sua audiência” antes de agir. Esta abordagem aproxima a produção de áudio de uma tendência que começa já a surgir noutras áreas do marketing e do AdTech: a passagem de ferramentas generativas que respondem a uma instrução concreta para sistemas agênticos capazes de encadear tarefas e tomar decisões dentro de um fluxo de trabalho. No caso da AudioStack, essas decisões concentram-se nas diferentes etapas necessárias para produzir uma criatividade de áudio. A AudioStack afirma ter concebido a atualização em torno de situações comuns entre os seus clientes. Entre elas estão agências que precisam de dispor rapidamente de uma peça de demonstração para apresentar num pitch, equipas de produção que, num determinado momento, não contam com algum especialista ou marcas e publishers que precisam de reagir rapidamente a alterações do mercado. Nestes casos, a empresa propõe um fluxo no qual o utilizador introduz um briefing e recebe uma primeira versão fundamentada e preparada para revisão, reduzindo a dependência de uma cadeia de produção sequencial.

A automatização não implica necessariamente eliminar a revisão humana. O sistema foi concebido para produzir um ativo que possa ser revisto ou utilizado posteriormente de acordo com as necessidades de cada equipa. A diferença está na quantidade de trabalho que pode ser realizada antes dessa intervenção. Este ponto pode ser particularmente relevante na publicidade, onde a adaptação de uma mesma campanha a diferentes audiências, mercados, durações ou contextos pode multiplicar rapidamente o número de peças necessárias. Os atuais clientes da AudioStack não terão de realizar qualquer migração nem contratar um novo produto para aceder às novas capacidades. A empresa mantém a sua abordagem model-agnostic, que procura evitar a dependência de um único modelo de inteligência artificial, e garante que as novas funcionalidades serão disponibilizadas diretamente na plataforma existente. Serão também mantidos os controlos que as marcas já utilizam sobre aspetos como voz e tom. A evolução da AudioStack mostra como a IA generativa começa a avançar para uma fase diferente dentro da produção publicitária. Gerar uma voz, uma imagem ou um texto tornou-se rapidamente uma capacidade disponível para inúmeros fornecedores. A próxima área de competição está em perceber que sistemas conseguem coordenar essas capacidades, interpretar corretamente um briefing e transformá-lo num ativo finalizado com menos intervenção entre cada etapa.

No áudio, a AudioStack quer que essa unidade de automatização deixe de ser a voz gerada e passe a ser a produção completa.

Anterior
Anterior

O Retail Media olha para 2028 com a integração como principal desafio

Próximo
Próximo

O Prime Video reforça a aposta nas compras dentro dos conteúdos