A inteligência artificial já faz parte de alguma etapa da produção de áudio para 85% dos profissionais ouvidos pelo estudo Who is Narrating the Future? AI Adoption, Use and Outlook in Audio Production, realizado pela Dosdoce.com em parceria com a Feira do Livro de Frankfurt e a Frankfurt Audio. O levantamento reúne respostas de 53 editoras, estúdios de produção e distribuidoras, complementadas pela contribuição de outros 32 profissionais do setor em diferentes regiões do mundo.
Apesar da ampla adoção, o uso da tecnologia ainda está longe de representar uma automatização completa dos processos. Apenas 17% dos participantes afirmam ter integrado a IA em mais de seis etapas do fluxo de produção. O relatório aponta que o setor vem migrando da experimentação para a incorporação da tecnologia à infraestrutura operacional, mas ressalta que a adoção ampla ainda é limitada.
Um dos principais dados do estudo diz respeito aos custos. A economia efetivamente observada fica entre 20% e 50% no segundo e no terceiro ano de adoção da IA, bem abaixo dos 85% a 95% frequentemente anunciados por fornecedores de tecnologia.
Segundo o relatório, a diferença está relacionada ao fato de que muitas estimativas consideram apenas linhas isoladas de custo, enquanto a produção de um audiolivro envolve um fluxo mais amplo de etapas e profissionais.
Na escolha de ferramentas e fornecedores, a redução de custos também não aparece como principal critério. Qualidade da voz e transparência sobre direitos são citadas por 86% dos entrevistados, enquanto 79% apontam a privacidade dos dados. A economia de custos aparece para 44%, e o suporte técnico, para 33%.
O relatório identifica, ainda, uma tendência de convivência entre diferentes modelos de produção. O chamado modelo de “três velocidades” combina narração humana para títulos de maior valor, processos híbridos, nos quais a IA assume tarefas mecânicas sob supervisão humana, e produção totalmente sintética para títulos de catálogo, de nicho ou outros projetos que dificilmente seriam viáveis em áudio com os modelos tradicionais.
A expansão do uso de IA também deverá ampliar os catálogos, segundo o estudo. Para 86% dos entrevistados, a tecnologia deverá provocar crescimento moderado ou disruptivo do setor nos próximos três anos, especialmente pela possibilidade de produzir títulos de catálogo, acadêmicos, de nicho e em idiomas que ainda têm pouca oferta de audiolivros. O relatório, porém, alerta que esse movimento pode ampliar desigualdades existentes na representação de idiomas e regiões menos atendidos.
Direitos, transparência e remuneração aparecem como questões ainda em aberto. Nove em cada dez participantes defendem maior transparência para autores e consumidores sobre o uso de IA, enquanto 60% apontam a necessidade de conjuntos de dados de voz licenciados de forma ética e de remuneração justa para profissionais de voz. O estudo também defende modelos baseados em consentimento para o uso de vozes e textos no treinamento de sistemas de IA.
O estudo tem abrangência internacional, com participantes da Europa, América Latina, América do Norte, África e Oriente Médio. O material divulgado não apresenta, contudo, um recorte específico de dados sobre o Brasil, embora a América Latina esteja entre as regiões consideradas na pesquisa.
Who is Narrating the Future? é o terceiro estudo anual da Dosdoce.com sobre inteligência artificial e publicação de áudio, depois dos levantamentos realizados em 2024 e 2025.
Clique aqui para baixar o relatório.




