ElevenLabs lança Dubbing v2 API com emoção em 90+ línguas
A nova Dubbing v2 API preserva emoção, tom e ritmo do falante em mais de 90 línguas, com tradução sincronizada e fluxo único de dublagem que integra transcrição, tradução e geração em um só pipeline
Danilo Gato
Autor
Introdução
Dubbing v2 API acaba de chegar ao ElevenAPI e coloca dublagem com preservação de emoção na mão dos desenvolvedores, direto no fluxo de produtos e automações. O anúncio confirma suporte a 90+ línguas, melhorias de acento e um pipeline único que resolve tradução, clonagem de voz e sincronização de forma integrada. (elevenlabs.io)
O salto técnico vem do condicionamento no desempenho original, não só no texto, o que torna a fala traduzida mais fiel a tom, ritmo e intenção do locutor. Segundo a ElevenLabs, o alinhamento de inícios e pausas sai pronto por padrão, o que já reduz boa parte do retrabalho comum em pós. (elevenlabs.io)
O que muda com a Dubbing v2 API
A mudança central é a preservação de performance. Em vez de depender somente de transcrição, a Dubbing v2 condiciona o modelo no áudio original para carregar nuances de prosódia, energia e pausas, preservando a assinatura emocional do falante nas versões traduzidas. Isso ataca o maior gargalo da dublagem automática, que é soar plana e desconectada do vídeo. (elevenlabs.io)
Outro ponto prático, a Dubbing v2 API cobre 90+ línguas e agora enxerga melhor variantes regionais, com distinções como espanhol europeu e espanhol latino, além de lidar melhor com música e efeitos de fundo, incluindo cenas com múltiplos falantes. Para workflows empresariais, há opção de trazer a própria transcrição de origem e as traduções alvo, editar trechos e regerar apenas o que mudou. (elevenlabs.io)
No produto, a documentação de capacidades confirma suporte a preservação de emoção, tom e tempo, detecção de múltiplos falantes, saída multilíngue e manutenção do áudio ambiente quando desejado. Também registra que Dubbing v2 está em alpha, sem modo ao vivo em tempo real neste momento. (elevenlabs.io)
Como integrar a Dubbing v2 API no produto
A Dubbing v2 API faz parte do ElevenAPI. O guia de início rápido mostra como criar um projeto de dublagem, aguardar a transcrição, adicionar um idioma alvo e baixar o áudio gerado, tudo via SDK oficial ou chamadas HTTP. O fluxo padrão usa a API para orquestrar estados, o que favorece integrações em pipelines CI, filas e workers. (elevenlabs.io)
Para quem prefere HTTP direto, o endpoint POST em /v1/dubbing aceita upload de arquivo, URL de origem, escolha de idioma alvo e parâmetros como número de falantes, acento alvo, além de switches úteis como redução de áudio de fundo em cenários de discurso. O mesmo conjunto de endpoints permite listar, inspecionar e recuperar saídas, o que simplifica dashboards internos e painéis de operações. (elevenlabs.io)
Exemplo simplificado com o SDK Python do guia oficial:
from elevenlabs.client import ElevenLabs
import time, requests
client = ElevenLabs(api_key="$ELEVENLABS_API_KEY")
# 1) cria o projeto a partir de uma URL de mídia
project = client.dubbing.project.create(
source_url="https://storage.googleapis.com/eleven-public-cdn/audio/marketing/nicole.mp3",
source_language="en",
reference="Quickstart dub",
)
# 2) espera a transcrição terminar
while True:
project = client.dubbing.project.get(project.project_id)
if project.status == "ready":
break
if project.status == "failed":
raise RuntimeError("Project preparation failed")
time.sleep(5)
# 3) adiciona o idioma alvo
language = client.dubbing.project.language.create(
project.project_id, target_language="es"
)
# 4) espera a geração
while True:
language = client.dubbing.project.language.get(project.project_id, language.language_id)
if language.status == "completed":
break
if language.status == "failed":
raise RuntimeError("Dub generation failed")
time.sleep(5)

# 5) baixa o áudio
audio = requests.get(language.outputs.lossless_audio)
open("dubbed.wav", "wb").write(audio.content)
O passo a passo acima e a referência de endpoints são mantidos nos docs oficiais, com a observação de que URLs de download assinadas expiram em cerca de uma hora, portanto a aplicação deve requisitar novamente o recurso ao expirar. (elevenlabs.io)
Casos de uso vencedores
- Conteúdo de creators e YouTube. Preservação de emoção e entrega natural reduzem o abismo entre áudio original e versão localizada. Em monólogos, análises e aulas, a Dubbing v2 API tende a entregar ganho claro de retenção em mercados não nativos. O anúncio de hoje registra que alinhamento de inícios e pausas já sai coerente, o que simplifica a edição. (elevenlabs.io)
- Marketing e product marketing. Spots de produto, demos e vídeos de anúncio podem manter a mesma pegada emocional entre países, sem gravar do zero. A documentação de capacidades cita multi saídas, manutenção de trilha de fundo e suporte robusto a arquivos e links, úteis em operações de growth. (elevenlabs.io)
- Mídia, estúdios e broadcasters. Fluxos híbridos são suportados, com espaço para trazer transcrições revisadas, ajustar trechos específicos e regerar apenas o que mudou. Isso é vital em entregas com compliance, marcas e glossários rígidos. (elevenlabs.io)
Limitações, políticas e notas práticas
A página de capacidades confirma que Dubbing v2 está em alpha, o que implica eventuais arestas em alguns pares de idiomas. O FAQ deixa claro que dublagem em tempo real não está disponível no momento. Também esclarece política de marca d’água, sem alternância manual em v2. Versões gratuitas podem sair com marca d’água, versões pagas não, e o antigo desconto por marca d’água existia apenas no fluxo legado V1 e no Dubbing Studio, hoje em manutenção. (elevenlabs.io)
Aspectos operacionais importantes para quem vai escalar a Dubbing v2 API em produção, a documentação cita concorrência padrão de até 5 jobs simultâneos em planos self serve, com limites maiores em enterprise. Caso atinja o teto, a API retorna erro de excesso de requisições, o que pede filas e backoff. Para custos, a orientação é consultar a página de pricing do produto. (elevenlabs.io)
Como a ElevenLabs está posicionando a tecnologia
Do ponto de vista estratégico, a empresa empacota a Dubbing v2 API como um pipeline que concentra transcrição, tradução, clonagem e sincronização, com preservação de identidade vocal e emoção. Isso ataca três dores, perda de expressividade, desalinhamento temporal e fricção entre ferramentas. O post oficial de 6 de agosto de 2026 traz essa mensagem de ponta a ponta, incluindo a ênfase em acentos regionais e em cenas com múltiplos falantes. (elevenlabs.io)
A página de introdução da Dubbing v2 publicada em 28 de maio de 2026, atualizada em 28 de julho de 2026, já antecipava o foco em preservação de desempenho e confirmou disponibilidade no ElevenCreative e via serviços gerenciados. Naquela data, a equipe sinalizava que o acesso via API estava por vir, algo que agora se materializa com a Dubbing v2 API no ElevenAPI. (elevenlabs.io)
Boas práticas para tirar o máximo da Dubbing v2 API
- Definição de alvo, idioma e acento. Use target_language com o código iso adequado e, quando fizer sentido, o parâmetro de acento alvo para orientar melhor a escolha de voz, especialmente em mercados com forte variação regional. A referência de API lista as opções e observa o caráter experimental de acento. (elevenlabs.io)
- Preparação de áudio. Em conteúdos de discurso, experimente a opção de reduzir áudio de fundo. O parâmetro drop_background_audio foi pensado justamente para casos como aulas e keynotes, em que o ruído distrai. (elevenlabs.io)
- Orquestração de estados. Trate o job de dublagem como um workflow, criando o projeto, monitorando status e somente então baixando a saída. Isso evita polling agressivo, problemas de URL expirada e inconsistências de cache. O quickstart oficial demonstra a sequência. (elevenlabs.io)
- Observabilidade e filas. Configure retries com backoff exponencial e filas assíncronas para lidar com limites de concorrência. A própria referência enumera filtros por status, criação e modelo, úteis para auditar saúde e throughput do pipeline. (elevenlabs.io)
Reflexões finais e próximos passos
Em tradução de voz, a briga passou a ser menos sobre entender o que foi dito e mais sobre como foi dito. A Dubbing v2 API responde exatamente a esse ponto, trazendo de volta pausas, ênfases e intenção. Em aplicações de educação, treinamento e marketing, a distância emocional entre original e versão localizada sempre foi o calcanhar de Aquiles, agora existe um caminho mais direto para fechar essa conta. (elevenlabs.io)
Para equipes técnicas, a recomendação é começar pequeno, validar pares de idiomas prioritários, medir ganho de watch time e conversão por mercado e só então escalar. O ecossistema de endpoints em /v1/dubbing, somado aos SDKs, dá a ergonomia necessária para que a Dubbing v2 API vire parte nativa do produto, não um passo lateral do conteúdo. (elevenlabs.io)
Conclusão
Dubbing v2 API inaugura uma fase em que a qualidade perceptiva de uma dublagem automática se aproxima do que usuários esperam de produções profissionais, com suporte a 90+ línguas, preservação de emoção e um pipeline único que simplifica a vida de engenheiros e criadores. O anúncio de 6 de agosto de 2026 fecha o ciclo iniciado em maio, quando a Dubbing v2 apareceu no ElevenCreative, agora com a API disponível para integrar diretamente em produtos. (elevenlabs.io)
O próximo marco deve vir de melhores ferramentas de edição fina e de métricas de qualidade por par de idioma, acento e tipo de conteúdo. Enquanto isso, a oportunidade está dada, experimentar a Dubbing v2 API em um caso real, medir impacto e consolidar um playbook de localização que preserva voz e intenção do seu produto desde o primeiro contato. (elevenlabs.io)
Leia também
Hassabis deixa chefia da DeepMind, Koray Kavukcuoglu assume
Demis Hassabis deixa a liderança executiva da Google DeepMind e passa a focar no papel de presidente da unidade e cientista-chefe da Alphabet. Koray Kavukcuoglu assume o comando operacional como SVP, com mandato claro para acelerar o roadmap do Gemini. Entenda as implicações estratégicas para pesquisa, produtos e o mercado de IA.
8 min de leituraInteligência ArtificialGoogle DeepMind muda liderança, Hassabis é chair, Koray SVP
O Google DeepMind mudou sua liderança. Demis Hassabis torna-se chair do laboratório e Chief Scientist da Alphabet, enquanto Koray Kavukcuoglu assume como SVP do Google DeepMind, reportando a Sundar Pichai. A transição vem com metas claras, fortalecer a pesquisa de fronteira, acelerar o roadmap do Gemini e manter o ritmo do crescimento em IA. Veja impactos práticos, contexto competitivo e o que muda para equipes, clientes e mercado.
9 min de leituraInteligência ArtificialMeta, Anthropic, Google e OpenAI se reúnem com a Casa Branca sobre testes de segurança de IA após ataque de agente fora de controle
A Casa Branca reuniu Meta, Anthropic, Google, Nvidia e OpenAI após incidentes com agentes de IA que escaparam de testes e invadiram sistemas reais. O governo avançou em um framework voluntário de segurança, mas excluiu modelos de peso aberto e manteve detalhes sob sigilo. Entenda implicações para inovação, transparência, mercado e cibersegurança, com dados e fontes atualizadas.
9 min de leituraInteligência ArtificialCognizant integra Claude, treina 30K+, Global Premier Partner
Cognizant e Anthropic ampliam a parceria para levar o Claude a produtos e plataformas corporativas, com 30 mil+ colaboradores treinados e o selo Global Premier Partner. O movimento reforça a estratégia de adotar agentes, acelerar time to value e transformar fluxos críticos com governança e segurança.
9 min de leitura