Em 26 de setembro de 2026, o TechCrunch publicou um experimento incomum. A repórter Dominic-Madori Davis apresentou aos leitores um avatar digital interativo criado à sua imagem, capaz de responder perguntas sobre uma de suas reportagens.
O trabalho foi feito pela Synthesia, startup britânica de avatares e vídeo generativo, no novo escritório da empresa em Nova York.
A história começou no meio do ano. Alexandru Voica, chefe de assuntos corporativos da Synthesia, enviou à jornalista o link de um avatar interativo treinado para responder perguntas de imprensa sobre a companhia.
Para ela, era o estágio mais avançado do uso de IA em relações públicas, bem além dos textos gerados automaticamente que o setor já discute.
A Synthesia concorre com nomes como D-ID, HeyGen e Colossyan. Atingiu avaliação de US$ 4 bilhões no início de 2026 e afirmou, no ano anterior, ter passado de US$ 100 milhões em receita recorrente anual.
Além de vídeos corporativos com avatares, lançou o Roleplay Sessions, em que funcionários treinam argumentos de venda diante de um avatar que responde e avalia o desempenho.
Convidada a conhecer o novo escritório em setembro, ela aceitou na hora a oferta de ter um gêmeo digital. Diz que era indiferente a avatares até então, mas convencida de que eles se tornarão parte inevitável da vida online.
Um gêmeo digital em poucos dias
A produção ocorreu em um pequeno estúdio montado dentro do escritório, com diversas fotos e uma gravação de dois minutos de voz. Foi necessário consentir formalmente com a criação dos avatares.
A equipe montou um avatar pessoal, que apenas lê o roteiro que recebe, e dois avatares interativos, que ouvem e respondem, todos nas versões com e sem óculos. O processo levou alguns dias.
No primeiro teste, o avatar pessoal leu um roteiro genérico sobre a chegada do outono em Nova York, estação favorita da jornalista. A voz saiu razoavelmente fiel e, para alívio dela, sem a rouquidão daquele dia.
Como funciona a tecnologia
O avatar interativo foi treinado sobre uma reportagem específica, a que investiga por que startups financiadas por capital de risco cometem mais fraudes do que as sem esse tipo de investimento. Ele responde apenas sobre esse tema.
A construção combina quatro camadas: um modelo de fala para texto; um modelo de linguagem agêntico, que interpreta o pedido e decide ações; um modelo de texto para fala; e um modelo de vídeo, feito pela própria Synthesia, que anima o avatar enquanto ele fala.
A pilha usa os modelos de vídeo e voz da Synthesia, mas clientes podem escolher alternativas de laboratórios como Cartesia, ElevenLabs, Google ou OpenAI. Podem hospedar os avatares na nuvem que quiserem ou na estrutura da empresa.
A oferta se divide em três frentes. Uma plataforma de criação e distribuição de vídeos com avatares clássicos, em que alguém digita um roteiro e o avatar o reproduz.
Uma plataforma agêntica chamada Sessions, voltada a pesquisas e simulações de papéis. E uma plataforma de API, que permite combinar os modelos de vídeo e voz da Synthesia a outros serviços.
O que o experimento revela
Segundo o TechCrunch, é a primeira vez que a Synthesia cria um avatar digital para um jornalista, e também a primeira fora de Voica. O caso expõe a tensão que a própria repórter admite sentir ao clonar a si mesma com IA, em uma profissão baseada em confiança, presença e autoria.
Ao mesmo tempo, mostra que a tecnologia deixou as demonstrações e entrou em produtos corporativos de treinamento, atendimento e comunicação.
Para as empresas de tecnologia, avatares interativos podem virar interface padrão no contato com imprensa, clientes e funcionários, com ganhos de escala e riscos de credibilidade. Para quem produz conteúdo, surgem questões práticas: quem controla o que o clone diz, como o público sabe que está falando com uma máquina e o que acontece quando o avatar sobrevive ao consentimento que o originou.
A experiência não responde a essas perguntas. Apenas as coloca, de forma bastante concreta, em um navegador aberto.
Fontes e links
- TechCrunch
- Synthesia: avatar interativo de relações públicas
- Organization Science: paper sobre fraude em startups financiadas por capital de risco
- Synthesia: os três níveis de agentes de vídeo







