Em resumo
- A Tavus afirma que 26 de 54 participantes (48%) acreditaram que Griffin-Lite era uma pessoa real após uma chamada de vídeo de um minuto, contra 1 de 41 para seu sistema anterior.
- O Griffin-Lite ocupa o primeiro lugar no benchmark VideoFDB da Nvidia, com pontuação de 3,83 de 5 em geração, contra 2,80 do segundo melhor sistema e 3,92 de uma referência humana.
- Os resultados vêm da própria página de pesquisa da Tavus, os participantes foram informados de que encontrariam outra pessoa, e o Griffin-Lite está limitado a testadores confiáveis selecionados enquanto a Tavus trabalha em medidas de segurança.
A startup de IA Tavus afirma que seu novo modelo, Griffin, convenceu 48% das pessoas que conversaram com ele em uma chamada de vídeo ao vivo de que estavam falando com um humano real.
A empresa o apresentou em 1º de outubro e o chama de primeiro Modelo de Interação Humana, uma IA criada para entender e gerar conversas cara a cara, prestando atenção a expressões e pausas, bem como às palavras. Seu sistema anterior obteve 2,4% no mesmo teste.

Griffin-Lite, a versão testada pela Tavus, enfrentou 54 pessoas, e 26 delas disseram depois acreditar que seu parceiro era uma pessoa real. O sistema mais antigo enfrentou 41 pessoas e obteve exatamente um crente.
Tavus explica que os participantes foram informados de que seriam combinados com outra pessoa para uma chamada de vídeo de um minuto sobre o que estavam ansiosos para este ano. Somente no final foram questionados se lhes passou pela cabeça que seu parceiro poderia não ser real.
Esse não é o clássico Teste de Turing, proposto em 1950 pelo matemático britânico Alan Turing, no qual um juiz conversa com um humano oculto e uma máquina oculta e precisa descobrir qual é qual. Ninguém na chamada foi informado de que um bot poderia estar do outro lado.
Os resultados vêm da própria página de pesquisa da Tavus, e os participantes foram recrutados por meio do que ela chama de uma plataforma de pesquisa independente. Uma nota da comunidade no X já sinalizou que os resultados não são verificados de forma independente e não seguem um protocolo padrão. A Tavus diz que as pessoas que ficaram desconfiadas geralmente o fizeram em até 20 segundos.
Empresas de IA construindo em direção a isso já é algo há um tempo. Um estudo da UC San Diego descobriu que o GPT-4.5 da OpenAI convenceu os juízes de que era humano em 73% das conversas, quando instruído a interpretar uma pessoa jovem introvertida e experiente na internet. Esse teste foi apenas de texto.
Griffin adiciona um rosto e uma voz, em tempo real.
No benchmark VideoFDB da NVIDIA, um teste de conversa ao vivo com áudio e vídeo, a Tavus diz que o Griffin-Lite ocupa o primeiro lugar. Sua trilha de geração, que avalia quão naturais e expressivas são as respostas de um modelo, deu ao Griffin-Lite 3,83. O segundo melhor sistema obteve 2,80, e a referência humana marcou 3,92.
A trilha de percepção, que verifica se um modelo entende o que vê e ouve, mostra onde ele ainda fica atrás das pessoas. O Griffin-Lite marcou 3,73 contra 3,44 da linha de base mais forte, enquanto a referência humana atingiu 4,20. A Tavus diz que a NVIDIA executou a avaliação de forma independente.
BitcoinBTC · USD
$84,141+0.14%
25 de set27 de set29 de set1 de out2 de out
$86,8 mil$85,4 mil$84,0 mil$82,7 mil
Máxima 24hMáxima$87,086
Mínima 24hMínima$84,473
VolVol$2,2B
Projeções de mercadoProbabilidades por Myriad
Comprar Bitcoin com USDT
Fornecido por Jupiter
Griffin também é full-duplex, o que significa que ele escuta, observa e fala ao mesmo tempo, como uma chamada telefônica em vez de um walkie-talkie. Em uma demonstração da Tavus, ele orienta um homem a resolver um cubo de Rubik com base no que vê em suas mãos, e espera quando ele fica quieto para pensar. O atraso de áudio para vídeo é em média de 0,43 segundos em chips NVIDIA H100, o tipo usado em data centers de IA, o que a Tavus afirma ser metade do próximo método mais rápido.
Por que alguém fora da área de tecnologia deveria se importar? Bem, por um motivo, porque os golpistas já atuam em chamadas de vídeo.
Em janeiro, hackers ligados à Coreia do Norte usaram deepfakes, vídeos feitos por IA que imitam uma pessoa real, em chamadas de Zoom ou Teams para se passarem por contatos de confiança. Pesquisadores de segurança atribuem a invasão ao BlueNoroff, uma subsidiária do Lazarus Group. As vítimas são convencidas a instalar malware disfarçado de correção de áudio.
David Liberman, cocriador do Gonka, uma rede descentralizada para computação de IA, disse naquele relatório que fotos e vídeos não podem mais ser confiáveis como prova de que algo é real. Aqueles modelos não eram tão avançados quanto este.
As empresas já improvisam suas defesas. Em 2025, a Kraken sinalizou um suposto candidato a emprego norte-coreano depois que sua equipe de segurança fez perguntas espontâneas, como solicitar documento de identidade do governo e os nomes de restaurantes locais. O candidato teve dificuldades.
Testamos os modelos da Tavus e os resultados foram… decepcionantes. Após algumas pesquisas, descobrimos que o Griffin-Lite não está disponível para clientes, apenas para testadores confiáveis selecionados como uma prévia de pesquisa, e a empresa diz que está trabalhando em recursos de divulgação e com organizações de segurança de IA.
Isso porque a Tavus diz que o Griffin precisa de medidas de segurança antes de um lançamento público.
A Tavus levantou US$ 40 milhões em uma Série B em novembro de 2025, liderada pela CRV. O sistema que obteve 2,4% combinou três modelos separados, um para visuais, um para diálogo e um para percepção.
Testadores confiáveis podem solicitar acesso ao Griffin-Lite enviando um formulário no site da Tavus.






