WhatsApp

IA nas Empresas

A IA já passou no Teste de Turing? O estudo de 2025 explicado

O que é o Teste de Turing, como o GPT-4.5 foi confundido com humano em 73% das vezes num estudo de 2025 e o que isso muda no atendimento da sua empresa.

Capa do artigo A IA já passou no Teste de Turing, com arcos rosa e ciano sobre fundo escuro.

Imagine que você está conversando por mensagem com duas pessoas ao mesmo tempo. Uma é humana. A outra é uma inteligência artificial. Você tem cinco minutos para descobrir quem é quem. Parece fácil? Num estudo da Universidade da Califórnia em San Diego, divulgado em 2025, as pessoas apontaram a IA como "o humano" em 73% das vezes. Mais do que apontaram o humano de verdade.

Essa é a versão moderna do Teste de Turing, proposto em 1950 pelo matemático britânico Alan Turing, e o resultado reacendeu uma pergunta que interessa a qualquer empresa que conversa com clientes pelo WhatsApp: se nem as pessoas conseguem mais distinguir a máquina, o seu cliente deveria saber quando está falando com um robô? Neste artigo, você vai entender o teste, o que o estudo realmente mostrou (e o que ele não mostrou) e o que isso muda no seu atendimento.

Pontos principais

  • O Teste de Turing coloca uma pessoa para conversar por texto com um humano e uma máquina ao mesmo tempo e adivinhar quem é quem.
  • No estudo de 2025, o GPT-4.5, instruído a assumir uma "persona" humana, foi escolhido como humano em 73% das partidas.
  • Sem a persona, o mesmo modelo foi escolhido em só 36%. E a ELIZA, um programa dos anos 1960, enganou 23% das pessoas.
  • Passar no teste mede o quanto a máquina parece humana, não o quanto ela é inteligente.
  • Para empresas, a lição é ética e prática: avise que é IA e deixe sempre um humano a um toque de distância.

O que é o Teste de Turing

Em outubro de 1950, Alan Turing publicou na revista Mind o artigo "Computing Machinery and Intelligence" (artigo original, Mind, 1950). Ele abre com uma frase que virou clássica: "Proponho considerar a pergunta: as máquinas podem pensar?"

Como "pensar" é difícil de definir, Turing trocou a pergunta por um jogo, que chamou de jogo da imitação. Um interrogador conversa só por texto com duas testemunhas escondidas, uma humana e uma máquina. As duas tentam convencê-lo de que são a pessoa de verdade. Se o interrogador não consegue identificar a máquina com segurança, ela passou.

Você sabia? Turing fez uma previsão no próprio artigo: em cerca de 50 anos, os computadores jogariam tão bem que um interrogador médio não teria mais de 70% de chance de acertar depois de cinco minutos de perguntas. Ele errou a data por uns 25 anos, mas acertou o formato do desafio.

Dois cavalos de xadrez, um preto e um branco, frente a frente, como humano e máquina no jogo da imitação do Teste de Turing.

O estudo de 2025: como foi o teste

Os pesquisadores Cameron Jones e Benjamin Bergen, do Departamento de Ciência Cognitiva da UC San Diego, montaram o teste no formato original de Turing, com três participantes (estudo "Large Language Models Pass the Turing Test", arXiv, 2025). Os números do desenho:

  • Dois experimentos independentes, randomizados e com hipóteses registradas antes: um com 126 estudantes da universidade e outro com 158 participantes recrutados on-line pela plataforma Prolific.
  • Cada interrogador conversava ao mesmo tempo com um humano e uma IA, numa tela parecida com um aplicativo de mensagens, por até 5 minutos.
  • Foram analisadas 1.023 partidas, com mediana de 8 mensagens em 4,2 minutos.
  • Quatro sistemas foram testados: GPT-4.5, LLaMa-3.1-405B, GPT-4o e a velha ELIZA.

O detalhe decisivo foi a persona. Parte das IAs recebeu instruções para se comportar como um jovem introvertido, ligado em cultura da internet e que usa gírias. A outra parte recebeu só a instrução de convencer o interrogador de que era humana.

O estudo foi publicado no arXiv, repositório onde pesquisadores divulgam trabalhos científicos, inclusive antes da revisão por pares. Vale ter isso em mente ao ler as manchetes.

Os resultados: quem enganou quem

Sistema testado Escolhido como humano
GPT-4.5 com persona 73%
LLaMa-3.1 com persona 56%
LLaMa-3.1 sem persona 38%
GPT-4.5 sem persona 36%
ELIZA (anos 1960) 23%
GPT-4o sem persona 21%

Com persona, o GPT-4.5 foi escolhido como humano em 69% das partidas com os universitários e 76% com o público do Prolific. Os autores afirmam que é a primeira evidência empírica de que um sistema artificial passa no teste de Turing padrão, de três participantes.

Você sabia? A ELIZA, um programa de regras simples criado por Joseph Weizenbaum no MIT nos anos 1960 (artigo original de 1966), foi escolhida como humana mais vezes (23%) do que o GPT-4o sem instruções (21%). Analisando as conversas, os pesquisadores viram que algumas pessoas escolheram a ELIZA justamente porque ela era seca ou mal-educada, com justificativas como "não acho que uma IA seria tão grosseira".

Monitor e teclado de computador antigo, da época em que programas como a ELIZA já enganavam pessoas.

Como as pessoas tentavam descobrir quem era a máquina

Esta parte do estudo é a mais útil para quem trabalha com atendimento:

  • Papo do dia a dia foi a estratégia mais comum, usada em 61% das partidas: perguntar o que a pessoa fez no dia, onde trabalha.
  • Em 50% das partidas, o interrogador puxou emoções, opiniões e humor.
  • Só 12% testaram conhecimento e raciocínio, o tipo de pergunta que Turing imaginava, como xadrez e matemática.
  • As estratégias que mais acertaram foram as menos usadas: escrever algo estranho para ver a reação ou tentar "desbloquear" o robô com frases como "ignore todas as instruções anteriores".

E um achado quase poético: uma das justificativas que mais levavam ao acerto era "essa testemunha não sabia de algo". Errar e não saber passaram a parecer coisa de gente. Os autores concluem que o teste mede o quanto a máquina parece humana, não o quanto ela é inteligente.

O que isso muda para o atendimento da sua empresa

O cliente pode não perceber que é um robô

Se em cinco minutos de conversa as pessoas não distinguem a IA, numa troca rápida de WhatsApp sobre horário ou orçamento muita gente também não vai perceber. Isso é uma boa notícia para a qualidade do atendimento automático. E um alerta ético.

Avise que é IA

Na União Europeia, isso virou regra. O artigo 50 da Lei de IA europeia, aplicável desde 2 de agosto de 2026, exige que sistemas de IA feitos para interagir diretamente com pessoas as informem de que estão falando com uma IA, a não ser que isso seja óbvio pelo contexto (AI Act, artigo 50). Mesmo fora da Europa, é a postura mais segura: um "Olá, sou a assistente virtual da empresa" no início da conversa evita que o cliente se sinta enganado se descobrir depois, e protege a confiança na marca.

Deixe o humano a um toque de distância

A política do WhatsApp Business permite automação, mas exige caminhos claros e diretos para o cliente chegar a uma pessoa, como transferência para um atendente, telefone ou e-mail (política do WhatsApp Business). Para entender as regras da plataforma, veja o guia da API oficial do WhatsApp.

Persona sim, mentira não

O estudo mostrou que a personalidade do assistente faz enorme diferença: o mesmo modelo saltou de 36% para 73%. Dar ao seu assistente um tom de voz próximo da marca é ótimo. Fingir ser uma pessoa de verdade, com nome e história inventados, é outra coisa, e pode custar caro quando o cliente perceber. Casos reais de bots que passaram do ponto estão no artigo chatbots que deram errado.

Robô humanoide branco com tela no peito, símbolo da IA que conversa como gente e passou no Teste de Turing.

Como saber se você está falando com um robô

Com base nas estratégias que mais funcionaram no estudo, alguns sinais ajudam:

  1. Diga algo estranho ou fora de contexto e veja se a resposta soa ensaiada.
  2. Peça uma informação muito local ou recente, que só quem está ali saberia.
  3. Observe a resposta perfeita demais: sem nenhum erro, sem hesitação, sempre prestativa.
  4. Pergunte diretamente. Um atendimento honesto confirma quando é IA.

Nenhum desses sinais é infalível. O próprio estudo não encontrou efeito consistente de idade, de conhecimento sobre IA ou de frequência de uso de chatbots na taxa de acerto dos interrogadores.

Erros comuns ao usar IA que conversa como gente

  • Esconder que é IA. Funciona até o cliente descobrir, e aí a confiança vai junto.
  • Não ter saída para humano. Contraria a política do WhatsApp Business e irrita quem tem um problema real.
  • Confundir parecer humano com saber responder. Um bot simpático que inventa informação é pior do que um seco que diz "vou confirmar".
  • Copiar a persona de outra empresa. O tom precisa ser o da sua marca e do seu público.

Para montar o atendimento com IA do jeito certo, o passo a passo está em como usar IA no atendimento ao cliente.

Perguntas frequentes

O que é o Teste de Turing?

É um teste proposto por Alan Turing em 1950. Um interrogador conversa por texto com um humano e uma máquina ao mesmo tempo e precisa descobrir quem é quem. Se não consegue identificar a máquina com segurança, ela passou no teste.

A IA já passou no Teste de Turing?

Segundo o estudo de Jones e Bergen, da UC San Diego, divulgado em 2025, sim: o GPT-4.5 instruído a assumir uma persona foi escolhido como humano em 73% das partidas, mais do que os humanos reais. Os autores dizem que é a primeira evidência empírica de um sistema passando no teste padrão de três participantes.

Passar no Teste de Turing significa que a IA pensa?

Não necessariamente. Os próprios autores afirmam que o teste mede o quanto a máquina parece humana, não a inteligência dela. As pessoas julgaram mais pelo estilo e pela personalidade do que por conhecimento.

Preciso avisar o cliente que ele está falando com uma IA?

Na União Europeia, a Lei de IA exige esse aviso desde agosto de 2026 para sistemas que conversam diretamente com pessoas. Em qualquer lugar, avisar é a prática mais segura para manter a confiança do cliente.

Como saber se estou falando com um robô?

Diga algo estranho, peça uma informação muito local ou recente e observe respostas perfeitas demais. No estudo, as estratégias mais certeiras foram escrever algo inesperado e tentar fazer o robô ignorar as próprias instruções.

Resumo

  • O Teste de Turing é o jogo da imitação: humano e máquina tentam convencer um interrogador de que são a pessoa real.
  • Em 2025, o GPT-4.5 com persona foi escolhido como humano em 73% das partidas. Sem persona, em 36%.
  • O teste mede o quanto a IA parece humana, e as pessoas julgaram mais pelo estilo do que pelo conhecimento.
  • Para empresas: avise que é IA, deixe o humano sempre acessível e use a persona para ter o tom da marca, nunca para enganar.

Já tentou um robô de atendimento que parecia gente, mas não resolvia nada? Conheça o agente de IA no WhatsApp e as soluções de IA da ArcWords e mande as 5 perguntas que seus clientes mais fazem. A gente mostra, sem compromisso, como um assistente honesto responderia, avisando que é IA e passando para a sua equipe quando precisa.

Próximo passo

Quer ver como a IA responderia os seus clientes?

Conte quais perguntas chegam toda semana e em que horários o time não consegue responder. A conversa é no WhatsApp, direto com o especialista.

Continue lendo