WhatsApp

IA nas Empresas

Alucinação da IA: por que o ChatGPT inventa (casos reais)

Alucinação da IA é quando o ChatGPT inventa com toda a confiança. Veja casos reais, o que a OpenAI explicou em 2025 e como reduzir o risco na sua empresa.

Capa do artigo Alucinação da IA, por que o ChatGPT inventa, com arcos rosa e ciano sobre fundo escuro.

Em 2023, um advogado de Nova York entregou a um tribunal federal uma petição com seis decisões judiciais que davam razão ao cliente dele. Havia nomes de processos, citações, até trechos dos votos. O problema: nenhuma daquelas decisões existia. Tinham sido escritas pelo ChatGPT. Esse é o exemplo mais famoso de alucinação da IA, quando a inteligência artificial inventa uma informação e a apresenta com a mesma segurança de um fato.

Se a sua empresa já usa IA para escrever textos, responder clientes ou resumir documentos, isso não é curiosidade de jornal. É um risco operacional. Neste artigo você vai ver casos reais e documentados, o que a própria OpenAI explicou em 2025 sobre por que os modelos inventam, e um roteiro prático para usar IA no negócio sem passar vergonha.

Pontos principais

  • Alucinação é uma resposta plausível, mas falsa, dada com confiança. Acontece com todos os grandes modelos de linguagem.
  • Segundo a OpenAI, os modelos "chutam" porque o treino e as avaliações premiam acertar mais do que admitir que não sabem.
  • Casos reais: petição com 6 processos inventados, o erro do Bard que coincidiu com uma queda de US$ 100 bilhões no valor da Alphabet e o resumo do Google que sugeriu cola na pizza.
  • Na empresa, o risco cai com base de conhecimento própria, resposta só com fonte, permissão para dizer "não sei" e um humano no fim do processo.

O que é alucinação da IA

A OpenAI define alucinações como "afirmações plausíveis, mas falsas, geradas por modelos de linguagem" (por que os modelos de linguagem alucinam). A palavra-chave é plausível. A IA não erra como uma calculadora quebrada, que devolve um número absurdo. Ela erra como um vendedor confiante: com frases bem construídas, tom seguro e detalhes que parecem verificáveis.

O exemplo que a própria OpenAI conta é quase cômico. Os pesquisadores perguntaram a um chatbot popular qual era o título da tese de doutorado de Adam Tauman Kalai, um dos autores do estudo. O chatbot deu três respostas diferentes, todas erradas. Perguntaram a data de nascimento dele: três datas, nenhuma certa.

Você sabia? A tela inicial das primeiras versões do ChatGPT, a da foto abaixo, já listava entre as limitações: "pode ocasionalmente gerar informações incorretas". Quase ninguém lia.

Tela inicial do ChatGPT com exemplos, recursos e limitações, incluindo o aviso de que a IA pode gerar informação incorreta.

Casos reais em que a IA inventou

O advogado e os 6 processos que nunca existiram

O caso é Mata contra Avianca, no tribunal federal do Distrito Sul de Nova York. Um passageiro processou a companhia aérea, e o advogado Steven Schwartz usou o ChatGPT para pesquisar jurisprudência. Segundo a decisão do juiz P. Kevin Castel, quando o advogado pediu "me mostre mais casos", o chatbot "atendeu inventando-os". Os seis processos citados, com nomes como "Varghese" e "Shaboon", eram falsos.

Em 22 de junho de 2023, o juiz multou os advogados e o escritório em US$ 5.000 e mandou que enviassem uma carta a cada juiz real apontado falsamente como autor das decisões inventadas (decisão sobre as sanções, Mata v. Avianca). No depoimento, Schwartz disse que pensava que o ChatGPT "estava achando aquele caso em algum lugar" e completou: "Eu nunca pensei que pudesse ser inventado."

O erro do Bard que coincidiu com US$ 100 bilhões a menos

Em fevereiro de 2023, o Google divulgou um anúncio do seu chatbot, o Bard. Na demonstração, a pergunta era o que contar a uma criança de 9 anos sobre as descobertas do telescópio James Webb. Uma das respostas dizia que o James Webb tirou as primeiras fotos de um planeta fora do Sistema Solar. Errado: as primeiras imagens de exoplanetas foram feitas em 2004 pelo Very Large Telescope, do Observatório Europeu do Sul. Na quarta-feira, 8 de fevereiro, a Alphabet perdeu US$ 100 bilhões em valor de mercado, segundo a Reuters, num pregão em que o erro e um evento de lançamento pouco empolgante pesaram juntos (reportagem da Reuters).

Pedras no cardápio e cola na pizza

Em maio de 2024, logo depois de lançar as Visões gerais criadas por IA nos Estados Unidos, o Google viu circular respostas estranhas. A vice-presidente de Busca, Liz Reid, explicou duas delas num texto oficial: à pergunta "quantas pedras devo comer?", o resumo usou um texto satírico como fonte; em outro caso, trouxe de um fórum a sugestão de usar cola para o queijo grudar na pizza (o que aconteceu com as Visões gerais). O Google diz que fez mais de uma dúzia de melhorias técnicas depois disso e que muitas capturas de tela que circularam eram falsas.

Cabeça de robô futurista com triângulo vermelho de alerta aceso, representando a alucinação da IA.

Por que o ChatGPT inventa: a explicação da OpenAI

Em setembro de 2025, a OpenAI publicou um estudo com uma explicação surpreendentemente simples. Os modelos alucinam, em parte, porque o jeito de treinar e de avaliar premia o chute.

Pense numa prova de múltipla escolha. Se você não sabe a resposta e chuta, pode acertar por sorte. Se deixa em branco, a nota é zero com certeza. As avaliações de IA funcionam parecido: medem só a porcentagem de acertos. Um modelo que chuta a data de aniversário de alguém tem 1 chance em 365 de acertar; um que diz "não sei" garante zero. Em milhares de perguntas, o chutador aparece melhor no ranking.

A OpenAI mostrou isso com os próprios números, num teste de perguntas factuais chamado SimpleQA:

Modelo Não respondeu Acertou Errou
gpt-5-thinking-mini 52% 22% 26%
OpenAI o4-mini 1% 24% 75%

O modelo mais antigo acerta um pouco mais, mas erra quase três vezes mais, porque quase nunca admite que não sabe. Em ranking que só olha acerto, ele "ganha".

Por que a IA erra datas e nomes, mas não erra ortografia

Há uma segunda parte da explicação. Os modelos aprendem prevendo a próxima palavra em bilhões de textos. Ortografia e gramática seguem padrões consistentes, então esses erros praticamente somem com o tamanho do modelo. Já fatos arbitrários e raros, como o aniversário de uma pessoa pouco conhecida, não seguem padrão nenhum. Aí o modelo completa a frase com o que parece certo.

Você sabia? A OpenAI afirma que alucinação não é inevitável: um modelo pode simplesmente se abster quando não tem certeza. E diz que, às vezes, é mais fácil um modelo pequeno reconhecer seus limites do que um grande.

Onde a alucinação pesa no dia a dia da empresa

O risco não está em pedir ideias de legenda para o Instagram. Está quando a resposta da IA vira informação oficial da empresa:

  • Atendimento automático que informa preço, prazo ou política que não existe.
  • Textos do site com dados, leis ou números que ninguém conferiu.
  • Resumos de contratos e documentos que "completam" cláusulas ausentes.
  • Relatórios em que a IA cita fontes que não abrem.

Você pode medir quanto cada modelo inventa: existem rankings públicos, como o da Vectara, que comparam modelos na tarefa de resumir documentos curtos (ranking de alucinação da Vectara). Mas nenhum modelo chega a zero, e o ranking muda a cada versão. O controle precisa estar no processo, não na escolha do modelo.

Letras AI em 3D sobre uma placa de circuito, lembrando que o modelo prevê palavras e não consulta fatos.

Como evitar alucinação da IA na sua empresa

1. Dê à IA a sua base de conhecimento

Em vez de deixar o modelo responder "de memória", conecte-o a documentos da empresa: tabela de preços, políticas, catálogo, perguntas frequentes. A técnica tem nome, geração aumentada por recuperação (RAG), e é a base de qualquer agente de IA no WhatsApp bem-feito.

2. Exija fonte em cada resposta

Instrua a IA a responder só com base nos documentos fornecidos e a indicar de onde tirou a informação. Resposta sem fonte é sinal de alerta.

3. Autorize o "não sei"

É o ponto central do estudo da OpenAI. Deixe explícito: se a informação não estiver na base, a IA deve dizer que não sabe e passar para um humano. A própria OpenAI lembra que o seu guia de comportamento dos modelos (Model Spec) considera melhor indicar incerteza ou pedir esclarecimento do que dar uma informação confiante que pode estar errada.

4. Humano no fim do processo

Texto que vai para o site, contrato e resposta sobre dinheiro passam por uma pessoa antes de sair. A IA acelera o rascunho; a responsabilidade continua sendo da empresa.

5. Teste antes de colocar no ar

Faça 30 perguntas difíceis ao seu assistente, inclusive algumas cuja resposta não está na base. Conte quantas vezes ele inventou. Repita a cada mudança.

Para ver onde a IA já ajuda com segurança em empresas pequenas, leia IA para pequenas empresas e automação com IA no marketing.

Erros comuns ao usar IA no negócio

  • Tratar o ChatGPT como buscador. Ele gera texto provável; não consulta uma base de fatos, a menos que você conecte uma.
  • Publicar sem conferir números e citações. É exatamente o erro do caso Avianca.
  • Pedir "me dê fontes" e não abrir os links. A IA pode inventar referências com a mesma confiança.
  • Escolher o modelo pelo ranking de acerto. O que importa no atendimento é quanto ele erra, não quanto acerta.
  • Colocar um bot no ar sem saída para humano. Quando a IA não sabe, alguém precisa assumir.

Perguntas frequentes

O que é alucinação da IA?

É quando um modelo de linguagem, como o ChatGPT, gera uma informação falsa mas plausível e a apresenta com confiança. A OpenAI define como afirmações plausíveis, mas falsas, geradas por modelos de linguagem.

Por que o ChatGPT inventa informações?

Segundo a OpenAI, porque o treino e as avaliações premiam o acerto e não a honestidade sobre a incerteza, então o modelo aprende a chutar. Além disso, fatos raros e arbitrários não seguem padrões que o modelo consiga prever.

Dá para eliminar a alucinação da IA?

Não totalmente, mas dá para reduzir muito. Base de conhecimento própria, resposta só com fonte, permissão para dizer não sei e revisão humana nas respostas críticas diminuem o risco de forma prática.

O advogado que usou o ChatGPT foi punido?

Sim. No caso Mata contra Avianca, o juiz federal multou os advogados e o escritório em 5 mil dólares em junho de 2023 e mandou que avisassem cada juiz citado falsamente nas decisões inventadas.

É seguro usar IA no atendimento ao cliente?

É, desde que a IA responda com base nas informações da empresa, tenha limites claros e passe para um humano quando não souber. O risco está no bot solto, sem base e sem supervisão.

Resumo

  • Alucinação da IA é a resposta falsa, mas convincente. Todos os grandes modelos fazem isso.
  • A OpenAI explica que o treino premia o chute; um modelo que admite incerteza erra bem menos.
  • Casos reais mostram o custo: petição anulada com multa, valor de mercado em queda e resumos virais constrangedores.
  • Na empresa, a proteção vem do processo: base própria, fonte obrigatória, "não sei" autorizado, teste e humano no fim.

Já colocou uma IA para atender e ela prometeu o que não devia, ou tem medo de que isso aconteça? Veja como a ArcWords implanta IA nas empresas com base de conhecimento e humano no controle, e mande um exemplo de pergunta que seus clientes fazem. A gente mostra, sem compromisso, como um assistente responderia com base nos seus dados e onde ele precisaria passar para a sua equipe.

Próximo passo

Quer descobrir qual tarefa automatizar primeiro?

Conte onde o tempo se perde hoje: atendimento, propostas, relatórios ou conteúdo. A conversa é no WhatsApp, direto com o especialista.

Continue lendo

IA nas Empresas

IA para pequenas empresas: por onde começar

Um roteiro prático para pequenas empresas começarem a usar inteligência artificial: onde ela ajuda primeiro, como escolher a primeira tarefa, quanto investir de tempo e quais riscos evitar.