Em 2023, um advogado de Nova York entregou a um tribunal federal uma petição com seis decisões judiciais que davam razão ao cliente dele. Havia nomes de processos, citações, até trechos dos votos. O problema: nenhuma daquelas decisões existia. Tinham sido escritas pelo ChatGPT. Esse é o exemplo mais famoso de alucinação da IA, quando a inteligência artificial inventa uma informação e a apresenta com a mesma segurança de um fato.
Se a sua empresa já usa IA para escrever textos, responder clientes ou resumir documentos, isso não é curiosidade de jornal. É um risco operacional. Neste artigo você vai ver casos reais e documentados, o que a própria OpenAI explicou em 2025 sobre por que os modelos inventam, e um roteiro prático para usar IA no negócio sem passar vergonha.
Pontos principais
- Alucinação é uma resposta plausível, mas falsa, dada com confiança. Acontece com todos os grandes modelos de linguagem.
- Segundo a OpenAI, os modelos "chutam" porque o treino e as avaliações premiam acertar mais do que admitir que não sabem.
- Casos reais: petição com 6 processos inventados, o erro do Bard que coincidiu com uma queda de US$ 100 bilhões no valor da Alphabet e o resumo do Google que sugeriu cola na pizza.
- Na empresa, o risco cai com base de conhecimento própria, resposta só com fonte, permissão para dizer "não sei" e um humano no fim do processo.
O que é alucinação da IA
A OpenAI define alucinações como "afirmações plausíveis, mas falsas, geradas por modelos de linguagem" (por que os modelos de linguagem alucinam). A palavra-chave é plausível. A IA não erra como uma calculadora quebrada, que devolve um número absurdo. Ela erra como um vendedor confiante: com frases bem construídas, tom seguro e detalhes que parecem verificáveis.
O exemplo que a própria OpenAI conta é quase cômico. Os pesquisadores perguntaram a um chatbot popular qual era o título da tese de doutorado de Adam Tauman Kalai, um dos autores do estudo. O chatbot deu três respostas diferentes, todas erradas. Perguntaram a data de nascimento dele: três datas, nenhuma certa.
Você sabia? A tela inicial das primeiras versões do ChatGPT, a da foto abaixo, já listava entre as limitações: "pode ocasionalmente gerar informações incorretas". Quase ninguém lia.

Casos reais em que a IA inventou
O advogado e os 6 processos que nunca existiram
O caso é Mata contra Avianca, no tribunal federal do Distrito Sul de Nova York. Um passageiro processou a companhia aérea, e o advogado Steven Schwartz usou o ChatGPT para pesquisar jurisprudência. Segundo a decisão do juiz P. Kevin Castel, quando o advogado pediu "me mostre mais casos", o chatbot "atendeu inventando-os". Os seis processos citados, com nomes como "Varghese" e "Shaboon", eram falsos.
Em 22 de junho de 2023, o juiz multou os advogados e o escritório em US$ 5.000 e mandou que enviassem uma carta a cada juiz real apontado falsamente como autor das decisões inventadas (decisão sobre as sanções, Mata v. Avianca). No depoimento, Schwartz disse que pensava que o ChatGPT "estava achando aquele caso em algum lugar" e completou: "Eu nunca pensei que pudesse ser inventado."
O erro do Bard que coincidiu com US$ 100 bilhões a menos
Em fevereiro de 2023, o Google divulgou um anúncio do seu chatbot, o Bard. Na demonstração, a pergunta era o que contar a uma criança de 9 anos sobre as descobertas do telescópio James Webb. Uma das respostas dizia que o James Webb tirou as primeiras fotos de um planeta fora do Sistema Solar. Errado: as primeiras imagens de exoplanetas foram feitas em 2004 pelo Very Large Telescope, do Observatório Europeu do Sul. Na quarta-feira, 8 de fevereiro, a Alphabet perdeu US$ 100 bilhões em valor de mercado, segundo a Reuters, num pregão em que o erro e um evento de lançamento pouco empolgante pesaram juntos (reportagem da Reuters).
Pedras no cardápio e cola na pizza
Em maio de 2024, logo depois de lançar as Visões gerais criadas por IA nos Estados Unidos, o Google viu circular respostas estranhas. A vice-presidente de Busca, Liz Reid, explicou duas delas num texto oficial: à pergunta "quantas pedras devo comer?", o resumo usou um texto satírico como fonte; em outro caso, trouxe de um fórum a sugestão de usar cola para o queijo grudar na pizza (o que aconteceu com as Visões gerais). O Google diz que fez mais de uma dúzia de melhorias técnicas depois disso e que muitas capturas de tela que circularam eram falsas.

Por que o ChatGPT inventa: a explicação da OpenAI
Em setembro de 2025, a OpenAI publicou um estudo com uma explicação surpreendentemente simples. Os modelos alucinam, em parte, porque o jeito de treinar e de avaliar premia o chute.
Pense numa prova de múltipla escolha. Se você não sabe a resposta e chuta, pode acertar por sorte. Se deixa em branco, a nota é zero com certeza. As avaliações de IA funcionam parecido: medem só a porcentagem de acertos. Um modelo que chuta a data de aniversário de alguém tem 1 chance em 365 de acertar; um que diz "não sei" garante zero. Em milhares de perguntas, o chutador aparece melhor no ranking.
A OpenAI mostrou isso com os próprios números, num teste de perguntas factuais chamado SimpleQA:
| Modelo | Não respondeu | Acertou | Errou |
|---|---|---|---|
| gpt-5-thinking-mini | 52% | 22% | 26% |
| OpenAI o4-mini | 1% | 24% | 75% |
O modelo mais antigo acerta um pouco mais, mas erra quase três vezes mais, porque quase nunca admite que não sabe. Em ranking que só olha acerto, ele "ganha".
Por que a IA erra datas e nomes, mas não erra ortografia
Há uma segunda parte da explicação. Os modelos aprendem prevendo a próxima palavra em bilhões de textos. Ortografia e gramática seguem padrões consistentes, então esses erros praticamente somem com o tamanho do modelo. Já fatos arbitrários e raros, como o aniversário de uma pessoa pouco conhecida, não seguem padrão nenhum. Aí o modelo completa a frase com o que parece certo.
Você sabia? A OpenAI afirma que alucinação não é inevitável: um modelo pode simplesmente se abster quando não tem certeza. E diz que, às vezes, é mais fácil um modelo pequeno reconhecer seus limites do que um grande.





