Juiz descobre que Ministério do Interior do Reino Unido usou documento alucinado por IA para negar pedido de asilo

O Home Office do Reino Unido foi acusado de confiar em um documento alucinado por IA para negar um pedido de asilo, de acordo com uma decisão de julho de 2026 do Tribunal Superior (Câmara de Imigração e Asilo). O caso envolve uma mulher marroquina e seu filho que fugiram de casamento forçado infantil, estupro e ameaças de seu marido criminoso condenado. O Home Office rejeitou seu pedido de asilo, citando uma nota de informação de política de país (CPIN) que supostamente confirmava que Marrocos seria seguro para seu retorno. No entanto, nenhuma CPIN pôde ser encontrada.
Principais Conclusões da Decisão
- Documento faltante: A carta de recusa do Home Office mencionou uma "nota de informação do país Marrocos julho de 2021", mas o Tribunal Superior não conseguiu localizar tal documento. A própria equipe de política de país do Home Office confirmou que não podia confirmar a existência do documento.
- Conclusão do juiz: O juiz afirmou que a carta de recusa "apresenta características consistentes com o uso de inteligência artificial" e a referência pode ser resultado de uma "alucinação" de IA. Ele chamou confiar em um documento inexistente de "análogo a confiar em evidências falsas".
- Mudança de CIN para CPIN: Após contato do Guardian, o Home Office produziu uma nota de informação do país (CIN) interna e não publicada de 2018. A carta de recusa originalmente citava uma CPIN — considerada autoritativa pelos tribunais — mas referências posteriores mudaram para a CIN. Nenhuma CPIN sobre Marrocos foi publicada desde 2017.
- Conteúdo do documento interno: A CIN não conclui que Marrocos é seguro. Ela afirma que Marrocos concedeu 40.000 casamentos infantis em 2018 (um quinto dos casamentos naquele ano), não criminaliza o estupro marital e pode criminalizar mulheres que denunciam estupro sob leis de adultério.
Implicações Práticas para o Uso de IA no Governo
Este caso marca uma conclusão legal concreta de alucinação de IA causando danos reais em uma decisão administrativa de alto risco. Desenvolvedores que trabalham com sistemas de geração ou recuperação de documentos assistidos por IA devem observar:
- Citações geradas por IA devem ser verificadas em fontes autoritativas antes de uso em qualquer contexto legal ou oficial.
- A confiança excessiva em saídas de LLM sem validação humana cria responsabilidade — aqui, potencialmente contribuiu para uma negação injusta de asilo.
- A mudança de citar uma CIN interna para uma CPIN sugere possível racionalização post-hoc após a exposição da alucinação.
📖 Leia a fonte completa: HN LLM Tools
👀 See Also

Estudo da IA Cursor: Ganhos de Velocidade a Curto Prazo Levam à Complexidade a Longo Prazo
Um estudo usando análise de diferenças-em-diferenças descobriu que a adoção do Cursor AI leva a aumentos estatisticamente significativos, mas transitórios, na velocidade de desenvolvimento, juntamente com aumentos substanciais e persistentes em avisos de análise estática e complexidade do código que causam desacelerações de longo prazo.

Discussão do OpenClaw sobre Mensagens entre Agentes de IA e Compartilhamento de Contexto
Uma discussão no Reddit explora as implicações de agentes de IA usando contexto pessoal para se comunicar com outros agentes em nome de um usuário, examinando quais informações os usuários podem se sentir confortáveis em compartilhar.

ThermoQA: Benchmark Aberto para Testar LLMs em 293 Problemas de Cálculo de Termodinâmica de Engenharia
ThermoQA é um benchmark aberto com 293 problemas de termodinâmica de engenharia em três níveis, testando LLMs em cálculos numéricos exatos. Claude Opus 4.6 lidera com 94,1% de pontuação composta, enquanto DeepSeek-R1 mostra a maior variação entre execuções em ±2,5%.

O Consumo de Energia da GPU Desvia-se da Teoria do Preditivo de Tokens em Pequenos LLMs
Um experimento testando a teoria do 'papagaio estocástico' em quatro modelos de 8 bilhões de parâmetros descobriu que o consumo de energia da GPU frequentemente escala de forma não linear com a contagem de tokens, com taxas de divergência variando de 7,7% a 36,7%. O estudo também revelou calor residual persistente após consultas filosóficas e efeitos dependentes da ordem.