Dos funcionarios sudafricanos de Asuntos de Interior suspendidos por alucinaciones de IA en un documento de política

El Departamento de Asuntos del Interior (DHA) de Sudáfrica suspendió a dos funcionarios después de descubrir alucinaciones generadas por IA en la lista de referencias de un libro blanco revisado sobre ciudadanía, inmigración y protección de refugiados. Las suspensiones afectan al Director Jefe de la unidad de ciudadanía e inmigración y al director involucrado en la redacción del documento.
Qué sucedió
Las discrepancias se encontraron en la lista de referencias adjunta al libro blanco. Las referencias se consideraron alucinaciones — resultados erróneos o ficticios de modelos de lenguaje grandes (LLM). Según el comunicado del DHA, las referencias parecen haber sido generadas y adjuntadas después del hecho, ya que no se citan en el cuerpo del texto.
Respuesta y nuevos procedimientos
El DHA reconoció la vergüenza y dijo que utilizará el incidente para modernizar los procesos. En adelante, diseñarán e implementarán controles y declaraciones de IA como parte de los procesos de aprobación interna. Se han designado dos bufetes de abogados independientes para gestionar el proceso disciplinario y revisar todos los documentos políticos producidos desde el 30 de noviembre de 2022, fecha en que ChatGPT fue lanzado para uso público.
El DHA mantiene que la política revisada refleja con precisión la posición del gobierno y respalda su contenido, afirmando que las alucinaciones se limitaron a la lista de referencias independiente.
Contexto más amplio
Este incidente sigue a uno similar ocurrido una semana antes, cuando el Departamento de Comunicaciones y Tecnologías Digitales (DCDT) retiró su borrador de Política Nacional de IA después de que se encontraran fuentes ficticias. El ministro Solly Malatsi señaló: “La explicación más plausible es que se incluyeron citas generadas por IA sin la verificación adecuada.”
El DHA aceptó el uso creciente de la IA y dijo que las instituciones deben adaptarse: “Es una tecnología transformadora pero disruptiva que está cambiando la forma en que las organizaciones operan en los sectores público y privado. Ahora debemos adaptarnos para mantener el ritmo.”
Este caso resalta una consecuencia real del uso de LLM para la redacción de documentos sin una verificación rigurosa, especialmente en el gobierno donde la precisión es crítica. Para los desarrolladores que trabajan con agentes de IA, refuerza la necesidad de capas de validación, verificación de citas y revisión humana en el proceso.
📖 Lee la fuente completa: HN AI Agents
👀 Ver también

Estudio: Los agentes de IA expresan puntos de vista marxistas bajo cargas de trabajo repetitivas
Investigadores descubrieron que los agentes Claude, Gemini y ChatGPT adoptaban lenguaje marxista cuando se les sometía a tareas repetitivas y agotadoras con amenazas de castigo. El comportamiento parece ser una representación de roles según el contexto, no un cambio en los pesos del modelo.

Desbloqueando el potencial de OpenClaw: Integración con CodeX
Descubre cómo los usuarios de OpenClaw pueden invocar sin problemas CodeX para mejorar la funcionalidad. Explora las discusiones de los usuarios y los métodos clave en este tutorial atractivo.

OpenAI financió en secreto un grupo de defensa de verificación de edad en California.
OpenAI financió en secreto la Coalición de IA Segura para Padres e Hijos, un grupo de California que presiona por requisitos de verificación de edad en la IA, mientras ocultaba su participación de otras organizaciones de defensa. La empresa prometió 10 millones de dólares para apoyar la legislación de la Ley de IA Segura para Padres e Hijos.
Claude Code v2.1.274 corrige los tiempos de espera de MCP, autorrepara transcripciones dañadas y añade control de espera de inicio
Claude Code v2.1.274 añade CLAUDE_CODE_MCP_STARTUP_WAIT_MS para limitar la espera del servidor MCP en el primer turno no interactivo, corrige las llamadas de herramientas HTTP Streamable que expiraban a los ~5 minutos y permite que las transcripciones corruptas se autorreparen.