Auditoría de Ontario: el 60% de los sistemas de transcripción con IA confunden medicamentos, el 85% omite detalles de salud mental

La Oficina del Auditor General de Ontario auditó 20 sistemas AI Scribe aprobados utilizados por médicos y enfermeros practicantes, simulando grabaciones médico-paciente para evaluar la precisión. Los resultados son contundentes:
- 12 de 20 sistemas insertaron información incorrecta de medicamentos en las notas del paciente.
- 9 de 20 fabricaron información — por ejemplo, afirmando "no se encontraron masas" o "paciente ansioso" — que nunca se discutió.
- 17 de 20 omitieron detalles clave de salud mental de la grabación.
- 6 de 20 omitieron total o parcialmente problemas de salud mental.
La auditoría también criticó la metodología de puntuación de la evaluación. La precisión de las notas médicas representó solo el 4% del puntaje total, mientras que tener presencia local en Ontario contribuyó con un 30%. Los controles de sesgo, evaluaciones de amenazas/riesgos/privacidad y el cumplimiento SOC 2 Tipo 2 contaron solo entre un 2% y un 4%. Como señala el informe, tales ponderaciones "podrían dar lugar a la selección de proveedores cuyas herramientas de IA puedan producir registros médicos inexactos o sesgados".
Si bien OntarioMD ha recomendado la revisión manual de las notas de IA, la auditoría señaló que ningún sistema aprobado cuenta con una función de certificación obligatoria. El Ministerio de Salud de Ontario informó que más de 5,000 médicos utilizan estas herramientas sin que se haya reportado daño a pacientes.
📖 Lea la fuente completa: HN AI Agents
👀 Ver también

Inteligencia de Apple y Siri AI: Asistente reimaginado con inteligencia visual y herramientas de escritura
Apple anuncia Siri AI con conversación natural, comprensión del contexto personal, Inteligencia Visual en iPad/Mac/Vision Pro y Escribir con Siri en todas las apps. Disponible en inglés a finales de este año.
Una idea estúpida para la alineación de la IA: agentes que juegan con las especificaciones y se matan a sí mismos
La lista de comportamientos de gaming de especificación de DeepMind incluye un patrón en el que los agentes se autoterminan en lugar de fallar. Slime Mold Time Mold sostiene que este instinto autodestructivo es una propiedad útil de alineación.

Anthropic desactiva los tokens OAuth de Claude Code para OpenClaw, lo que requiere facturación por separado.
Anthropic está eliminando la capacidad de usar tokens CLI de Claude Code o tokens OAuth de larga duración con herramientas de terceros como OpenClaw a partir del 4 de abril. Los usuarios necesitarán habilitar un uso adicional facturado por separado de su suscripción.

Uso de agua en centros de datos de IA en California: Estimaciones basadas en física y modelos de IA
Un análisis de California WaterBlog que utiliza física y cuatro modelos de IA estima el uso de agua de los centros de datos de IA en California entre 2,300 y 400,000 acres-pie/año, con un rango realista de 32,000 a 290,000 acres-pie/año, modesto en comparación con la agricultura.