온타리오 감사: AI 기록 시스템의 60%가 약물을 혼동하고, 85%가 정신 건강 세부사항을 놓친다

온타리오주 감사원(Office of the Auditor General of Ontario)은 의사와 간호사가 사용하는 승인된 20개의 AI 필기 시스템을 감사하여 의사-환자 녹음을 시뮬레이션하고 정확성을 평가했습니다. 결과는 뚜렷합니다:
- 20개 중 12개 시스템이 환자 기록에 잘못된 약물 정보를 삽입했습니다.
- 20개 중 9개는 실제로 논의되지 않은 정보(예: "종괴 없음" 또는 "환자 불안")를 조작했습니다.
- 20개 중 17개는 녹음에서 핵심 정신 건강 세부 사항을 놓쳤습니다.
- 20개 중 6개는 정신 건강 문제를 완전히 또는 부분적으로 생략했습니다.
감사는 또한 평가 점수 매기기 방법론을 비판했습니다. 의료 기록의 정확성은 전체 점수의 4%만을 차지한 반면, 온타리오 내 국내 입지는 30%를 기여했습니다. 편향 통제, 위협/위험/개인정보 평가, SOC 2 Type 2 준수는 각각 2~4%만을 차지했습니다. 보고서에 따르면, 이러한 가중치는 "AI 도구가 부정확하거나 편향된 의료 기록을 생성할 수 있는 공급업체가 선택되는 결과를 초래할 수 있습니다."
OntarioMD는 AI 기록의 수동 검토를 권장했지만, 감사는 승인된 시스템에 의무 인증 기능(mandatory attestation feature)이 없다고 지적했습니다. 온타리오 보건부는 5,000명 이상의 의사가 이러한 도구를 사용하며 환자 피해가 보고되지 않았다고 밝혔습니다.
📖 전체 출처 읽기: HN AI Agents
👀 See Also

인공지능에서 41%는 -59%에 달려 있다
아폴로의 수석 이코노미스트가 AI 밸류체인 계층별 수익 마진을 분석했습니다: 모델 및 앱은 -59%인 반면, 상류인 실리콘 및 장비는 41%에 달합니다. 이 붐은 고객이 아닌 투자자에 의해 자금이 조달됩니다.

Mistral AI가 산업 공학 AI 스택 구축을 위해 Emmi AI를 인수하다
Mistral AI가 Emmi AI를 인수하여 에너지, 자동차, 반도체, 항공우주 분야의 산업 시뮬레이션을 위한 물리학 AI 모델을 통합합니다. 30명 이상의 연구원으로 구성된 통합 팀은 린츠에 새로운 사무소를 개설할 예정입니다.

클로드 소넷 4.6 공개: 향상된 코딩 및 컴퓨터 사용 능력
클로드 소넷 4.6은 100만 토큰 컨텍스트 창을 도입하고 코딩 및 컴퓨터 사용 능력을 향상시켜, 더 넓은 범위의 작업에 대해 오푸스급 모델에 대한 강력한 대안이 되었습니다.
클로드 코드 v2.1.259: 관리형 MCP 서버, 헤드리스 권한 모드 및 동시성 수정
Claude Code v2.1.259는 조직을 위한 관리형 MCP 서버 배포, 무인 호스트를 위한 `--permission-prompts none` 플래그, 그리고 동시 세션에서 발생하는 무음 상태 손상 문제를 수정했습니다.