Deloitte承认AI撰写了惠灵顿市议会报告的部分内容——但仍坚持其调查结果
웰링턴 시장 앤드류 리틀은 시의회 직원에 대한 43만 5천 달러 규모의 덜로이트 보고서의 "상당 부분"이 인공지능에 의해 작성되었다고 공개적으로 밝혔습니다. 이 인정은 330명의 직원 감축을 권고한 Future Fit Pōneke 보고서에 대한 비판이 커지는 가운데 나온 것입니다. 이 수치는 결함이 있는 데이터에 기반한 것으로 드러났습니다.
보고서에서 발견된 주요 오류
시의회 자체 검토에서 여러 데이터 처리 실수가 발견되었습니다:
- 델로이트는 현재 직원과 공석인 직위를 이중으로 계산했습니다.
- 고용 데이터는 3년 전 것으로, 납세자 연합(Taxpayers' Union)에서 가져왔습니다.
- 모든 직원은 실제 근무 시간과 관계없이 전일 급여로 계산되었습니다.
- 인건비는 2,150만 달러 초과 계산되었습니다.
- 직위에 "프로젝트"가 포함된 경우 자동으로 중복으로 간주되었습니다.
이러한 부정확성 때문에 시의회는 330 FTE 직위를 삭감하라는 권고가 "본질적으로 결함이 있다"고 결론지었습니다. 더 정확한 수치는 284명일 수 있지만, 그것조차도 다른 잠재적 오류를 설명하지는 못합니다.
AI 공개는 여전히 모호합니다
리틀 시장은 Newstalk ZB와의 인터뷰에서 AI로 생성된 부분은 계약 관리 시스템에 관한 장에 비해 "시간 낭비"에 불과하다고 말했습니다. 그는 그 장을 "재앙"이지만 유용하다고 설명했습니다. 덜로이트는 어떤 부분이 AI로 생성되었는지 또는 AI가 어떻게 사용되었는지 명시하지 않았습니다.
준비된 성명에서 덜로이트는 다음과 같이 말했습니다: "델로이트는 적절한 경우 AI 지원 도구를 포함한 다양한 도구와 기술을 작업 전반에 사용합니다." 또한 "모든 분석, 결과 및 결론에는 사람의 서명이 필요했습니다."라고 요구했습니다. 그들은 보고서의 결론이 타당하다고 주장합니다.
컨설팅에서 AI 사용에 대한 시사점
이 사례는 특히 위험이 큰 공공 부문 보고서에서 엄격한 검증 없이 AI를 사용할 때의 위험을 강조합니다. AI 지원 워크플로우를 구축하는 개발자와 팀에게 교훈은 분명합니다: AI는 초안을 작성할 수 있지만, 인간은 모든 데이터 포인트와 가정을 검증해야 합니다. 웰링턴 시의회의 경험은 철저한 감사 없이 AI 생성 콘텐츠를 수용할 때 발생할 수 있는 평판 비용에 대한 경고입니다.
📖 전체 소스 읽기: HN LLM Tools
👀 See Also
엔비디아 AI 하드웨어 가격 인상 15% 이상, 고객들 타격
블룸버그 뉴스에 따르면, 엔비디아가 AI 관련 제품 가격을 15% 이상 인상했다고 고객들에게 통보했습니다. 이번 인상은 데이터센터 GPU와 네트워킹 장비에 적용되며, AI 개발 비용에 영향을 미칠 수 있습니다.

다트머스 강좌에서 새 AI 튜터가 0.71-1.30 SD 효과 크기 달성
다트머스 대학의 입문용 컴퓨터 과학 과정에 도입된 새로운 AI 튜터가 대조군과 비교하여 0.71~1.30 표준편차의 학습 향상을 보였습니다.

Hy3 LLM, 오픈라우터 순위 정상: 가장 저렴한 모델일까, 다른 이유가 있을까?
텐센트의 오픈소스 LLM Hy3 preview가 OpenRouter 사용량 기준으로 Claude와 DeepSeek을 제치고 1위에 올랐습니다. 가격은 $0.066/1M 토큰으로 가장 저렴하지만, 품질은 선두 모델에 크게 못 미칩니다.

Claude Code 2.1.132: 멀티에이전트 문서, 일정 게이트, 스킬 제한 변경
릴리스 v2.1.132는 멀티에이전트 세션, 결과 및 웹훅에 대한 Managed Agents 문서를 추가하고, 사전 예방적 /schedule 제안에 대해 기본 거부 게이트를 도입하며, 문서화된 스킬 제한을 에이전트당 64개에서 20개로 낮춥니다.