위키백과, AI 생성 콘텐츠 금지 및 인간 검토를 통한 제한적 AI 사용 허용

위키백과는 AI가 생성한 백과사전 항목을 금지하는 새로운 정책을 시행했으며, 인간의 감독 하에 제한적으로 AI 사용을 허용합니다.
정책 세부 사항
위키미디어 재단의 주력 사이트는 ChatGPT와 같은 대규모 언어 모델을 사용하여 백과사전 콘텐츠를 생성하는 것을 편집자들에게 금지하는 정책을 승인했습니다. 이 금지는 중재자들 사이의 수개월간의 논의 끝에 자원봉사자들의 40대 2 투표로 승인되었습니다.
위키백과 지도자들은 AI 생성 텍스트에 대한 몇 가지 구체적인 우려를 제기했습니다:
- 검증 가능성과 중립성의 핵심 원칙 위반
- AI 환각이 허구의 사실을 만들어냄
- 깨진 링크와 어디로도 연결되지 않는 참조
- 부정확하거나 가짜 인용
- 과도하게 사용된 구문과 진부한 표현
- 장황한 설명과 갑작스러운 스타일 전환
허용된 AI 사용
새로운 정책에 따라 위키백과의 26만 명 편집자들은 다음과 같은 특정 방식으로 여전히 AI를 사용할 수 있습니다:
- 다른 언어로 된 글 번역
- 사소한 원고 편집 제안
모든 변경 사항은 인간이 검토해야 하며, AI 지원을 통해 새로운 정보를 도입할 수 없습니다.
탐지 및 시행
위키백과는 작년에 편집자들이 AI 글쓰기를 발견하는 데 도움이 되는 봇 탐지 지침을 개발했습니다. WikiProject AI 정화팀의 창립 멤버인 자원봉사 편집자 일리야스 르블뢰는 의심스러운 글들이 종종 "위키백과에서 일반적으로 보던 스타일과 일치하지 않는 스타일"을 가지고 있다고 지적했습니다. 의심되는 사례는 다른 편집자들이 검토하며, 이들은 의문스러운 콘텐츠에 대해 이의를 제기하거나 수정하거나 제거할 수 있습니다.
배경 및 영향
위키백과 공동 창립자 지미 웨일스는 현재의 AI 모델을 신뢰할 수 없다고 평가했으며, 10월에 이 상황을 "혼란"이라고 묘사하며 이 기술이 인간 편집자를 대체할 준비가 되지 않았다고 경고했습니다. 이 정책 변화는 ChatGPT 트래픽이 위키백과의 월간 페이지 방문 수를 초과하고, 2024년 대비 2025년 말 인간 페이지 조회수가 8% 감소하는 가운데 이루어졌습니다.
새로운 지침 작성에 도움을 준 르블뢰는 404Media에 AI 생성 글의 증가가 편집자들에게 관리 불가능해졌으며, "신중한 낙관론을 고수하던 사람들이 진정한 걱정으로 돌아섰다"고 말했습니다. 그는 위키백과의 결정이 더 넓은 반성을 시작할 수 있다고 경고하며, "도미노 효과를 예상하며, 다른 플랫폼의 커뮤니티가 AI를 자신들의 조건에 맞게 환영할지 여부를 결정할 수 있도록 권한을 부여할 것"이라고 말했습니다.
📖 Read the full source: HN AI Agents
👀 See Also

개발자가 Cursor Composer 2와 Kimi 2.6에서 Qwen3.6:35b-a3b로 엔터프라이즈 워크로드 전환
한 개발자가 Qwen3.6:35b-a3b를 사용하여 50만~70만 줄 규모의 엔터프라이즈 제품군에서 일상 업무를 수행하고 있으며, Kimi 2.6 및 DeepSeek 4 Pro/Flash보다 성능이 우수하고 OpenRouter에서 토큰 100만 개당 약 $0.08의 비용이 든다고 보고했습니다.

AI 생성 프론트엔드가 에메랄드 그린 디자인 패턴으로 수렴합니다
AI 생성 프론트엔드 컴포넌트는 이전의 보라색 그라데이션 시대에서 에메랄드 그린 액센트, 버튼, 호버 상태를 중심으로 한 새로운 통일성으로 전환되었습니다. 이 수렴 현상은 AI 기술과 Tailwind 컴포넌트 프롬프트가 에메랄드를 고품질 UI 디자인과 연관시키는 것과 관련이 있는 것으로 보입니다.

Claude Code v2.1.121: MCP alwaysLoad, 플러그인 정리, 터미널 스크롤 수정, 메모리 누수 패치
Claude Code v2.1.121은 MCP 서버에 alwaysLoad, 플러그인 prune 명령어, /skills의 입력 필터, PostToolUse 출력 교체, 터미널 스크롤 및 URL 수정, 그리고 다수의 이미지 처리 시 멀티 GB RSS 증가를 포함한 여러 메모리 누수 수정을 추가했습니다.

DeepSWE 벤치마크에서 평가된 Qwen 3.6 27B: 2% 점수, 70시간, 평균 출력 토큰 44k
Qwen 3.6 27B(FP8, BF16 KV 캐시, 262k 컨텍스트)가 DeepSWE에서 70시간 만에 2%를 기록했습니다. 작업당 평균 출력 토큰 수는 44k로, Qwen 3.6 Plus와 같은 대형 모델에 필적합니다. RunPod에서 1x RTX6000 Pro Blackwell으로 실행되었습니다.