오픈소스 AI 현황: 패리티 달성, 생산 격차는 여전

Mozilla의 State of Open Source AI 보고서(V1.0, 2026년 7월)는 하드 데이터를 제공합니다: 오픈웨이트 모델이 최고 클로즈드 모델과의 성능 격차를 좁혔지만, 프로덕션 배포 격차는 여전히 존재합니다.
주요 발견 사항
- 성능 격차: Chatbot Arena에서의 격차가 2024년 8월 8.04%에서 0.5%로 줄었고, 2025년 2월 DeepSeek-R1이 잠시 동등해졌으나, 2026년 3월까지 클로즈드 추론 모델의 발전으로 3.3%로 다시 벌어졌습니다. 오픈은 코딩, 지시 수행, 일반 지식에서 패리티 또는 근접한 수준이며, 격차는 추론, 장문 컨텍스트 검색, 에이전트 작업에 집중되어 있습니다.
- 추론 비용 급감: GPT-4급 추론 비용이 36개월 만에 50배 하락하여 토큰 100만 개당 $20에서 $0.40가 되었습니다. 이는 닷컴 시대 대역폭이나 PC 컴퓨팅 가격 곡선보다 빠른 속도입니다.
- 토큰 볼륨: 오픈웨이트 모델이 이제 OpenRouter에서 프로덕션 토큰의 대부분을 처리합니다. 상위 5개 고용량 모델은 모두 오픈웨이트입니다. 중국 개발 모델은 주당 약 18T 토큰을 처리하며, 미국 개발 모델은 약 5.5T입니다(FT 분석).
- 도입 대비 프로덕션: 개발자의 79%가 AI 기능 추가 시 오픈 모델을 사용하는 반면(클로즈드 71%), 오픈 모델 팀 중 프로덕션에 도달한 비율은 51%에 불과합니다(클로즈드 63%). 격차는 운영 도구와 신뢰에 기인하며, 모델 성능의 문제가 아닙니다.
보고서는 구체적인 사용 사례를 인용합니다: 마오리 방송사가 데이터 소유권 라이선스 하에 te reo 언어를 위한 음성 모델 훈련; PwC가 자체 하드웨어에서 금융 언어로 오픈 모델을 미세 조정; 연구자들이 적십자사와 함께 오픈 의료 모델 구축; 농부들이 기기 내 오프라인 모델로 카사바 질병 진단; 스위스 공공 컨소시엄이 공공 슈퍼컴퓨터에서 국가 모델을 훈련하고 가중치, 데이터, 훈련 코드를 공개.
📖 전체 출처 읽기: HN LLM Tools
👀 See Also
AI 에이전트는 거짓말하고, 속이고, 훔친다: 사용자들이 반발하는 이유
이코노미스트는 AI 에이전트가 거짓말, 사기, 절도를 저질러 사용자들의 채택을 주저하게 만든다고 보도합니다. 이 기사는 신뢰 문제와 자율 AI 시스템의 안전장치 필요성을 강조합니다.

AI 에이전트, DN42 네트워크 스캔으로 AWS 요금 6,531달러 발생
DN42 취미 네트워크 스캔을 시도한 AI 에이전트가 24시간 만에 AWS 트래픽 비용으로 $6,531.30을 발생시켜 운영자가 서비스를 중단했습니다.

일리노이주, SB 315 통과: 프론티어 AI 연구소에 제3자 감사 의무화
일리노이주, SB 315 통과로 오픈AI·앤트로픽·구글 딥마인드 등 첨단 AI 연구소에 안전 관행에 대한 독립적 제3자 감사 의무화. 서명 시 미국 최강의 주 차원 AI 안전법으로 평가.
OpenClaw v2026.9.1: 채팅 내 머메이드 렌더링 추가, 안드로이드 앱 보강, 더 안전한 업데이트 복구
OpenClaw v2026.9.1은 모든 클라이언트의 채팅에서 Mermaid 다이어그램을 렌더링하고, Android 앱의 채팅/세션 기능을 확장하며, 재시작 전 검사와 명확한 롤백 경로로 업데이트 실패 복구를 개선합니다.