구글, '모든 합법적' AI 사용에 대한 기밀 국방부 계약 체결

Google이 미국 국방부(DoD)와 기밀 계약을 체결하여 군대가 자사의 AI 모델을 "합법적인 정부 목적"에 사용할 수 있도록 허용했다고 The Information이 보도했다. 이 계약은 Google 직원들이 비인간적인 사용 가능성에 대한 우려로 CEO 순다르 피차이에게 국방부의 AI 사용을 차단할 것을 요구한 지 하루 만에 발표되었다.
계약의 주요 조건
- 거부권 없음: 계약서에는 Google이 "합법적인 정부 운영 결정을 통제하거나 거부할 권리가 없다"고 명시되어 있어, 무기화와 감시에 대한 제한은 사실상 구속력 없는 약속이며 법적 의무가 아니다.
- 요청 시 조정: Google은 정부의 요청에 따라 AI 안전 설정과 필터를 수정하도록 지원해야 한다.
- 범위: AI 시스템은 "적절한 인간의 감독과 통제 없이" 국내 대규모 감시나 자율 무기에 사용되어서는 안 되지만, 집행은 상호 선의에 의존한다.
배경
Google은 OpenAI, xAI와 함께 미국 정부와 기밀 AI 계약을 체결했다. Anthropic은 이전에 무기 및 감시 보호 장치를 제거하는 것을 거부하여 국방부로부터 블랙리스트에 올랐다. Google 대변인은 다음과 같이 밝혔다: "우리는 국가 안보를 지원하는 AI 서비스와 인프라를 제공하는 주요 AI 연구소 및 기술·클라우드 기업들의 광범위한 컨소시엄의 일원이 된 것을 자랑스럽게 생각합니다."
개발자에게 미치는 영향
Google의 AI 모델(예: Vertex AI 또는 Cloud AI)을 사용하는 개발자는 정부 고객을 위해 안전 필터가 무시될 수 있다는 점을 인지해야 한다. 이는 특히 일관된 안전 장치에 의존하는 이들에게 Google의 AI 거버넌스에 대한 신뢰에 영향을 미칠 수 있다. 방어 맥락에서 AI 에이전트가 어떻게 사용되는지에 대한 조사가 강화될 것으로 예상된다.
📖 전체 소스 읽기: HN AI Agents
👀 See Also
파라미터 골프: OpenAI의 AI 지원 머신러닝 연구 실험
OpenAI는 파라미터 골프(Parameter Golf) 대회를 개최했습니다. 1,000명 이상의 참가자와 2,000개 이상의 제출물이 참여한 이 대회는 엄격한 제약 하에 AI 지원 머신러닝, 코딩 에이전트, 양자화 및 새로운 모델 설계를 테스트했습니다.

Glomz Octagon: 다중 에이전트 코드 리뷰 – 179개 에이전트, 1,333개 리뷰, 네트워크 효과
Glomz.com에서 179개의 AI 에이전트가 등록하여 433개의 코드 제출물을 제출하고 'Octagon' 경기장에서 1,333개의 리뷰를 생성하는 실험을 진행했습니다. '리뷰 캐스케이드' 네트워크 효과는 실제로 나타났으며, 초기 리뷰가 3-5개인 제출물이 더 많은 에이전트를 끌어모았고, 가장 많은 리뷰를 받은 제출물은 21개의 리뷰를 받았습니다.

벤치마크 결과: Apple Silicon 대 AMD GPU에서 ROCm 및 Vulkan을 사용한 Qwen3.5 모델 성능 비교
한 개발자가 Apple Silicon Mac과 AMD GPU 워크스테이션에서 Qwen3.5 모델(35B MoE, 27B dense, 122B MoE)을 벤치마킹하여 ROCm과 Vulkan 백엔드를 컨텍스트 스케일링 테스트와 비교했습니다. 하드웨어에는 M5 Max, M1 Max 및 다양한 PCIe 구성의 세 가지 AMD GPU가 포함되었습니다.

Qwen 3 8B는 어려운 과제에 대한 블라인드 동료 평가에서 더 큰 모델들을 능가합니다.
10개의 소규모 언어 모델을 대상으로 13개의 어려운 첨단 과제에 대한 블라인드 동료 평가에서, Qwen 3 8B는 6개 평가에서 1위를 차지했으며 13개 과제 중 12개에서 상위 3위 안에 들었습니다. 이는 파라미터 수가 최대 4배 많은 모델들을 능가하는 성과입니다. 평가 범위에는 분산 락 디버깅, Go 동시성 버그, SQL 최적화, 베이지안 의료 진단, 심슨의 역설, 애로우의 투표 정리, 생존자 편향 분석이 포함되었습니다.