Anthropic, Claude의 컴퓨터 사용 능력 향상을 위해 Vercept AI 인수

Anthropic이 Claude의 컴퓨터 사용 능력을 개발하기 위해 Vercept AI를 인수했습니다. 발표에 따르면, 이 인수는 특히 Claude의 "컴퓨터 사용 기능"을 목표로 하며, Vercept AI의 작업은 "어려운 지각과 상호작용 문제 해결"을 중심으로 이루어졌습니다.
출처는 Vercept AI가 "명확한 테제를 중심으로 구축되었습니다: AI가 복잡한 작업을 완수하는 데 진정으로 유용하려면 어려운 지각과 상호작용 문제를 해결해야 합니다."라고 밝히며, 이는 인수가 Claude의 컴퓨터 인터페이스 및 시스템과 상호작용하는 능력을 향상시키는 데 초점을 맞추고 있음을 나타냅니다.
컴퓨터 사용 능력은 일반적으로 소프트웨어 애플리케이션을 작동하고, 사용자 인터페이스를 탐색하며, 디지털 환경 내에서 작업을 수행할 수 있는 AI 시스템을 의미합니다. Claude의 경우, 이는 코드 편집기, 개발 도구 또는 개발자가 일상적으로 사용하는 다른 소프트웨어와 함께 작업하는 능력이 향상될 수 있음을 의미할 수 있습니다. 이 인수는 Anthropic이 Claude가 단순한 텍스트 기반 대화뿐만 아니라 실용적이고 실습적인 개발 작업을 처리하는 데 더 능숙해지도록 투자하고 있음을 시사합니다.
이러한 유형의 능력 개발은 AI 어시스턴트가 대화형 인터페이스에서 소프트웨어 환경을 조작할 수 있는 능동적인 도구로 진화하는 더 넓은 산업 트렌드와 일치합니다. AI 코딩 에이전트를 사용하는 개발자에게, 이는 결국 Claude가 IDE와 직접 상호작용하거나, 명령을 실행하거나, 개발 워크플로우를 더 자율적으로 관리할 수 있게 될 수 있음을 의미할 수 있습니다.
📖 전체 출처 읽기: r/ClaudeAI
👀 See Also

Qwen 3.6 27B: AMD MI50에서 52.8 tps TG, 전체 정밀도, MTP 없음, 양자화 없음
Reddit 사용자가 Qwen3.6-27B를 8개의 AMD MI50(2018년 카드)에서 vllm 포크와 ROCm 7.2.1을 사용해 벤치마크하여, 전체 정밀도와 MTP 없이 52.8 tps TG와 1569 tps PP를 달성했습니다.

SWE-rebench 리더보드 업데이트: 2026년 2월 결과, 치열한 경쟁 양상 보여
SWE-rebench 리더보드가 2026년 2월 결과로 업데이트되었으며, 57개의 새로운 GitHub PR 작업을 테스트했습니다. Claude Opus 4.6이 65.3%의 해결률로 선두를 달리고 있지만, 상위 6개 모델은 5% 포인트 이내의 근접한 성적을 보이고 있습니다.

LLM 공간 추론 능력 테스트: 소코반 벤치마크에서 ChatGPT, Qwen3.7-max, Gemini 3.5-thinking 선두
맞춤형 소코반 벤치마크가 엄격한 형식으로 LLM의 제로샷 공간 추론을 테스트했습니다. ChatGPT, Qwen3.7-max, Gemini 3.5-thinking만 통과했습니다. Gemini 3.5-flash, Qwen3.7-plus 등은 잘못된 이동이나 교착 상태로 실패했습니다.

샤오미 MiMo-V2-Pro AI 모델, 오픈라우터에서 7일간 무료 이용 가능
샤오미의 MiMo-V2-Pro AI 모델이 OpenRouter에서 7일간 무료 API 접근으로 이용 가능합니다. 이 모델은 100만 토큰 컨텍스트 윈도우를 특징으로 하며, 벤치마크 결과 클로드 오푸스 4.6과 경쟁하고 GPT-5.2 성능에 근접하는 것으로 나타났습니다.