inclusionAI, Ling-2.6-1T 출시: 희소 어텐션과 빠른 사고를 갖춘 하이브리드 아키텍처의 조 단위 파라미터 모델

inclusionAI가 Ling 제품군의 1조 매개변수 플래그십 모델인 Ling-2.6-1T를 오픈소스로 공개했습니다. 이 모델은 복잡한 실제 작업을 대상으로 합니다. Multi-head Latent Attention (MLA)과 Linear Attention을 결합한 하이브리드 아키텍처를 도입하여 추론 효율성을 개선하고, 긴 컨텍스트에서 지연 시간과 VRAM 사용량을 낮추면서 표현력을 유지합니다.
보상 전략을 통한 빠른 사고
포스트 트레이닝에는 Contextual Process Redundancy Suppression 보상 전략을 사용하여 더 짧고 직접적인 출력을 장려합니다. 이는 장황한 사고 체인에 대한 의존도를 줄이는 '빠른 사고' 메커니즘으로, 성능을 유지하면서 토큰 오버헤드를 줄입니다.
벤치마크 최고 성능
Ling-2.6-1T는 실행 중심 벤치마크에서 오픈소스 최고 성능을 달성합니다:
- AIME26 (추론)
- SWE-bench Verified (소프트웨어 엔지니어링)
- BFCL-V4 (함수 호출)
- TAU2-Bench (작업 완료)
- IFBench (명령 수행)
에이전트 통합
이 모델은 코드 생성부터 버그 수정까지 엔드투엔드 엔지니어링 워크플로를 위해 설계되었으며, Claude Code, OpenClaw, OpenCode, CodeBuddy를 포함한 주요 에이전트 프레임워크와 통합됩니다. 엔터프라이즈 환경에서 다중 도구, 다중 단계 제약 조건을 처리합니다.
📖 전체 소스 읽기: r/LocalLLaMA
👀 See Also

Anthropic, 서드파티 도구를 통한 Claude 구독 차단
Anthropic은 제3자 OAuth 통합을 통해 사용되는 Claude Pro/Max 구독에 대해 서버 측 차단을 시행했습니다. 이는 대규모로 악용되고 있는 보조금 지원 접근 방식 때문이라고 밝혔습니다. 이 정책 변경에는 '추가 사용량' 청구가 포함되어 있어 이러한 통합을 경제적으로 비실용적으로 만듭니다.

Anthropic의 새로운 Claude 구독 크레딧: 에이전트 SDK와 claude -p가 6월 15일부터 별도의 한도 풀을 얻습니다
6월 15일부터 Claude 구독자는 Agent SDK와 claude -p 사용을 위한 별도의 월별 크레딧을 받게 됩니다: Max 20x 요금제는 월 $200, Max 5x는 $100, Pro는 $20입니다. 크레딧이 소진되면 추가 결제에 동의하지 않는 한 사용이 중단됩니다. 대화형 Claude Code와 채팅은 기존 구독 풀에서 사용됩니다.

SDNY 판결, AI 채팅 대화에 대한 변호사-고객 특권 인정 거부
라코프 판사는 미국 대 헵너 사건에서 ChatGPT와 같은 AI 도구와의 커뮤니케이션이 변호사-의뢰인 특권에 해당하지 않으며, 모든 AI 생성 법률 작업의 공개를 요구한다고 판결했습니다. 법원은 AI가 특권 보호에 필요한 인간 간 기밀성을 결여하고 있다고 판단했습니다.

Anthropic 정책 업데이트로 Claude Pro/Max 사용자의 타사 도구 사용이 금지됩니다
Anthropic은 2026년 2월에 정책을 업데이트하여 Claude Pro 또는 Max 플랜과 함께 사용되는 모든 스크립트, 래퍼 또는 타사 도구 사용을 명시적으로 금지했으며, 이 정책을 위반하는 사용자에게 평생 이용 정지를 부과하고 있습니다. 2026년 3월 집행 단계에서는 고강도 코딩 세션을 진행하는 상위 티어 Max 플랜 사용자들을 대상으로 하고 있습니다.