앤트로픽, 클로드 코드 백그라운드 자동화를 별도 SDK 크레딧 버킷으로 이동시켜 에이전트 워크플로우 중단

Anthropic은 6월 15일부터 claude -p, Agent SDK 사용, Claude Code GitHub Actions 및 타사 Agent SDK 앱이 더 이상 일반 Pro/Max 대화형 Claude 사용량에 포함되지 않는다고 발표했습니다. 대신 이들은 별도의 월간 Agent SDK 크레딧 버킷으로 이동합니다. Max 5x의 경우 해당 버킷은 분명 월 100달러입니다.
에이전트 스택에 미치는 영향
다음과 같은 파이프라인을 기반으로 구축한 경우:
- 티켓 → 에이전트 → 후크 → 실행기 →
claude -p→ 백그라운드 자동화
아마도 큰 타격을 받을 것입니다. 생산 시스템 내에서 워커로서 Claude Code 에이전트를 대규모로 오케스트레이션하는 AgentiBridge / AgentiCore / AgentiHooks와 같은 프레임워크가 직접적인 영향을 받습니다. Anthropic은 본질적으로 유료 SDK/API 버킷으로 이동하라고 말한 것입니다.
제안된 해결책: 모델 라우팅
이 게시물은 실용적인 해결 방법을 제안합니다. 추론이 실제로 중요한 대화형 운영자 작업(아키텍처 결정, 디버깅, 코드 리뷰, 높은 컨텍스트 코딩)에는 Claude를 사용하되, 백그라운드 자동화, 일회성 워커, CI 스타일 작업 및 단순 작업 실행은 LiteLLM 또는 Portkey와 같은 LLM 게이트웨이를 통해 더 저렴한 모델로 라우팅하는 것입니다.
제안된 더 저렴한 모델:
- Gemini
- DeepSeek
- Qwen
- OpenAI 호환 모델
- 가능한 경우 로컬/자체 호스팅 모델
Claude Code는 이미 환경 변수를 통해 사용자 지정 모델 옵션을 지원합니다. 접근 방식: 작업에 따라 다양한 프로필/스크립트/별칭이 모델 라우팅을 전환합니다. 하나의 프로필은 대화형 Claude용, 다른 프로필은 자동화용, 또 다른 프로필은 저렴한 백그라운드 에이전트용입니다.
더 큰 그림
이번 변경은 본질적으로 항상 도래할 것으로 예상되었던 아키텍처(게이트웨이, 라우팅, 워크로드 분리)를 강제합니다. 모든 백그라운드 에이전트를 비싼 두뇌로 보내는 것은 낭비입니다. 미래는 각 작업에 적합한 모델을 사용하는 것입니다.
📖 전체 출처 읽기: r/ClaudeAI
👀 See Also

벤치마크 결과, 증류된 모델이 구조화된 작업에서 최첨단 LLM과 동등한 성능을 10배 낮은 비용으로 달성하는 것으로 나타났습니다.
소형 증류 Qwen3 모델(0.6B~8B)과 최첨단 LLM의 포괄적 비교 결과, 증류 모델이 9개 작업 중 6개에서 중간 수준 최첨단 모델과 동등하거나 더 나은 성능을 보이며 비용은 극적으로 낮았습니다. Text2SQL 작업에서 98.0% 정확도를 달성했으며, 요청당 비용은 $3/M으로 Claude Haiku의 $378 대비 매우 저렴했습니다.

12개월 만에 사라진 50명 규모의 로우코드 샵: AI 코딩 에이전트의 의존성 함정
50명 규모의 로우코드 개발사가 12개월 만에 모든 고객을 잃었다. "로우코드 + AI"가 순수 로우코드와 풀스택을 압도했기 때문이다. 한편, Claude Max에 의존하는 솔로 개발자는 세션 제한과 비용 상승에 직면했다. 두 사례 모두 같은 딜레마를 보여준다: 적응하거나 의존하거나.

클로드 API 사용 데이터, 맥스 플랜 사용자에게 새로운 제한 사항이 미치는 영향 확인
Claude Max 20x 사용자가 새로운 제한이 도입된 후 API 동등 일일 사용량이 약 $210/일에서 약 $52/일로 감소했다고 보고하며, Sonnet과 Codex 사용을 포함한 상당한 워크플로우 변경이 필요했다고 전합니다.

트럼프 행정부, Anthropic의 Mythos AI 모델 정부 사용 승인
트럼프 행정부가 Anthropic의 Mythos AI 모델을 선별된 기업과 정부 기관에 출시하도록 승인했습니다.