Anthropic traslada la automatización en segundo plano de Claude Code a un bucket de créditos SDK separado, interrumpiendo los flujos de trabajo de agentes

Anthropic anunció que a partir del 15 de junio, claude -p, el uso del SDK de Agent, Claude Code GitHub Actions y las aplicaciones de terceros del SDK de Agent ya no contarán para el uso interactivo normal de Claude Pro/Max. En su lugar, estos se incluirán en un bucket de créditos mensual separado del SDK de Agent. Para Max 5x, ese bucket aparentemente es de $100/mes.
Qué significa esto para las pilas de agentes
Si construiste algo en torno al pipeline:
- tickets → agents → hooks → executor →
claude -p→ automatización en segundo plano
lo más probable es que estés en problemas. Frameworks como AgentiBridge / AgentiCore / AgentiHooks, que orquestan agentes de Claude Code a escala como trabajadores dentro de sistemas de producción, se ven directamente afectados. Anthropic básicamente dijo: muévete al bucket de SDK/API de pago.
Solución propuesta: enrutamiento de modelos
La publicación sugiere una solución práctica: mantén Claude para trabajo interactivo de operador donde el razonamiento realmente importa (decisiones de arquitectura, depuración, revisiones, codificación de alto contexto), pero enruta la automatización en segundo plano, trabajadores desechables, trabajos estilo CI y ejecución de tareas simples a modelos más baratos a través de una puerta de enlace LLM como LiteLLM o Portkey.
Los modelos más baratos sugeridos incluyen:
- Gemini
- DeepSeek
- Qwen
- Modelos compatibles con OpenAI
- Modelos locales/alojados donde sea posible
Claude Code ya admite opciones de modelo personalizadas a través de variables de entorno. El enfoque: diferentes perfiles/scripts/alias intercambian el enrutamiento del modelo según la tarea. Un perfil para Claude interactivo, otro para automatización, otro para agentes baratos en segundo plano.
El panorama general
Este cambio esencialmente fuerza la arquitectura que siempre se avecinaba: puertas de enlace, enrutamiento, separación de cargas de trabajo. Enviar cada agente en segundo plano al cerebro caro es un desperdicio. El futuro es usar el modelo adecuado para cada tarea.
📖 Lee la fuente original: r/ClaudeAI
👀 Ver también

Bench de caché KV de Qwen 3.6-35B-A3B: f16 vs q8_0 vs Turbo3 vs Turbo4 en M5 Max hasta 1M de contexto
Los puntos de referencia del fork TurboQuant Metal de TheTom en M5 Max muestran que f16 y q8_0 se quedan sin memoria (OOM) más allá de 256K, mientras que turbo3 alcanza 1M a 6.5 tok/s de decodificación. La división de prefill y decodificación favorece a turbo3 para prefill y a turbo4 para decodificación en contextos largos.

Claude.ai, la API y Claude Code están experimentando un aumento de errores
Claude.ai, la API de Claude y Claude Code están experimentando errores elevados con la interfaz web y la consola de desarrolladores caídas. El inicio de sesión de Claude Code a través de Claude.ai está roto, aunque los usuarios que ya han iniciado sesión aún pueden usarlo.

Los agentes de IA necesitan primitivas de reversión, no solo autonomía
Un desarrollador argumenta que los frameworks de agentes deben adoptar conceptos de bases de datos como ACID, sagas y acciones compensatorias para manejar fallos parciales, en lugar de depender de que los LLMs "lo resuelvan".
El Puntero de IA de Google DeepMind: Reimaginando el Ratón para las Interacciones con Gemini
Google DeepMind presenta un puntero de mouse con inteligencia artificial que usa Gemini para entender el contexto, permitiendo comandos como señalar una imagen y decir 'Muéstrame las indicaciones', integrado en Chrome y Googlebook.