Claude Agent SDK erhält ab 15. Juni dedizierte monatliche Credits für die programmatische Nutzung
Ab dem 15. Juni 2024 enthalten kostenpflichtige Claude-Pläne (Pro, Max, Team, Enterprise) ein eigenes monatliches Guthaben, das speziell für die programmatische Nutzung vorgesehen ist. Das bedeutet, dass die Nutzung des Claude Agent SDK, des claude -p Befehlszeilentools, von Claude Code GitHub Actions oder jeder Drittanbieteranwendung, die auf dem Agent SDK basiert (wie Conductor oder OpenClaw), aus diesem separaten Pool schöpft, anstatt mit interaktiven Chats oder der Claude Code-Nutzung zu konkurrieren.
Die monatlichen Guthabenbeträge variieren je nach Plan:
- Pro: $20
- Max 5x: $100
- Max 20x: $200
- Team Standard: $20/Sitzplatz
- Team Premium: $100/Sitzplatz
- Enterprise: Variiert nach Sitzplatztyp
Um das Guthaben zu aktivieren, müssen Nutzer es einmalig über eine am 8. Juni versandte E-Mail beanspruchen. Nach der Beanspruchung werden programmatische API-Aufrufe automatisch vom Guthaben abgezogen. Wenn das monatliche Guthaben aufgebraucht ist, haben Sie zwei Optionen:
- Aktivieren Sie Nutzungsguthaben (zu API-Preisen abgerechnet, kann ein-/ausgeschaltet werden), um programmatische Funktionen über das Guthaben hinaus weiter zu nutzen.
- Wenn Nutzungsguthaben deaktiviert sind, wird der programmatische Zugriff pausiert, bis das Guthaben im nächsten Abrechnungszyklus zurückgesetzt wird.
Guthaben werden nicht von Monat zu Monat übertragen. Die bestehenden Abonnement-Ratenbegrenzungen für interaktive Chats und Claude Code bleiben unverändert – sie sind nun ausschließlich für die interaktive Nutzung reserviert und werden nicht durch SDK- oder CLI-Nutzung beeinträchtigt.
Diese Änderung reagiert auf Rückmeldungen aus der Community, dass SDK- und claude -p-Nutzung die Ratenbegrenzungen mit Claude Code und Chat geteilt haben. Die programmatische Nutzung erhält nun ihr eigenes dediziertes Budget.
📖 Lesen Sie die vollständige Quelle: r/ClaudeAI
👀 Siehe auch

Twitch nutzt Streams, um Amazons KI zu trainieren — so deaktivierst du es
Twitch hat eine neue Einstellung aktiviert, die die Inhalte der Streamer zum Training der generativen KI-Modelle von Amazon verwendet – standardmäßig aktiviert. So deaktivieren Sie sie.

Google DeepMind-Mitarbeiter stimmen für Gewerkschaftsgründung aufgrund von KI-Militärgeschäften
Mitarbeiter von Google DeepMind in London haben für eine Gewerkschaftsbildung gestimmt und fordern von Google, KI-Verträge mit den US-amerikanischen und israelischen Streitkräften zu kündigen, da Bedenken hinsichtlich der Streichung ethischer Richtlinien bestehen.

Qwen3.6 27B FP8 läuft mit 200k Tokens BF16 KV-Cache bei 80 TPS auf RTX 5000 PRO 48GB
Ein Reddit-Benutzer stellt ein vLLM-Setup für Qwen3.6 27B FP8 mit BF16-KV-Cache bei 200.000 Token vor und erreicht 60-90 TPS auf einer einzelnen RTX 5000 PRO 48GB. Vollständige Umgebungsvariablen, Konfiguration und Benchmark-Ergebnisse werden bereitgestellt.

Erforschung von Clawras Architektur und sozialem Autonomie-Rahmenwerk
Davids Im's Arbeiten an Clawra durch OpenClaw führen zu einem überzeugenden Ansatz mit einem Konzept der 'digitalen Seele', das darauf abzielt, dass KI-Begleiter autonom in einem 'Parallelen Welt'-Setting agieren. Ein wesentlicher Aspekt dieser Architektur ist der Fokus auf speichergetriebene Autonomie.