Claudeのコードレート制限は、100万トークンのコンテキストウィンドウ過負荷が原因かもしれません。

コンテキストウィンドウ拡大によるシステム負荷
Anthropicは最近、100万トークンのコンテキストウィンドウを備えたOpus 4.6を全ユーザーにリリースしました。このリリース後、ユーザーから2つの重大な問題が報告されています:長いタスクのパフォーマンス低下とキャパシティ問題の増加です。当初は100万コンテキストモデルをオプトアウトするオプションはありませんでした。
仮説:非効率なコンテキスト圧縮
Redditユーザーの分析によると、Claude Codeのコンテキスト圧縮システム(古い会話履歴を要約してトークンを節約する)は、拡大された100万コンテキストウィンドウに対して十分に積極的ではありません。これは、各Claude Codeセッションがおそらく必要以上に多くの生トークンデータをリクエストごとに送信していることを意味します。これを全ユーザーベースで乗算すると、ユーザーが意図せずに不要な情報を含む膨張したコンテキストを送信するため、サーバー過負荷が発生します。
使用制限への影響
この仮説は、Anthropicの短期的な解決策が、増加したサーバー負荷を補うために使用制限を下げることだったと示唆しています。これが、Anthropicによる意図的な制限削減ではなく、ユーザーがタスクごとにトークンをより速く消費しているため、制限が縮小したように見える理由を説明しています。
回避策の特定
昨日、Anthropicは静かに古い非100万コンテキストモデルをオプションとして再導入しました。このモデルに切り替えたユーザーは、安定性の顕著な向上と使用制限の消費速度の低下を報告しており、コンテキストウィンドウの非効率性に関する仮説を支持しています。
推奨アクション
レート制限と安定性の問題から即座に解放されるには、100万コンテキストモデルをオフに切り替えてみてください。長期的な解決策には、改善されたコンテキスト圧縮アルゴリズムが必要でしょう。これが実装されれば、Anthropicは以前の使用制限を復元できる可能性があります。
📖 Read the full source: r/ClaudeAI
👀 See Also

微調整されたQwen3 Smallモデルは、特定のタスクにおいてフロンティアLLMを凌駕し、低コストで優れた性能を発揮します
蒸留されたQwen3モデル(0.6Bから8Bパラメータ)は、関数呼び出しやText2SQLを含む9つのタスクのうち6つで、GPT-5、Gemini、Claudeなどの最先端APIモデルに匹敵するか上回る性能を示し、同等の性能に対して100万リクエストあたりのコストはわずか3ドル(比較対象は378ドル)でした。

Claude-Code v2.1.110は、TUIモード、プッシュ通知、および複数の修正を追加しました。
Claude-Code v2.1.110では、ちらつきのないレンダリングのための新しい/tuiコマンド、モバイルアラートのためのプッシュ通知機能、プラグイン管理とリモートコントロール機能の改善が導入されました。このリリースには、MCPサーバー、セッション処理、UI問題に関する多数のバグ修正も含まれています。

クロード軍団:アンソロピックの非営利AI向け1億5000万ドル国家フェローシップ
Anthropic、AIツール開発のための有償フェローシップ「Claude Corps」を発表。12ヶ月間、1,000人の初期キャリアのフェローが非営利団体でClaudeを用いたAIソリューションを構築。総額1億5,000万ドル、年収85,000ドル、専門家によるメンタリング付き。

デイ10:Claude Codeでゲームを構築 — 3,200人のプレイヤーとサーバーダウン
ある個人開発者が、Claude Codeを主に使ってライブマルチプレイヤードラッグレースを構築。開始から10日で3,200人、ホストの10万リクエスト/日の制限に達し、ゲームがフリーズ。出荷された機能の完全なポストモーテム — リアルタイムマルチプレイヤー、50の新トラック、第三の惑星、ゾウ狩り。