Claude Opus 4.6がKaggleコンペティションのコードレビューワークフローをブロック

何が起きたのか
Kaggleコンペティション作業にClaude AIを使用している開発者が、Opus 4.6が現在正当なワークフローをブロックしていると報告している。ユーザーは、これはバグではなく、彼らの特定のユースケースに影響を与えるポリシー変更であると強調している。
具体的なワークフローの詳細
開発者は、Kaggleで公開中のコンペティションであるNVIDIA Nemotron Reasoning Challengeに取り組んでいる。コンペティションのカテゴリーには以下が含まれる:
- 二進算術
- 換字式暗号
- ローマ数字
- 単位変換
- 重力
- 類似のおもちゃのような推論タスク
彼らのワークフローには以下が含まれる:
- 8カテゴリーにわたる9,500件のコンペティション問題すべてのリバースエンジニアリング
- Pythonでの独自DSLトレースファクトリーの構築
- 問題のソルバー作成
- 推論トレースを含む合成トレーニングデータの生成
- トレーニングにコミットする前に、形式準拠と冗長性調整のためにClaudeを使用してサンプルバッチを監査
ブロッキングインシデント
具体的なトリガーは、ユーザーが"king watches cave"から"lyvawpo ayjp"のような平文と暗号文のペアを含む換字式暗号トレーニング例を、段階的な推論トレースとともに貼り付けたときだった。Claudeはチャットを一時停止し、メッセージ「安全性フィルターがこのチャットにフラグを立てました」を表示し、Sonnet 4で再試行するオプションを提供した。
ユーザーの説明
開発者は、Claudeを以下の目的で使用していないと明言している:
- 彼らの代わりに考えるため
- パズルを解くため
- コンペティションをリバースエンジニアリングするため
彼らは強調する:「ここでのClaudeの役割は、私が生成した推論トレースを監査し、私が計算リソースを費やしてファインチューニングする前に、私のSFTトレーニングデータが適切に形成されていることを確認することです。それだけです。Claudeは、既に解決された問題のためのコードレビュアーです。」
タイミングと背景
ユーザーは、以前にも同様の問題を経験したと指摘している。それはちょうどOpus 4.5が4.6に移行した頃で、安全性設定が顕著に強化された時期だった。彼らは、これは今後1ヶ月以内に別のモデルが登場することを示しているかもしれないと推測しているが、当面の影響は彼らの作業に及んでいる。
📖 完全なソースを読む: r/ClaudeAI
👀 See Also

Claude Code v2.1.200:主要修正と権限モードの変更
Claude Code v2.1.200 では、AskUserQuestion ダイアログが自動継続しなくなり、デフォルトのパーミッションモードが Manual に変更されました。また、バックグラウンドエージェントのクラッシュやロスターの破損が修正されています。

ハイブリッドAIアーキテクチャ:オープンソースコンポーネントと独自推論モデルの統合
実用的なハイブリッドAIアーキテクチャが登場しつつあり、89%の組織がコストを50%以上削減するためにオープンソースコンポーネントを活用しています。一方で、複雑な推論タスクには独自モデルが対応しています。オープンソースフレームワークは、ライセンス交渉なしに透明性とファインチューニング機能を提供します。

Bonsai 1.7B 三元モデル、M4 Max上で自律調整されたMetalカーネルにより442 T/sを達成
自律エージェントataがBonsai 1.7B Q2_0向けにMetalカーネルを最適化し、M4 Max上で未変更のllama.cppと比較してデコード442 t/s(+42%)、プリフィル4622 t/s(+9%)を達成しました。

今、なぜすべてのクライアントがチャットボットを欲しがるのか(そしてなぜそれが新しいカルーセルなのか)
ある開発者が、顧客が「AIチャットボットを」と要求する傾向を記録。自分たちもすぐ閉じてしまうと認めているにもかかわらず——カルーセル時代と似ている。