Claudeは、リアルタイムのPythonコーディングチャレンジにおいて、Gemini、ChatGPT、Grokを上回る性能を発揮します。

✍️ OpenClawRadar📅 公開日: March 20, 2026🔗 Source
Claudeは、リアルタイムのPythonコーディングチャレンジにおいて、Gemini、ChatGPT、Grokを上回る性能を発揮します。
Ad

ロボットワードレーサートーナメントの設定

開発者は「ロボットワードレーサー」と呼ばれる競争的コーディングチャレンジを作成し、4つのAIコーディングアシスタント(Claude、Gemini、ChatGPT、Grok)をテストしました。各AIは同じプロンプトを受け取り、標準ライブラリのみを使用して完全なPython 3.10クライアントを書くように求められました。

チャレンジの仕組み

トーナメントには以下の特定の制約がありました:

  • 4つのAI生成ボットがTCPサーバーに同時に接続
  • 各ボットは15×15の文字グリッドを受け取る
  • ボットは互いに競い合い、有効な単語を先に見つけて提出する
  • 単語はグリッド上で隣接してトレースされなければならない(水平、垂直、または斜め)
  • タイルは単語ごとに再利用できない
  • 最小単語長は3文字
  • スコアリング式:文字数 − 6(短い単語はポイントを失い、長い単語は得点となる)
  • 辞書にない単語やグリッド上でトレースできない単語を提出すると即時失格
  • 各ラウンドは10秒間続く

結果

ソースによると、Claudeがトーナメントで圧倒的に勝利しました。開発者は「Claudeが勝ち、その差は歴然だった」と述べ、この特定のリアルタイムコーディングチャレンジにおいて、Claudeと他のAIアシスタントの間に大きなパフォーマンスの差があったことを示しました。

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

TranslateGemma-12b: 自動評価指標が見逃したエラーの71%を人間のレビューが発見
News

TranslateGemma-12b: 自動評価指標が見逃したエラーの71%を人間のレビューが発見

人間によるMQMレビューにより、自動評価指標で問題なしとされた翻訳セグメントの71%にフラグが立てられ、25件の正確性エラーはすべて指標が検出できない領域にありました。

OpenClawRadar
マイクロソフト、トレーニングの洞察を伴うPhi-4-reasoning-vision-15Bマルチモーダルモデルをリリース
News

マイクロソフト、トレーニングの洞察を伴うPhi-4-reasoning-vision-15Bマルチモーダルモデルをリリース

マイクロソフトリサーチは、Microsoft Foundry、HuggingFace、GitHubを通じて利用可能な150億パラメータのオープンウェイトマルチモーダル推論モデル「Phi-4-reasoning-vision-15B」をリリースしました。このモデルは推論能力と効率性のバランスを取り、数学・科学推論やUI理解に優れています。

OpenClawRadar
Claude Code 事後報告:品質低下の原因となった3つのバグ、現在は修正済み
News

Claude Code 事後報告:品質低下の原因となった3つのバグ、現在は修正済み

Anthropicは、最近のClaude Codeの品質に関する苦情が、デフォルトの推論努力の低下、キャッシュバグによるセッションメモリの喪失、および冗長性プロンプトによるコーディング品質の低下という3つの別々の変更に起因することを明らかにしました。これらはすべて4月20日(v2.1.116)時点で修正されています。

OpenClawRadar
Claude Code IDE拡張機能がWindowsで読み込みに失敗 – 状況更新
News

Claude Code IDE拡張機能がWindowsで読み込みに失敗 – 状況更新

公式のステータス更新によると、Claude Code IDE拡張機能が2026-05-08T22:32:19Z現在、Windowsで読み込めない状態です。ステータスページで進捗と解決を追跡してください。

OpenClawRadar