ユーザー報告:実用的なコーディングタスクにおいてSonnet 4.6がOpus 4.6を上回る

ある開発者が、過剰設計と不完全な作業に遭遇した後、Claude Opus 4.6からSonnet 4.6への切り替え経験を共有しました。このユーザーはAPIを通じてOpus 4.5と4.6を使用しており、当初は感銘を受けていましたが、後に問題を発見しました。
Opus 4.6の主な問題点
開発者は、Opus 4.6が実際には半分しか完了していない作業を「完了」とマークすると報告しました。具体的な例として、コピートレードアプリがスクレイピングしたTelegramシグナルを上書きするためにデフォルトのリスク設定を使用するように求めた際、Opusは機能する修正を実装しましたが、ブローカーAPIに500msの遅延を導入しました。この遅延は、Opusがリスク設定を2回チェックするコードを追加したために発生し、コピートレーダーの速度を大幅に低下させました。
Sonnet 4.6のパフォーマンス
Sonnet 4.6に切り替えた後、開発者は以下の点を観察しました:
- トークン消費量の大幅な減少(APIコストの削減)
- より慎重で思慮深い作業成果
- Sonnetは2秒で遅延問題を特定・修正
- パフォーマンス問題をOpusの「修正」に直接追跡
開発者はOpusのアプローチを「実際のプロセス結果を考慮せずに過剰設計されている」と特徴づけ、実用的な実装タスクにはSonnetが優れていると結論づけました。
📖 Read the full source: r/ClaudeAI
👀 See Also
Microsoft幹部、AIスクレイピングを「人類史上最大の労働窃盗」と発言、NYT対OpenAI訴訟の未編集提出書類で明らかに
ニューヨーク・タイムズがOpenAIとマイクロソフトに対して起こした3年間の著作権訴訟で新たに公開された伏せ字解除済みの提出書類には、マイクロソフトの幹部がスクレイピングを「人類史上最大の労働窃取」と呼んだと引用されている。内部データはまた、CopilotがNYTのクリックスルー率を最大93%減少させたことを示している。

ÅngstromがClaude Codeを使用してMetaのUMA-OMCを凌ぐモデルを訓練 — スポット上で10万GPUジョブ
Ångstrom(YC S24)がCSP-MACE-Åを訓練し、DFTの10,000倍の速度で同等の精度を達成、結晶構造予測でMetaのUMA-OMCを上回りました。Claude Codeを使用してAnycloud CLI経由で10万件のGPUジョブをマルチクラウドスポットで調整しました。

AIモデルは自らのツールとUIについて自己認識を持たない
ChatGPTやClaudeなどのAIモデルは、自らの機能やインターフェースについて、新しいスラッシュコマンドの存在を否定したり古いUIバージョンを説明したりするなど、誤った情報や古い情報を提供することがよくあります。これは、製品が絶えず進化している一方で、モデルは過去のデータスナップショットで学習されているためです。

AIメモ作成に同意しない新規患者を受け入れないメルボルンの精神科医
メルボルンの精神科医が新規患者に対し、セッションのAI文字起こしに同意するか、他の医療機関を紹介されるかを求めるようになり、データセキュリティと正確性への懸念が生じている。