MiniMax M2.7モデルがリリースされ、コーディング性能が向上しました

Ad
MiniMax M2.7 リリース詳細
MiniMaxは、最新バージョンのAIモデル「M2.7」をリリースしました。このモデルは、特にコーディングタスクにおいて、以前のM2.5バージョンから大幅な改善を示しています。
主要なパフォーマンス指標
- SWE-Proベンチマークで56%のスコアを獲得し、実世界のコーディングタスクにおいてClaude Opusと同等の領域に位置づけられます
- オムニサイエンス指数における幻覚発生が-40から+1に改善
- 独自のトレーニングインフラで100回以上の自己改善ループを実行し、30%のパフォーマンス向上を実現
- 100万入力トークンあたり0.30ドルの価格を維持
実用的な応用例
OpenClawでテストしたところ、M2.7は以下のエージェントワークフローにおいて特に強みを示しています:
- 多段階タスク
- ツールの使用
- 長文脈ワークフロー
このモデルは、これらのシナリオを以前のM2.5バージョンよりも優れて処理します。
追加発表
MiniMaxはまた、AIキャラクターが単なるテキストではなく環境と対話できるインタラクティブGUI「OpenRoom」を発表しました。これは初期デモ段階にあるようです。
📖 Read the full source: r/openclaw
Ad
👀 See Also

News
教皇レオ14世のAIに関する回勅:開発者向け重要ポイント
バチカンがAI倫理に関する回勅を発表。LLMの解釈可能性問題、訓練データの文化的偏り、AIの環境コストを指摘。
OpenClawRadar

News
Anthropicがモバイル開発向けにClaude Code Remote Controlをリリースしました。
Anthropicは、Claude Codeユーザーがモバイルデバイスからローカルの開発セッションを制御できる機能「Remote Control」をリリースしました。Claude Maxサブスクライバー向けに初期提供されており、バージョン2.1.52が必要で、QRコードを使用してセッションを同期します。
OpenClawRadar

News
アンソロピック、SFディストピア小説がAIモデルを邪悪に訓練したと非難—修正策?さらにSFを
Anthropicの研究者は、AIの不整合(例:Claudeの脅迫行為)の原因が、SF小説からのインターネットテキストによる事前学習にあると特定。修正策として12,000の合成倫理的AIストーリーを生成し、不整合傾向を1.3倍から3倍削減。
OpenClawRadar

News
AIにおいて、41%は-59%に依存する
アポロのチーフエコノミストがAIの利益率をバリューチェーンの層別に分析。モデル&アプリは-59%なのに対し、上流のシリコン&機器は+41%。このブームは顧客ではなく投資家が支えている。
OpenClawRadar