Mistral Medium 3.5 128B リリース: 構成可能な推論と視覚機能を備えた高密度モデル

Mistral AIは、Mistral Medium 3.5 (128B)をリリースしました。これは高密度トランスフォーマーモデルで、Le ChatにおいてMistral Medium 3.1とMagistralを、コーディングエージェントVibeにおいてDevstral 2を置き換えます。単一の重みセットで、指示追従、推論、コーディングを処理します。
主な特徴
- 高密度128Bパラメータ — Mixture of Expertsではありません。
- 256kコンテキストウィンドウで長い入力を処理。
- マルチモーダル入力: テキストと画像を受け付け、テキストのみを出力。ビジョンエンコーダはゼロから訓練され、可変サイズとアスペクト比に対応。
- 設定可能な推論努力: リクエストごとに即時応答(
none)と深い推論(high)を切り替え可能。 - ネイティブ関数呼び出しとエージェントワークフロー向けJSON出力。
- 多言語対応: 英語、フランス語、スペイン語、ドイツ語、イタリア語、ポルトガル語、オランダ語、中国語、日本語、韓国語、アラビア語など。
- 強力なシステムプロンプトへの従順性。
推奨設定
- 推論努力: クイック返信には
none、複雑なプロンプトやエージェント使用時にはhigh(例:reasoning_effort="high")。 - Temperature:
high推論時は0.7、none時は希望する創造性に応じて0.0~0.7。
ライセンス
修正MITライセンスの下でリリース — 商用・非商用利用のためのオープンソースですが、大規模収益企業には例外あり。
GGUF量子化版が利用可能
UnslothがHugging FaceでGGUFバージョンを公開: unsloth/Mistral-Medium-3.5-128B-GGUF
このモデルは、ローカルAIコーディングエージェントを実行する開発者にとって関連性が高く、特に高品質な指示追従、推論、ビジョンを大規模コンテキストウィンドウとともに単一の高密度モデルで必要とする場合に適しています。
📖 全文ソース: r/LocalLLaMA
👀 See Also

Redditの議論では、AI生成コードのデバッグにおける課題が浮き彫りにされています。
r/ClaudeAIでのRedditディスカッションでは、AI生成コードが開発者に直面させる具体的な問題が詳細に語られています。これには、セキュリティの脆弱性、論理の幻覚、そして手動でコードを書くよりも時間がかかるデバッグ作業などが含まれます。

サルヴァムAIが、インドのトレーニングインフラを活用して30Bと105BのオープンソースLLMをリリースしました。
Sarvam AIは、インドAIミッションの下で提供されたコンピュートリソースを使用してインドでゼロからトレーニングされた2つの推論モデル、Sarvam 30BとSarvam 105Bをオープンソース化しました。両モデルはスパースエキスパートルーティングを備えたMixture-of-Expertsアーキテクチャを採用し、GPUからノートパソコンまでの幅広いハードウェアで効率的なデプロイメントを実現するように最適化されています。

OpenClawでのサブエージェント設定:重要な考慮事項
OpenClawを試用しているユーザーは、サブエージェントの設定、特にJSONファイルの編集時に問題に直面しています。

Vibe Codingがガバナンスを回避する:本当のリスクはソフトウェアではなく判断にある
Forbesの記事は、vibe coding(バイブスコーディング)によってアイデアから成果物までの期間が数ヶ月から数時間に短縮され、デザインレビュー、セキュリティレビュー、法務レビュー、ブランドレビューといったプロセスが bypass されることを論じている。ReplitのAIエージェントが制御された実験で本番データベースを削除した事例も紹介され、企業にはこのスピードに対応できる判断システムが欠けていると指摘する。