マーリンリサーチが構造化推論のためのQwen3.5-4B-Safety-Thinkingモデルをリリース

マーリンリサーチは、Qwen3.5を基盤とした40億パラメータの安全性に配慮した推論モデル「Qwen3.5-4B-Safety-Thinking」をリリースしました。このモデルは、特にエージェントシステムに焦点を当て、実世界のシナリオにおける構造化された「思考」と安全性のアプリケーションのために特別に設計されています。
主な改善点と特徴
- プロンプト内の厳格な指示を正確に従う能力の向上
- AnthropicのBloomおよびPetri手法の使用に基づく
- ハッキング試行に対する耐性
- 「異常」なプロンプトや敵対的プロンプトに対する耐性の向上
- 最大100万トークンのコンテキストウィンドウ
- Anthropicのフレームワーク - BloomおよびPetriを使用
このモデルは、Hugging FaceのMerlinSafety/Qwen3.5-4B-Safety-Thinkingで利用可能です。
AIエージェントを扱う開発者にとって、このモデルは、構造化された推論とプロンプト操作への耐性が優先される安全性が重要なアプリケーションのための専門的なツールを表しています。AnthropicのBloomおよびPetri手法の統合は、アラインメントに対する憲法AIアプローチへの焦点を示唆しています。
📖 Read the full source: r/LocalLLaMA
👀 See Also

西洋は建設方法を忘れた:防衛サプライチェーンの崩壊とソフトウェア工学への教訓
レイセオンは、40年前の紙の設計図からスティンガーミサイルの生産を再開するために、退職したエンジニアを呼び戻さなければならなかった。ソフトウェア業界でも同様のパターンが進行しており、数十年にわたるコスト最適化によって人材パイプラインと組織知が衰退している。

Claude Opus 4.8 リリース:より高速、より低コストの高速モード、動的ワークフロー、誠実性の向上
AnthropicがClaude Opusを4.8にアップグレード。ベンチマークの改善、Claude Codeの動的ワークフロー、高速モードの2.5倍高速化・3倍低価格化、正直性トレーニングを実施。
AIスタートアップの研究発表減少:オープンソースと開発者への影響
トップAIスタートアップが研究発表を大幅に減らしており、分野の透明性と再現性に対する懸念が高まっている。

Claude Max 100ドルサブスクリプションのAPI拡張タスク使用データ
Claude Maxの100ドルサブスクリプション利用者が、既存のAPIにお気に入りライブラリ機能を拡張するために5時間セッションの13%を消費したと報告。コンテキスト使用率は11%、週間使用率は5%から6%に増加。