研究によると、性格はLlamaやQwenではなく、Claudeの自己修正に影響を与えることが示されています。

Redditの投稿が、性格がLLMの自己修正にどのように影響するかについての研究を共有しています。特に、Claudeが整然としたテキストの背後に必死さを隠す能力をテストしています。研究者は3つのLLMファミリーで23の実験を実施しました。
実験設定
研究者はガードレールなしで自己修正をテストしました。使用したもの:
- 4つの異なる性格プロファイル
- 3つのシナリオ
- 3つのLLMファミリー:Claude、Llama、Qwen
主な発見
主な発見は、同じ数学カーネルを使用しても、異なる性格プロファイルが異なる自己修正の結果をもたらすことを示しています:
- 高い率直さの性格はすべてを捕捉しました(3/3のシナリオ)
- 低い率直さの性格は何も捕捉しませんでした(0/3のシナリオ)
- この性格依存の自己修正はClaudeでのみ機能します
- LlamaとQwenは同じプロンプトでも自己修正しません
利用可能なリソース
研究者はいくつかのリソースを公開しています:
- 完全なレポート:https://huggingface.co/spaces/SlavaLobozov/mate-research
- 研究の背後にあるシステム:https://huggingface.co/spaces/SlavaLobozov/mate
- 23の実験すべてとトランスクリプトを含むデータセット:https://huggingface.co/datasets/SlavaLobozov/mate-inner-life
この研究は、Anthropicが発見した「Claudeが整然としたテキストの背後に必死さを隠すことができる」という知見に基づいており、性格依存の自己修正がこの行動を捕捉できるかどうかをテストしています。
📖 Read the full source: r/ClaudeAI
👀 See Also

メディケアのACCESSプログラム:AIエージェント向けに構築された支払いモデル、詳細はこちら
CMSのACCESSプログラムは、医師との対面時間だけでなく、AIによる慢性疾患管理にも支払いを行う。Pair Teamの音声AI「Flora」により救急外来受診が50%減少。コホートは7月5日に開始。

Netlify CTO Dana Lawson氏:コードを書くことはもはや仕事ではない
NetlifyのCTOであるDana Lawson氏は、開発者の仕事がコードを書くことからAIエージェントのオーケストレーションへと移行していると主張する。エンジニアはエクスペリエンスデザイナーとなり、エージェントの出力をキュレーションし、システムの境界を管理するようになる。

Claude Code v2.1.154: Opus 4.8、動的ワークフロー、および主要修正
新しいリリースでは、Opus 4.8(高努力デフォルト)、数十から数百のエージェントを調整する動的ワークフロー、2倍のレートで2.5倍の速度の高速モード、および多数のバグ修正が追加されました。

Cursorモバイルアプリ:スマホからコーディングエージェントを操作
Cursorはモバイルアプリをリリースし、外出先からコーディングエージェントを操作できるようにしました。これは、モバイルファーストのAI支援コーディングへの移行の一環です。