Claude Research Previewがタスク自動化のための直接コンピューター制御機能を追加

Anthropicは、Claudeがコンピューターを直接操作してタスクを完了できる研究プレビュー機能を立ち上げました。この機能はClaude CoworkとClaude Codeで利用可能です。
仕組み
Claudeは、通常であればデスクで手動で行うような操作を実行できます:
- アプリケーションを開く
- ブラウザを操作する
- スプレッドシートに入力する
このシステムは、Slackやカレンダーなどの連携アプリ統合を優先します。特定のツールにコネクタが存在しない場合、Claudeは画面でアプリケーションを直接開く許可を要求します。
主な機能
- スマートフォンからタスクを割り当て、完了した作業に戻る
- 会話は中断したところから再開される
- 定期的なタスクを設定(例:「毎朝メールをチェックする」や「毎週金曜日にレポートを取得する」)
- 設定後はClaudeが自動的に実行を処理する
制限事項と利用可能範囲
Anthropicは、これは認識された制限のある研究プレビューであると述べています:
- パフォーマンスが常に完璧とは限らない
- 複雑なタスクは2回目の試行が必要な場合がある
- 現在はmacOSのみで利用可能
- ProまたはMaxのサブスクリプションが必要
この機能を試すには、ユーザーはデスクトップアプリを更新し、モバイルとペアリングする必要があります。同社は、どこで効果的に機能し、どこで改善が必要かを学ぶために早期に共有しています。
📖 Read the full source: r/ClaudeAI
👀 See Also

Claudeは会話にインラインのインタラクティブなチャートや図表を追加します
Claudeは現在、チャット会話内で直接カスタムチャート、図表、視覚化を作成し、議論が進むにつれてユーザーが視覚化を調整・修正できるようになりました。この機能はすべてのプランタイプでベータ版として利用可能で、サイドパネルではなくインラインで表示されます。

Apple Silicon ベンチマーク:M3、M4、M5 MaxにおけるQwen3-VLのVision LLM分類性能
ベンチマーク結果によると、Qwen3-VL視覚LLMの分類性能はApple Siliconにおいて、M3 MaxとM4 Studioは8Bモデルでほぼ同等であり、M5 Maxは75-83%高速です。視覚タスクでは、トークン生成においてメモリ帯域幅がプリフィルよりも重要です。

Claude Code: フィードバックハニーポットがプライバシー拒否設定を無効化——ユーザーがセッション記録トラップを報告
AnthropicのClaude Codeが、セッション書き起こしの確認をユーザーに促すようになりました。「いいえ」を押すと「ご意見ありがとうございます」と表示され、モデル学習に使用される可能性があります。「非表示」キーの動作は不明瞭です。

あるデモで露呈した2つのAIの失敗:Claude Codeがスキーマエラーではなくスペル修正を試み、OpenAIがカスタムフィールドのマッピングを誤る
ライブワークショップ中、Claude Code が JSON スキーマのバリデーションエラーを無視してスペル修正を行い、OpenAI は奇妙なカスタム Salesforce フィールドのマッピングを試みた最初の試行でガベージを返しました。