Coasty AIエージェントは、トレーニングなしでレベル6までのCAPTCHA課題を解決します。

CoastyのComputer Using Agentが実際のデスクトップ課題に対応
CoastyのComputer Using Agent(CUA)は、「私はロボットではありません」テストに特化してトレーニングされていないにもかかわらず、CAPTCHAチャレンジをレベル6まで解決する能力を示しました。このエージェントはOSWorldベンチマークで82%を達成し、実際のデスクトップ環境で動作するコンピュータ使用エージェントの最先端性能を表しています。
このエージェントは、通常他のエージェントを妨げる様々なウェブインターフェース課題に対応します:
- レベル6までのCAPTCHAチャレンジ
- ブラウザのポップアップ
- クッキーバナー
ソースによると、開発者はCUAに「私はロボットではありません」チャレンジを解決することを特に教えなかったと述べており、「皮肉は私たちにもわかっています」と指摘しています。エージェントの性能は、個々の課題タイプに対する特化した解決策ではなく、一般化されたコンピュータ対話能力を発展させたことを示唆しています。
エージェントの動作を見たい方にはリプレイリンクが利用可能です:https://coasty.ai/share/1cd404ae-3fcb-4d7f-b9d4-dac7aa26fc6d
📖 完全なソースを読む: HN AI Agents
👀 See Also

Claude-Code v2.1.78: プラグイン状態、ストリーミング応答、および重要な修正
Claude-Code v2.1.78では、${CLAUDE_PLUGIN_DATA}によるプラグインの永続的状態の追加、行単位のレスポンスストリーミング、APIエラーループの修正、権限バイパス問題の解決、サンドボックスセキュリティ警告の改善が行われました。

アンソロピックの国防総省会議と中国のAI研究所がクロードを蒸留
AnthropicのCEOが米国防長官と会談し、当局者はこれを『改善するか撤退するか』の状況と表現。一方、同社は3つの中国AI研究所がClaudeの能力を大規模に蒸留していたことを発見したと報告。

AIベンダーロックインが深刻化:モデル切り替えコスト、予想以上に高く
Zapierが実施した米国経営幹部542人を対象とした調査によると、90%がAIベンダーの切り替えは4週間以内に可能と考えているが、実際の移行では58%が失敗するか予想以上に時間がかかっている。一方、OpenAIはGPT-5.2の入力トークン価格を1.25ドルから5.75ドルに引き上げ、AnthropicはClaudeエンタープライズを動的価格設定に変更したため、ヘビーユーザーはコストが2倍から3倍になる可能性がある。

Claude Code v2.1.160:シェル設定の安全プロンプト、acceptEditsファイル保護、数十のバグ修正
AnthropicはClaude Code v2.1.160をリリース。acceptEditsモードでのシェル起動ファイルやビルドツール設定への書き込み前に安全確認プロンプトを追加。Windowsクリップボードサポートを改善し、セッション履歴消失などのバグを修正。