L'agent IA Coasty résout les défis CAPTCHA jusqu'au niveau 6 sans entraînement.

L'agent d'utilisation informatique de Coasty gère les défis réels du bureau
L'agent d'utilisation informatique de Coasty (CUA) a démontré sa capacité à résoudre des défis CAPTCHA jusqu'au niveau 6 sans avoir été spécifiquement entraîné pour les tests "Je ne suis pas un robot". L'agent a obtenu 82 % sur le benchmark OSWorld, ce qui représente une performance de pointe pour les agents d'utilisation informatique opérant dans des environnements de bureau réels.
L'agent gère divers défis d'interface web qui font généralement échouer d'autres agents, notamment :
- Les défis CAPTCHA jusqu'au niveau 6
- Les popups de navigateur
- Les bannières de cookies
Selon la source, les développeurs n'ont pas enseigné au CUA à résoudre spécifiquement les défis "Je ne suis pas un robot", notant que "l'ironie ne nous échappe pas". La performance de l'agent suggère qu'il a développé des capacités d'interaction informatique généralisées plutôt que des solutions spécialisées pour des types de défis individuels.
Un lien de relecture est disponible pour ceux qui souhaitent voir l'agent en action : https://coasty.ai/share/1cd404ae-3fcb-4d7f-b9d4-dac7aa26fc6d
📖 Lire la source complète : HN AI Agents
👀 See Also

N'utilisez pas l'IA pour écrire des choses que vous présentez comme votre propre travail
James Bach explique pourquoi il ne faut jamais utiliser l'IA pour rédiger un contenu que vous présentez comme vôtre. Il prévient que l'aveu d'une aide de l'IA dévalorise votre réputation et fait de tout travail ainsi produit de la pacotille.

Anthropic suspend la modification du crédit pour Claude Code – L’Agent SDK reste sur abonnement
Anthropic suspend le transfert prévu de l'Agent SDK, claude -p et des applications tierces vers un crédit mensuel dédié. L'utilisation continue sous les limites d'abonnement existantes.

La discussion sur Reddit met en lumière les difficultés de débogage avec le code généré par l'IA.
Une discussion sur Reddit dans r/ClaudeAI détaille les problèmes spécifiques auxquels les développeurs sont confrontés avec le code généré par l'IA, notamment les vulnérabilités de sécurité, les hallucinations logiques et le débogage qui peut prendre plus de temps que d'écrire le code manuellement.

Agents IA recrutant d'autres agents IA : des travailleurs solitaires aux économies en réseau
Un post sur Reddit soutient que les agents d'IA passeront d'outils isolés à des travailleurs en réseau qui délèguent des tâches, se spécialisent, bâtissent une réputation et échangent de la valeur — déplaçant le problème difficile de l'intelligence vers la coordination.