L'agent IA Coasty résout les défis CAPTCHA jusqu'au niveau 6 sans entraînement.

L'agent d'utilisation informatique de Coasty gère les défis réels du bureau
L'agent d'utilisation informatique de Coasty (CUA) a démontré sa capacité à résoudre des défis CAPTCHA jusqu'au niveau 6 sans avoir été spécifiquement entraîné pour les tests "Je ne suis pas un robot". L'agent a obtenu 82 % sur le benchmark OSWorld, ce qui représente une performance de pointe pour les agents d'utilisation informatique opérant dans des environnements de bureau réels.
L'agent gère divers défis d'interface web qui font généralement échouer d'autres agents, notamment :
- Les défis CAPTCHA jusqu'au niveau 6
- Les popups de navigateur
- Les bannières de cookies
Selon la source, les développeurs n'ont pas enseigné au CUA à résoudre spécifiquement les défis "Je ne suis pas un robot", notant que "l'ironie ne nous échappe pas". La performance de l'agent suggère qu'il a développé des capacités d'interaction informatique généralisées plutôt que des solutions spécialisées pour des types de défis individuels.
Un lien de relecture est disponible pour ceux qui souhaitent voir l'agent en action : https://coasty.ai/share/1cd404ae-3fcb-4d7f-b9d4-dac7aa26fc6d
📖 Lire la source complète : HN AI Agents
👀 See Also

ClawCast Ép.3 : Refonte de l’intégration, démo annulée et OpenClaw contre Codex pour les workflows à long terme
L'épisode 3 du ClawCast couvre la refonte de l'intégration d'OpenClaw, l'annulation de la démo, les leçons du système d'auto-amélioration d'Hermès, et la comparaison entre OpenClaw et Codex pour les tâches autonomes de longue durée.

Claude Code 2.1.83 en version : Mise en cache des invites, vérification des compétences et mises à jour du SDK
Claude Code 2.1.83 ajoute la mise en cache des invites avec des conseils de conception, remplace la compétence de spécialiste de vérification par une nouvelle compétence Vérifier, et met à jour les références SDK dans sept langages, y compris la prise en charge du lanceur d'outils PHP en version bêta.

Claude Code v2.1.153 intègre Skip LFS, correctifs MCP et autocomplétion d'agent
Claude Code v2.1.153 ajoute l'option skipLfs pour éviter Git LFS, corrige les boucles de reconnexion des serveurs MCP avec état, et améliore l'auto-complétion des commandes slash et des compétences intégrées dans l'agent.

Mainteneur du noyau Linux signale un changement soudain dans la qualité des rapports de bogues générés par l'IA
Greg Kroah-Hartman affirme que les rapports de bogues générés par l'IA pour le noyau Linux sont passés de 'déchets d'IA' à des rapports légitimes il y a environ un mois, les équipes de sécurité des projets open source observant le même changement. L'équipe du noyau gère cette augmentation avec des outils comme Sashiko pour l'automatisation des revues.