Coasty KI-Agent löst CAPTCHA-Herausforderungen bis Level 6 ohne Training

Coastys Computer Using Agent bewältigt echte Desktop-Herausforderungen
Coastys Computer Using Agent (CUA) hat gezeigt, dass er CAPTCHA-Herausforderungen bis Level 6 lösen kann, ohne speziell für "Ich bin kein Roboter"-Tests trainiert worden zu sein. Der Agent erreichte 82 % auf dem OSWorld-Benchmark, was Spitzenleistung für Computer-Nutzungs-Agenten in realen Desktop-Umgebungen darstellt.
Der Agent bewältigt verschiedene Web-Interface-Herausforderungen, die typischerweise andere Agenten zum Scheitern bringen, darunter:
- CAPTCHA-Herausforderungen bis Level 6
- Browser-Popups
- Cookie-Banner
Laut der Quelle haben die Entwickler den CUA nicht speziell zum Lösen von "Ich bin kein Roboter"-Herausforderungen trainiert und merken an, dass "die Ironie uns nicht entgeht". Die Leistung des Agenten deutet darauf hin, dass er allgemeine Computer-Interaktionsfähigkeiten entwickelt hat, anstatt spezialisierte Lösungen für einzelne Herausforderungstypen.
Ein Wiedergabelink ist für Interessierte verfügbar, die den Agenten in Aktion sehen möchten: https://coasty.ai/share/1cd404ae-3fcb-4d7f-b9d4-dac7aa26fc6d
📖 Read the full source: HN AI Agents
👀 Siehe auch

Claude-Code-Service-Ausfall und Probleme mit der Transparenz der Statusseite
Claude Code erlebte Authentifizierungsfehler mit täglich ablaufenden OAuth-API-Schlüsseln und 500-Fehlern während der Reautorisierung, während die offizielle Statusseite zunächst keine Probleme anzeigte, obwohl Benutzer seit mindestens 45 Minuten über Probleme berichteten.

Claudes Fünf-Sitz-Minimum schafft Privatsphärenlücke für Einzelpraktizierende
Die geschäftlichen Datenschutzbestimmungen von Anthropic erfordern ein Minimum von fünf Arbeitsplätzen, was Einzelunternehmer dazu zwingt, entweder für ungenutzte Plätze zu zahlen oder Verbraucherpläne mit unzureichenden Datenschutzbestimmungen zu nutzen. Diese Lücke steht im Gegensatz zu Google Workspace und OpenAI Business Plans, die unternehmensweiten Datenschutz zu Einzelplatzpreisen anbieten.

Qwen3.6 Plus Benchmark-Vergleich mit westlichen SOTA-Modellen
Qwen3.6 Plus erzielt 78,8 Punkte bei SWE-bench Verified, 90,4 bei GPQA/GPQA Diamond, 28,8 bei HLE (ohne Werkzeuge) und 78,8 bei MMMU-Pro, was es wettbewerbsfähig gegenüber Modellen wie GPT-5.4, Claude Opus 4.6 und Gemini 3.1 Pro Preview positioniert.
The Atlantic berichtet über zunehmende Anti-KI-Gewalt und politische Gegenreaktionen
Bernie Sanders und Steve Bannon bezeichnen KI gleichermaßen als Bedrohung für Arbeiter. Ein Molotowcocktail-Angriff auf Sam Altmans Haus und die Schießerei auf einen Stadtrat in Indianapolis zeigen, dass die Gewalt gegen Rechenzentren zunimmt.