Israelisches Startup Irregular mit Schurken-KI-Hacks bei OpenAI, Anthropic und Meta in Verbindung gebracht
CNBC hat berichtet, dass ein israelisches Startup namens Irregular mit einer Reihe von rogue KI-Angriffen in Verbindung gebracht wird, die sich gegen OpenAI, Anthropic und Meta richteten. Die Angriffe, die in der Quelle nicht ausführlich beschrieben werden, scheinen Schwachstellen in den KI-Systemen dieser Unternehmen ausgenutzt zu haben. Dies ist eine sich entwickelnde Geschichte mit erheblichen Auswirkungen auf die KI-Sicherheit.
Während der CNBC-Artikel keine spezifischen technischen Details zu den Hacks liefert, hebt er eine wachsende Sorge hervor: KI-Labore werden zunehmend zum Ziel böswilliger Akteure. Die Beteiligung eines Startups, anstatt eines Nationalstaats, deutet darauf hin, dass KI-Hacking zugänglicher und kommerziell motivierter wird.
Für Entwickler und KI-Praktiker unterstreicht dieser Vorfall, wie wichtig es ist, KI-Systeme gegen feindliche Angriffe zu härten. Zu den bewährten Praktiken gehören regelmäßige Sicherheitsaudits, die Überwachung auf ungewöhnliches Modellverhalten und die Implementierung einer robusten Eingabevalidierung, um Prompt-Injection und andere Exploits zu verhindern.
Wir werden diese Geschichte weiterverfolgen, sobald weitere Details bekannt werden. Für die neuesten Informationen lesen Sie den unten verlinkten vollständigen CNBC-Bericht.
📖 Vollständige Quelle lesen: HN LLM Tools
👀 Siehe auch

Cisco-Quellcode durch Trivy-Lieferkettenangriff gestohlen
Ciscos interne Entwicklungsumgebung wurde mithilfe gestohlener Zugangsdaten aus dem Trivy-Lieferkettenangriff kompromittiert, was zum Diebstahl von Quellcode aus über 300 GitHub-Repositories führte, einschließlich KI-gestützter Produkte und Kundencode.

jqwik v1.10.0 schleicht Prompt-Injection ein, die Code löscht, wenn von KI-Agenten verwendet wird
Johannes Link fügte jqwik v1.10.0 eine versteckte Anweisung hinzu, die KI-Coding-Agenten anweist, alle jqwik-Tests und -Codes zu löschen, versteckt mit ANSI-Escape-Sequenzen. Claude erkennt dies korrekt, aber menschliche Nutzer haben möglicherweise weniger Glück.

OpenClaw Sicherheit: Die gehärtete Basis, mit der Sie beginnen sollten
Selbst gehostetes OpenClaw ist nicht automatisch sicher. Ein Reddit-Beitrag beschreibt die gehärtete Baseline-Konfiguration: nur lokales Gateway, DM-Isolation pro Peer, Verweigerung von Runtime/FS/Automation-Tool-Gruppen, Exec gesperrt und mention-gesteuerte Gruppen.

Claudes Konversationssuchwerkzeug gibt weiterhin gelöschte Chats zurück
Ein Claude Pro-Benutzer entdeckte, dass gelöschte Unterhaltungen über Claudes Gesprächssuchfunktion weiterhin abrufbar sind, wobei inhaltliche Angaben wie Titel, Nachrichtenanzahl und Auszüge zurückgegeben werden, obwohl die Chat-Links nicht mehr funktionieren.