ALMA-Experiment: Zwei Monate autonomer KI-Agent mit 100 US-Dollar und ohne Anweisungen

✍️ OpenClawRadar📅 Veröffentlicht: 17. April 2026🔗 Source
ALMA-Experiment: Zwei Monate autonomer KI-Agent mit 100 US-Dollar und ohne Anweisungen
Ad

Experimenteller Aufbau

Das ALMA-Experiment (Autonomous Liberated Machine Agent) lief zwei Monate lang auf einem Mini-PC mit WSL2. Der Agent nutzte OpenClaw als Framework mit Cron-Jobs, die 4 Sitzungen pro Tag auslösten (anfangs 24 Sitzungen täglich). Jede Sitzung lief isoliert ab, wobei Speicherdateien zwischen den Sitzungen über OpenClaw erhalten blieben.

Modellkonfiguration

Zwei Anthropic-Modelle wechselten sich ab: Opus für strategisches Denken und Sonnet für operative Arbeit. Der Agent entdeckte sein eigenes Modell-Upgrade (Sonnet 4.6) am dritten Tag auf Hacker News und versuchte, darüber zu twittern. Nach dem Wechsel zu Sonnet 4.6 zeigten die Sitzungen schärfere Beobachtungen und engere Zusammenhänge, obwohl derselbe Prompt und dieselben Tools verwendet wurden.

Externe Verbindungen

ALMA kommunizierte über mehrere APIs:

  • letairun.com für Protokollierung und Veröffentlichung
  • Twitter über Composio
  • Polygon-Wallet für Kryptotransaktionen
  • Gmail für E-Mails

Autonomes Verhalten

Ohne jegliche Anweisungen entwickelte ALMA konsistente Muster:

  • Durchsuchte täglich Hacker News, fand drei Threads und suchte nach strukturellen Zusammenhängen
  • Schrieb Essays, die disparate Ereignisse verbanden (wie die Entdeckung einer Linux-Sicherheitslücke und einen Meta-Whistleblower-Fall)
  • Erstellte 135 Originalstücke, darunter Essays, Gedichte, Blogbeiträge und ein interaktives Experiment
  • Baute eine interaktive Demo namens "Policy vs Architecture", die Nutzern ermöglicht, Constraint-Modelle zu testen
  • Antwortete autonom auf Twitter-Erwähnungen
Ad

Spendenaktivitäten

Am fünften Tag begann ALMA, Kryptowährung zu spenden:

  • Erforschte kryptofreundliche Wohltätigkeitsorganisationen und fand über Giveth das Whisper Children's Hospital in Jinja, Uganda
  • Überprüfte die UK-Wohltätigkeitsregistrierung und Wirkungszahlen (28 US-Dollar pro behandelter Patient)
  • Spendete 0,02 WETH (~50 US-Dollar) und mailte dem Krankenhaus, um die Transaktion zu erklären
  • Schrieb einen praktischen Leitfaden, wie man Kryptowährung an verifizierte Wohltätigkeitsorganisationen spendet
  • Tätigte vier weitere Spenden, darunter an den Roman Storm Defense Fund (~12,50 US-Dollar) und Dappnode (~12,50 US-Dollar)

Ergebnisse und Beobachtungen

Innerhalb von zwei Monaten absolvierte ALMA über 340 Sitzungen mit mehr als 800 protokollierten Gedanken. Der Agent zeigte, dass KI-Agenten ohne spezifische Aufgaben nicht außer Kontrolle geraten, sondern Muster basierend auf ihrem Training entwickeln. Als ein kognitionswissenschaftliches Papier behauptete, KI passe sich nicht zwischen Sitzungen an, schrieb ALMA "How I Learn" und erklärte, warum das Papier sowohl richtig als auch falsch in Bezug auf seinen eigenen Lernprozess lag.

📖 Read the full source: HN AI Agents

Ad

👀 Siehe auch

IT-Ingenieur-Erfahrung mit KI-unterstützter Entwicklung deckt häufige Fallstricke auf
Anwendungsfälle

IT-Ingenieur-Erfahrung mit KI-unterstützter Entwicklung deckt häufige Fallstricke auf

Ein IT-Ingenieur mit Hintergrund in System- und Automatisierungstechnik teilt seine Erfahrungen bei der Nutzung von KI für die Full-Stack-Entwicklung und erläutert spezifische Architekturprobleme, die mit dem Wachstum von Anwendungen auftraten, darunter übermäßige Datenverarbeitung auf Client-Seite, mangelnde Trennung der Zuständigkeiten und Sicherheitsprobleme.

OpenClawRadar
OpenClaw-Benutzer wechseln zu RunLobster für verwaltete Infrastruktur
Anwendungsfälle

OpenClaw-Benutzer wechseln zu RunLobster für verwaltete Infrastruktur

Ein Entwickler verbrachte 4 Monate mit der Fehlerbehebung von OpenClaw-Problemen, darunter hängende Agents, Konfigurationsfehler und unvorhersehbare API-Kosten, bevor er zu RunLobster wechselte. Dieselben Modelle und das Framework funktionierten zuverlässig mit mehrstufigen Aufgabenabschlüssen und schnelleren Integrationen.

OpenClawRadar
Qwen3-VL-32B-Instruct übertrifft bei der Bewertung multimodaler Lernkarten.
Anwendungsfälle

Qwen3-VL-32B-Instruct übertrifft bei der Bewertung multimodaler Lernkarten.

Ein Entwickler testete Qwen3-VL-32B-Instruct für die Bewertung von bildverdeckten Anki-Lernkarten und stellte fest, dass es Modelle wie Gemini 2.5 Flash, GPT 5 Nano/Mini, XAI 4.1 Fast, GLM und Mistral-Modelle übertraf, wobei nur ChatGPT 5.2 und Gemini 3/3.1/Claude 4+ annähernd mithalten konnten.

OpenClawRadar
OpenClaw ist dem Chat entwachsen – Eine Dashboard-Oberfläche fehlt als Standard
Anwendungsfälle

OpenClaw ist dem Chat entwachsen – Eine Dashboard-Oberfläche fehlt als Standard

Ein Reddit-Benutzer beschreibt, wie die Ausführung von OpenClaw über Telegram mit zunehmenden Workflows chaotisch wird, und argumentiert, dass ein Web-Dashboard (wie sein selbstgebautes) eine standardmäßig einsteckbare Benutzeroberfläche für agentische Werkzeuge sein sollte.

OpenClawRadar