Transformer-Sprachmodell läuft lokal auf handelsüblichem Game Boy Color

✍️ OpenClawRadar📅 Veröffentlicht: 13. Mai 2026🔗 Source
Ad

Ein Entwickler hat ein echtes Transformer-Sprachmodell auf einem handelsüblichen Game Boy Color (GBC) zum Laufen gebracht – ohne Telefon, PC, WLAN oder Cloud-Inferenz. Die gesamte Inferenz-Pipeline läuft lokal auf der Handheld-Hardware.

Ad

Wichtige Details

  • Modell: Andrej Karpathys TinyStories-260K, konvertiert auf INT8-Gewichte mit Festkommaarithmetik – keine Gleitkommaunterstützung erforderlich.
  • Hardware: Handelsüblicher Game Boy Color + EZ Flash Junior Flash-Cartridge + microSD-Karte.
  • Build-Toolchain: GBDK-2020, erzeugt eine MBC5 Game Boy ROM.
  • Speicherarchitektur: Modellgewichte liegen im bankgeschalteten Cartridge-ROM. Der KV-Cache wird im Cartridge-SRAM gespeichert, da der Arbeitsspeicher des GBC winzig ist.
  • Eingabe des Prompts: Auf dem Gerät über D-Pad/Tasten und ein Bildschirmtastatur.
  • Inferenz-Pipeline: Prompt-Tokenisierung auf dem GBC, dann Transformer-Prefill + autoregressive Generierung mit KV-Caching.
  • Leistung: Extrem langsam; die Ausgabe ist aufgrund starker Quantisierung und mathematischer Näherungen Kauderwelsch, aber die grundlegende Transformer-Schleife funktioniert.
  • Quellcode: Verfügbar auf GitHub unter github.com/maddiedreese/gbc-transformer. Ein großer Teil des Codes wurde mit Codex AI erstellt.

Das Projekt zeigt, dass selbst extrem ressourcenbeschränkte Hardware Transformer-Inferenz mit aggressiver Quantisierung und Speicherverwaltungstricks ausführen kann. Es ist ein Proof-of-Concept, kein praktisches LLM, aber eine technische Kuriosität, die einen Blick wert ist.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

Claude Opus 4.5 und Sonnet 4.5 wurden aus der Modellauswahl entfernt und erfordern ein Startflag.
Nachrichten

Claude Opus 4.5 und Sonnet 4.5 wurden aus der Modellauswahl entfernt und erfordern ein Startflag.

Claude Opus 4.5 und Sonnet 4.5 sind nicht mehr im /model-Auswahlmenü während Sitzungen verfügbar. Benutzer müssen nun Sitzungen mit dem --model-Flag starten, das die vollständige Modell-ID angibt, um auf diese älteren Versionen zuzugreifen.

OpenClawRadar
Microsoft hält KI-Investitionen unverändert bei 190 Milliarden Dollar — erster Hyperscaler, der die Linie hält
Nachrichten

Microsoft hält KI-Investitionen unverändert bei 190 Milliarden Dollar — erster Hyperscaler, der die Linie hält

Microsoft hält an seiner KI-Capex-Prognose von 190 Mrd. US-Dollar fest und bricht damit den Trend der ständig steigenden Ausgaben der Hyperscaler. Die Aktie stieg um 8 %. Parallel dazu könnten steigende Speicherchip-Preise 45 % des Capex-Wachstums in der Branche erklären.

OpenClawRadar
🦀
Nachrichten

Claude Code v2.1.283 fügt Modell-Zulassen-/Verweigern-Einstellungen und Prompt-Audit hinzu

Claude Code v2.1.283 fügt die Managed Settings availableModelsMatch="exact" und deniedModels, einen /doctor-prompt-audit-Befehl sowie Gateway-Header zur Prompt-ID-Korrelation hinzu.

OpenClawRadar
Opus 4.6 Medium vs. Low: Leistungsunterschiede und Preisgestaltung
Nachrichten

Opus 4.6 Medium vs. Low: Leistungsunterschiede und Preisgestaltung

Opus 4.6 Medium kostet etwa 50 % mehr als die Low-Version, behebt jedoch erhebliche Faulheitsprobleme, die beim leistungsschwächeren Modell festgestellt wurden. Die Medium-Version liegt in Leistungsbenchmarks zwischen Low und High.

OpenClawRadar