Transformer-Sprachmodell läuft lokal auf handelsüblichem Game Boy Color
Ein Entwickler hat ein echtes Transformer-Sprachmodell auf einem handelsüblichen Game Boy Color (GBC) zum Laufen gebracht – ohne Telefon, PC, WLAN oder Cloud-Inferenz. Die gesamte Inferenz-Pipeline läuft lokal auf der Handheld-Hardware.
Wichtige Details
- Modell: Andrej Karpathys TinyStories-260K, konvertiert auf INT8-Gewichte mit Festkommaarithmetik – keine Gleitkommaunterstützung erforderlich.
- Hardware: Handelsüblicher Game Boy Color + EZ Flash Junior Flash-Cartridge + microSD-Karte.
- Build-Toolchain: GBDK-2020, erzeugt eine MBC5 Game Boy ROM.
- Speicherarchitektur: Modellgewichte liegen im bankgeschalteten Cartridge-ROM. Der KV-Cache wird im Cartridge-SRAM gespeichert, da der Arbeitsspeicher des GBC winzig ist.
- Eingabe des Prompts: Auf dem Gerät über D-Pad/Tasten und ein Bildschirmtastatur.
- Inferenz-Pipeline: Prompt-Tokenisierung auf dem GBC, dann Transformer-Prefill + autoregressive Generierung mit KV-Caching.
- Leistung: Extrem langsam; die Ausgabe ist aufgrund starker Quantisierung und mathematischer Näherungen Kauderwelsch, aber die grundlegende Transformer-Schleife funktioniert.
- Quellcode: Verfügbar auf GitHub unter github.com/maddiedreese/gbc-transformer. Ein großer Teil des Codes wurde mit Codex AI erstellt.
Das Projekt zeigt, dass selbst extrem ressourcenbeschränkte Hardware Transformer-Inferenz mit aggressiver Quantisierung und Speicherverwaltungstricks ausführen kann. Es ist ein Proof-of-Concept, kein praktisches LLM, aber eine technische Kuriosität, die einen Blick wert ist.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Claude Opus 4.5 und Sonnet 4.5 wurden aus der Modellauswahl entfernt und erfordern ein Startflag.
Claude Opus 4.5 und Sonnet 4.5 sind nicht mehr im /model-Auswahlmenü während Sitzungen verfügbar. Benutzer müssen nun Sitzungen mit dem --model-Flag starten, das die vollständige Modell-ID angibt, um auf diese älteren Versionen zuzugreifen.

Microsoft hält KI-Investitionen unverändert bei 190 Milliarden Dollar — erster Hyperscaler, der die Linie hält
Microsoft hält an seiner KI-Capex-Prognose von 190 Mrd. US-Dollar fest und bricht damit den Trend der ständig steigenden Ausgaben der Hyperscaler. Die Aktie stieg um 8 %. Parallel dazu könnten steigende Speicherchip-Preise 45 % des Capex-Wachstums in der Branche erklären.
Claude Code v2.1.283 fügt Modell-Zulassen-/Verweigern-Einstellungen und Prompt-Audit hinzu
Claude Code v2.1.283 fügt die Managed Settings availableModelsMatch="exact" und deniedModels, einen /doctor-prompt-audit-Befehl sowie Gateway-Header zur Prompt-ID-Korrelation hinzu.

Opus 4.6 Medium vs. Low: Leistungsunterschiede und Preisgestaltung
Opus 4.6 Medium kostet etwa 50 % mehr als die Low-Version, behebt jedoch erhebliche Faulheitsprobleme, die beim leistungsschwächeren Modell festgestellt wurden. Die Medium-Version liegt in Leistungsbenchmarks zwischen Low und High.