UI und Server für Anthropics Natural Language Autoencoder auf llama.cpp
Anthropics erste Open-Weight-Modelle, die Natural Language Autoencoder (NLAs), sind Feinabstimmungen beliebter Open-Weight-Architekturen. Da sie die zugrunde liegende Modellarchitektur oder den Modellierungscode nicht ändern, ist die Inferenz mit llama.cpp unkompliziert. Ein Entwickler hat alle NLA-Funktionen – Aktivierungsextraktion, Aktivierungserklärung, Aktivierungsrekonstruktion und Steuerung durch Erklärungsbearbeitung – in einen benutzerdefinierten llama.cpp-Server integriert, gepaart mit einer Mikupad-Benutzeroberfläche für tokenweise Aktivierungserklärung und Steuerung.
Hauptfunktionen
- Aktivierungsextraktion: Extrahiert interne Aktivierungen aus jeder Schicht des Basismodells.
- Aktivierungserklärung: Liefert menschenlesbare Erklärungen für extrahierte Aktivierungen.
- Aktivierungsrekonstruktion: Rekonstruiert Aktivierungen aus ihren Erklärungen.
- Steuerung durch Erklärungsbearbeitung: Ändert Erklärungen und steuert die Modellausgabe entsprechend.
Technische Details
Der Server basiert auf llama.cpp und erfordert das gleichzeitige Laden von drei Modellen: das Basismodell, das Actor-Modell und das Critic-Modell. Dies ist ein speicherintensiver Aufbau. Der Entwickler arbeitet an einer LoRA-basierten Version, die das Laden eines einzigen Modells in den Speicher erlauben würde, wodurch der Speicherbedarf deutlich reduziert wird.
Die Mikupad-Benutzeroberfläche bietet eine tokenweise Schnittstelle für Aktivierungserklärung und Steuerung. Sie können überprüfen, welche Tokens bestimmte Merkmale aktivieren, und das Verhalten des Modells anpassen, indem Sie Erklärungen in Echtzeit bearbeiten.
Erste Schritte
Quellcode und Einrichtungsanweisungen sind auf Reddit verfügbar. Derzeit benötigen Sie die drei NLA-Modell-Checkpoints (Base, Actor, Critic) und müssen den benutzerdefinierten llama.cpp-Server kompilieren. Die LoRA-Version folgt in Kürze.
📖 Quelle: r/LocalLLaMA
👀 Siehe auch

Kreativ-Exzellenz-Plugin für Claude Code verbessert Animationsqualität durch Interaktionsthese
Ein neues Open-Source-Plugin für Claude Code adressiert die generische Animation-Erstellung durch die Implementierung eines 'Interaktions-These'-Ansatzes, bei dem Claude zunächst Bewegungskonzepte beschreiben muss, bevor er Code schreibt. Das Plugin umfasst 8 Teilfähigkeiten, die GSAP, Framer Motion, CSS-Animationen und Designprinzipien aus untersuchten Repositories abdecken.

Echtzeit-Aktienanalyse zu Claude Desktop über MCP-Server hinzugefügt
Ein Entwickler hat einen MCP-Server namens agent-toolbelt erstellt, der Echtzeit-Aktienanalyse-Fähigkeiten zu Claude Desktop und Claude Code hinzufügt und damit Live-Daten für Investitionsanalysen anstelle von Claudes Trainingsdaten-Vermutungen bereitstellt.

Karpathys Autoresearch auf Apple Neural Engine portiert für bessere Durchsatzleistung pro Watt
Ein Prototyp kombiniert Andrej Karpathys Autoresearch-Projekt mit reverse-engineerter Apple Neural Engine-Leistung und zielt auf einen besseren Durchsatz pro Watt im Vergleich zu offiziellen APIs ab. Das Projekt basiert auf bestehenden GitHub-Repositories und würdigt Beiträge mehrerer Entwickler.

KONTAKT: 3D-Naval-Kampfspiel, vollständig mit Claude Code erstellt
CONTACT ist ein 3D-Marinekampfspiel, das vollständig mit Claude Code + Opus erstellt wurde. Es verfügt über einen 7×7×7 volumetrischen Würfel, eine Kreditwirtschaft mit taktischen Vorteilen und drei Spielmodi, darunter Mensch gegen Claude und Sonnet gegen Sonnet mit anhaltendem strategischem Gedächtnis.