Eä: Ein SIMD-Compiler für Python, geschrieben in Rust

Was Eä macht
Eä ist ein Compiler für SIMD-Kernel, der ein häufiges Workflow-Problem löst: Python-Code schreiben, Profiling durchführen, um Engpässe zu finden, in C umschreiben, mit ctypes kämpfen, Pointer debuggen und schließlich eine 5-fache Beschleunigung zu erreichen – nur um den Prozess in der nächsten Woche zu wiederholen.
Wie es funktioniert
Mit Eä:
- Schreiben Sie eine kleine .ea-Datei
- Führen Sie einen Befehl aus
- Rufen Sie es aus Python wie eine normale Funktion auf
Der Kernel läuft mit nativer vektorisierter Geschwindigkeit. Beispielnutzung:
import ea
kernel = ea.load("fma.ea")
result = kernel.fma_f32x8(a, b, c, out) # 6,6× schneller als NumPy
Technische Details
Der Compiler generiert:
- Shared Library
- Python-Wrapper
- Außerdem Rust-, C++-, PyTorch- und CMake-Bindings
Zielarchitekturen:
- x86-64 (AVX2 / AVX-512)
- AArch64 (NEON)
Der Compiler selbst:
- ~12.000 Zeilen Rust-Code
- 475 Tests
- Keine ctypes, Header-Dateien oder Build-System erforderlich
Entwicklungskontext
Der Entwickler hat Eä mit Hilfe von KI-Modellen erstellt, wobei Claude die schwere Arbeit übernahm, während die architektonische Kontrolle erhalten blieb. Die zentrale Erkenntnis war, dass die Handhabung des gesamten "Glue-Code" wichtiger ist als SIMD selbst, sodass Entwickler sich nur auf den Kernel konzentrieren können.
Benchmarks
Benchmarks zeigen eine 6,6-fache Leistungssteigerung gegenüber NumPy für das fma_f32x8-Beispiel. Der Entwickler merkt an, dass diese von einem recht einfachen Setup stammen, aber versucht hat, die Bedingungen fair und reproduzierbar zu halten.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

QCAI-App bietet mobiles Kontrollzentrum für das OpenClaw-Ökosystem
Ein akademisches Forschungsteam veröffentlicht die QCAI-App für iOS und Android, die mit KI-unterstützter Entwicklung erstellt wurde und Dashboard-Überwachung, Gateway-Chat und sicheren VPN-Zugang zu OpenClaw-Tools bietet.

Entwickler baut native tmux-Port für Windows mit Claude Code, ohne C zu kennen
Ein Entwickler hat tmux-win erstellt, einen nativen Windows-Multiplexer, der Claude Code nutzt, um Win32-API und conpty-Implementierung zu handhaben, obwohl er C nicht kennt. Das Tool bietet vertikale/horizontale Aufteilungen, abtrennbare Sitzungen und native Leistung ohne VM-Overhead.

Einführung von Lean Collab: Ein Multi-Agenten-Orchestrator für langanhaltende LLM-Aufgaben.
Lean Collab ist ein Open-Source-Orchestrator, der entwickelt wurde, um langfristige LLM-Aufgaben mit koordinierten, parallelen Unteragenten zu verwalten.

GuppyLM: Ein 9-Millionen-Parameter-LLM, das zu Bildungszwecken von Grund auf entwickelt wurde
GuppyLM ist ein Sprachmodell mit ~9M Parametern, das von Grund auf mit 60K synthetischen Gesprächen trainiert wurde. Es verwendet eine einfache Transformer-Architektur mit 6 Schichten, 384 versteckten Dimensionen und 6 Aufmerksamkeitsköpfen. Das Training dauert etwa 5 Minuten auf einer kostenlosen Colab T4 GPU, und es spricht mit einer Fisch-Persönlichkeit, die sich auf Wasser, Futter und Aquarienleben konzentriert.