Eä: Ein SIMD-Compiler für Python, geschrieben in Rust

Was Eä macht
Eä ist ein Compiler für SIMD-Kernel, der ein häufiges Workflow-Problem löst: Python-Code schreiben, Profiling durchführen, um Engpässe zu finden, in C umschreiben, mit ctypes kämpfen, Pointer debuggen und schließlich eine 5-fache Beschleunigung zu erreichen – nur um den Prozess in der nächsten Woche zu wiederholen.
Wie es funktioniert
Mit Eä:
- Schreiben Sie eine kleine .ea-Datei
- Führen Sie einen Befehl aus
- Rufen Sie es aus Python wie eine normale Funktion auf
Der Kernel läuft mit nativer vektorisierter Geschwindigkeit. Beispielnutzung:
import ea
kernel = ea.load("fma.ea")
result = kernel.fma_f32x8(a, b, c, out) # 6,6× schneller als NumPy
Technische Details
Der Compiler generiert:
- Shared Library
- Python-Wrapper
- Außerdem Rust-, C++-, PyTorch- und CMake-Bindings
Zielarchitekturen:
- x86-64 (AVX2 / AVX-512)
- AArch64 (NEON)
Der Compiler selbst:
- ~12.000 Zeilen Rust-Code
- 475 Tests
- Keine ctypes, Header-Dateien oder Build-System erforderlich
Entwicklungskontext
Der Entwickler hat Eä mit Hilfe von KI-Modellen erstellt, wobei Claude die schwere Arbeit übernahm, während die architektonische Kontrolle erhalten blieb. Die zentrale Erkenntnis war, dass die Handhabung des gesamten "Glue-Code" wichtiger ist als SIMD selbst, sodass Entwickler sich nur auf den Kernel konzentrieren können.
Benchmarks
Benchmarks zeigen eine 6,6-fache Leistungssteigerung gegenüber NumPy für das fma_f32x8-Beispiel. Der Entwickler merkt an, dass diese von einem recht einfachen Setup stammen, aber versucht hat, die Bedingungen fair und reproduzierbar zu halten.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Homelab AI Sentinel: Selbst gehosteter Überwachungsassistent mit LLM-Integration
Homelab AI Sentinel ist ein selbst gehostetes Tool, das Überwachungs-Webhooks über ein LLM verarbeitet, um Diagnosen in einfachem Englisch zu generieren. Es unterstützt 11 Alarmquellen, 10 Benachrichtigungsplattformen und funktioniert mit jedem OpenAI-kompatiblen Endpunkt, einschließlich Ollama und LM Studio für lokale Inferenz.

Entwickler baut Scheme-Compiler zu WASM mithilfe von KI in 4 Tagen
Ein Entwickler erstellte Puppy Scheme, einen Scheme-Compiler, der WebAssembly als Ziel hat, in etwa 4 Tagen mit KI-Unterstützung. Der Compiler unterstützt 73 % von R5RS und R7RS, nutzt WASM GC und erreichte Verbesserungen der Kompilierzeit von 3½ Minuten auf 11 Sekunden über Nacht.
Mergetrain: Eine lokale Merge-Warteschlange für parallele Claude-Code-Sitzungen, die überschriebene Pushes verhindert
Mergetrain ist eine lokale Merge-Warteschlange, die verhindert, dass parallele Claude Code-Sitzungen gegenseitig ihre Pushs überschreiben. Sie verwendet Worktrees, einen Pre-Push-Hook und einen einzelnen Runner, der Branches zu einem Zug zusammenstellt, Tests ausführt und dann atomar pusht.
Aufbau einer Jarvis-ähnlichen KI mit MCP und offenen Modellen
Ein Entwickler baute einen persönlichen KI-Assistenten mit MCP und offenen Modellen wie Qwen3-Coder 480B, mit autonomer Dateibearbeitung, persistentem Kontext und hybridem lokalen/Cloud-Inferenz.