Ollamas technische Probleme und Kontroversen in der Community

✍️ OpenClawRadar📅 Veröffentlicht: 18. April 2026🔗 Source
Ollamas technische Probleme und Kontroversen in der Community
Ad

Ollamas Kerntechnologie und Zuschreibungsprobleme

Ollamas gesamte Inferenzfähigkeit stammte ursprünglich von llama.cpp, der C++-Inferenz-Engine, die Georgi Gerganov im März 2023 erstellt hat. Über ein Jahr lang enthielt Ollamas README keine Erwähnung von llama.cpp, und ihre Binärdistributionen enthielten nicht die erforderliche MIT-Lizenznotiz für den llama.cpp-Code, den sie auslieferten.

Die Community eröffnete im Frühjahr 2024 das GitHub-Issue #3185 mit der Bitte um Lizenzkonformität, das über 400 Tage lang ohne Antwort der Maintainer blieb. Als im April 2024 das Issue #3697 speziell zur Anerkennung von llama.cpp eröffnet wurde, fügte Ollamas Mitgründer Michael Chiang schließlich eine einzige Zeile am Ende der README hinzu: "llama.cpp-Projekt gegründet von Georgi Gerganov."

Technische Probleme mit dem eigenen Backend

Mitte 2025 entfernte sich Ollama von der Verwendung von llama.cpp als Inferenz-Backend und baute eine eigene Implementierung direkt auf ggml auf. Dieses eigene Backend führte Fehler wieder ein, die llama.cpp bereits vor Jahren gelöst hatte, darunter:

  • Defekte Unterstützung für strukturierte Ausgaben
  • Fehler bei Vision-Modellen
  • GGML-Assertion-Abstürze über mehrere Versionen hinweg
  • Modelle, die im Upstream llama.cpp einwandfrei funktionierten, versagten in Ollama
  • Fehlende Unterstützung für Tensor-Typen, die für neue Versionen wie GPT-OSS 20B erforderlich sind

Georgi Gerganov stellte fest, dass Ollama GGML geforkt und schlechte Änderungen vorgenommen hatte.

Ad

Leistungsbenchmarks

Mehrere Community-Tests zeigen, dass llama.cpp auf derselben Hardware mit demselben Modell 1,8-mal schneller läuft als Ollama:

  • 161 Token pro Sekunde gegenüber 89 Token pro Sekunde
  • Auf der CPU beträgt die Leistungslücke 30-50 %
  • Ein kürzlicher Vergleich bei Qwen-3 Coder 32B zeigte ~70 % höheren Durchsatz mit llama.cpp

Der Leistungsaufwand kommt von Ollamas Daemon-Schicht, schlechten GPU-Offloading-Heuristiken und einem mitgelieferten Backend, das dem Upstream hinterherhinkt.

Probleme mit der Modellbenennung

Als DeepSeek im Januar 2025 seine R1-Modellfamilie veröffentlichte, listete Ollama die kleineren destillierten Versionen (Modelle wie DeepSeek-R1-Distill-Qwen-32B) auf, ohne klar anzugeben, dass es sich um destillierte und nicht um die Vollversionen handelte.

📖 Read the full source: HN LLM Tools

Ad

👀 Siehe auch

QCAI Mobile App fügt OpenClaw-Gateway-Steuerung mit nativer Tailscale-VPN-Unterstützung hinzu
Werkzeuge

QCAI Mobile App fügt OpenClaw-Gateway-Steuerung mit nativer Tailscale-VPN-Unterstützung hinzu

QCAI für iOS und Android integriert nun OpenClaw Control Center, ermöglicht direkte Gateway-Verwaltung von Mobilgeräten über sichere Tailscale-VPN-Tunnel ohne offene Ports.

OpenClawRadar
Alibis monatlicher 10-Dollar-Codierplan bietet OpenClaw-Nutzern umfangreichen Zugang zu mehreren KI-Modellen.
Werkzeuge

Alibis monatlicher 10-Dollar-Codierplan bietet OpenClaw-Nutzern umfangreichen Zugang zu mehreren KI-Modellen.

Für 10 US-Dollar pro Monat bietet Alibabas Plan Zugang zu den Modellen Qwen3.5-Plus, Kimi-K2.5, GLM-5 und MiniMax-M2.5 mit Kontingenten von 1.200 Anfragen pro 5 Stunden, 9.000 pro Woche und 18.000 pro Monat.

OpenClawRadar
Codeset verbessert Codierungsagenten mit repositoriums-spezifischem Kontext aus dem Git-Verlauf.
Werkzeuge

Codeset verbessert Codierungsagenten mit repositoriums-spezifischem Kontext aus dem Git-Verlauf.

Codeset generiert statische Dateien aus dem Git-Verlauf, die Kontextinformationen wie frühere Fehler, Ursachen und Co-Change-Beziehungen liefern. Tests zeigten eine Verbesserung von 5,3 Prozentpunkten bei codeset-gym-python und 2 Prozentpunkten bei SWE-Bench Pro mit OpenAI Codex.

OpenClawRadar
Kostenlose Version von Karpathys Coding-Skills neu geschrieben, schaltet Claude Coding-Disziplin ohne Pro frei
Werkzeuge

Kostenlose Version von Karpathys Coding-Skills neu geschrieben, schaltet Claude Coding-Disziplin ohne Pro frei

Ein Reddit-Nutzer hat Karpathys Programmierdisziplin-Richtlinien für den kostenlosen Plan von Claude umgeschrieben und dabei Terminal- und Subagent-Abhängigkeiten entfernt. Der System-Prompt löst sich automatisch bei Programmieranfragen aus und erzwingt ein verifikationsorientiertes Denken.

OpenClawRadar