Bin ich OpenAI-kompatibel: Tool & Dokumentation für einheitliche API-Signaturen

Ein Reddit-Nutzer hat ein Tool und eine Dokumentationsseite namens 'Am I OpenAI compatible' veröffentlicht, die auflistet, welche großen Open-Source-KI-Projekte die API-Signaturen von OpenAI einhalten. Das Projekt entstand aufgrund von Inkonsistenzen zwischen Engines wie vLLM und llama.cpp, die denselben Endpunkt oft unterschiedlich implementieren.
Wichtige Details
Das Tool katalogisiert sowohl offizielle als auch inoffizielle API-Signaturen für jedes Projekt. Bei Modellen, bei denen Lücken in der OpenAI-Kompatibilität bestehen, wird 'ht-compatibility' als geerbter Standard eingeführt. Der Entwickler plant, optionale Anthropic-kompatible Signaturen und andere Erweiterungen hinzuzufügen.
Zwei Ressourcen sind verfügbar:
- GitHub-Repository: heiervang-technologies/am-i-openai-compatible
- Dokumentationsseite: ReadTheDocs
Der Entwickler weist darauf hin, dass das Tool nützlich ist, um LLM- und andere KI-Endpunkte in Apps einzubinden oder Proxy-/Middleware-Schichten zu erstellen. Entwickler, die eigene API-Schnittstellen erstellen, profitieren ebenfalls von den dokumentierten Signaturen, was die Integration in Agenten erleichtert.
Für wen es gedacht ist
Entwickler, die mit mehreren Open-Source-Inferenz-Engines arbeiten und eine zuverlässige Referenz für API-Kompatibilität benötigen, oder alle, die Middleware- oder Agentensysteme bauen, die mehrere Backends nutzen.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Vibe Hosting: Claude Code MCP-Integration für KI-gestützte Bereitstellung
NameOceans Vibe Hosting-Plattform integriert Claude Code MCP, um Projekte über natürliche Sprachbefehle zu erstellen und bereitzustellen. Der Service bietet kostenloses SSL, Domains, DNS und VPS-Einrichtung für statische Websites sowie Node.js-, Python-, Django- und Go-Anwendungen.

Memctl: Open-Source-MCP-Server für Persistent Memory in KI-Codierungsagenten
Memctl ist ein Open-Source-MCP-Server, der KI-Codierungsagenten persistenten Speicher über Sitzungen, Maschinen und IDEs hinweg bietet. Er wurde hauptsächlich mit Claude Code in zwei Wochen entwickelt und speichert Projektkontext, um ihn in nachfolgenden Sitzungen wieder bereitzustellen.

Claude Code lädt Tool-Schemata per ToolSearch lazy, um Token zu sparen
Claude Code verschiebt das Laden von Tool-Schemata, indem nur die Tool-Namen vorab gesendet werden und ein ToolSearch-Aufruf erforderlich ist, um die Schemata vor der Nutzung zu laden. Diese Architektur reduziert den Token-Verbrauch erheblich.

GLM-5.1 vs MiniMax M2.7: Leistungsvergleich für KI-Coding-Agenten
GLM-5.1 erreicht SWE-bench-Verified 77,8 und Terminal Bench 2.0 56,2 Punkte, die höchsten unter Open-Source-Modellen, während MiniMax M2.7 schnelle Antworten mit niedrigem TTFT und hohem Durchsatz bietet, ideal für CI-Bots und Batch-Bearbeitungen.