GoModel: Ein leichtgewichtiges Open-Source-AI-Gateway, geschrieben in Go

✍️ OpenClawRadar📅 Veröffentlicht: 21. April 2026🔗 Source
GoModel: Ein leichtgewichtiges Open-Source-AI-Gateway, geschrieben in Go
Ad

GoModel ist ein in Go geschriebenes Open-Source-AI-Gateway, das zwischen Ihrer Anwendung und Modellanbietern wie OpenAI, Anthropic, Gemini und anderen sitzt. Es bietet eine einheitliche OpenAI-kompatible API-Schnittstelle, während es anbieterspezifische Unterschiede intern verarbeitet.

Wichtige Funktionen und Unterschiede

Das Projekt wurde entwickelt, um mehrere praktische Probleme zu lösen: Nachverfolgung der KI-Nutzung und Kosten pro Kunde oder Team, Wechsel von Modellen ohne Änderung des Anwendungscodes, einfachere Fehlersuche im Anfragefluss und Reduzierung der KI-Ausgaben durch exakte und semantische Zwischenspeicherung.

Wesentliche Unterscheidungsmerkmale zu Alternativen:

  • ~17 MB großes Docker-Image (LiteLLMs Image ist ~746 MB auf amd64, wodurch GoModel 44-mal leichter ist)
  • Anfrage-Workflow ist sichtbar und leicht zu überprüfen
  • Konfiguration ist standardmäßig umgebungsvariablenbasiert

Schnellstart

Grundlegende Bereitstellung mit Docker:

docker run --rm -p 8080:8080 \
  -e OPENAI_API_KEY="your-openai-key" \
  enterpilot/gomodel

Für den Produktionseinsatz sollten Sie Geheimnisse nicht über die Befehlszeile übergeben und stattdessen verwenden:

docker run --env-file .env enterpilot/gomodel

Stellen Sie Ihren ersten API-Aufruf:

curl http://localhost:8080/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{ "model": "gpt-5-chat-latest", "messages": [{"role": "user", "content": "Hello!"}] }'
Ad

Unterstützte Anbieter

GoModel unterstützt mehrere LLM-Anbieter mit automatischer Erkennung basierend auf den bereitgestellten Zugangsdaten:

  • OpenAI (OPENAI_API_KEY)
  • Anthropic (ANTHROPIC_API_KEY)
  • Google Gemini (GEMINI_API_KEY)
  • Groq (GROQ_API_KEY)
  • OpenRouter (OPENROUTER_API_KEY)
  • Z.ai (ZAI_API_KEY)
  • xAI/Grok (XAI_API_KEY)
  • Azure OpenAI (AZURE_API_KEY + AZURE_BASE_URL)
  • Oracle (ORACLE_API_KEY + ORACLE_BASE_URL)
  • Ollama (OLLAMA_BASE_URL)

Das Gateway unterstützt Chat-Vervollständigungen, Einbettungen, Dateiverarbeitung, Batch-Operationen und Durchleitungsfunktionen bei den meisten Anbietern. Für Oracle müssen Sie möglicherweise ORACLE_MODELS=openai.gpt-oss-120b,xai.grok-3 setzen, wenn der Upstream-/models-Endpunkt nicht verfügbar ist.

Alternative Einrichtungsmethoden

Sie können es auch aus dem Quellcode ausführen (Go 1.26.2+ erforderlich) oder Docker Compose für Infrastrukturkomponenten wie Redis, PostgreSQL, MongoDB und Adminer verwenden.

Diese Art von Gateway ist besonders nützlich für Teams, die mehrere KI-Modelle über verschiedene Anbieter hinweg verwalten, Kostenverfolgung benötigen oder die Flexibilität bewahren möchten, Anbieter ohne Codeänderungen zu wechseln. Das schlanke Docker-Image macht es für ressourcenbeschränkte Umgebungen geeignet.

📖 Read the full source: HN LLM Tools

Ad

👀 Siehe auch

Claude Code fügt automatischen Modus für Berechtigungsentscheidungen hinzu
Werkzeuge

Claude Code fügt automatischen Modus für Berechtigungsentscheidungen hinzu

Claude Code verfügt jetzt über einen Automatikmodus, der Claude Entscheidungen über Berechtigungen überlässt, anstatt für jeden Dateischreibvorgang und jeden Bash-Befehl eine manuelle Genehmigung zu erfordern. Dieser Modus enthält Sicherheitsvorkehrungen, die jede Aktion vor der Ausführung überprüfen, wobei ein Klassifikator Werkzeugaufrufe auf potenziell zerstörerische Aktionen hin untersucht.

OpenClawRadar
🦀
Werkzeuge

xAI TTS-Integration für Home Assistant mit Claude erstellt — Vollständiges Repo

Ein Entwickler nutzte Claude, um eine benutzerdefinierte Home Assistant-Integration für xAIs TTS-API (Eve-Stimme) mit vollständiger UI-Konfiguration, fünf Stimmen und Sprach-Tags zu erstellen.

OpenClawRadar
Claw Code Agent: Python-Neuimplementierung der Claude-Code-Architektur für lokale Modelle
Werkzeuge

Claw Code Agent: Python-Neuimplementierung der Claude-Code-Architektur für lokale Modelle

Claw Code Agent ist eine Python-Neuimplementierung der Claude-Code-Agent-Architektur, die mit lokalen Open-Source-Modellen über OpenAI-kompatible Backends wie vLLM und Ollama läuft und Funktionen wie Tool-Aufrufe, Slash-Befehle und gestufte Berechtigungen bietet.

OpenClawRadar
Pali v0.1: Open-Source-Gedächtnisinfrastruktur für LLMs mit reproduzierbaren Benchmarks
Werkzeuge

Pali v0.1: Open-Source-Gedächtnisinfrastruktur für LLMs mit reproduzierbaren Benchmarks

Pali ist eine Open-Source-Speicherinfrastruktur für LLMs, die in Go als einzelne Binärdatei mit Multi-Tenant-APIs, hybridem Retrieval und Plug-and-Play-Erweiterungen entwickelt wurde. Das Release v0.1 enthält einen Benchmark-Suite mit reproduzierbaren Ergebnissen, die Leistungsmetriken für verschiedene Konfigurationen zeigen.

OpenClawRadar