GoModel : Une passerelle d'IA légère et open-source écrite en Go

GoModel est une passerelle IA open-source écrite en Go qui s'intercale entre votre application et les fournisseurs de modèles comme OpenAI, Anthropic, Gemini et d'autres. Elle fournit une interface API unifiée compatible OpenAI tout en gérant en interne les différences spécifiques à chaque fournisseur.
Fonctionnalités clés et différences
Le projet a été conçu pour résoudre plusieurs problèmes pratiques : suivre l'utilisation et les coûts de l'IA par client ou équipe, changer de modèles sans modifier le code de l'application, déboguer plus facilement les flux de requêtes et réduire les dépenses en IA grâce à une mise en cache exacte et sémantique.
Différenciateurs clés par rapport aux alternatives :
- Image Docker d'environ 17 Mo (celle de LiteLLM fait environ 746 Mo sur amd64, ce qui rend GoModel 44 fois plus léger)
- Le flux de travail des requêtes est visible et facile à inspecter
- La configuration privilégie par défaut les variables d'environnement
Démarrage rapide
Déploiement de base avec Docker :
docker run --rm -p 8080:8080 \
-e OPENAI_API_KEY="your-openai-key" \
enterpilot/gomodel
Pour la production, évitez de passer les secrets via la ligne de commande et utilisez :
docker run --env-file .env enterpilot/gomodel
Effectuez votre premier appel API :
curl http://localhost:8080/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{ "model": "gpt-5-chat-latest", "messages": [{"role": "user", "content": "Bonjour !"}] }'
Fournisseurs pris en charge
GoModel prend en charge plusieurs fournisseurs de LLM avec une détection automatique basée sur les identifiants fournis :
- OpenAI (OPENAI_API_KEY)
- Anthropic (ANTHROPIC_API_KEY)
- Google Gemini (GEMINI_API_KEY)
- Groq (GROQ_API_KEY)
- OpenRouter (OPENROUTER_API_KEY)
- Z.ai (ZAI_API_KEY)
- xAI/Grok (XAI_API_KEY)
- Azure OpenAI (AZURE_API_KEY + AZURE_BASE_URL)
- Oracle (ORACLE_API_KEY + ORACLE_BASE_URL)
- Ollama (OLLAMA_BASE_URL)
La passerelle prend en charge les complétions de chat, les embeddings, le traitement de fichiers, les opérations par lots et les capacités de passage à travers la plupart des fournisseurs. Pour Oracle, vous devrez peut-être définir ORACLE_MODELS=openai.gpt-oss-120b,xai.grok-3 lorsque le point de terminaison /models en amont n'est pas disponible.
Méthodes d'installation alternatives
Vous pouvez également l'exécuter à partir des sources (Go 1.26.2+ requis) ou utiliser Docker Compose pour les composants d'infrastructure, notamment Redis, PostgreSQL, MongoDB et Adminer.
Ce type de passerelle est particulièrement utile pour les équipes gérant plusieurs modèles d'IA auprès de différents fournisseurs, ayant besoin d'un suivi des coûts ou souhaitant conserver la flexibilité de changer de fournisseur sans modifier le code. L'image Docker légère la rend adaptée aux environnements aux ressources limitées.
📖 Lire la source complète : HN LLM Tools
👀 See Also

Knowledge Raven : Une plateforme de base de connaissances agnostique en modèles, construite avec Claude Code
Knowledge Raven est une plateforme de base de connaissances qui permet à tout LLM compatible MCP de rechercher et citer des documents d'entreprise. L'ensemble de la plateforme a été construit avec Claude Code par un fondateur solo, avec un backend Python/FastAPI, une couche d'outils MCP et un pipeline RAG agentique.

Support officiel de Kotlin pour VS Code désormais en alpha — Propulsé par le serveur de langage d'IntelliJ
JetBrains a publié l'extension officielle Kotlin pour VS Code en version Alpha, basée sur le serveur de langage Kotlin construit sur l'infrastructure d'analyse de code d'IntelliJ IDEA. Elle inclut la complétion de code, les diagnostics, la navigation, les correctifs rapides, le formatage et l'import de projet.

Parlez avec Claw : Interface Vocale iOS Open Source pour les Bots OpenClaw Telegram
Une application iOS open source qui permet une interaction vocale avec les bots Telegram alimentés par OpenClaw. L'application envoie l'audio à un serveur Mac local pour traitement, avec des réponses retournées sous forme de texte et d'audio.

Développeur construit un cadre d'IA avec 17 principes biologiques en utilisant Claude Code
Un développeur a créé un framework d'IA appelé Cognitive Sparks en implémentant 17 principes biologiques comme le seuil de déclenchement et la plasticité hébbienne, inspiré du livre de 1999 'Sparks of Genius'. L'ensemble du projet—22 documents de conception et 3 300 lignes de code—a été construit en un jour en utilisant Claude Code, sans aucune ligne de code écrite par un humain.