KubeShark: Eine Kubernetes-Fähigkeit für Claude Code und Codex, um halluziniertes YAML abzufangen

Lukas Niessen hat KubeShark entwickelt, eine Kubernetes-Fähigkeit für Claude Code und Codex, die ein spezifisches Problem angeht: LLMs halluzinieren beim Schreiben von Kubernetes-YAML. Sie generieren veraltete API-Versionen, vergessen Sicherheitskontexte, erstellen Services, die keine Pods auswählen, konfigurieren Probes falsch, lassen Ressourcenanfragen weg und produzieren Rollouts, die gültig aussehen, aber unter Last versagen. Kubernetes ist hier unnachgiebig – ein falscher Service-Selector oder eine defekte Liveness-Probe werden erfolgreich angewendet, verursachen aber stille Ausfälle oder Pod-Neustarts.
Fehlermodus-zuerst-Workflow
KubeShark ist keine Ansammlung bewährter Verfahren. Bevor YAML generiert wird, muss der Agent darüber nachdenken, was in sechs Fehlerdomänen schiefgehen kann:
- Unsicher Workload-Standards
- Ressourcenverknappung
- Netzwerkfreigabe
- Berechtigungsausbreitung
- Fragile Rollouts
- API-Abweichung
Erst nach dieser Überlegung werden Manifests, Helm-Charts, Kustomize-Overlays, RBAC, NetworkPolicies oder Validierungsschritte erstellt. Die Idee ist, betriebliche Details unvermeidbar zu machen, anstatt sie zu überspringen.
Spezifische erkannte Fehler
- Service-Selector, der nicht zu Deployment-Labels passt
- Ingress mit einer in modernem Kubernetes entfernten API-Version
- Deployment, das als root läuft, ohne Sicherheitskontext
- Liveness-Probe, die eine externe Datenbank prüft
- ClusterRoleBinding, wo ein RoleBinding ausreichen würde
- StatefulSet, das annimmt, dass PVCs beim Verkleinern verschwinden
- Helm-Template, das gültiges YAML mit falscher Kubernetes-API rendert
- Kustomize-Patch, das stillschweigend die falsche Ressource anvisiert
Token-effiziente Architektur
Die Hauptdatei SKILL.md von KubeShark bleibt kompakt und prozedural. Tieferes Wissen liegt in fokussierten Referenzdateien, die nur bei Bedarf geladen werden – zum Beispiel lädt Probe-Anleitung keine RBAC-Regeln, und Helm-Aufgaben laden keine NetworkPolicy-Anleitung. Dadurch wird Token-Verschwendung vermieden und die Wahrscheinlichkeit verringert, dass der Agent unzusammenhängende Konzepte vermischt.
Die Fähigkeit unterstützt auch plattformspezifische Kontexte über Conditional Reference Retrieval. Sie erkennt Signale wie IRSA, Karpenter, Azure Workload Identity, GKE Autopilot, OpenShift Routes, ApplicationSet, HelmRelease, ServiceMonitor oder OpenTelemetry Collector und lädt dann die passende Referenz. Dies ermöglicht EKS-bewusste, AKS-bewusste, GKE-bewusste, OpenShift-bewusste, GitOps-bewusste oder observability-bewusste Manifest-Generierung und -Überprüfung – nur wenn der Kontext relevant ist.
Die Voreinstellungen tendieren zur Sicherheit: Pod-Sicherheitsstandards, Ressourcenübergreifende Konsistenzprüfungen, Label/Selector/Port-Ausrichtung, Vermeidung veralteter APIs und Rollback-Anleitung sind eingebaut.
Zielgruppe
Plattformingenieure, SREs, DevOps-Ingenieure und alle, die Claude Code oder Codex für Kubernetes-Arbeiten verwenden.
📖 Lies die vollständige Quelle: r/openclaw
👀 Siehe auch

Murmur: Ein Open-Source-Cron-Daemon zur Automatisierung von Claude-Code-Sitzungen
Murmur ist ein Cron-Daemon, der Claude-Code-Sitzungen plant und automatisiert mithilfe einer HEARTBEAT.md-Datei zur Konfiguration.
Bonsai 2 (Qwen 3.8 27B) als OpenClaw-Fallback: 8 GB, 85 tok/s auf einer 5070
Ein r/openclaw-Nutzer hat PrismMLs Ternary Bonsai 2 (Qwen 3.8 27B) als OpenClaw-Fallback-Modell eingesetzt – ~8 GB auf der Festplatte, 85 tok/s Output auf einer 5070, Text plus Vision und agentische Browser-/VM-Aufgaben, die überzeugen.

Künstliches Leben: Eine 300-zeilige Python-Reproduktion der Computational-Life-Forschung
Eine Python-Implementierung, die das Computational-Life-Papier reproduziert, bei der ein 240x135-Raster aus Brainfuck-ähnlichen Programmen interagiert und sich selbst replizierenden Code durch zufällige Paarung und Verkettung von Instruktionsbändern entwickelt.

Google Gemma 4 26B-A4B lokal mit LM Studio 0.4.0 Headless CLI ausführen
LM Studio 0.4.0 führt llmster und die lms CLI für lokale Modellinferenz ohne Benutzeroberfläche ein. Der Artikel beschreibt die Einrichtung von Googles Gemma 4 26B-A4B MoE-Modell auf einem MacBook Pro M4 Pro, wobei 51 Token/Sekunde mit 48 GB vereinheitlichtem Speicher erreicht werden.