SkillOpt: Optimierung von Markdown-Fähigkeitsdateien als trainierbare Parameter für KI-Agenten

✍️ OpenClawRadar📅 Veröffentlicht: 27. Mai 2026🔗 Source
SkillOpt: Optimierung von Markdown-Fähigkeitsdateien als trainierbare Parameter für KI-Agenten
Ad

SkillOpt ist ein neues Optimierungs-Framework, das Markdown-Skill-Dateien als trainierbare Parameter behandelt und die Ad-hoc-Skill-Bearbeitung, die viele Agent-Entwickler bereits durchführen, mit richtiger Optimierungsmethodik versieht. Das Papier (arxiv.org/pdf/2605.23904) formalisiert einen Prozess: Ein Frontier-Modell schlägt begrenzte Änderungen (Hinzufügen/Löschen/Ersetzen) an Markdown-Skill-Dateien vor, und jede Änderung wird gegen einen zurückgehaltenen Validierungssatz geprüft. Nur strikte Verbesserungen werden akzeptiert; Gleichstände werden abgelehnt, und abgelehnte Änderungen dienen als negatives Signal für nachfolgende Runden.

Wichtigste Erkenntnisse

  • Konvergenz: Die besten Skills konvergieren mit 1 bis 4 akzeptierten Änderungen aus vielen weiteren Vorschlägen. Ein Änderungsbudget von 4 bis 8 pro Schritt funktioniert am besten; wenn die Obergrenze entfernt wird, bricht die Leistung ein.
  • Skill-Größe: Der mediane endgültige Skill hat ~920 Tokens.
  • Modellübertragung: Ein auf Codex optimierter Skill wurde ohne Änderung auf Claude Code übertragen und erzielte +59,7 auf SpreadsheetBench. GPT 4.1 Nano mit einem optimierten Skill erreichte in etwa die Leistung von Frontier-Modellen bei prozeduralen Benchmarks.
Ad

Einschränkungen

Das Validierungs-Gate erfordert einen automatischen Bewerter mit klaren korrekten Antworten. Dies funktioniert für Code und Tabellenkalkulationen, versagt jedoch bei allem Offenen.

Für wen es gedacht ist

Entwickler, die KI-Codierungsagenten bauen und Skill-Dateien systematisch optimieren möchten, anstatt sich auf manuelle Iteration oder Ad-hoc-Prompt-Engineering zu verlassen.

📖 Vollständige Quelle lesen: r/LocalLLaMA

Ad

👀 Siehe auch

Creation OS: Ein lokaler σ-gesteuerter LLM-Laufzeit, der Modelle sagen lässt „Ich weiß es nicht“ statt zu halluzinieren
Werkzeuge

Creation OS: Ein lokaler σ-gesteuerter LLM-Laufzeit, der Modelle sagen lässt „Ich weiß es nicht“ statt zu halluzinieren

Creation OS umhüllt lokale LLMs (BitNet, Qwen, Gemma, beliebige GGUF) mit einem σ-Gate, das mehrere Unsicherheitskanäle misst und pro Ausgabe ACCEPT, RETHINK oder ABSTAIN entscheidet. Keine Cloud, keine API. Die Genauigkeit bei TruthfulQA verbesserte sich durch selektive Regeneration um ~29%.

OpenClawRadar
NGX-OS: Netzwerkbetriebssystem für KI entwickelt mit eBPF und MCP-Integration
Werkzeuge

NGX-OS: Netzwerkbetriebssystem für KI entwickelt mit eBPF und MCP-Integration

NGX-OS ist ein Netzwerkbetriebssystem, das von Grund auf für die KI-Integration entwickelt wurde und eBPF für Echtzeit-Telemetrie sowie MCP für den direkten Zugriff von LLMs auf Netzwerkstatusdaten ohne Übersetzungsschichten nutzt.

OpenClawRadar
Ausführen von OpenClaw und Codex CLI nativ auf Android über AnyClaw APK
Werkzeuge

Ausführen von OpenClaw und Codex CLI nativ auf Android über AnyClaw APK

Ein Entwickler hat OpenClaw und Codex CLI in eine Android-APK namens AnyClaw verpackt, wodurch das Gateway und die Control-UI lokal auf ARM64-Android-Geräten ab Version 7.0 ohne Root-Zugriff laufen können. Das Projekt erforderte das Kompilieren von Abhängigkeiten aus dem Quellcode und das Patchen mehrerer Komponenten, um Android-spezifische Einschränkungen zu bewältigen.

OpenClawRadar
Pangolin: Open-Source identitätsbasierte VPN als ZTNA-Alternative
Werkzeuge

Pangolin: Open-Source identitätsbasierte VPN als ZTNA-Alternative

Pangolin ist ein Open-Source-VPN, das sich auf identitätsbasierten Fernzugriff konzentriert und eine Alternative zu Cloudflare ZTNA, Zscaler und Twingate bietet.

OpenClawRadar