Interfaze: Neue Modellarchitektur übertrifft Gemini-3-Flash und GPT-5.4-Mini bei deterministischen Aufgaben

✍️ OpenClawRadar📅 Veröffentlicht: 11. Mai 2026🔗 Source
Interfaze: Neue Modellarchitektur übertrifft Gemini-3-Flash und GPT-5.4-Mini bei deterministischen Aufgaben
Ad

Interfaze ist eine neue Modellarchitektur von Interfaze, die aufgabenspezifische DNN/CNN-Modelle mit Omni-Transformatoren vereint und auf hochpräzise deterministische Aufgaben in großem Maßstab abzielt. Es bietet ein Kontextfenster von 1 Million Token, maximal 32.000 Ausgabetoken und unterstützt Text-, Bild-, Audio- und Dateieingaben mit optionalem Reasoning.

Benchmark-Ergebnisse

Laut ihren Benchmarks liegt Interfaze in 9 direkten Vergleichen vor ähnlich teuren Modellen (Flash-/Mini-Modelle wie Gemini-3-Flash, GPT-5.4-Mini, Claude Sonnet 4.6 und Grok-4.3):

  • OCRBench V2: Interfaze 70,7 % vs. Gemini-3-Flash 55,8 %, Claude-Sonnet-4.6 54,7 %, GPT-5.4-Mini 52,7 %, Grok-4.3 54,7 %
  • olmOCR: Interfaze 85,7 % vs. Gemini-3-Flash 75,3 %, Claude-Sonnet-4.6 73,9 %, GPT-5.4-Mini 80,1 %, Grok-4.3 81,9 %
  • RefCOCO: Interfaze 82,1 % vs. Gemini-3-Flash 75,2 %, Claude-Sonnet-4.6 75,5 %, GPT-5.4-Mini 67,0 %, Grok-4.3 25,0 %
  • VoxPopuli (WER, niedriger ist besser): Interfaze 2,4 % vs. Gemini-3-Flash 4,0 %
  • Spider 2.0-Lite: Interfaze 52,9 % vs. Gemini-3-Flash 45,2 %, Claude-Sonnet-4.6 49,6 %, GPT-5.4-Mini 26,7 %, Grok-4.3 45,9 %
  • GPQA Diamond: Interfaze 89,9 % vs. Gemini-3-Flash 88,5 %, Claude-Sonnet-4.6 89,9 %, GPT-5.4-Mini 82,8 %, Grok-4.3 73,6 %
  • MMMLU: Interfaze 90,9 % vs. Gemini-3-Flash 88,7 %, Claude-Sonnet-4.6 84,9 %, GPT-5.4-Mini 75,3 %, Grok-4.3 89,7 %
  • MMMU-Pro: Interfaze 71,1 % vs. Gemini-3-Flash 67,6 %, Claude-Sonnet-4.6 46,3 %, GPT-5.4-Mini 40,4 %, Grok-4.3 68,7 %
  • SOB Value Acc: Interfaze 79,5 % vs. Gemini-3-Flash 77,3 %, Claude-Sonnet-4.6 77,9 %, GPT-5.4-Mini 75,1 %, Grok-4.3 78,4 %

Interfaze übertrifft laut Quelle auch spezialisierte OCR-Anbieter wie Chandra OCR und Reducto.

Ad

Preise

Interfaze kostet 1,50 $ pro Million Eingabe-Token und 3,50 $ pro Million Ausgabe-Token – auf dem Niveau von Gemini-3-Flash.

Zielgruppe

Entwickler, die umfangreiche OCR-, Dokumentenextraktions-, Websuch-, Audio-Transkriptions-/Sprecher-Diarisierungs-, Übersetzungs- oder Objekt-/GUI-Erkennungspipelines erstellen und dabei deterministische Genauigkeit ohne die Kosten vollständiger LLMs benötigen.

📖 Vollständige Quelle lesen: HN AI Agents

Ad

👀 Siehe auch

Holaboss AI Runtime wechselt zu TypeScript, implementiert persistente MCP-Ports
Werkzeuge

Holaboss AI Runtime wechselt zu TypeScript, implementiert persistente MCP-Ports

Die Holaboss AI-Laufzeitumgebung für lokale Agenten wurde überarbeitet, um ausschließlich TypeScript zu verwenden, wodurch Python-Abhängigkeiten entfallen und die Bündelgröße reduziert wird. Sie speichert nun MCP-Server-Ports in SQLite mit UNIQUE(port)-Einschränkungen, um Konflikte bei Neustarts zu verhindern.

OpenClawRadar
Claude Code-Benutzer entwickelt NVM-Plugin zur Erfassung von Problemlösungskontext
Werkzeuge

Claude Code-Benutzer entwickelt NVM-Plugin zur Erfassung von Problemlösungskontext

Ein Entwickler hat ein Claude-Plugin namens nvm (non-volatile memory) erstellt, das den Claude-Sitzungsverlauf in Markdown-Karten umwandelt, die Problemlösungsentscheidungen und wiederverwendbare Erkenntnisse dokumentieren. Das Tool behebt das Problem, den Überblick darüber zu verlieren, wie Probleme gelöst wurden, wenn man KI-Codierungsassistenten nutzt.

OpenClawRadar
RelayPlane Open Source Proxy zeigt 73 % Kostensenkung durch Claude-Modell-Routing
Werkzeuge

RelayPlane Open Source Proxy zeigt 73 % Kostensenkung durch Claude-Modell-Routing

RelayPlane, ein Open-Source-npm-nativer Proxy für die Anthropic API, zeigte in Benchmarks 73,4 % Kosteneinsparungen, indem Anfragen basierend auf der Komplexität an geeignete Claude-Modelle weitergeleitet wurden. Das Tool reduzierte die Kosten pro 10 Anfragen von 0,0323 $ auf 0,0086 $ und verbesserte gleichzeitig die p50-Latenz von 1,55 s auf 0,78 s.

OpenClawRadar
Apideck CLI: Eine Low-Context-Alternative zu MCP für KI-Agenten
Werkzeuge

Apideck CLI: Eine Low-Context-Alternative zu MCP für KI-Agenten

Apideck CLI ist eine KI-Agent-Schnittstelle, die etwa 80 Tokens für ihren Agenten-Prompt verwendet, anstatt Zehntausende für Werkzeugschemata, und adressiert damit das Kontextfenster-Verbrauchsproblem von MCP. Benchmarks zeigen, dass MCP für identische Operationen 4- bis 32-mal mehr Tokens kosten kann als die CLI.

OpenClawRadar