Interfaze : Une nouvelle architecture de modèle surpasse Gemini-3-Flash et GPT-5.4-Mini sur les tâches déterministes

Interfaze est une nouvelle architecture de modèle développée par Interfaze qui fusionne des modèles DNN/CNN spécialisés par tâche avec des omni-transformeurs, visant des tâches déterministes à haute précision à grande échelle. Elle offre une fenêtre de contexte de 1 million de tokens, un maximum de 32 000 tokens de sortie et prend en charge les entrées texte, image, audio et fichier avec raisonnement optionnel.
Résultats des benchmarks
Selon leurs benchmarks, Interfaze mène face aux modèles de gamme de prix similaire (modèles Flash/mini comme Gemini-3-Flash, GPT-5.4-Mini, Claude Sonnet 4.6 et Grok-4.3) sur 9 tests en tête-à-tête :
- OCRBench V2 : Interfaze 70,7 % vs Gemini-3-Flash 55,8 %, Claude-Sonnet-4.6 54,7 %, GPT-5.4-Mini 52,7 %, Grok-4.3 54,7 %
- olmOCR : Interfaze 85,7 % vs Gemini-3-Flash 75,3 %, Claude-Sonnet-4.6 73,9 %, GPT-5.4-Mini 80,1 %, Grok-4.3 81,9 %
- RefCOCO : Interfaze 82,1 % vs Gemini-3-Flash 75,2 %, Claude-Sonnet-4.6 75,5 %, GPT-5.4-Mini 67,0 %, Grok-4.3 25,0 %
- VoxPopuli (WER, plus bas = meilleur) : Interfaze 2,4 % vs Gemini-3-Flash 4,0 %
- Spider 2.0-Lite : Interfaze 52,9 % vs Gemini-3-Flash 45,2 %, Claude-Sonnet-4.6 49,6 %, GPT-5.4-Mini 26,7 %, Grok-4.3 45,9 %
- GPQA Diamond : Interfaze 89,9 % vs Gemini-3-Flash 88,5 %, Claude-Sonnet-4.6 89,9 %, GPT-5.4-Mini 82,8 %, Grok-4.3 73,6 %
- MMMLU : Interfaze 90,9 % vs Gemini-3-Flash 88,7 %, Claude-Sonnet-4.6 84,9 %, GPT-5.4-Mini 75,3 %, Grok-4.3 89,7 %
- MMMU-Pro : Interfaze 71,1 % vs Gemini-3-Flash 67,6 %, Claude-Sonnet-4.6 46,3 %, GPT-5.4-Mini 40,4 %, Grok-4.3 68,7 %
- SOB Value Acc : Interfaze 79,5 % vs Gemini-3-Flash 77,3 %, Claude-Sonnet-4.6 77,9 %, GPT-5.4-Mini 75,1 %, Grok-4.3 78,4 %
Interfaze surpasse également des fournisseurs spécialisés en OCR comme Chandra OCR et Reducto, selon la source.
Tarification
Interfaze est proposé à 1,50 $ par million de tokens en entrée et 3,50 $ par million de tokens en sortie — aligné sur Gemini-3-Flash.
À qui cela s'adresse
Les développeurs construisant des pipelines à grand volume d'OCR, d'extraction de documents, de recherche web, de transcription audio/diarisation des locuteurs, de traduction ou de détection d'objets/interfaces GUI qui ont besoin de précision déterministe sans le coût des LLM complets.
📖 Lire la source complète : HN AI Agents
👀 See Also

Statespace : Créez des applications Web interactives pour les agents OpenClaw avec Markdown
Statespace est un framework gratuit et open-source pour créer et partager des applications web conviviales pour l'IA, que les agents OpenClaw peuvent naviguer et avec lesquelles ils peuvent interagir en utilisant du Markdown pur. Il vous permet de définir des outils, des composants et des instructions dans des fichiers Markdown auxquels les agents accèdent via HTTP.

Open-Sourcé le-vibe-stack : Règles Markdown pour Maintenir la Cohérence du Code Claude
Un développeur a rendu open-source 'the-vibe-stack' — un ensemble de règles Markdown conçues pour maintenir Claude Code sur la bonne voie lors de longues sessions en imposant un schéma rigide. Cette approche vise à réduire la dérive logique et le gaspillage de tokens tout en garantissant une sortie prévisible.

L'extension Compass pour Chrome ajoute des outils de navigation à Claude et ChatGPT
Un développeur a créé une extension Chrome gratuite appelée Compass qui ajoute une mini-carte de prompts, des en-têtes de défilement fixes, des listes de contrôle de session et des modèles de création de prompts aux interfaces Claude et ChatGPT pour résoudre les problèmes de navigation dans les conversations longues.

Envoyez un message à vos autres sessions Claude Code : messagerie inter-sessions
Claude Code v2.1.224+ permet à Claude d'envoyer des messages entre vos sessions pour coordonner le travail parallèle, partager les découvertes et avertir des changements cassants sans copier-coller.