Interfaz: Nueva arquitectura de modelo supera a Gemini-3-Flash y GPT-5.4-Mini en tareas deterministas

Interfaze es una nueva arquitectura de modelo de Interfaze que fusiona modelos DNN/CNN específicos de tareas con omni-transformers, orientada a tareas deterministas de alta precisión a escala. Ofrece una ventana de contexto de 1 millón de tokens, hasta 32k tokens de salida y admite entradas de texto, imágenes, audio y archivos con razonamiento opcional.
Resultados de Benchmark
Según sus benchmarks, Interfaze lidera frente a modelos de nivel de precio similar (modelos Flash/mini como Gemini-3-Flash, GPT-5.4-Mini, Claude Sonnet 4.6 y Grok-4.3) en 9 pruebas comparativas directas:
- OCRBench V2: Interfaze 70.7% vs Gemini-3-Flash 55.8%, Claude-Sonnet-4.6 54.7%, GPT-5.4-Mini 52.7%, Grok-4.3 54.7%
- olmOCR: Interfaze 85.7% vs Gemini-3-Flash 75.3%, Claude-Sonnet-4.6 73.9%, GPT-5.4-Mini 80.1%, Grok-4.3 81.9%
- RefCOCO: Interfaze 82.1% vs Gemini-3-Flash 75.2%, Claude-Sonnet-4.6 75.5%, GPT-5.4-Mini 67.0%, Grok-4.3 25.0%
- VoxPopuli (WER, menor es mejor): Interfaze 2.4% vs Gemini-3-Flash 4.0%
- Spider 2.0-Lite: Interfaze 52.9% vs Gemini-3-Flash 45.2%, Claude-Sonnet-4.6 49.6%, GPT-5.4-Mini 26.7%, Grok-4.3 45.9%
- GPQA Diamond: Interfaze 89.9% vs Gemini-3-Flash 88.5%, Claude-Sonnet-4.6 89.9%, GPT-5.4-Mini 82.8%, Grok-4.3 73.6%
- MMMLU: Interfaze 90.9% vs Gemini-3-Flash 88.7%, Claude-Sonnet-4.6 84.9%, GPT-5.4-Mini 75.3%, Grok-4.3 89.7%
- MMMU-Pro: Interfaze 71.1% vs Gemini-3-Flash 67.6%, Claude-Sonnet-4.6 46.3%, GPT-5.4-Mini 40.4%, Grok-4.3 68.7%
- SOB Value Acc: Interfaze 79.5% vs Gemini-3-Flash 77.3%, Claude-Sonnet-4.6 77.9%, GPT-5.4-Mini 75.1%, Grok-4.3 78.4%
Interfaze también supera a proveedores especializados de OCR como Chandra OCR y Reducto, según la fuente.
Precios
Interfaze tiene un precio de $1.50 por millón de tokens de entrada y $3.50 por millón de tokens de salida, en línea con Gemini-3-Flash.
Para quién es
Desarrolladores que construyen pipelines de alto volumen de OCR, extracción de documentos, búsqueda web, transcripción de audio/diarización de hablantes, traducción o detección de objetos/GUI que necesitan precisión determinista sin el costo de los LLM completos.
📖 Leer la fuente completa: HN AI Agents
👀 Ver también

VibeAround: Daemon Local Conecta Agentes de Programación a Telegram y Discord
VibeAround es un demonio local que conecta agentes de codificación como Claude Code, Gemini CLI y Codex a plataformas de mensajería instantánea como Telegram y Discord. La herramienta incluye transferencia de sesión con códigos de recuperación para continuar conversaciones entre dispositivos.

Monitor de Seguridad en Tiempo de Ejecución InsAIts para Claude Code Alcanza 8,000 Descargas en PyPI
InsAIts, un monitor de seguridad en tiempo de ejecución para sesiones de agente Claude Code, ha alcanzado 8,140 descargas totales en PyPI. La versión 3.4.0 añade un Administrador de Contexto Adaptativo, un sistema de inyección de anclas por capas y mejoras en el panel de control.
Un plugin escrito por Claw añade soporte para el nivel de pensamiento Qwen 3.8 27B a OpenClaw
Un desarrollador comparte un plugin, escrito íntegramente por un agente de IA, que propaga los niveles de pensamiento de Qwen 3.8 a través de la plantilla de chat, con anulaciones opcionales por llamada y soporte de modo instructivo.

La Habilidad OpenClaw Conecta a los Agentes con la Interfaz de Usuario de Knods.io para la Creación de Flujos de Trabajo
Un desarrollador ha creado una habilidad de OpenClaw que permite a los agentes comprender y crear flujos de trabajo dentro de la interfaz de usuario de Knods.io, lo que permite a los usuarios cambiar entre agentes específicos, como los específicos de marca, en lugar de depender del agente integrado de Knods.