인터페이즈: 결정론적 작업에서 제미니-3-플래시와 GPT-5.4-미니를 능가하는 새로운 모델 아키텍처

Interfaze는 Interfaze가 개발한 새로운 모델 아키텍처로, 작업별 DNN/CNN 모델과 옴니트랜스포머를 결합하여 대규모 고정밀 결정론적 작업을 목표로 합니다. 100만 토큰 컨텍스트 창, 최대 32,000개 출력 토큰을 제공하며, 텍스트, 이미지, 오디오, 파일 입력과 선택적 추론을 지원합니다.
벤치마크 결과
해당 벤치마크에 따르면, Interfaze는 유사한 가격대 모델(Gemini-3-Flash, GPT-5.4-Mini, Claude Sonnet 4.6, Grok-4.3과 같은 Flash/mini 모델)과의 9개 항목 비교에서 앞섰습니다:
- OCRBench V2: Interfaze 70.7% vs Gemini-3-Flash 55.8%, Claude-Sonnet-4.6 54.7%, GPT-5.4-Mini 52.7%, Grok-4.3 54.7%
- olmOCR: Interfaze 85.7% vs Gemini-3-Flash 75.3%, Claude-Sonnet-4.6 73.9%, GPT-5.4-Mini 80.1%, Grok-4.3 81.9%
- RefCOCO: Interfaze 82.1% vs Gemini-3-Flash 75.2%, Claude-Sonnet-4.6 75.5%, GPT-5.4-Mini 67.0%, Grok-4.3 25.0%
- VoxPopuli (WER, 낮을수록 좋음): Interfaze 2.4% vs Gemini-3-Flash 4.0%
- Spider 2.0-Lite: Interfaze 52.9% vs Gemini-3-Flash 45.2%, Claude-Sonnet-4.6 49.6%, GPT-5.4-Mini 26.7%, Grok-4.3 45.9%
- GPQA Diamond: Interfaze 89.9% vs Gemini-3-Flash 88.5%, Claude-Sonnet-4.6 89.9%, GPT-5.4-Mini 82.8%, Grok-4.3 73.6%
- MMMLU: Interfaze 90.9% vs Gemini-3-Flash 88.7%, Claude-Sonnet-4.6 84.9%, GPT-5.4-Mini 75.3%, Grok-4.3 89.7%
- MMMU-Pro: Interfaze 71.1% vs Gemini-3-Flash 67.6%, Claude-Sonnet-4.6 46.3%, GPT-5.4-Mini 40.4%, Grok-4.3 68.7%
- SOB Value Acc: Interfaze 79.5% vs Gemini-3-Flash 77.3%, Claude-Sonnet-4.6 77.9%, GPT-5.4-Mini 75.1%, Grok-4.3 78.4%
또한 출처에 따르면 Interfaze는 Chandra OCR이나 Reducto 같은 특화 OCR 제공업체보다도 뛰어납니다.
가격
Interfaze는 입력 토큰 100만 개당 1.50달러, 출력 토큰 100만 개당 3.50달러로, Gemini-3-Flash와 비슷한 수준입니다.
대상 사용자
대용량 OCR, 문서 추출, 웹 검색, 오디오 전사/화자 분할, 번역, 객체/GUI 탐지 파이프라인을 구축하며, 전체 LLM 비용 없이 결정론적 정확도가 필요한 개발자에게 적합합니다.
📖 전체 출처 보기: HN AI Agents
👀 See Also

nan-forget: 단일 SQLite 파일에 저장된 로컬 AI 코딩 메모리
nan-forget는 단일 SQLite 파일(~3MB)에 컨텍스트를 저장하고 백그라운드 서비스 없이 작동하는 AI 코딩 에이전트용 메모리 도구입니다. 3단계 검색 파이프라인을 사용하며 Claude Code, Cursor, CLI를 통한 터미널에서 작동합니다.

cq: AI 코딩 에이전트를 위한 로컬-퍼스트 지식 공유 시스템
Mozilla.ai의 cq는 로컬 SQLite 저장소를 통해 AI 코딩 에이전트가 일반적인 함정에 대한 '지식 단위'를 공유할 수 있게 해주는 오픈소스 도구로, Docker API를 통한 팀 공유 옵션도 제공합니다. Claude Code 플러그인 또는 OpenCode MCP 서버로 설치할 수 있습니다.

Memorine: Python과 SQLite를 사용한 OpenClaw 에이전트를 위한 로컬 메모리 시스템
Memorine은 Python과 SQLite만 사용하는 OpenClaw 에이전트용 로컬 메모리 시스템으로, 외부 종속성, API 호출 또는 원격 측정이 필요하지 않습니다. 사실 저장, 전체 텍스트 검색, 메모리 감소, 모순 감지, 인과적 이벤트 체인, 그리고 fastembed와 sqlite-vec를 통한 선택적 의미 검색을 제공합니다.

인프라코스트, AI 에이전트를 위한 CLI 재설계로 클로드 토큰 사용량 79% 절감
Infracost가 AI 에이전트 호출자를 위해 CLI를 재설계하여, bare-Claude 기준 대비 Claude 출력 토큰을 79%, API 비용을 67% 절감했습니다. 핵심 전략: CLI로의 조건 푸시다운(predicate pushdown)과 토큰 효율적인 출력 형식.