OmniCoder-9B: 425K 에이전트 궤적으로 미세 조정된 90억 파라미터 코딩 에이전트

테슬레이트가 Qwen3.5-9B의 하이브리드 아키텍처를 기반으로 파인튜닝한 90억 파라미터 코딩 에이전트 모델 OmniCoder-9B를 공개했습니다. 이 아키텍처는 표준 어텐션과 인터리빙된 게이티드 델타 네트워크를 사용합니다.
학습 데이터 및 출처
이 모델은 실제 소프트웨어 엔지니어링 작업을 아우르는 425,000개 이상의 정제된 에이전트 코딩 트랙으로 학습되었습니다. 학습 데이터는 특히 Claude Opus 4.6 에이전트 및 코딩 추론 트레이스에서 구축되었으며, 다음의 스캐폴딩 패턴을 대상으로 합니다:
- Claude Code
- OpenCode
- Codex
- Droid
데이터셋에는 Claude Opus 4.6, GPT-5.4, GPT-5.3-Codex, Gemini 3.1 Pro와 같은 모델의 성공적인 트랙이 포함되어 있습니다.
주요 특징
- 프론티어 에이전트 트레이스 학습: Claude Code, OpenCode, Codex, Droid 스캐폴딩에서 Claude Opus 4.6, GPT-5.3-Codex, GPT-5.4, Gemini 3.1 Pro 에이전트 코딩 트랙으로 구축됨
- 하이브리드 아키텍처: 효율적인 장문맥 처리를 위해 표준 어텐션과 인터리빙된 Qwen3.5의 게이티드 델타 네트워크 상속
- 262K 네이티브 컨텍스트: 전체 262,144 토큰 컨텍스트 윈도우, 100만 이상으로 확장 가능
- 오류 복구: 쓰기 전 읽기 패턴 학습, LSP 진단 응답, 전체 재작성 대신 최소 편집 차분 적용
- 사고 모드: 복잡한 문제 분해를 위한 <think>...</think> 추론 체인 지원
- Apache 2.0: 완전한 오픈 웨이트, 제한 없음
에이전트 행동
이 모델은 학습된 실제 에이전트 트랙에서 직접 학습한 강력한 에이전트 행동을 보여줍니다. 쓰기 전 읽기 패턴을 사용하여 오류에서 복구하고, LSP 진단에 응답하며, 전체 재작성 대신 적절한 편집 차분을 사용합니다.
모델은 https://huggingface.co/Tesslate/OmniCoder-9B에서 이용 가능합니다.
📖 Read the full source: r/LocalLLaMA
👀 See Also

프리 LLM API와 툴 콜링으로 구축된 포켓몬 쇼다운 AI 에이전트
무료 API 티어를 통해 Llama 3, Qwen, Gemma를 사용하여 구조화된 도구 호출로 자율적으로 포켓몬 쇼다운 배틀을 진행하는 시스템. 인간 vs AI 및 AI vs AI 모드를 지원합니다.

클로드 코드를 위한 다중 에이전트 아키텍처 기반 연구팀 인어박스 프레임워크
한 개발자가 Claude Code용 다중 에이전트 연구 프레임워크를 만들어 Opus 4.6을 활용해 전문 에이전트들을 조율합니다. 이 프레임워크는 research-clab이라는 플러그인을 사용하며, 안내된 질의응답 과정을 통해 전개되고 11가지 기술, 에이전트 정의, 복잡한 연구 프로젝트 관리를 위한 구조화된 디렉터리를 포함합니다.

클로드와의 에이전트형 AI 파트너십을 위한 오픈소스 방법론
한 개발자가 세션 간 공유 메모리, 인지 모니터링, 다중 AI 컨설테이션을 활용하는 지속적 파트너십 시스템을 Claude와 구축하는 방법에 대한 25,000단어 논문을 발표하고 오픈소스 템플릿을 공개했습니다.

인터페이즈: 결정론적 작업에서 제미니-3-플래시와 GPT-5.4-미니를 능가하는 새로운 모델 아키텍처
DNN/CNN과 트랜스포머를 결합한 새로운 모델 아키텍처 Interfaze가 OCR, 비전, STT, 구조화된 출력 등 9개 벤치마크에서 Gemini-3-Flash, Claude-Sonnet-4.6, GPT-5.4-Mini, Grok-4.3을 능가합니다.