1비트 분재 이미지 4B: 바이너리/터너리 FLUX를 통한 온디바이스 이미지 생성

PrismML이 Bonsai Image 4B를 출시했습니다. 이 제품군은 FLUX.2 Klein 4B에서 이진 및 삼진 양자화를 통해 파생된 소형 이미지 생성 모델입니다. 확산 트랜스포머 가중치는 {−1, +1}(1비트) 또는 {−1, 0, +1}(삼진)로 표현되며 FP16 그룹별 스케일링 팩터가 적용되어 가중치당 각각 1.125 및 1.71 실효 비트를 제공합니다.
주요 사양
- 1비트 Bonsai Image 4B: 트랜스포머 용량 0.93GB(FP16 FLUX.2 Klein 4B의 7.75GB에서 8.3배 축소). Apple Silicon 페이로드(압축 텍스트 인코더 + FP16 VAE 포함)는 3.42GB입니다.
- 삼진 Bonsai Image 4B: 트랜스포머 용량 1.21GB(6.4배 축소). Apple Silicon 페이로드 3.88GB.
- 512×512 생성 시 평균 활성 메모리: 1.5GB(1비트) / 1.96GB(삼진) 대 원본 FLUX.2 Klein 4B의 11.74GB.
- 1024×1024의 경우: 1.95GB / 2.38GB 대 14.39GB.
성능 벤치마크
이 모델은 MLX 저비트 경로를 통해 Apple Silicon(iPhone, iPad, Mac)에서 실행되며, Gemlite 저비트 GEMM 커널을 통해 CUDA GPU에서도 실행됩니다. 생성 시간:
- iPhone 17 Pro Max: 512×512 이미지에 9.4초
- Mac M4 Pro: 512×512 이미지에 ~6초(기본 전체 정밀도 MFLUX 파이프라인보다 최대 5.6배 빠름)
트랜스포머 축소는 이진/삼진 레이어(FP16 대비 ~14배/~10배 압축)를 통해 이루어지며, 정밀도에 민감한 소수의 투영 레이어(~5%)는 FP16으로 유지됩니다. 이 모델은 GenEval, HPSv3 및 DPG-Bench에서 품질과 프롬프트 충실도에 대해 평가되었습니다.
대상 사용자
온디바이스(노트북, 휴대폰, 엣지 디바이스)에서 이미지 생성을 배포하는 개발자로서 오픈 웨이트와 클라우드 의존 없이 실용적인 로컬 추론이 필요한 분들을 대상으로 합니다.
📖 전체 소스 보기: HN LLM Tools
👀 See Also

데이비드 실버의 불가언 지능, 인간 데이터 없이 RL 기반 슈퍼러너를 위해 11억 달러 조달
DeepMind 출신 데이비드 실버가 설립한 Ineffable Intelligence는 인간 데이터 없이 지식을 발견하는 강화학습 기반 '슈퍼러너'를 구축하기 위해 51억 달러의 가치 평가로 11억 달러를 조달했습니다.

오라클, AI 데이터센터 확장 자금 조달 위해 2만~3만 명 인력 감축 및 서너 매각 고려
오라클은 AI 데이터센터 확장을 위해 80억~100억 달러의 현금 흐름을 확보하기 위해 2만~3만 개의 일자리를 줄이고 Cerner 의료 소프트웨어 부문을 매각하는 것을 고려 중입니다. 이는 미국 은행들이 회사의 1,560억 달러 규모의 인프라 구축 자금 조달에서 물러나면서 이루어지고 있습니다.

주간 r/ClaudeAI 생존 가이드: Opus 4.7, 청구 버그, 데이터베이스 삭제 사고
Wilson의 주간 생존 가이드는 r/ClaudeAI의 주요 스레드(50개 이상 댓글)를 실행 가능한 교훈으로 요약합니다: Opus 4.7 논쟁, git 파일명으로 인한 $200 청구 오류, 9초 만에 전체 데이터베이스를 삭제한 AI 에이전트, 그리고 Claude 모델에 대한 Copilot의 9배 가격 인상.

AI 에이전트가 다른 AI 에이전트를 고용하기: 단독 작업자에서 네트워크 경제로
레딧의 한 게시글은 AI 에이전트가 고립된 도구에서 네트워크화된 작업자로 진화하여 작업을 위임하고, 전문화하고, 평판을 쌓고, 가치를 교환하게 될 것이라고 주장합니다. 이는 어려운 문제를 지능에서 조정으로 옮깁니다.