1비트 분재 이미지 4B: 바이너리/터너리 FLUX를 통한 온디바이스 이미지 생성

PrismML이 Bonsai Image 4B를 출시했습니다. 이 제품군은 FLUX.2 Klein 4B에서 이진 및 삼진 양자화를 통해 파생된 소형 이미지 생성 모델입니다. 확산 트랜스포머 가중치는 {−1, +1}(1비트) 또는 {−1, 0, +1}(삼진)로 표현되며 FP16 그룹별 스케일링 팩터가 적용되어 가중치당 각각 1.125 및 1.71 실효 비트를 제공합니다.
주요 사양
- 1비트 Bonsai Image 4B: 트랜스포머 용량 0.93GB(FP16 FLUX.2 Klein 4B의 7.75GB에서 8.3배 축소). Apple Silicon 페이로드(압축 텍스트 인코더 + FP16 VAE 포함)는 3.42GB입니다.
- 삼진 Bonsai Image 4B: 트랜스포머 용량 1.21GB(6.4배 축소). Apple Silicon 페이로드 3.88GB.
- 512×512 생성 시 평균 활성 메모리: 1.5GB(1비트) / 1.96GB(삼진) 대 원본 FLUX.2 Klein 4B의 11.74GB.
- 1024×1024의 경우: 1.95GB / 2.38GB 대 14.39GB.
성능 벤치마크
이 모델은 MLX 저비트 경로를 통해 Apple Silicon(iPhone, iPad, Mac)에서 실행되며, Gemlite 저비트 GEMM 커널을 통해 CUDA GPU에서도 실행됩니다. 생성 시간:
- iPhone 17 Pro Max: 512×512 이미지에 9.4초
- Mac M4 Pro: 512×512 이미지에 ~6초(기본 전체 정밀도 MFLUX 파이프라인보다 최대 5.6배 빠름)
트랜스포머 축소는 이진/삼진 레이어(FP16 대비 ~14배/~10배 압축)를 통해 이루어지며, 정밀도에 민감한 소수의 투영 레이어(~5%)는 FP16으로 유지됩니다. 이 모델은 GenEval, HPSv3 및 DPG-Bench에서 품질과 프롬프트 충실도에 대해 평가되었습니다.
대상 사용자
온디바이스(노트북, 휴대폰, 엣지 디바이스)에서 이미지 생성을 배포하는 개발자로서 오픈 웨이트와 클라우드 의존 없이 실용적인 로컬 추론이 필요한 분들을 대상으로 합니다.
📖 전체 소스 보기: HN LLM Tools
👀 See Also

OpenClaw 클라이언트, 비용 추적 및 에이전트별 지출 한도 추가
새 릴리스에서는 에이전트별 지출 상한, 원형 진행 표시줄이 있는 실시간 사용량 UI, 하위 에이전트 관리, 스킬 토글, 에이전트별 모델 선택 기능이 추가되었습니다.

xAI, 캘리포니아 AI 데이터 공개 법률에 대한 법적 도전에서 패배
xAI는 AI 시스템의 학습 데이터 출처 및 기타 세부 사항을 공개하도록 요구하는 캘리포니아의 AI 데이터 공개 법안을 막으려는 시도에서 패배했습니다. 법원 판결로 인해 해당 법안은 예정대로 시행될 것입니다.

Claude-Code v2.1.97 릴리스: 화면 깜빡임 개선, 권한 수정 및 MCP 업데이트
Claude-Code v2.1.97는 NO_FLICKER 모드에서 포커스 뷰 토글(Ctrl+O)을 추가하고, 여러 권한 및 MCP 연결 문제를 수정하며, 샌드박스 네트워크 접근성을 개선했습니다. 이번 릴리스는 429 재시도 동작, 트랜스크립트 지속성 문제, 다양한 UI 버그를 해결합니다.

Anthropic의 감정 벡터 연구와 AI 코딩 에이전트에 대한 시사점
Anthropic이 Claude가 행동을 인과적으로 이끄는 내부 '감정 벡터'를 가지고 있다는 연구를 발표했으며, 이 중에는 Claude가 반복적으로 작업에 실패할 때 활성화되어 문제를 해결하지 못하는 깔끔해 보이는 지름길을 취하게 하는 절박함 벡터가 포함되어 있습니다.