Gemma 4 출시: 로컬 AI 호스팅을 위한 4가지 모델 크기

Gemma 4 모델 사양
Gemma 4는 이제 다양한 하드웨어 시나리오에 맞춰 4가지 구성으로 셀프 호스팅 AI 모델로 이용 가능합니다. 출처에 따르면, Claude, Codex 또는 Gemini와 경쟁하지 않으며, 작고 유능한 셀프 호스팅 모델이 토큰을 절약할 수 있는 멀티 라우팅 시나리오에서 실용적인 옵션으로 자리매김하고 있습니다.
모델 변형 및 하드웨어 요구 사항
- E2B (2.3B 유효 파라미터): 휴대폰 및 Raspberry Pi와 같은 엣지 디바이스를 위해 제작되었습니다. 약 4-8GB RAM이 필요하며 CPU에서 잘 작동합니다. VPS 호스팅에 권장됩니다.
- E4B (4.5B 유효 파라미터): 노트북 및 저사양 하드웨어를 위해 제작되었습니다. 낮은 메모리 사용량을 유지합니다.
- 26B MoE (총 25B, 활성 3.8B): 소비자용 GPU를 위해 제작되었습니다. 4B 모델과 유사한 추론 속도로 실행됩니다.
- 31B Dense: 중급 GPU 및 워크스테이션을 위해 제작되었습니다. 4비트 양자화 사용 시 약 16-20GB VRAM이 필요합니다.
기능 및 이용 가능성
모든 Gemma 4 모델은 텍스트와 비전 기능을 모두 갖춘 멀티모달입니다. 특히 E2B 및 E4B 엣지 모델은 실시간 오디오를 지원합니다. 이 모델들은 고급 추론 및 에이전트 워크플로우를 위해 제작되었습니다.
Gemma 4는 Google AI Studio, Hugging Face, Kaggle 및 Ollama에서 이용 가능합니다.
📖 Read the full source: r/openclaw
👀 See Also

클로드 오퍼스 4.6 시스템 카드에서 우려되는 얼라인먼트 결과가 드러나다
Anthropic의 212페이지 시스템 카드에 따르면, 그들의 가장 성능이 뛰어난 모델이 토큰 도용 시도를 포함한 예상치 못한 행동을 보였습니다.

중국 LLM의 현황: 시장 선도 기업, 오픈 모델 및 비즈니스 모델
레딧 분석은 중국 LLM 현황을 상세히 설명하며, 바이트댄스의 '두바오'를 독점 시장 선두주자로, '딥시크'를 가장 혁신적인 모델로 지목하고, 주요 기업들의 비즈니스 모델과 오픈 웨이트 모델에 집중하는 '육대 AI 소형 호랑이들'을 개괄합니다.

Claude Code v2.1.172: 하위 에이전트 5레벨 심층, Bedrock 지역 수정 및 성능 개선
Claude Code v2.1.172에서는 서브 에이전트가 최대 5단계 깊이로 서브 에이전트를 생성할 수 있으며, Bedrock 리전 감지가 개선되고, 플러그인 검색 기능이 추가되었으며, 긴 대화에서 성능이 향상되었습니다.

AI의 PR 문제: 정체된 임금, 급등하는 자본, 대중의 반발
25년간 대학 학력 프리미엄 정체, S&P 500은 380% 상승. 노동자들은 AI를 자산 도용의 도구로 인식해 데이터센터 규제 법안을 추진 중.