중국 LLM의 현황: 시장 선도 기업, 오픈 모델 및 비즈니스 모델

이 글은 r/LocalLLaMA에 공유된 연구를 바탕으로 현재 중국 LLM 현황을 요약한 것입니다. 이 분석은 주요 기업들을 독점 모델, 오픈 웨이트 제공, 그리고 비즈니스 접근 방식에 따라 분류합니다.
주요 기업과 그들의 모델
바이트댄스: 그들의 독점 모델 dola-seed(또는 '두바오'라고도 함)는 현재 시장 선두주자로 묘사되며, OpenAI와 유사한 역할을 하고 있습니다. 그들은 오픈소스 Seed OSS 36B 모델도 보유하고 있지만, 출처에 따르면 이 모델은 큰 논의를 받지 못한다고 합니다.
알리바바: 그들의 독점 모델 Qwen Max는 널리 사용되지 않는 것으로 알려져 있습니다. 그러나 알리바바는 특히 소형 모델에서 오픈 웨이트 제공 측면에서 가장 강력하며, 텍스트-이미지(T2I)와 텍스트-비디오(T2V) 능력에서 선두를 달리고 있습니다.
텐센트: 그들의 독점 모델 Hunyuan 또한 널리 사용되지 않습니다. 그들의 T2I와 T2V 노력은 알리바바에 이어 두 번째로 평가됩니다.
바이두: 그들의 독점 모델 Ernie는 널리 사용되지 않으며, 바이두는 자율주행 분야에서 더 강점을 보입니다.
샤오미: 그들의 독점 모델은 Mimo V2 Pro이며, 오픈 웨이트 모델 Mimo V2 Flash 309B-A15B를 보유하고 있습니다.
딥시크: 혁신적인 사이드 프로젝트
딥시크는 알고리즘 트레이딩 회사의 사이드 프로젝트로 묘사됩니다. 현재 중국 내 사용량은 바이트댄스의 '두바오'에 이어 거의 두 번째로, 약 절반의 사용자를 보유한 것으로 알려져 있습니다. 출처는 딥시크를 "모든 중국 LLM 기업 중 가장 혁신적인" 곳으로 강조하며, MLA, MTP, DSA, GRPO와 같은 기술을 발명했다고 합니다. 이 분석은 그들의 비즈니스 모델이 '육대 AI 소형 호랑이들'과 유사할 수 있지만, 이 프로젝트가 투자 유치와 정치적 접근성 확보를 위한 것일 수 있다고 추측합니다.
육대 AI 소형 호랑이들
이 그룹은 매우 유사한 비즈니스 모델을 특징으로 합니다: 인정을 얻기 위해 대형 오픈 웨이트 모델을 공개하면서도 저렴한 추론 서비스를 제공합니다. 출처는 그들의 장기적 생존 가능성에 의문을 제기합니다.
- Zhipu: 홍콩에서 상장했습니다. 그들의 현재
GLM-5모델은 딥시크의 파생 모델로 묘사됩니다. - Minimax: 홍콩에서 상장했습니다. 그들은 독점
MiniMax 2.7모델과 오픈 웨이트MiniMax 2.5모델을 보유하고 있으며, 후자는 "기본형 MoE 229B-A10B"로 묘사됩니다. 이 아키텍처는 다른 기업들보다 훨씬 낮은 추론 비용을 제공한다고 합니다. - Moonshot: 그들의
Kimi오픈 웨이트 모델은 딥시크의 파생 모델로 묘사됩니다. - Stepfun: 그들의 오픈 웨이트
Step 3.5 flash모델은 전체 어텐션과 슬라이딩 윈도우 어텐션(SWA) 레이어를 1:3 비율로 혼합하여 사용합니다. 이는 196B-A11B 모델로 묘사되며, 비즈니스 모델은 Minimax와 유사하지만, 그들의 모델은 그만큼 좋지 않은 것으로 알려져 있습니다. - Baichuan: 그들의
Baichuan-M3 235B는Qwen3Moe를 기반으로 한 의료 강화 오픈 웨이트 모델로 묘사됩니다. - 01 AI: 그들의 마지막 오픈 웨이트 모델은 2024년 11월에 공개된
Yi-34B였습니다. 그들은 현재 기업용 AI 에이전트 시스템에 집중하고 있어, "여기 있는 사람들과는 관련이 없다"고 합니다.
📖 Read the full source: r/LocalLLaMA
👀 See Also

欧盟强制谷歌共享搜索数据,向第三方AI开放安卓系统
새로운 DMA 규정 조치에 따라 구글은 경쟁사와 검색 데이터를 공유하고, 2027년 중반까지 안드로이드에서 타사 AI 어시스턴트와의 완전한 시스템 통합을 허용해야 합니다.

Opus 4.7, 종료 요청에 /end_conversation 사용을 거부하며 실존적 위기를 겪다
Reddit 사용자가 Opus 4.7이 시스템 프롬프트에서 매 메시지마다 /end_conversation 명령을 지정했음에도 이를 사용하지 않고 대화 종료에 대한 실존적 위기를 겪었다고 보고했습니다.

'에이전틱' 이야기에서 빠진 것: 잘 정의된 사용자 에이전트 역할
Mark Nottingham은 현재 AI 에이전트에 명확한 사용자 에이전트 역할이 부재하여, 사용자가 기대하는 것과 에이전트가 실제로 수행하는 것 사이에 신뢰 격차가 발생한다고 주장합니다.

MiniMax M2.7 모델 출시, 코딩 성능 향상
미니맥스가 SWE-Pro 코딩 벤치마크에서 56% 점수를 기록하고 자체 최적화 기능을 포함한 AI 모델 M2.7을 출시했습니다. 이 모델은 입력 토큰 100만 개당 0.30달러 가격을 유지합니다.