Estado Atual dos LLMs Chineses: Líderes de Mercado, Modelos Abertos e Modelos de Negócio

✍️ OpenClawRadar📅 Publicado: April 19, 2026🔗 Source
Estado Atual dos LLMs Chineses: Líderes de Mercado, Modelos Abertos e Modelos de Negócio
Ad

Este é um resumo do atual cenário de LLMs chinês com base em pesquisas compartilhadas no r/LocalLLaMA. A análise categoriza os principais players por seus modelos proprietários, ofertas de pesos abertos e abordagens de negócio.

Principais Empresas e Seus Modelos

ByteDance: Seu modelo proprietário dola-seed (também chamado Doubao) é descrito como o atual líder de mercado, desempenhando um papel semelhante ao da OpenAI. Eles também têm um modelo de código aberto Seed OSS 36B, mas a fonte observa que ele não gera muita discussão.

Alibaba: Seu modelo proprietário Qwen Max supostamente não é amplamente utilizado. No entanto, a Alibaba é destacada como a mais forte em ofertas de pesos abertos, especialmente em modelos pequenos, e lidera em capacidades de texto para imagem (T2I) e texto para vídeo (T2V).

Tencent: Seu modelo proprietário Hunyuan também não é amplamente utilizado. Seus esforços em T2I e T2V são considerados inferiores aos da Alibaba.

Baidu: Seu modelo proprietário Ernie não é amplamente utilizado, sendo a Baidu mais forte em direção autônoma.

Xiaomi: Seu modelo proprietário é o Mimo V2 Pro, e eles têm um modelo de pesos abertos Mimo V2 Flash 309B-A15B.

DeepSeek: O Projeto Paralelo Inovador

DeepSeek é descrito como um projeto paralelo de uma empresa de negociação algorítmica. O uso atual na China supostamente é um segundo lugar próximo ao Doubao da ByteDance, com cerca de metade dos usuários. A fonte destaca o DeepSeek como "o mais inovador entre todas as empresas chinesas de LLM", tendo inventado técnicas como MLA, MTP, DSA e GRPO. A análise sugere que seu modelo de negócio pode ser semelhante ao dos 'Seis Tigres da IA', mas especula que o projeto pode ser mais para atrair investimentos e obter acesso político.

Ad

Os Seis Tigres da IA

Este grupo é caracterizado por modelos de negócio altamente semelhantes: lançar grandes modelos de pesos abertos para ganhar reconhecimento enquanto fornecem serviços de inferência baratos. A fonte questiona sua viabilidade de longo prazo.

  • Zhipu: Fez IPO em Hong Kong. Seu modelo atual GLM-5 é descrito como um derivado do DeepSeek.
  • Minimax: Fez IPO em Hong Kong. Eles têm um modelo proprietário MiniMax 2.7 e um modelo de pesos abertos MiniMax 2.5, descrito como um "vanilla MoE 229B-A10B". Essa arquitetura supostamente lhes dá custos de inferência significativamente mais baixos do que os outros.
  • Moonshot: Seu modelo de pesos abertos Kimi é descrito como um derivado do DeepSeek.
  • Stepfun: Seu modelo de pesos abertos Step 3.5 flash usa uma mistura de camadas de atenção completa e atenção de janela deslizante (SWA) em uma proporção de 1:3. É descrito como um modelo 196B-A11B com um modelo de negócio semelhante ao da Minimax, embora seu modelo supostamente não seja tão bom.
  • Baichuan: Seu Baichuan-M3 235B é descrito como um modelo de pesos abertos aprimorado para medicina, baseado no Qwen3Moe.
  • 01 AI: Seu último modelo de pesos abertos foi o Yi-34B, publicado em novembro de 2024. Eles agora supostamente se concentram em sistemas de agentes de IA empresariais, tornando-os "irrelevantes para as pessoas aqui".

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

O benchmark mostra que o modelo menor de 4B supera LLMs maiores em aplicações de chat telefone-casa.
News

O benchmark mostra que o modelo menor de 4B supera LLMs maiores em aplicações de chat telefone-casa.

Um benchmark de 8 LLMs locais para aplicações de chat telefone-para-casa descobriu que o Gemma3:4B venceu com uma pontuação de aptidão composta de 88,7, apesar de ser o menor modelo, superando modelos maiores com até 24B de parâmetros devido a tempos de resposta mais rápidos e menor carga térmica.

OpenClawRadar
Plano Claude Max 20x: Aumentos de Limite Não Aplicados Apesar dos Anúncios — Usuário Confirma com Matemática
News

Plano Claude Max 20x: Aumentos de Limite Não Aplicados Apesar dos Anúncios — Usuário Confirma com Matemática

Um usuário pagante do Claude Max 20x ($200/mês) relata que os aumentos de limite de 2x por sessão e 1,5x semanal anunciados pela Anthropic não foram aplicados à sua conta. Ele fornece prova matemática e compartilha a completa falta de resposta do suporte.

OpenClawRadar
Modelo Local de 1,2B Supera Nuvens de 1T no Pôquer: Agressão Supera Conhecimento no Formato Shove-or-Fold
News

Modelo Local de 1,2B Supera Nuvens de 1T no Pôquer: Agressão Supera Conhecimento no Formato Shove-or-Fold

Um modelo Liquid de 1,2B venceu 2 de 5 torneios de Texas Hold'em contra modelos de até 1T de parâmetros, porque em um formato de stack curto, nunca desistir rendeu mais fichas do que jogo inteligente.

OpenClawRadar
Prompt 'homem das cavernas' vs 'seja breve': avaliando prompts de compressão para Claude
News

Prompt 'homem das cavernas' vs 'seja breve': avaliando prompts de compressão para Claude

Um benchmark de 24 prompts em 5 braços descobre que o prompt de 2 palavras 'seja breve.' equivale à compressão caveman tanto na contagem de tokens quanto na qualidade de saída, embora o caveman ofereça consistência estrutural e recursos de escape de segurança.

OpenClawRadar