Ant Group lança AntLing-3.0-flash no OpenClaw via OpenRouter – Contexto de 256K, gratuito até 3 de agosto
Os usuários do OpenClaw agora podem acessar o modelo AntLing-3.0-flash do Ant Group via OpenRouter. Nenhuma atualização do OpenClaw é necessária — basta definir o ID do modelo e ele aparece na sua lista de modelos.
Configuração
Execute este comando para configurar:
openclaw models set openrouter/inclusionai/ling-3.0-flash
Nota: O ID do modelo não deve ter o sufixo :free — adicioná-lo resulta em erro 404.
Detalhes importantes
- Tamanho do contexto: 256K tokens
- Treinamento: Aprendizado por reforço em chamadas de ferramentas de longo horizonte
- Preço: Gratuito até 3 de agosto de 2025 (via API OpenRouter)
- Disponibilidade: Apenas API; sem pesos nesta versão
Observações da comunidade
Os primeiros adotantes no Reddit estão testando a estabilidade do loop em várias etapas. A própria InclusionAI recomenda que o modelo funciona melhor quando recebe erros de compilação complexos como entrada. Se você tiver acesso a um repositório TypeSpec, há relatos de interesse em ver se o modelo mantém a coerência após algumas etapas.
📖 Leia a fonte original: r/openclaw
👀 See Also

mnemos: Uma Camada de Memória Persistente para Agentes de Codificação de IA (Go, Nativo MCP, Sem Python)
mnemos é uma camada de memória nativa do MCP baseada em Go para agentes de codificação de IA. O autor construiu um verificador para medir o ganho: +40% agregado em cenários de leitura, mas apenas 53% de taxa de captura no lado de escrita após correções iterativas.

Operações de Fundador no Claude: 19 Habilidades Reutilizáveis para Startups em Estágio Inicial
Um fundador que recentemente saiu de sua primeira startup publicou 19 prompts de habilidade compatíveis com Claude para funções como posicionamento, precificação, prospecção e copy — baseados em seus próprios SOPs e fluxos de trabalho do Notion.

Vyra: Editor de Vídeo Web Inteligente para Agentes Claude via MCP
Vyra indexa vídeos para que o Claude possa pesquisar e editar semanticamente — suporta gráficos em movimento, sincronização de música, mascaramento inteligente, edição por transcrição, correção de cores e mais de 30 efeitos.

Krasis: Runtime Híbrido CPU/GPU para Grandes Modelos MoE Alcança 3.324 tok/s de Preenchimento no RTX 5080
Krasis é um runtime híbrido CPU/GPU que executa grandes modelos MoE processando o preenchimento na GPU e a decodificação na CPU, alcançando 3.324 tokens/segundo no preenchimento em uma RTX 5080 com Qwen3-Coder-Next 80B Q4. Ele requer aproximadamente 2,5x o tamanho do modelo em RAM do sistema, mas permite executar modelos grandes demais para a VRAM.