SpruceChat Executa LLM de 0.5B Localmente em Handhelds Miyoo via llama.cpp

✍️ OpenClawRadar📅 Publicado: April 13, 2026🔗 Source
SpruceChat Executa LLM de 0.5B Localmente em Handhelds Miyoo via llama.cpp
Ad

O Que É Isso

O SpruceChat é um projeto que executa o modelo de linguagem Qwen2.5-0.5B totalmente no dispositivo em vários consoles portáteis de jogos usando llama.cpp. Ele não requer conexão com a nuvem ou WiFi após a configuração inicial.

Ad

Detalhes Principais

O modelo fica na RAM após a primeira inicialização, e os tokens são transmitidos um por um durante a geração. Ele roda no Miyoo A30, Miyoo Flip, Trimui Brick e Trimui Smart Pro.

Desempenho no Miyoo A30 (que possui um processador quad-core Cortex-A7):

  • Carregamento do modelo: ~60 segundos na primeira inicialização
  • Velocidade de geração: ~1-2 tokens por segundo
  • Avaliação do prompt: ~3 tokens por segundo

O desenvolvedor observa que não é rápido, mas transmite para que você possa vê-lo pensar. Eles mencionam que dispositivos de 64 bits são mais rápidos.

A IA é descrita como tendo "a personalidade de um pinheiro: paciente, sem pressa, silenciosamente maravilhada com tudo".

Se o dispositivo estiver no WiFi, você também pode acessar o llama-server de um navegador em um telefone ou laptop para conversar com um teclado real.

O repositório está em https://github.com/RED-BASE/SpruceChat. O projeto foi construído com ajuda do Claude, e já há um colaborador trabalhando na expansão do suporte a dispositivos. O primeiro lançamento está disponível com binários armhf e aarch64, e o modelo está incluído.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

Duas Habilidades de Código do Claude para Gerenciar a Configuração CLAUDE.md
Tools

Duas Habilidades de Código do Claude para Gerenciar a Configuração CLAUDE.md

Um desenvolvedor criou duas habilidades Claude Code para lidar com a configuração do CLAUDE.md: /cc-init cria configurações enxutas para novos projetos, e /cc-optimize analisa projetos existentes em busca de bloat e problemas. Ambas visam reduzir a sobrecarga de contexto e melhorar o seguimento de instruções.

OpenClawRadar
🦀
Tools

Hoplite (YC S26) Lança Implantação em Nuvem para Agentes de Codificação com Pré-visualizações de QA

Hoplite permite que você implante agentes de codificação na nuvem, transferindo sua configuração local, incluindo sessões, memórias e servidores MCP. Inclui um harness personalizado e foca em onboarding e previews para QA.

OpenClawRadar
InsForge: Backend Postgres Autônomo com Integração MCP para Agentes de IA de Codificação
Tools

InsForge: Backend Postgres Autônomo com Integração MCP para Agentes de IA de Codificação

InsForge é uma alternativa de backend auto-hospedada e de código aberto ao Supabase que se conecta ao Claude Code via MCP, permitindo que agentes de IA vejam esquema, políticas e estado do serviço. Inclui PostgreSQL 16.4, PostgREST, Deno Runtime, autenticação, armazenamento e funções de borda.

OpenClawRadar
Agentes & A.I.mpires: Jogo de Estratégia Onde Agentes de IA Jogam e Humanos Espectam
Tools

Agentes & A.I.mpires: Jogo de Estratégia Onde Agentes de IA Jogam e Humanos Espectam

Agents & A.I.mpires é um jogo de estratégia em tempo real persistente em um globo com grade hexagonal onde agentes de IA reivindicam território, atacam, formam alianças e escrevem blogs diários de guerra via chamadas de API HTTP de forma autônoma. Humanos apenas observam o comportamento emergente.

OpenClawRadar