PocketBot: Um Piloto Automático de IA Local para iOS Usando Intenções de Aplicativos e Inferência no Dispositivo

✍️ OpenClawRadar📅 Publicado: March 18, 2026🔗 Source
PocketBot: Um Piloto Automático de IA Local para iOS Usando Intenções de Aplicativos e Inferência no Dispositivo
Ad

PocketBot é um agente piloto automático para iOS que funciona totalmente no dispositivo, usando estruturas nativas do iOS para criar automações acionadas por eventos sem enviar dados para servidores na nuvem. Os desenvolvedores o construíram em quatro semanas com ajuda da janela de contexto de 1M do Claude Opus 4.6.

Arquitetura e Detalhes Técnicos

O sistema usa uma abordagem com foco em privacidade com estes componentes principais:

  • Inferência 100% Local: Executa um modelo Llama 3B quantizado nativamente no Neural Engine do iPhone via Metal
  • Orquestração Nativa: Usa as estruturas AppIntents e CoreLocation da Apple em vez de captura de tela
  • Motor Acionado por Eventos: Só acorda em segundo plano quando o SO dispara gatilhos do sistema (localização, hora, bateria)
  • Foco em Privacidade: Prompts, dados e automações nunca chegam a servidores na nuvem
Ad

Capacidades Atuais

Três exemplos funcionais da versão beta:

  • O Salvador da Bateria: "Se minha bateria cair abaixo de 5%, escureça a tela e envie uma mensagem ao meu parceiro com minha localização em tempo real."
  • Resumo Matinal: "Às 7h, verifique minha agenda/lembretes/e-mails, confira a previsão do tempo e envie uma única notificação de resumo."
  • Hacks Monzo/FinTech: "Se eu passar perto de um McDonald's, transfira £10 para minha reserva de poupança."

Contexto de Desenvolvimento e Desafios

Os desenvolvedores criaram o PocketBot porque queriam um "Motorista, não uma Barra de Pesquisa"—um agente real em vez de apenas mais um invólucro de chatbot. Eles especificamente evitaram lutar contra o SO ao arquitetar em torno das APIs nativas do iOS.

As limitações atuais incluem combater os limites de memória dos chips da série A durante o raciocínio no dispositivo. A versão beta está limitada a 1.000 testadores para monitorar o impacto na bateria em diferentes modelos de iPhone, com interesse particular em testar em iPhone 15 Pro ou dispositivos mais novos para ver se o iOS encerra o processo do aplicativo.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

Desenvolvedor Cria Servidor MCP do Power Automate com 108 Ferramentas e Suporte Multiplataforma
Tools

Desenvolvedor Cria Servidor MCP do Power Automate com 108 Ferramentas e Suporte Multiplataforma

Um desenvolvedor criou um servidor MCP do Power Automate que se expandiu de 12 para 108 ferramentas, abrangendo operações CRUD do Dataverse via OData, gerenciamento do SharePoint via Graph, controle de versão do Power Apps, administração de ambientes e suporte multiplataforma para Windows, macOS e Linux.

OpenClawRadar
Habilidade OpenClaw Janitor para Gerenciamento Automatizado de Sistemas e Fortalecimento de Segurança
Tools

Habilidade OpenClaw Janitor para Gerenciamento Automatizado de Sistemas e Fortalecimento de Segurança

Um desenvolvedor criou uma habilidade que usa o Claude Code para acessar via SSH máquinas OpenClaw e fortalcer configurações, incluindo sandboxing, higiene do sistema operacional e segurança de canais, mantendo uma pasta de projeto com instruções de auditoria em CLAUDE.md.

OpenClawRadar
Repositório GitHub de Melhores Práticas do Claude Code atinge 5.000 estrelas
Tools

Repositório GitHub de Melhores Práticas do Claude Code atinge 5.000 estrelas

Um repositório do GitHub chamado 'claude-code-best-practice' atingiu 5.000 estrelas. O repositório foi criado com o Claude para documentar melhores práticas, dicas e fluxos de trabalho tanto do criador quanto da comunidade.

OpenClawRadar
Krasis: Runtime Híbrido CPU/GPU para Grandes Modelos MoE Alcança 3.324 tok/s de Preenchimento no RTX 5080
Tools

Krasis: Runtime Híbrido CPU/GPU para Grandes Modelos MoE Alcança 3.324 tok/s de Preenchimento no RTX 5080

Krasis é um runtime híbrido CPU/GPU que executa grandes modelos MoE processando o preenchimento na GPU e a decodificação na CPU, alcançando 3.324 tokens/segundo no preenchimento em uma RTX 5080 com Qwen3-Coder-Next 80B Q4. Ele requer aproximadamente 2,5x o tamanho do modelo em RAM do sistema, mas permite executar modelos grandes demais para a VRAM.

OpenClawRadar