Apple constrói nova arquitetura de IA sobre os modelos fundacionais Google Gemini

A Apple anunciou hoje uma grande reformulação de sua plataforma Apple Intelligence, construída sobre modelos de base codesenvolvidos com o Google usando tecnologias da família Gemini. A nova arquitetura, revelada na WWDC 2026, foi projetada para funcionar tanto no dispositivo quanto em servidores por meio da infraestrutura Private Cloud Compute da Apple.
Detalhes Principais
- Modelos de Base da Apple: Codesenvolvidos com o Google, esses modelos alimentam o novo Apple Intelligence. A Apple descreve a colaboração como "profunda."
- Suporte multimodal: Os modelos agora lidam com compreensão e geração de imagens, incluindo criação de imagens realistas, edição avançada de fotos e resposta visual a perguntas.
- Variante de maior potência: Alguns dispositivos receberão uma versão com capacidades adicionais: geração de fala, precisão melhorada de ditado e compreensão de linguagem natural mais forte. A Apple não especificou quais dispositivos.
- Orquestrador do sistema: Um novo componente fica no centro da arquitetura, coordenando recursos de forma segura entre plataformas. Ele adapta as respostas com base no aplicativo ativo e na tarefa atual do usuário, permitindo "inteligência verdadeiramente em todo o sistema."
- Privacidade: A Apple reitera que os dados do usuário são usados apenas para executar a solicitação imediata e não são acessíveis à Apple ou a terceiros. Especialistas externos podem verificar as garantias de privacidade a qualquer momento.
A Apple enquadrou o anúncio como um contraste aos concorrentes que "correm para frente" sem se importar com os usuários, e enfatizou seu compromisso com o processamento no dispositivo e o Private Cloud Compute.
Para desenvolvedores que usam agentes de codificação de IA, isso significa que futuros SDKs e ferramentas da Apple podem expor esses modelos por meio de APIs do Private Cloud Compute, permitindo fluxos de trabalho agentivos com garantias de privacidade. O padrão de orquestrador pode servir como referência para construir sistemas de roteamento de tarefas entre modelos no dispositivo e na nuvem.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Ford recontrata mais de 300 engenheiros veteranos após verificações de qualidade da IA ficarem aquém
A Ford recontratou mais de 300 inspetores de qualidade veteranos após verificações com IA não atingirem o nível de especialização deles, citando dados de treinamento inadequados e perda de funcionários experientes.

Claude Cowork para Windows ARM64 Lançado com Verificador de Compatibilidade
A Anthropic lançou o Claude Cowork para dispositivos Windows ARM64, exigindo Windows 11 Pro com Hyper-V e virtualização ativada. A empresa fornece uma ferramenta verificadora de compatibilidade EXE para confirmar os requisitos do sistema.

IA economiza ~3% das horas, quase nada chega ao salário
Estudo dinamarquês com 25 mil trabalhadores descobre que IA economiza ~3% das horas (1 hora/semana), mas apenas 3-7% desse ganho se traduz em salário. Velocidades de 40% em laboratório evaporam em empregos reais, a menos que capturadas deliberadamente.

A BitNet da Microsoft Permite Inferência de LLM com 100 Bilhões de Parâmetros em uma Única CPU
O projeto BitNet de código aberto da Microsoft alcança inferência de LLM com 100B de parâmetros a 5-7 tokens/segundo em uma única CPU, com o modelo de 2B de parâmetros usando 0,4GB de memória e latência de 29ms, enquanto iguala modelos de precisão total em benchmarks.