Apple Usando Acesso ao Google Gemini para Destilação de Modelos de IA no Dispositivo

A Apple está aproveitando os modelos de IA Gemini do Google para criar versões menores e locais por meio da destilação. De acordo com o The Information, o Google deu à Apple "acesso completo" ao Gemini em seus próprios data centers, permitindo que a Apple personalize o modelo para o Siri e outros recursos de IA.
Como Funciona o Processo de Destilação
A Apple pode pedir ao modelo principal do Gemini para executar tarefas que fornecem resultados de alta qualidade, incluindo um resumo do processo de raciocínio. A Apple então alimenta as respostas e as informações de raciocínio do Gemini para treinar modelos menores e mais baratos. Isso permite que os modelos menores aprendam os cálculos internos usados pelo Gemini, produzindo modelos eficientes com desempenho semelhante ao do Gemini, mas exigindo menos poder de computação.
Detalhes Técnicos e Desafios
- A Apple pode projetar modelos construídos para rodar em dispositivos Apple sem conectividade com a internet
- A Apple pode editar o Gemini conforme necessário para garantir que as respostas estejam alinhadas com os requisitos da Apple
- A Apple encontrou problemas porque o Gemini foi ajustado para aplicações de chatbot e codificação, o que nem sempre atende às necessidades da Apple
- A versão mais inteligente e de chatbot do Siri planejada para o iOS 27 dependerá dos modelos Gemini do Google
Capacidades e Desenvolvimento
O Siri será capaz de executar muitas das mesmas funções que o Gemini e outros chatbots, incluindo:
- Responder perguntas
- Resumir informações
- Digitalizar e entender documentos enviados
- Contar histórias
- Fornecer suporte emocional
- Completar tarefas como reservar viagens
A equipe Apple Foundation Models continua trabalhando em modelos de IA da Apple distintos dos modelos Gemini, indicando que esta é uma abordagem transitória enquanto a Apple desenvolve suas próprias capacidades de IA.
📖 Read the full source: HN AI Agents
👀 See Also

Título: Claude Code v2.1.129: Orientação para Persistência de Loop Autônomo e Classificador de Estado de Agente em Segundo Plano
Claude Code v2.1.129 adiciona prompt de sistema CLAUDE_CODE_LOOP_PERSISTENT para loops de trabalho autônomos, remove subagente especialista em verificação, e expande classificador de estado do agente de fundo com limites detalhados.

Título do artigo: "Claude Code supostamente recusa solicitações ou cobra a mais quando commits mencionam 'OpenClaw'"
Um tweet de Theo alega que o Claude Code recusa solicitações ou cobra a mais se seus commits git mencionarem 'OpenClaw', gerando discussão no HN.

Uber queima orçamento de IA de 2026 em 4 meses com Claude Code — US$ 500 a US$ 2 mil por engenheiro ao mês
A Uber gastou todo o seu orçamento de IA de 2026 em apenas quatro meses, impulsionada pela adoção do Claude Code e do Cursor. Os custos mensais de API chegaram a US$ 500–US$ 2.000 por engenheiro. 95% dos engenheiros usam ferramentas de IA mensalmente; 70% do código commitado é gerado por IA.

Preocupações com a Visibilidade de Custos da API Claude para Desenvolvedores Independentes
Uma discussão no Reddit destaca que a falta de rastreamento granular de custos da API Claude Sonnet pode levar desenvolvedores independentes a abandoná-la, apesar de sua qualidade, com contas de US$ 400 a US$ 900 pegando-os de surpresa devido à observabilidade insuficiente em comparação com o monitoramento no estilo AWS.