Apple utilise l'accès à Google Gemini pour la distillation de modèles d'IA sur l'appareil

Apple exploite les modèles d'IA Gemini de Google pour créer des versions plus petites et embarquées grâce à la distillation. Selon The Information, Google a donné à Apple un "accès complet" à Gemini dans ses propres centres de données, permettant à Apple de personnaliser le modèle pour Siri et d'autres fonctionnalités d'IA.
Fonctionnement du processus de distillation
Apple peut demander au modèle principal Gemini d'effectuer des tâches qui fournissent des résultats de haute qualité, y compris un résumé du processus de raisonnement. Apple alimente ensuite les réponses et les informations de raisonnement de Gemini pour entraîner des modèles plus petits et moins coûteux. Cela permet aux modèles plus petits d'apprendre les calculs internes utilisés par Gemini, produisant ainsi des modèles efficaces avec des performances similaires à Gemini mais nécessitant moins de puissance de calcul.
Détails techniques et défis
- Apple peut concevoir des modèles conçus pour fonctionner sur les appareils Apple sans connexion internet
- Apple peut modifier Gemini selon les besoins pour garantir que les réponses correspondent aux exigences d'Apple
- Apple a rencontré des problèmes car Gemini était optimisé pour les applications de chatbot et de codage, ce qui ne répond pas toujours aux besoins d'Apple
- La version plus intelligente et de type chatbot de Siri prévue pour iOS 27 s'appuiera sur les modèles Gemini de Google
Capacités et développement
Siri pourra effectuer de nombreuses fonctions similaires à Gemini et autres chatbots, notamment :
- Répondre aux questions
- Résumer des informations
- Analyser et comprendre des documents téléchargés
- Raconter des histoires
- Fournir un soutien émotionnel
- Accomplir des tâches comme réserver des voyages
L'équipe Apple Foundation Models continue de travailler sur des modèles d'IA Apple distincts des modèles Gemini, indiquant qu'il s'agit d'une approche transitoire pendant qu'Apple développe ses propres capacités d'IA.
📖 Read the full source: HN AI Agents
👀 See Also
Benchmark d'effort de raisonnement Opus 4.7 : Le niveau moyen bat les niveaux élevé et maximal sur des tâches réelles
Dans 29 tâches du dépôt GraphQL-go-tools, Opus 4.7 dans Claude Code atteint son pic à un effort de raisonnement moyen — des réglages plus élevés détériorent la correction et augmentent le coût sans améliorer la qualité des correctifs.

Les modèles d'IA manquent de connaissance de leurs propres outils et interfaces utilisateur.
Les modèles d'IA comme ChatGPT et Claude fournissent souvent des informations incorrectes ou obsolètes sur leurs propres fonctionnalités et interfaces, comme nier l'existence de nouvelles commandes slash ou décrire d'anciennes versions de l'interface utilisateur, car ils sont entraînés sur des instantanés passés alors que les produits évoluent constamment.

Accord de CBP avec Clearview AI : Reconnaissance faciale pour le ciblage tactique
Les douanes et la protection des frontières des États-Unis ont contracté Clearview AI pour le ciblage tactique, en utilisant la technologie de reconnaissance faciale sur des milliards d'images extraites d'Internet.

Analyse des prix de DeepSeek V4 : tokens en cache 178x moins chers qu'Opus, mais retard de capacités reconnu
Entrée DeepSeek V4 Pro à 0,145 $/M tokens contre Claude Opus 4.7 à 5 $/M (34x moins cher) ; hits de cache à 0,0036 $/M contre 0,625 $/M (173x moins cher). La capacité est en retard de 3 à 6 mois sur GPT-5.4 et Gemini 3.1 Pro.