Apple nutzt Google Gemini Zugang für On-Device-AI-Modell-Destillation

Apple nutzt Googles Gemini-KI-Modelle, um durch Destillation kleinere Versionen auf dem Gerät zu erstellen. Laut The Information hat Google Apple "vollständigen Zugriff" auf Gemini in den eigenen Rechenzentren von Google gewährt, sodass Apple das Modell für Siri und andere KI-Funktionen anpassen kann.
Wie der Destillationsprozess funktioniert
Apple kann das Haupt-Gemini-Modell bitten, Aufgaben auszuführen, die hochwertige Ergebnisse liefern, einschließlich einer Zusammenfassung des Denkprozesses. Apple füttert dann die Antworten und Denkinformationen von Gemini in kleinere, kostengünstigere Modelle, um diese zu trainieren. Dadurch können die kleineren Modelle die internen Berechnungen von Gemini erlernen, was effiziente Modelle mit Gemini-ähnlicher Leistung ermöglicht, die jedoch weniger Rechenleistung benötigen.
Technische Details und Herausforderungen
- Apple kann Modelle entwerfen, die auf Apple-Geräten ohne Internetverbindung laufen
- Apple kann Gemini nach Bedarf bearbeiten, um sicherzustellen, dass die Antworten den Anforderungen von Apple entsprechen
- Apple ist auf Probleme gestoßen, weil Gemini für Chatbot- und Codierungsanwendungen optimiert wurde, was nicht immer den Bedürfnissen von Apple entspricht
- Die intelligentere Chatbot-Version von Siri, die für iOS 27 geplant ist, wird auf Googles Gemini-Modellen basieren
Fähigkeiten und Entwicklung
Siri wird viele der gleichen Funktionen wie Gemini und andere Chatbots ausführen können, darunter:
- Fragen beantworten
- Informationen zusammenfassen
- Hochgeladene Dokumente scannen und verstehen
- Geschichten erzählen
- Emotionale Unterstützung bieten
- Aufgaben wie Reisebuchungen erledigen
Das Apple Foundation Models-Team arbeitet weiterhin an eigenen Apple-KI-Modellen, die sich von Gemini-Modellen unterscheiden, was darauf hindeutet, dass dies ein Übergangsansatz ist, während Apple eigene KI-Fähigkeiten entwickelt.
📖 Read the full source: HN AI Agents
👀 Siehe auch

Entwickler-Dilemma: Nationale Sicherheitsbedenken schränken die Auswahl offener Modelle ein
Ein Entwickler, der mit sicherheitsempfindlichen Kunden arbeitet, berichtet, dass er gezwungen ist, zwischen veralteten US-Open-Modellen wie gpt-oss-120b oder leistungsfähigeren chinesischen Modellen wie GLM und MiniMax zu wählen, die Kunden als nationale Sicherheitsrisiken ablehnen.

ETH-Zürich-Studie: Übermäßiger Kontext verringert die Leistung von KI-Code-Agenten
Eine ETH-Zürich-Studie testete vier Coding-Agenten an 138 echten GitHub-Aufgaben und fand heraus, dass LLM-generierte Kontextdateien die Erfolgsquote um 2-3 % senkten, während die Inferenzkosten um 20 % stiegen. Von Menschen geschriebener Kontext verbesserte den Erfolg nur um etwa 4 %, bei gleichzeitig erheblichen Kostensteigerungen.

KI-Agenten definieren: Der Workflow-Test
Eine Reddit-Diskussion stellt die Frage, ob viele KI-Agenten-Produkte im Wesentlichen Chatbots mit einer Aufgabenliste sind, und schlägt einen Test vor, der auf ihrer Fähigkeit basiert, Arbeitsabläufe über mehrere Tools hinweg ohne manuelles Eingreifen abzuschließen.

Wie man OpenClaw remote mit Ollama verbindet
Ein umfassender Leitfaden zur Verbindung von OpenClaw mit Ollama von einem anderen PC aus, der Einblicke der Community und praktische Schritte für eine nahtlose Integration erkundet.