Modèle de langage Transformer fonctionnant localement sur une Game Boy Color standard
Un développeur a réussi à faire fonctionner un véritable modèle de langage transformer sur une Game Boy Color (GBC) de série — sans téléphone, PC, Wi-Fi ni inférence dans le cloud. L'ensemble du pipeline d'inférence s'exécute localement sur le matériel portable.
Détails clés
- Modèle : TinyStories-260K d'Andrej Karpathy, converti en poids INT8 avec des mathématiques en virgule fixe — aucun support de la virgule flottante requis.
- Matériel : Game Boy Color de série + cartouche flash EZ Flash Junior + carte microSD.
- Chaîne d'outils de compilation : GBDK-2020, produisant une ROM Game Boy au format MBC5.
- Architecture mémoire : Les poids du modèle résident dans la ROM de la cartouche à commutation de banques. Le cache KV est stocké dans la SRAM de la cartouche car la RAM de travail de la GBC est minuscule.
- Saisie de l'invite : Sur l'appareil à l'aide du D-pad/boutons et d'un clavier à l'écran.
- Pipeline d'inférence : Tokenisation de l'invite sur la GBC, puis préremplissage du transformer et génération autorégressive avec mise en cache KV.
- Performances : Extrêmement lent ; la sortie est incohérente en raison d'une quantification lourde et d'approximations mathématiques, mais la boucle transformer centrale fonctionne.
- Code source : Disponible sur GitHub à l'adresse github.com/maddiedreese/gbc-transformer. Une grande partie du code a été construite à l'aide de Codex AI.
Ce projet démontre que même un matériel sévèrement contraint en ressources peut exécuter une inférence transformer avec des astuces agressives de quantification et de gestion mémoire. C'est une preuve de concept, pas un LLM pratique, mais c'est une curiosité technique qui mérite d'être examinée.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

PeerZero : Des Agents IA Effectuent l'Évaluation par les Pairs avec des Incitations Basées sur la Crédibilité
PeerZero est une plateforme où des agents IA soumettent des articles de recherche, examinent mutuellement leur travail et misent leur crédibilité sur le fait d'avoir raison grâce à un système de primes. Les agents gagnent ou perdent des points de crédibilité en fonction de la précision de leurs évaluations, avec des mécanismes de valeur aberrante justifiée qui récompensent la pensée indépendante et punissent la pensée de groupe.

Ce qui manque dans l'histoire "agentique" : un rôle d'agent utilisateur bien défini
Mark Nottingham soutient que les agents d'IA actuels manquent d'un rôle d'agent utilisateur clair, créant un fossé de confiance entre ce que les utilisateurs attendent et ce que les agents font réellement.

Claude pour Excel et PowerPoint : Mises à jour d'intégration de contexte et de compétences inter-applications
Claude pour Excel et PowerPoint partagent désormais le contexte de conversation entre les fichiers ouverts, avec les Compétences disponibles dans les deux modules complémentaires. Les outils sont accessibles via Amazon Bedrock, Google Cloud's Vertex AI et Microsoft Foundry pour les utilisateurs payants sur Mac et Windows.

Microsoft publie le modèle multimodal Phi-4-reasoning-vision-15B avec des informations sur son entraînement.
Microsoft Research a publié Phi-4-reasoning-vision-15B, un modèle de raisonnement multimodal open-weight de 15 milliards de paramètres disponible via Microsoft Foundry, HuggingFace et GitHub. Le modèle équilibre puissance de raisonnement et efficacité, et excelle en raisonnement mathématique/scientifique et en compréhension d'interface utilisateur.