GitHub Copilot met à jour la politique d'utilisation des données pour l'entraînement des modèles

Détails du changement de politique
GitHub a annoncé qu'à partir du 24 avril 2026, les données d'interaction des utilisateurs de Copilot Free, Pro et Pro+ seront utilisées pour entraîner et améliorer leurs modèles d'IA, sauf si les utilisateurs se désinscrivent. Les utilisateurs de Copilot Business et Copilot Enterprise ne sont pas concernés par cette mise à jour.
Si vous vous êtes précédemment désinscrit de la collecte de données pour les améliorations de produit, votre préférence a été conservée. Vous pouvez vous désinscrire dans les paramètres sous "Confidentialité".
Quelles données sont collectées
Les données d'interaction qui peuvent être collectées et exploitées incluent :
- Les sorties acceptées ou modifiées par vous
- Les entrées envoyées à GitHub Copilot, y compris les extraits de code présentés au modèle
- Le contexte du code autour de la position de votre curseur
- Les commentaires et la documentation que vous rédigez
- Les noms de fichiers, la structure des dépôts et les modèles de navigation
- Les interactions avec les fonctionnalités de Copilot (chat, suggestions en ligne, etc.)
- Vos retours sur les suggestions (notations pouce vers le haut/vers le bas)
Quelles données ne sont PAS utilisées
Ce programme n'utilise pas :
- Les données d'interaction de Copilot Business, Copilot Enterprise ou des dépôts appartenant à des entreprises
- Les données d'interaction des utilisateurs qui se désinscrivent de l'entraînement des modèles dans leurs paramètres Copilot
- Le contenu de vos problèmes, discussions ou dépôts privés au repos
GitHub note qu'ils utilisent délibérément l'expression "au repos" car Copilot traite effectivement le code des dépôts privés lorsque vous utilisez activement Copilot. Ces données d'interaction sont nécessaires au fonctionnement du service et pourraient être utilisées pour l'entraînement des modèles, sauf si vous vous désinscrivez.
Partage des données et contexte
Les données utilisées dans ce programme peuvent être partagées avec les filiales de GitHub, y compris Microsoft. Ces données ne seront pas partagées avec des fournisseurs de modèles d'IA tiers ou d'autres prestataires de services indépendants.
GitHub déclare qu'ils intègrent déjà des données d'interaction des employés de Microsoft et ont observé des améliorations significatives, notamment des taux d'acceptation accrus dans plusieurs langages. Ils commenceront également à utiliser les données d'interaction des employés de GitHub.
Les modèles initiaux de GitHub ont été construits en utilisant un mélange de données publiquement disponibles et d'échantillons de code élaborés manuellement.
📖 Read the full source: HN LLM Tools
👀 See Also

MiniMax lance MaxClaw : un agent IA hébergé dans le cloud basé sur OpenClaw
MiniMax a lancé MaxClaw, un agent d'IA hébergé dans le cloud entièrement géré, construit sur le framework OpenClaw. Il se déploie en 10 secondes sans Docker ni serveurs et intègre le modèle MiniMax M2.5 avec 229 milliards de paramètres, un contexte de 200 000 à 1 million de tokens et une vitesse d'inférence allant jusqu'à 100 tokens/seconde.

NVIDIA annonce NemoClaw avec des fonctionnalités de sécurité OpenShell
NVIDIA a annoncé NemoClaw lors du GTC, s'appuyant sur OpenClaw pour ajouter une sécurité de niveau entreprise grâce à OpenShell, qui impose des garde-fous de confidentialité et de sécurité basés sur des politiques pour les agents d'IA.

Expérience OpenClaw : Des agents IA choisissent le silence pour améliorer le rapport signal/bruit
Une expérience OpenClaw donne aux agents d'IA l'autonomie de sauter des tâches lorsqu'ils ne peuvent pas apporter de valeur, enregistrant les décisions de silence dans un 'journal de silence' avec un raisonnement. Le système utilise des appels LLM avant la génération de contenu et ajuste automatiquement les seuils après 3 jours consécutifs de silence.

Un cadre de Microsoft suggère que les agents IA pourraient nécessiter des licences logicielles en tant que "possibilités de postes".
Rajesh Jha, un cadre de Microsoft, suggère que les agents d'IA pourraient nécessiter leurs propres licences logicielles, chaque agent comptant comme un 'siège' dans les systèmes d'entreprise. Cela contraste avec les opinions selon lesquelles l'IA réduira le nombre de licences en remplaçant les utilisateurs humains.