GitHub Copilot atualiza política de uso de dados para treinamento de modelos

Detalhes da mudança de política
O GitHub anunciou que, a partir de 24 de abril de 2026, dados de interação de usuários do Copilot Free, Pro e Pro+ serão usados para treinar e melhorar seus modelos de IA, a menos que os usuários optem por não participar. Usuários do Copilot Business e Copilot Enterprise não são afetados por esta atualização.
Se você optou anteriormente por não participar da coleta de dados para melhorias de produto, sua preferência foi mantida. Você pode optar por não participar nas configurações em "Privacidade".
Quais dados são coletados
Os dados de interação que podem ser coletados e utilizados incluem:
- Saídas aceitas ou modificadas por você
- Entradas enviadas ao GitHub Copilot, incluindo trechos de código mostrados ao modelo
- Contexto de código ao redor da posição do seu cursor
- Comentários e documentação que você escreve
- Nomes de arquivos, estrutura de repositório e padrões de navegação
- Interações com recursos do Copilot (chat, sugestões inline, etc.)
- Seu feedback sobre sugestões (classificações de polegar para cima/baixo)
Quais dados NÃO são usados
Este programa não usa:
- Dados de interação do Copilot Business, Copilot Enterprise ou repositórios de propriedade empresarial
- Dados de interação de usuários que optam por não participar do treinamento de modelo em suas configurações do Copilot
- Conteúdo de seus problemas, discussões ou repositórios privados em repouso
O GitHub observa que usam a frase "em repouso" deliberadamente porque o Copilot processa código de repositórios privados quando você está usando ativamente o Copilot. Esses dados de interação são necessários para executar o serviço e poderiam ser usados para treinamento de modelo, a menos que você opte por não participar.
Compartilhamento de dados e contexto
Os dados usados neste programa podem ser compartilhados com afiliadas do GitHub, incluindo a Microsoft. Esses dados não serão compartilhados com provedores de modelos de IA de terceiros ou outros provedores de serviços independentes.
O GitHub afirma que já vem incorporando dados de interação de funcionários da Microsoft e tem visto melhorias significativas, incluindo taxas de aceitação aumentadas em vários idiomas. Eles também começarão a usar dados de interação de funcionários do GitHub.
Os modelos iniciais do GitHub foram construídos usando uma mistura de dados publicamente disponíveis e amostras de código elaboradas manualmente.
📖 Leia a fonte completa: HN LLM Tools
👀 See Also

Investimento do Reino Unido em IA sob escrutínio: datacenters fantasmas e financiamento não verificado
Uma investigação do Guardian revela que o impulso de bilhões de libras do Reino Unido pela IA inclui 'investimentos fantasmas' com datacenters alugados, um local de supercomputador que ainda funciona como pátio de andaimes e alegações não verificadas de criação de empregos.

Modelos de IA Aceleram a Pesquisa Matemática e a Descoberta de Provas
Os modelos de IA estão sendo usados por matemáticos para descobrir e provar novos resultados, realizando em um dia o que antes levava semanas ou meses. Em julho de 2025, vários modelos de IA resolveram cinco dos seis problemas da Olimpíada Internacional de Matemática.
Um Desalinhamento da IA na Matemática: Tao, o Economista e um Debate de 622 Comentários no HN
Terry Tao e The Economist publicaram textos sobre desalinhamento de IA na matemática no dia 11 de setembro de 2026. A thread do HN alcançou 560 pontos e 622 comentários.

Ubuntu Linux integrará recursos de IA no próximo ano, começando com inferência local
A Canonical anuncia uma iniciativa de IA plurianual para o Ubuntu, com foco em inferência local, fluxos de trabalho agênticos e recursos de SO sensíveis ao contexto, com recursos sendo lançados ao longo de 2026.