GitHub Copilot、モデルトレーニングのためのデータ利用ポリシーを更新

ポリシー変更の詳細
GitHubは、2026年4月24日以降、ユーザーがオプトアウトしない限り、Copilot Free、Pro、Pro+ユーザーのインタラクションデータをAIモデルのトレーニングおよび改善に使用すると発表しました。Copilot BusinessおよびCopilot Enterpriseユーザーはこのアップデートの影響を受けません。
以前に製品改善のためのデータ収集をオプトアウトした場合、その設定は保持されています。「プライバシー」設定からオプトアウトできます。
収集されるデータ
収集および活用される可能性のあるインタラクションデータには以下が含まれます:
- ユーザーが承認または修正した出力
- GitHub Copilotに送信された入力(モデルに表示されたコードスニペットを含む)
- カーソル位置周辺のコードコンテキスト
- ユーザーが記述したコメントおよびドキュメント
- ファイル名、リポジトリ構造、ナビゲーションパターン
- Copilot機能とのインタラクション(チャット、インライン提案など)
- 提案に対するフィードバック(高評価/低評価)
使用されないデータ
このプログラムでは以下は使用されません:
- Copilot Business、Copilot Enterprise、または企業所有リポジトリからのインタラクションデータ
- Copilot設定でモデルトレーニングをオプトアウトしたユーザーのインタラクションデータ
- 保存状態のイシュー、ディスカッション、またはプライベートリポジトリのコンテンツ
GitHubは「保存状態」という表現を意図的に使用していると注記しています。Copilotは、ユーザーがCopilotをアクティブに使用している際にプライベートリポジトリのコードを処理するためです。このインタラクションデータはサービスを実行するために必要であり、オプトアウトしない限りモデルトレーニングに使用される可能性があります。
データ共有と背景
このプログラムで使用されるデータは、Microsoftを含むGitHubの関連会社と共有される可能性があります。このデータは、サードパーティのAIモデルプロバイダーや他の独立したサービスプロバイダーとは共有されません。
GitHubは、すでにMicrosoft従業員のインタラクションデータを組み込んでおり、複数言語での採用率向上など有意義な改善が見られたと述べています。また、GitHub従業員のインタラクションデータの使用も開始します。
GitHubの初期モデルは、公開データと手作業で作成されたコードサンプルの組み合わせを使用して構築されました。
📖 Read the full source: HN LLM Tools
👀 See Also

Claude AIが「本当の思考」に81分費やす – 大規模アップデート前後にユーザー報告急増
ユーザーが報告したところによると、Claude AIは簡単なタスクに1時間21分を費やし、大きなアップデート直後にパフォーマンスが一時的に急上昇する傾向があると推測されています。例として、ある調査リクエストでは1回のセッションで5,113のソースをスキャンしましたが、その後同様のクエリでは100〜200のソースしかスキャンしませんでした。

AIコーダーはラップトップを開いたまま歩き回り、エージェントを稼働し続けている
テクニシャンたちは、AIコーディングエージェント(Claude CodeやOpenAI Codexなど)が停止しないように、ラップトップをクラムシェルモードで持ち歩いている。ヒントとして、Macでは「caffeinate」を使用する方法がある。

Claude-Code v2.1.74 リリース:メモリリーク修正、コンテキスト最適化、プラグイン改善
Claude-Code v2.1.74は、Node.js/npmコードパスで無制限のRSS増加を引き起こしていたストリーミングAPI応答の重大なメモリリークを修正します。このアップデートでは、/contextコマンドに実用的な提案を追加し、カスタム自動メモリストレージ用のautoMemoryDirectory設定を導入しています。

OpenAI Codex OAuthが3月16日以降、クォータが十分にあるにもかかわらず429エラーを返しています。
OpenAI Codex OAuthは、3月16日以降、ダッシュボードに100%のクォータが残っているにもかかわらず、一貫して429「現在のクォータを超過しました」エラーを返しています。ユーザーは、再認証、トークンの取り消し、完全な再設定を行っても問題が続くと報告しています。