ハリウッド脚本家がAIトレーニングへ転身:データアノテーション作業の一人称レポート

パラマウント、Hulu、BBCで番組を手がけてきたハリウッドの脚本家兼ショーランナーによる一人称の体験記。2023年の脚本家ストライキで従来の収入が途絶えた後、AIトレーニングの仕事に移行した経緯を描く。現在は「ri611」のようなハンドルネームで、Mercor、Outlier、Task-ify、Turing、Handshake、Micro1といった企業向けにデータ注釈業務を行っている。
参入までの経緯
- 非公式のWriters Guild Facebookグループで機会を発見:Mercorが脚本家に時給150ドルを支払うという投稿があった。
- 10件の仕事に応募し、テストに20時間の無給を費やし、AI採用エージェント(画面上でちらつく光)と面接。
- 6週間後に「ジェネラリスト」データ注釈者として採用され、時給52ドル(「エキスパート」よりは低いが、エントリーレベルよりは高い)。
毎日の業務
- ユーザーと主要なLLMチャットボットとの会話を読み、応答を1~5の尺度で評価し、文章で理由を記述。
- 口調を評価:自然か平坦か、気取っているか迷惑か。
- 画像に注釈(家具のパターン、グループ写真から個人を特定)。
- 動画イベントにタイムスタンプ:犬の吠え声、見知らぬ人が窓の前を通り過ぎる様子、風船の破裂。
- センシティブなコンテンツ(アニメの性的シーン、暴力的な画像、爆弾のレシピ)を生成し、レッドチームのセーフティテストに使用。
労働環境
- Slackチャンネル、Airtable、支払いポータル、Google Workspaceアプリ経由でタスクが割り当てられる。
- チームリーダーは明確に述べた:「これらは仕事ではなく、タスクであり、私たちはタスカーです」。
- プロジェクトマネージャー:投資銀行を志望していた22歳の新卒。
- 家賃を払い、食料を買い、清掃員(定額150ドル)を雇っている。
開発者への参考情報
この体験記は、LLMトレーニングデータの背後にある人間の労働を示している。トーン、ナラティブ、安全性の専門家である脚本家が、チャットボットの応答を評価し、エッジケースのコンテンツを生成している。AIエンジニアにとっては、データ品質が低賃金で不安定な請負業者に依存していることを思い出させる。OutlierやMercorのようなツールがこの労働を仲介し、タスク構造(タスク単位、福利厚生なし)はギグプラットフォームを反映している。
📖 原文を読む: HN AI Agents
👀 See Also

Claude Code v2.1.117 リリース: サブエージェント分岐、プラグインの改善、パフォーマンス修正
Claude Code v2.1.117は、CLAUDE_CODE_FORK_SUBAGENT=1の設定により外部ビルドでのフォークサブエージェントを有効化し、プラグイン依存関係の処理を改善し、Opus 4.7のコンテキストウィンドウ計算を修正します。このリリースには、並行MCP接続による高速な起動、およびmacOS/LinuxでのGlob/Grepツールの埋め込みbfs/ugrepへの置き換えが含まれています。

Claude Sonnet 4.6 公開:コーディングとコンピューター操作能力が強化
Claude Sonnet 4.6は、100万トークンのコンテキストウィンドウを導入し、コーディングとコンピューター利用スキルを向上させ、より幅広いタスクにおいてOpusクラスモデルの有力な代替手段となっています。

NVIDIA、エージェントAIワークロード向け「Vera CPU」を発表
NVIDIAは、エージェント型AIと強化学習ワークロード向けに特別に設計されたプロセッサ「Vera CPU」を発表しました。従来のラックスケールCPUと比較して、50%高速な性能と2倍の効率性を実現するとNVIDIAは主張しています。

OpenRouterに2つの新モデルが登場、おそらくDeepSeek V4の亜種か
OpenRouterにhealer-alphaとhunter-alphaという2つの新モデルが登場し、その仕様はDeepSeek V4に関するリーク情報と一致しています。初期テストでは、両モデルともロールプレイシナリオで良好な性能を示し、メッセージフィルタリングがなく、GLM 5.0よりも高速なトークン生成が確認されました。