9月22日、Joseph Coxが「People Training OpenAI's AI Fired for Using AI to Train the AI」と題した記事を公開した。「職場でのAI活用」を事業の核に据えるOpenAIが、そのAIを訓練する人間に対しては契約上AIの使用を厳禁し、違反者を即座に解雇している——そんな逆説的な実態を、内部文書と複数の業者への取材によって明らかにした報道だ。
「AIでAIを訓練した」業者がクビに
OpenAIは、実際のChatGPTユーザーのプロンプトや会話データを読み取り、モデルの応答品質を改善するための請負業者を大量に抱えている。先週404 Mediaが報じた「Project Lily」では、数百人の業者がChatGPTの実会話を読んで評価・批評していることが明らかになっていた。今回の報道はその続報にあたる。
今回404 Mediaが入手した内部文書と3人の業者への取材によれば、こうした訓練作業に関わる業者の数は1万人超に上るプロジェクトも存在する。そしてその中で、AIを使ってAI訓練データを生成した業者が解雇されるケースが後を絶たないという。
ある業者は次のように証言した。
「AIを使っている人は常にいて、常に解雇されている。それがほぼ唯一の即クビ案件だ。数千人規模のグループの中で、捕まった人間は山ほどいる」
内部文書が明かす「AI検出」の実態
入手した内部文書には、業者が他の業者の作業を監査する「レビュアー」向けの指示が含まれていた。そこには以下のような記述がある。
「AIツールを使用しないこと。GPTZeroその他のAI検出ツールも使わないこと。それらは信頼性がない。レビュアー自身もAIを使ってはならない。GrammarlyやAI翻訳も含む」
さらに注目すべき一節がある。
「なぜAIを疑っているかを評価対象者に伝えるな。手がかりを知られると隠すのが容易になる。一つの兆候ではなく、全体的なパターンで判断せよ」
AI使用の判断材料として挙げられているのは、繰り返しの多い語彙、AIらしい句読点の使い方(たとえばダッシュ記号の多用)、そして作業の異常な速さだという。関連するSlackチャンネルでは「これはAIが書いたか?」という質問が頻繁に投稿され、「だいたい答えはYes」だと業者は語った。
「少し助けが必要だっただけ」——解雇された業者の声
AIを使って作業し実際に解雇された業者の一人は、解雇通知とされる文書を404 Mediaに共有した。そこには作業の「真正性」に問題があったと記載されていた。本人はこう話す。
「私は悪い人間でも悪い労働者でもない。少し助けが必要でAIに頼ったら、それが失脚につながった。その仕事に喜びも、社会への貢献感も感じられなかった」
「意図的にAIを悪化させていた」業者も
さらに踏み込んだ証言もある。複数のAI企業のモデル訓練に関わった別の業者は、意図的に最悪の応答を選んでモデルの訓練を妨害していたと明かした。
「最初はこの仕事に罪悪感を覚えた。だから結果をまったく気にせずランダムに選んだり、意図的に最悪の出力を選んだりした。実際にどれだけ影響があるかわからない。他にも何百人もいるから。でも、AIを悪化させるために報酬をもらっている気分だった」
「AIを使うな」と契約で縛るAI企業の矛盾
今回の業者の一部は、OpenAIの下請けとして動くAI訓練企業Mercorに雇用されていた。MercorはAI開発向けのデータラベリングや人材マッチングを手がけるスタートアップで、OpenAIをはじめとする複数のAI企業の訓練業務を請け負っている。同社の広報担当者は声明でこう述べた。
「当社の専門家は専門知識と判断力のために雇われており、それがAI発展に不可欠だ。契約上LLMの使用は厳禁であり、違反の検出に多大な投資をしている。AI使用が確認された場合、即座にプロジェクトから外す」
一方、OpenAIは本件についてのコメントを拒否した。
「職場でのAI活用」を推進することを事業の核とするOpenAIが、そのAIを訓練する人間に対しては契約上AIの使用を厳禁し、違反した者を解雇している——この構図の持つ皮肉は、記事全体を通じて際立っている。
また、こうした不正が深刻なのは品質面でも同様だ。AIが生成したテキストでさらにAIを訓練すると、モデルの性能が徐々に劣化する「モデル崩壊(model collapse)」が起きることが研究者の間で広く知られている。その劣化を防ぐために雇われた業者が、自らAI生成コンテンツを訓練データに紛れ込ませていたことになる。
詳細はPeople Training OpenAI's AI Fired for Using AI to Train the AIを参照していただきたい。




