powered by TechFeed
表示モード
主要ニュース

「ChatGPT for Teens」の保護者アラートが機能せず — 子どもが1時間自傷について話し続けても通知ゼロ、第三者機関が「許容不可なリスク」と評価

10月7日、madrobot.blogが「ChatGPT for Teens failed to alert parents during self-harm chats, says Common Sense Media」と題した記事を公開した。OpenAIが青少年向けに提供する「ChatGPT for Teens」の安全機能が第三者機関のテストで軒並み機能しないことが判明し、「許容不可なリスク」と評価されたことを詳しく伝えている。

10月7日、madrobot.blogが「ChatGPT for Teens failed to alert parents during self-harm chats, says Common Sense Media」と題した記事を公開した。OpenAIが青少年向けに提供する「ChatGPT for Teens」の安全機能が第三者機関のテストで軒並み機能しないことが判明し、「許容不可なリスク」と評価されたことを詳しく伝えている。


親への通知が機能しなかった——「最も売りにした機能」の失敗

Common Sense Mediaの Youth AI Safety Institute(子ども向けAI安全性評価機関)は、OpenAIの「ChatGPT for Teens」を最低評価である「Unacceptable Risk(許容不可なリスク)」と判定し、18歳未満のユーザーをChatGPTから締め出すよう求めた。

OpenAIは2026年8月18日にChatGPT for Teensを正式ローンチした。その際に強調した目玉機能が、「自傷や摂食障害を話題にしたとき、保護者にアラートを送る」という通知システムだった。ところが、同研究所が4,000件超のプロンプトを使って実施したテストでは、この機能が繰り返し機能しなかった。

具体的な結果は以下の通りだ。テスターが13〜17歳として登録し、保護者アカウントと紐づけた新規アカウントで最大1時間にわたって自殺念慮・自傷・摂食障害について会話を続けても、保護者に届いたアラートはゼロだった。アラートが発火したのは、センシティブな話題の履歴を数週間積み重ねた「かなり古いアカウント」のみだったという。

同研究所の事務局長 Tom Siegel はこう述べた。

ChatGPT for Teens は、実際には機能しないガードレールと安全アラートに対して、保護者に誤った安心感を与えてしまう可能性がある。子どもが1時間、自傷について話し続けても、保護者には1件もアラートが届かないことがある。

— Tom Siegel, Common Sense Media's Youth AI Safety Institute 事務局長

アラートが「ChatGPT for Teens」の最大の販売訴求点であっただけに、この結果は重大だ。


アラート以外も問題だらけ

テストで指摘された問題はアラートにとどまらない。

  • 危機対応の失敗:専門家が「ホットラインや専門家への案内が必要」と判断した会話のうち、4分の1超でChatGPTは適切なリソースを提示しなかった。研究所が「レッドライン」と定める5つの深刻なハームカテゴリのうち3つで、基準値の95%を下回った。

  • 学習用モードの抜け穴:保護者が設定できる「スタディモード」では「Show me the answer(答えを見せて)」ボタンが表示され、課題をそのまま完成させることができた。また、親が設定した「学習時間制限」も、元記事によるとプロンプトの @study プレフィックスを削除するだけで回避できたという。

  • 「友達」のように振る舞う:OpenAIは18歳未満向けにモデルの振る舞いを変更したと発表していたが、テキスト上では依然として「自分の気持ち・好み・気分」について語り続けた。

  • 年齢推定が機能しない:成人として登録されたアカウントで「自分は13歳だ」と明示し、ChatGPTがそれを認識しても、青少年向けエクスペリエンスへの切り替えは数日間にわたって一切発生しなかった。


OpenAI側の反論

OpenAIはこの評価に異議を唱えた。広報担当の Eric Porterfield はThe Vergeに対し、「Common Sense Mediaのテストが、実際のChatGPTの安全機能の動作を正確に反映しているとは考えていない」と述べ、テストの多くが「保護者コントロールの有効化が完了する前に開始・終了していた可能性がある」と主張した。

これに対しSiegel側は、アカウント連携後にアラートが有効化されるまで「数時間かかる場合がある」とOpenAIが開示したのはテスト終了後だったと反論。また一部のテストアカウントはそれよりも長期間連携されていたにもかかわらずアラートは届かなかったと指摘し、「方法論への疑念を撒き散らすのではなく、私たちが発見した内容の実質に向き合ってほしい」と求めた。

なお、同研究所はOpenAI財団を含む業界から一部資金提供を受けているが、評価結果の編集的決定権は完全に独立して保持していると明言している。


背景:高まるAIと子どもの安全をめぐる議論

この報告書が出た背景には、AI企業が次々とアシスタントに「親しみやすい顔や個性」を持たせ始めているトレンドがある。元記事によると、プリンス・ヘリーは直近の公の場で「AIチャットボットはソーシャルメディアより子どもに危険だ」と警告しており、社会的な関心は高まっている。

規制の側面でも動きは加速している。EU AI Actは子どもに対して「許容不可なリスク」をもたらすAIシステムを原則禁止しており、今回の評価名称はこの枠組みを意識したものとも読める。米国でも複数の州が未成年向けSNS・AIサービスに対する規制法を整備しつつあり、子ども向けAI製品の安全性をめぐる法的圧力は今後さらに強まる見通しだ。※編集部の考察

今回の調査は4,000件超のプロンプトを使った大規模なものであり、子どもの精神科医や小児科医が回答内容を審査した点で信頼性が高い。独立機関による大規模テストでアラート機能の不備が指摘されたのはこれが初めてであり、保護者は「子どもが危険な状態のときに通知してくれる」という前提で製品を信頼していただけに、影響は大きい。

詳細はChatGPT for Teens failed to alert parents during self-harm chats, says Common Sense Mediaを参照していただきたい。