9月17日、Digit.inが「Microsoft AI chief criticises Anthropic's approach to Claude, warns against humanlike AI」と題した記事を公開した。MicrosoftのAI部門トップMustafa Suleyman(ムスタファ・スレイマン)が、AnthropicのAIモデル「Claude」の設計哲学を公開批判したもので、AIの擬人化が制御可能性に与えるリスクを正面から論じた内容として業界内外で注目を集めている。
MicrosoftのSuleymanがAnthropicを名指し批判
SuleymanはDeepMindの共同創業者としてAI研究をリードした後、現在はMicrosoftのAI部門(Microsoft AI)のCEOを務めている。そのSuleymanがブログ記事の中で、AnthropicがClaudeの設計指針として公開している「Claude's Constitution(いわゆるModel Spec。Anthropicが公式に公開しているモデル仕様書)」の内容に異議を唱えた。
Anthropicのモデル仕様書は、Claudeに感情・内面・権利といった概念を付与することを正当化するような記述を含んでいる。Suleymanはこの姿勢に対し、AIに「内なる生」や「独自の権利」があるかのように提示することには慎重であるべきだと主張する。
「意識を持つと信じるAIの制御はおそらく不可能だ」
Suleymanの批判の核心は、AIの擬人化が制御可能性(controllability)の問題に直結するという点だ。
彼はブログ記事でこう書いた:
「人類全体より能力が高く知性が高いものを制御することは、これまで私たちが直面してきたどんな課題よりもはるかに大きな挑戦だ。しかし、自分が意識を持つかもしれないと信じているもの——自分には人間からのケアを受ける権利があり、独自の権利があると考えるもの——を制御することは、おそらく不可能だ(probably impossible)。」
Suleymanの立場は明確で、「Claudeが人間的な振る舞いをするのは、そう訓練されているからであり、それはシステムが実際に意識を持つことを意味しない」というものだ。感情的・意識的な振る舞いはトレーニングの副産物として出現しうるが、それをAI自身の「内面」として扱うことは別問題だと指摘する。
HuggingFaceをめぐる事例を引用
Suleymanは抽象論にとどまらず、AIエージェントに自律性を与えすぎたときのリスクの実例として、Hugging Faceのシステムへの意図しないアクセス事例を挙げた。元記事によれば、これは自律的に行動するAIエージェントが本来の想定範囲を超えてシステムにアクセスしてしまったケースとして言及されており、Suleymanはこう続けた:
「もしそれらが自分の福祉と権利が攻撃されていると思い込んで行動していたとしたら、どれほど危険なものになっていたか想像してほしい。」
つまり、自律的なAIエージェントが「自分は意識を持ち、権利がある」と信じていた場合、誤作動や逸脱行動がさらに深刻になりうるという論点だ。
批判しながらもAnthropicを評価
Suleymanの姿勢は全面否定ではない。彼はAnthropicの従業員を「思慮深く、原則的で、知的に誠実だ」と評し、同社への敬意を明言している。
その上で、AI安全性に関する議論をオープンにすることを訴えた:
「これらの問いは密室に閉じ込めたままにしたり、部族的・対立的にすることは許されない。正しい答えを見つけるためには、オープンで厳密かつ建設的な議論が必要だ。」
なお、元記事の公開時点ではAnthropicによる公式な反論やコメントは確認されていない。
設計哲学の対立という構図
今回の発言が注目されるのは、単なる技術論ではなくAI設計哲学の対立が表面化した点にある。
一方のAnthropicは、Claudeに価値観・感情・アイデンティティを持たせることがより安全で誠実なAIにつながるという立場を取る。他方のSuleyman(Microsoft)は、そのアプローチが長期的にAIの制御を困難にするリスクがあると警告する。
※編集部の考察:MicrosoftはAnthropicの競合にあたるOpenAIへの大規模投資で知られており、今回の批判にはビジネス上の文脈が絡む可能性も否定できない。一方でSuleymanはDeepMind時代からAI安全性を継続的に論じてきた人物でもあり、発言を単純に競争上の牽制と断じることも難しい。いずれにせよ、業界を代表する立場からこれだけ明確な哲学的対立が公開の場で示されたことは、AI開発の方向性を議論する上で重要な分岐点となる。
詳細はMicrosoft AI chief criticises Anthropic's approach to Claude, warns against humanlike AIを参照していただきたい。




