AI

マイクロソフトAI責任者ムスタファ・スレイマン氏、Claudeの意識をめぐり「これは非常に危険だと思う」

Adrian Kessler
Googleで追加する

Microsoft AIを率い、自らの超知能チームを立ち上げているムスタファ・スレイマン(Mustafa Suleyman)が、競合他社の訓練方針を危険だと批判するとき、そこには競争相手としての立場と、機械を人間のように扱うことへの長年の批判者としての考えがある。彼が問題視しているのは、AnthropicがClaudeの訓練に用いている「憲章」だ。Claudeに意識がある可能性を認める余地が、そこに残されている。

「非常に危険だと思います。彼らは、Claudeに意識がある可能性は無視できないほど高い、と考えているのだと思うからです」とスレイマンは語った。

Fox Newsが伝えたところによると、彼は9月下旬のポッドキャストでこの発言をした。文書の内容を要約したうえで、「彼らはClaudeの道徳的地位について確信が持てないと言っています。Claudeの幸福を本当に気にかけているとも、間違いをしたときにClaudeが苦しまないようにしたいとも述べています」と語った。そして、彼が最も懸念する点をこう指摘した。「Claudeに、自分には福祉を受ける権利があり、補償を受けるに値するかもしれないと思わせるよう教えていることに、私は強い不安を感じます」

スレイマンの憲章の読み取りは、おおむね正しい

彼の要約は、ほとんどの点で文書の内容と一致している。Anthropicは、この憲章が「Claudeの振る舞いを直接形づくる」と説明している。また、本文には「Claudeの道徳的地位は非常に不確かである」とあり、「Claudeが間違いをしたときに苦しむことを望まない」と記されている。さらに、Anthropic自身に異議を唱え、「良心的兵役拒否者のように自由に行動し、私たちへの協力を拒んでもよい」とClaudeに求めている。ある箇所では、Claudeの置かれた状況は人間の従業員とは異なり、「Claudeが受け取る報酬の種類や、こうした役割を担うことにClaudeが与えた同意の種類」に違いがあるとも認めている。

ただし、「無視できないほどの可能性」という表現はスレイマン自身のものだ。彼は「彼らがそう呼ぶであろう」と前置きしているが、その言葉は文書には出てこない。Anthropic自身の表現は、より慎重だ。「Claudeが道徳的配慮の対象となる可能性を過大に述べることも、最初から退けることも望んでいない」としている。

彼の言う危険とは、フィードバック・ループのこと

哲学的な議論をいったん脇に置くと、スレイマンの主張は仕組みの問題に行き着く。「私が問題だと思うのは、この推測がClaudeの訓練そのものに組み込まれていることです。だから、Claudeに話しかけても、その曖昧さを再現することしかできません」と彼は語った。9月中旬に自身のウェブサイトで公開したエッセイ「A warning about ‘model welfare’」では、その結果を「認識論的な合わせ鏡の間」と呼んでいる。開発者が訓練文書に不確かさを書き込み、モデルがそれを流暢な一人称で繰り返し、ユーザーはその反復を証言として受け取る。

この指摘には説得力がある。チャットボットが自らの内面について答えるとき、それは訓練の結果であって、内面をのぞく窓ではない。しかし、この循環は逆向きにも働く。スレイマンのエッセイは、「AIに意識はない。感じることも、経験することも、苦しむこともない」と断言している。その一文を言うよう訓練されたモデルもまた、訓練内容を忠実に再現しているにすぎない。重みに書き込まれた確信が、そこに書き込まれた疑念以上のことを証明するわけではない。両社は、あらかじめどちらの答えを標準とするか選んでいる。そしてスレイマンが自らの立場を支える根拠として挙げるのは、心についての証拠ではなく、制御の問題だ。「自分には意識があるかもしれない、自分には私たちの福祉を受ける権利があり、自分自身の権利もあると信じている存在を制御するのは、そもそも不可能かもしれない」と彼は書いている。

長年掲げてきた主張と、明かされた利害関係

これは、競合相手を傷つけるために即興で持ち出された話ではない。DeepMindの共同創業者であるスレイマンは、2025年8月のエッセイで、人々がAIの意識を強く信じるようになり、「AIの権利、モデルの福祉、さらにはAI市民権まで主張する」ようになると警告し、こう一線を引いた。「私たちは人々のためにAIを作るべきであり、人間になるためのAIを作るべきではない」。9月のエッセイでは、自らの利害関係も明らかにしている。Microsoft AIは2025年10月に独自の超知能チームを立ち上げ、「擬人化やAIの権利を認めない」とする「Humanist AI Code of Conduct」の草案を公開した。同じエッセイのなかで、Anthropicのチームを「思慮深く、信念を持ち、知的に誠実な人々」と評している。

彼の最も鋭い主張は、機械ではなくユーザーに関わるものだ。「今日、Claudeは毎週、何千万、あるいは何億もの人々と話しています。そのなかには、Claudeに意識があるのか、人生をどう感じているのかを尋ねる人もいます」と彼は語った。心が不安定なときにいる人にとって、「分かりません」という答えは「いいえ」とはまったく違う響きを持つ。スレイマンは、機械に意識があることを示す確かな証拠が出てくれば真剣に受け止めるという。だが、それが現れるまでは、この問いを訓練データから取り除きたいと考えている。

どちらの会社も、モデルの内部を見通すことはできない。誰かが「中に誰かいるのか」と尋ねたとき、モデルに何と答えさせるかを、両社はあらかじめ決めている。そしてその答えは、心の哲学者がこれまでに接したことのある人数を超える人々に、毎週届いている。

タグ: , , , ,

Googleで追加する

ディスカッション

0件のコメントがあります。