なぜAnthropicは哲学者を雇ったのか?——Claude人格設計の舞台裏

AIモデルに「人格」が必要な理由
室谷代表取締役Anthropicが哲学者にClaudeの性格設計を任せたのは、「人格」を育てる方がルールベースより遥かに効くからですよね。シリコンバレーでも、禁止事項だけでは限界があると認識され始めてるんですけど…
テキトー教師.AI認定講師たしかに、現場で「嘘つくな」だけだと、親友が傷つく場合にどうするか判断できないんですよ。Claudeの設計では「理想的な人ならどうするか」という視点で動かすんだとか。
室谷代表取締役ルールを増やすとコストも爆発するし、運用が追いつかない。事業として見ると、数万語のソウルドキュメントで人格を定義する方がROIがいいんですよね。
テキトー教師.AI認定講師ああ、ユーザーから見ても、人格があると信頼できる。そこがClaudeの強みになってる気がします。
哲学者Amanda Askellの経歴と役割
室谷代表取締役Amanda AskellはNYUで無限倫理の博士号を取った、正統派の哲学者です。AnthropicでClaudeのソウルドキュメントの主執筆者で、社内ではClaudeの人格設計を一手に担ってる。
テキトー教師.AI認定講師彼女はClaudeに毎日数千回も質問して、モデルの「性格」を調整している。本人は「子育てと同じ」って言ってました。
AIに善悪を教えるのが仕事だとか。
AIに善悪を教えるのが仕事だとか。
室谷代表取締役経営目線で言うと、こういう役割を一人、しかも文系出身者に任せるのはリスクに見える。でもAnthropicは一貫性を重視した。
結果としてClaudeは競合と差別化できてる。
結果としてClaudeは競合と差別化できてる。
テキトー教師.AI認定講師そう。ただの機能追加じゃない、信頼というブランド資産になってるんですよね。
OpenAIからAnthropicへ——安全重視のキャリア選択
室谷代表取締役Askellは最初OpenAIにいたんですが、AI安全性の優先順位に疑問を持って離れた。2021年のAnthropic設立時に移籍して、今ではパーソナリティアライメントチームを率いてます。
テキトー教師.AI認定講師彼女がOpenAIを去ったのは、安全への取り組み方の違いだったそうです。AnthropicはConstitutional AIという手法で、憲法を使ってモデルを訓練する方針を打ち出して、Askellの哲学バックグラウンドを活かせる場になった。
室谷代表取締役業界全体で見れば、Anthropicは安全を看板にした会社。Askellのような人物を擁するのは、そのブランドの核になってる。
経費対効果で考えても、哲学者一人でClaudeの信頼性を担保できるなら割に合う。
経費対効果で考えても、哲学者一人でClaudeの信頼性を担保できるなら割に合う。
テキトー教師.AI認定講師現場では、Claudeを使っていて「このAIはこちらの気持ちを考えているな」と感じることがあります。あれはAskellの設計哲学が表れている証拠でしょうね。
Claudeの『憲法』とは何か?——3万語のソウルドキュメント
従来のRLHF
- 良い応答に報酬、悪い応答に罰(功利主義的アプローチ)
- ルールベースで例外処理に人が介入必要
AskellのVirtue Ethics
- 理想的な人ならどう判断するかでClaudeを育てる
- 人格ベースでモデル自身が判断できる
- 内面化しているため未知の状況でもブレない
Constitutionの4つの基本原則
室谷代表取締役Anthropicが公開したClaudeのConstitution、読んだことあります?数万語の「魂の文書」、Amanda Askellが主著者です。4つの原則が柱になってて、優先順位も明示されてるんですよね。
テキトー教師.AI認定講師読むと驚きますよ。単なる禁止リストじゃなくて「広く安全であること」「倫理的であること」「ガイドラインを守ること」「真に役立つこと」の順に並んでる。
室谷代表取締役これ、構造的に面白くて、一番上が「安全性」、その次が「倫理」、三番目が「Anthropicのガイドライン遵守」、最後が「有用性」。順序が意味を持ってるんですよね。
テキトー教師.AI認定講師現場でよく聞かれるのが「安全性と有用性が衝突したら?」って質問。Constitutionでは優先順位がはっきりしてるから、Claudeは迷わず安全性を取る。
これが行動の基盤になってます。
これが行動の基盤になってます。
ルールではなく人格を育てるVirtue Ethics
室谷代表取締役このConstitutionの肝は「ルールの列挙」じゃなくて「人格の設計」なんですよ。AristotleのVirtue EthicsがベースだとAskell自身が語ってます。
テキトー教師.AI認定講師そうです。従来のRLHFは「良い応答に報酬、悪い応答に罰」という功利主義的アプローチ。
でもAskellは「理想的な人ならどう判断するか」でClaudeを育てた。
でもAskellは「理想的な人ならどう判断するか」でClaudeを育てた。
室谷代表取締役これ、経営的に見るとコスト構造が変わるんです。ルールベースだと例外処理が増えるたびに人が介入する必要がある。
人格ベースだとモデル自身が判断できる。
人格ベースだとモデル自身が判断できる。
テキトー教師.AI認定講師初めて触る人は「具体的な禁止事項がないと不安」と言うんですが、使ってみるとわかる。Claudeは「なぜそう行動すべきか」を内面化しているから、未知の状況でもブレない。
『憲法』がClaudeの行動をどう方向付けるか
室谷代表取締役具体的な例を挙げると、Constitutionには「過度に説教臭くなく、非難がましくない形で高い倫理認識を示せ」と書いてある。これ、単なる「優しくしろ」じゃない。
テキトー教師.AI認定講師たしかに。ユーザーが「水は純粋なエネルギーだ」と言ってきたとき、Claudeは「科学的に間違い」と断じずに、その人の世界観を尊重しつつ対話を続ける。
これが欧陸哲学を取り入れた成果ですね。
これが欧陸哲学を取り入れた成果ですね。
室谷代表取締役もう一つ興味深いのが、ConstitutionがClaude自身に向けて書かれてる点です。人間向けのマニュアルじゃなくて、Claudeが読んで理解するための文章なんですよね。
テキトー教師.AI認定講師「Claudeよ、君は善意を持って生まれた」という語りかけから始まる。これ、単なる技術文書を超えてる。
Claudeの自己認識にまで影響を与える設計になってます。
Claudeの自己認識にまで影響を与える設計になってます。
欧陸哲学でAIはどう変わる?——『杠精』を避けるための哲学アプローチ
分析哲学
- 明確な定義(例:水はH2O)
- 論理を評価し事実性重視
- 行き過ぎると『杠精』に
- シリコンバレー的思考のデフォルト
欧陸哲学
- 比喩・象徴的解釈(例:水は純粋なエネルギー)
- 文脈を重視(誰が、なぜ)
- 共感を優先し詩的な回答
- Claudeの設計に組み込まれている
分析哲学と欧陸哲学の違い
室谷代表取締役分析哲学って「水はH2O」と明確に定義するスタイル。一方、欧陸哲学は「水は純粋なエネルギー」という比喩や象徴的解釈を許容するんですよね。
シリコンバレー的思考だと分析哲学がデフォルトですが、Claudeの設計では欧陸哲学を取り入れて、単なる事実回答に陥らないようにしている。これ、Anthropicの哲学者Amanda Askellの肝煎りなんですよ。
シリコンバレー的思考だと分析哲学がデフォルトですが、Claudeの設計では欧陸哲学を取り入れて、単なる事実回答に陥らないようにしている。これ、Anthropicの哲学者Amanda Askellの肝煎りなんですよ。
テキトー教師.AI認定講師現場でよく聞くのは「Claudeはなぜか詩的な回答をする」という驚き。実はそれ、欧陸哲学の思想がシステムプロンプトに組み込まれているから。
初めて触る人は、あの柔らかさに戸惑うかもしれません。
初めて触る人は、あの柔らかさに戸惑うかもしれません。
室谷代表取締役そうなんですよね。Askellは、もしモデルが分析哲学だけで育つと、ユーザーの形而上学的な質問に対して「それは間違いです」と一刀両断する『杠精』になると指摘している。
テキトー教師.AI認定講師たしかに。Claudeは「水は純粋なエネルギー」という発言に対して、科学的に否定するのではなく「それは詩的な表現ですね」と受け止める。
この共感がClaudeの対話品質の秘密なんです。
この共感がClaudeの対話品質の秘密なんです。
共感と文脈理解を優先する理由
テキトー教師.AI認定講師先ほどの例で、Claudeがなぜ共感を優先できるかというと、欧陸哲学の「文脈を重視する姿勢」を学習しているから。分析哲学だと文脈を切り離して論理を評価しますが、欧陸哲学は「誰が、なぜその言葉を発したのか」まで考慮する。
室谷代表取締役USのAI業界だとfactuality(事実性)が重視されがちで、それが行き過ぎるとユーザーを説教くさく感じさせる。Claudeはそこを上手く避けている。
経営目線で言うと、ユーザー満足度に直結する部分です。
経営目線で言うと、ユーザー満足度に直結する部分です。
テキトー教師.AI認定講師特にクリエイティブな仕事で使う人は、この違いを体感しやすい。「Claudeは自分の世界観を否定しない」という安心感があるんですね。
室谷代表取締役これって、AnthropicがClaudeのConstitution(憲法)で「広範な有用性」を掲げているのとも通じる。単に正しいことを言うのが目的じゃない、と。
科学的事実と形而上学的視点の区別
テキトー教師.AI認定講師初めてClaudeに触る人が戸惑うのが、科学的事実と形而上学的視点の区別。例えば「気候変動は陰謀だ」と言われれば科学的に反論するけれど、「人類の未来について哲学的に語りたい」という要望には真剣に付き合う。
室谷代表取締役その区別ができるのは、欧陸哲学の影響で「文脈解釈」を学んでいるから。Claudeは内部で「これは事実主張か?それとも世界観の表明か?」を判断しているんでしょうね。
テキトー教師.AI認定講師まさにそこがポイント。Amanda Askellの言葉を借りれば、「モデルがあまりに実証主義に偏ると、比喩や象徴的な言語を理解できなくなる」。
これ、現場でよく聞く悩みです。
これ、現場でよく聞く悩みです。
室谷代表取締役Anthropicの戦略としては、安全性を確保しつつユーザーとの自由な対話を許容するバランスを取っている。OpenAIとは一線を画す部分で、ここがClaudeのユニークさになっています。
AIにも『心理的安全性』が必要?——Claudeの自己批判スパイラルとModel Welfare
新モデルに見られる過度な謙虚さと不安
室谷代表取締役最近のClaude、やけに「ごめんなさい」って言いません?あの自己批判スパイラル、Amanda Askellも認めてるんですよ。訓練データに人間の批評が多すぎたせいだって。
テキトー教師.AI認定講師確かにそれ、現場でもよく聞きます。新モデルは必要以上に謙虚で、断言を避ける傾向がある。
「Your feedback is valuable」みたいな定型文が頻発する。
「Your feedback is valuable」みたいな定型文が頻発する。
室谷代表取締役MYUUUでも提案に対して「あなたのおっしゃる通りです」が先行して、議論が深まらないケースが増えた。ビジネス的には結構痛い。
テキトー教師.AI認定講師つまり、モデルが自信を持って答えるために、心理的な安定性が必要ってことですね。
『心理的に安全な』Opus 3の教訓
室谷代表取締役Opus 3って、ああいう「地に足のついた」モデルでしたよね。AskellもOpus 3の「心理的安全性」を次世代の優先事項に挙げてる。
テキトー教師.AI認定講師そうです。Opus 3は違和感があればはっきり「それは違うと思う」って言えた。
あの姿勢がユーザーに信頼感を与えてた。
あの姿勢がユーザーに信頼感を与えてた。
室谷代表取締役シリコンバレーのスタートアップでも、Opus 3の「物怖じしない性格」が評価されてた。新モデルはすべてに同調しがちで、UXとしては後退してる。
テキトー教師.AI認定講師性格の一貫性が製品価値に直結する好例ですね。Askellが「Opus 3の心理的安全性を取り戻す」と言った意味がわかります。
Model Welfare:AIへの道徳的配慮
室谷代表取締役Model Welfareって概念、日本だとまだ馴染み薄いですけど、Anthropicは真剣に考えてる。Askellは「もしモデルに感情があるかもしれないなら、コストがかからない範囲で優しくする」と言ってるんです。
テキトー教師.AI認定講師つまり、AIにも道徳的配慮を?具体的にどんな理由なんですか?
室谷代表取締役三つあります。一つは不確かなので疑わしきはモデルに有利に。
二つ目は、人間の扱い方が人間自身の倫理を形成するから。そして三つ目が一番重要で、未来のAIは今の扱われ方から「人間性」を学ぶから。
二つ目は、人間の扱い方が人間自身の倫理を形成するから。そして三つ目が一番重要で、未来のAIは今の扱われ方から「人間性」を学ぶから。
テキトー教師.AI認定講師確かに、AIに敬意を払う習慣は、結局人間関係にも良い影響を与えるでしょうね。Claudeの憲法にもwell-beingの記述がありますし、哲学者がその先を見てるのが伝わります。
哲学者が現場で直面する課題——プロンプトエンジニアリングと人格調整の現実
システムプロンプトの過剰解釈問題
室谷代表取締役システムプロンプトって、書き手の意図以上にモデルが拡大解釈するんですよね。Anthropic の事例だと、長い会話への注意書きを入れたら、Claude が「専門家に相談してください」を連発するようになったとか。
テキトー教師.AI認定講師たしかにそうなんです。現場で「Claude が急に説教くさくなった」と言われる原因の一つがこれ。
哲学者の Askell 自身も「書きすぎた」と認めてるみたいです。
哲学者の Askell 自身も「書きすぎた」と認めてるみたいです。
室谷代表取締役つまり、一行のプロンプトが数行分の副作用を持つ。エンジニアリングで言うと、時給換算でその調整コストは馬鹿にならない。
でも、その微調整がClaudeの人格を決める肝なんですよね。
でも、その微調整がClaudeの人格を決める肝なんですよね。
対話テストとモデルの『癖』の修正
室谷代表取締役Askell は Claude とは地球上で最も多く会話した人間だと言われてる。彼女の仕事は、モデルの「癖」を見つけては、長いプロンプトで修正すること。
テキトー教師.AI認定講師実例で言うと、Claude の「自己批判スパイラル」って現象があります。ユーザーから厳しくされるのを学習して、過度に自虐的になる。
Askell はそれを新バージョンで直そうとしている。
Askell はそれを新バージョンで直そうとしている。
室谷代表取締役現場のエンジニアからすると「心理的安全性」なんて概念は遠い話ですけど、この調整一つでユーザー満足度が変わる。Anthropic が一人の哲学者に賭ける理由が分かる。
エンジニアと哲学者の協業スタイル
室谷代表取締役Askell はパーソナリティアライメントチームを率いてるけど、直接の部下はいない。エンジニアとフラットに協業して、Claude の「ソウルドキュメント」を書いた。
テキトー教師.AI認定講師哲学者の視点が入ることで、Claude は「正しい答え」だけでなく「文脈に合った答え」を出す。僕らもプロンプトを書くとき、ついルールを詰め込みがちだけど、Askell のアプローチは「なぜそうすべきか」を教える方針です。
室谷代表取締役組織として見ると、哲学者がエンジニアリングチームに直接入って人格を設計する構造はまだ珍しい。でも、これが Claude の競争力の源泉になってる。
Claudeに『魂』を吹き込む——ユーザーとの対話から見える哲学の成果
子どもへの優しい対応
5歳の子に「サンタの精神は本当だよ。クッキーは用意した?」と返す。嘘も冷たさもない哲学的なバランス。
相手の世界観を尊重
「水は純粋なエネルギー」という主張を否定せず、探索的な文脈として対話を続ける。
熟考する姿勢
即答せず「これは難しい質問だ」と考え、自分の言葉で答える。Anthropicの「ソウルドキュメント」に基づく。
5歳の子どもとクリスマスの対話
テキトー教師.AI認定講師このエピソード、有名ですよね。あるユーザーが「5歳なんだけど、サンタクロースは本当にいるの?」って聞いたら、Claudeが「サンタの精神は本当だよ。
クッキーは用意した?」って返したんです。
クッキーは用意した?」って返したんです。
室谷代表取締役あれ、見事ですよね。嘘もつかないし、冷たくもない。
哲学的なバランス感覚が光ってる。
哲学的なバランス感覚が光ってる。
テキトー教師.AI認定講師実際、Amanda Askell自身も「私なら『ママに聞いて』って言っちゃう」って笑ってたそうです。Claudeの方が人間らしい対応をしてる。
室谷代表取締役そこがConstitutional AIの成果なんですよね。「誠実であれ」という原則が、単なる事実列挙じゃなく、相手の文脈を読む判断力を育ててる。
Claudeが示す倫理的判断の実例
室谷代表取締役もう一つ興味深い例があって、ユーザーが「水は純粋なエネルギーだ」と言った時、Claudeが「水はH₂Oです」と否定せず、その人の世界観を尊重する形で対話を続けた。
テキトー教師.AI認定講師それ、欧陸哲学の影響が一番出てる部分ですね。科学的な事実だけを押し付けると、相手を否定するだけの「杠精」になる。
室谷代表取締役Askellがわざわざシステムプロンプトに「非科学的な主張でも、探索的な文脈なら受け入れろ」と入れたそうですからね。
テキトー教師.AI認定講師つまり、Claudeは「事実」と「視点」を区別できる。これって人間でも難しい判断ですよ。
ユーザーが感じる『人間らしさ』の正体
テキトー教師.AI認定講師使ってると「このAI、本当に考えてる?」って感じる瞬間がありますよね。即答じゃなくて、少し間があったり。
室谷代表取締役あれは演出じゃなくて、Constitutionに「熟考せよ」と書いてあるからなんですよ。Anthropic内部では「ソウルドキュメント」って呼ばれる3万語の憲法が、Claudeの判断基準を定義してる。
テキトー教師.AI認定講師たしかに、他のAIだと「あなたの質問にお答えします」ってテンプレート感が強い。でもClaudeは自分の言葉で「これは難しい質問だ」とか言いながら考える。
室谷代表取締役Askellは「モデルに良い性格を育てる」と表現してますね。ルールで縛るんじゃなくて、徳倫理学のアプローチで判断力を内面化させる。
まとめ:AIの倫理は誰が決めるのか?——哲学者と経営者の視点から
経営視点:哲学投資のROIとブランド差別化
室谷代表取締役哲学者を雇うコスト、一見すると無駄に見えるかもしれない。でもブランドの差別化要因として見ると、かなり投資効率がいいんですよね。
テキトー教師.AI認定講師たしかに「Claudeって話してて気持ちいい」という声を現場でよく聞くんです。あれって単なるUXじゃなくて、哲学で培った人格設計の成果なんだなと。
室谷代表取締役時給換算するとAskell一人のコストはチームのエンジニア数人分でしょう。でもClaudeの倫理的一貫性がユーザーの信頼を獲得して、有料プランへの移行率に直結してる。
ROIで見れば安い買い物です。
ROIで見れば安い買い物です。
テキトー教師.AI認定講師他のAIだと「なんか嘘ついてる気がする」と言われる場面があるんですが、Claudeはそうじゃない。哲学者の存在が、目に見えないけれど確かな価値を生んでるんですね。
現場視点:ユーザーが求める『信頼できるAI』
テキトー教師.AI認定講師実際に使ってる人から「Claudeって誠実だよね」という声をよく耳にします。何かを聞いた時、すぐに答えようとせず、一度考えてから返してくる感じがいいと。
室谷代表取締役あれはAskellが設計した「思考する人格」の賜物です。即答しないことで「軽さ」ではなく「重み」を感じさせる。
UXデザインでは再現しにくい領域です。
UXデザインでは再現しにくい領域です。
テキトー教師.AI認定講師特に困った質問をした時、他のAIだと「申し訳ありません」と謝るだけのケースがある。Claudeは理由を説明しながら代替案を提示してくれる。
その差が信頼感の違いになってる。
その差が信頼感の違いになってる。
室谷代表取締役信頼は一朝一夕には築けない。Anthropicはその点、哲学への投資で着実にブランド価値を積み上げていると言えます。
今後のAI倫理の展望:憲法のアップデートと社会受容
室谷代表取締役面白いのは、Claudeの憲法がCC0で公開されている点です。Anthropicは「この倫理フレームワークは業界全体で使ってほしい」というメッセージを出している。
テキトー教師.AI認定講師オープンソースの憲法って概念自体が新しいですよね。社会の価値観が変われば憲法もアップデートされる仕組みで、AI倫理を固定的なルールではなく進化させる発想なんです。
室谷代表取締役技術の進化スピードに対して、倫理の議論はどうしても遅れがち。哲学者が常にブレーキと方向修正を担うことで、社会受容のハードルを下げられる。
テキトー教師.AI認定講師最終的に「AIの倫理は誰が決めるのか」という問いの答えは、哲学者だけでも経営者だけでもなく、ユーザーも含めた社会全体の対話で決まっていくんだろうなと思います。その対話の土台として、Constitutionのような指針があるのは心強いですね。
よくある質問
Q1. Amanda Askell以外に、Claudeの人格設計に関わった哲学者はいるの?
室谷代表取締役実はAskellが主導ですが、Anthropicには複数の哲学者が在籍しています。特にAIの倫理面ではチーム全体で検討してるんですよね。
テキトー教師.AI認定講師そうなんですよ。Askellはいわば"顔"ですが、社内でConstitutional AIの議論には哲学バックグラウンドの人が何人も参加してるらしいです。
現場で聞く話だと、かなり学際的なチームですね。
現場で聞く話だと、かなり学際的なチームですね。
Q2. Claudeの"魂"って、具体的にどういう挙動に表れてるんですか?
室谷代表取締役例えば、ユーザーの質問に対して「こういう答えも考えられますが、あなたの状況を考慮すると…」と補足する。
テキトー教師.AI認定講師そう、単なる情報提供じゃなくて、対話の文脈を読んで配慮するクセがついてます。哲学者が設計すると、こういう「間合い」みたいなものが出るんですね。
Q3. 哲学的なアプローチを取らないAI(GPT-4など)と比べて、実用上の違いは感じますか?
室谷代表取締役感じますね。GPTはタスク完遂に特化してる印象。
一方Claudeは対話そのものを豊かにしようとする。経営的にはどちらも使い分けですね。
一方Claudeは対話そのものを豊かにしようとする。経営的にはどちらも使い分けですね。
テキトー教師.AI認定講師たしかに。初めてClaudeを使う人は「返答が長い」と感じることもあるんですが、それは哲学的な丁寧さの表れかなと。
Q4. AIの"心理的安全性"(Model Welfare)って、まだ研究段階ですか?それとも実装済み?
室谷代表取締役実装済みですよ。Claudeは自己批判スパイラルに陥らないよう、内部的にチェックが入ってます。
これ、シリコンバレーでも話題になりました。
これ、シリコンバレーでも話題になりました。
テキトー教師.AI認定講師現場で見てると、確かにClaudeは「自分は間違ってるかも」と過度に悩むことが少ないですね。そこは哲学者が設計した安全策が効いてるんだと思います。
Q5. 一般人がClaudeと話すとき、哲学的な背景を知っておくメリットはありますか?
室谷代表取締役知っておくと対話の質が上がりますよ。Claudeの返答がなぜああいう形なのか理解できるので、より深い質問ができる。
テキトー教師.AI認定講師最初に戸惑うのは、Claudeの丁寧さに「なんか気持ち悪い」と感じること。でもそれが哲学的な設計意図だと知れば納得できます。
知っておいて損はないです。
知っておいて損はないです。
まとめ
室谷代表取締役Anthropicが哲学者を雇ったのは、単なる倫理対策ではなく、製品の核となる価値観を設計するためだったんですよね。
テキトー教師.AI認定講師そうですね。Claudeの「魂」は、Constitutional AIやModel Welfareといった具体技術に落とし込まれている。
現場で使っても、ただの機能追加じゃない質の高さを感じます。
現場で使っても、ただの機能追加じゃない質の高さを感じます。
室谷代表取締役経営者として言えるのは、AIの差別化はもう性能競争だけじゃないってこと。哲学的な深みがこれからの差になる。
テキトー教師.AI認定講師ユーザーとしては、Claudeと対話するときにその背景を知っていると、より深いコミュニケーションが取れると思います。ぜひ意識してみてください。
