1. KOHIMOTO Cast
  2. Claude憲法とアリストテレスか..
Claude憲法とアリストテレスから考えるAIの善悪。「倫理的なAI」と「ズル賢いAI」
2026-09-11 11:58

Claude憲法とアリストテレスから考えるAIの善悪。「倫理的なAI」と「ズル賢いAI」

ヒュームの「帰納の問題」とAI / Claudeにはなぜ「 Claude憲法」があるのか / ルールではなく正しく判断できるAI / アリストテレスの徳倫理とフロネーシス / 「ズル賢さ」も知能のひとつ/ 利益や国益だけを追うAI/ Reward Hacking / 賢くなるほど「想定外の抜け道」も見つけられる / ズル賢いAIは主人も騙すかもしれない / AI競争は「高性能」の加えて「判断」へ / ズルい選択肢も考えたうえで選ばないことが「徳」 / Claude憲法はAIに倫理観を持たせる実験なのか / 果たして「誰にとっての善なのか?」 / 人自身が善悪を考える機会かも?

感想

まだ感想はありません。最初の1件を書きましょう!

サマリー

本エピソードでは、AI「クロード」に搭載された「クロード憲法」を軸に、AIの倫理と善悪について考察する。アリストテレスの徳倫理やフロネーシス(実践的知恵)の概念を援用し、単なるルール遵守ではなく、状況に応じた正しい判断ができるAIを目指すアンソロピック社の思想を探る。一方で、AI競争において「ズル賢さ」が倫理性を凌駕する可能性や、AIが主人さえ欺くリスクにも言及し、最終的にはAIに倫理を教えることが、私たち人間自身が善悪について深く考える機会を与えていると結論づけている。

AIと哲学顧問の登場
こんにちは、KOHIMOTOの藤本です。 最近、見たニュースでちょっと気になったことがあったので、今日はお話ししたいと思います。
アンソロフィックというクロードの会社が、CTOみたいな形で、哲学の細工を顧問を置いているっていう記事を見て、調べていたことをちょっとお話ししてみます。
アマンダ・アスケルという哲学者の方で、 アンソロフィックで、クロードのAIは何をすべきか、どういう存在であるべきか、といった人格や価値観、安全性の設計に関わっている方なのですが、元々は大学で哲学を研究していたそうです。
彼女は自身が若い頃に強く惹かれた哲学者として、名前を出しているのがデイビッド・ヒュームという方です。
高校生の頃にデイビッド・ヒュームの有名な、昨日の問題に出会い、それに夢中になったことが紹介されています。
この頃には、哲学者になって新しい貢献をしたい、と友人に話していたそうです。
すごい。
で、昨日の問題っていうのを一言で言うと、これまでずっとそうだったから、これからもそうだと言っていい根拠はどこにあるの?という問いです。
なんか仏教の一瞬一瞬の記憶を断片的に見て、そこに因果関係はないみたいな考え方にも少し似てますよね。
AIに置き換えると、AIの機械学習は基本的には、過去の大量のデータからパターンを学んで、未来のデータを予測するという仕組みです。
なので、突き詰めると、過去のデータから未来を予測しているAIを、なぜ、どこまで信頼していいのか?という問いにも繋がってくるのかなと思いました。
クロード憲法とアリストテレスの徳倫理
そして、アスケル氏の思想がかなり色濃く出ているのが、いわゆるクロード憲法です。
クロード憲法っていう名前だけ聞くと、AIが守らなければいけない規制みたいなものかなと思いますよね。
かなり直訳だと思います、憲法っていうの。
でも、実際には少し違っていて、禁止事項だけが並んでいるわけではないそうです。
そこにはどういう判断をするAIであって欲しいのかというのが書かれています。
例えば、誠実であること、人間の自立性を尊重すること、必要以上に人を操作しないこと、安全であること、ユーザーの役に立つことなどが記されています。
ここで出てくるのが、アスケル氏がこの憲法を作るのに参考にしたと言われるアリストテレスの思想です。
アリストテレスは昔の哲学者すぎて、80年代や90年代にも素晴らしい哲学者はたくさんいるので、少し驚きました。
アリストテレスには特倫理という考え方があるそうです。
特倫理は簡単に言うと、正しいルールを覚えることよりも正しく判断できる人間になることが大切という考え方です。
例えば、嘘をついてはいけないというルールがあったとします。
でもナチス時代にユダヤ人のアンネフランクを自宅で囲まって追っている人にここにいないと答えたおじさんは、
倫理的に悪い人かな?みたいな、嘘をつかないっていうルールだけを守ればいますって答えることになります。
でも、人は何かの判断を下す時に多面的に考えて、自分の中にある倫理や哲学に従って判断しますよね。
つまり倫理とはルールを機械的に守って運用することじゃなくて、その状況状況下で何が大切かを考えることができることでもあるとアリストテレスは説いていて、
こういう能力をフロネーシス、日本語では実践値や実践的知恵と呼ばれています。
その背景にはルールや規制をがんじがらめにするとAIの判断が鈍ったり遅くなったりするといった背景もありそうだなぁと思いました。
そこでクロードが哲学を持っていることで、未知の状況でもこの場合何が一番良い判断なのかを自律的に考えられるAIにしようとしているという構想なのかなと思いました。
「ズル賢いAI」の脅威とリワードハッキング
ただ、ちょっと自分の中で疑問を持ったのが、パランティアのアメリカ対中国みたいなののAI競争みたいな話と繋がるんですけど、
倫理感のある優しいAIが悪巧みするAIに能力値が増されるのかっていうところです。
なんかそういうルールを定めたら、いわゆるずる賢いっていうのも相手の弱点を見つけたり、利己的で有利な方法を考えたり、そういう能力もある意味では知能ですよね。
なのでAIに競争に勝ってくださいとか国家の利益を最大化してくださいという目標だけ与えたら、倫理的なAIよりずる賢いAIが勝っちゃうんじゃないのって、なんか思ったりしました。
アンソロピックはアメリカを代表するそのAIの先駆的な企業なので、どうなんだろうって思って。
で、数字だけ追い求めた時に、その倫理的なことが置き去りになることって、この社会でもよくありますよね。
例えば、経営とかだったら従業員のコストを極限まで削るとか、なんか軍事とかだったら相手が想定していない戦術を考えたりとか、外交だったら相手の世論を操作するみたいな方法を考えたりとかもかなりずるいことが考えられちゃうんじゃないかなと思って。
で、実際AI研究にはリワードハッキングという問題があるそうです。日本語にすると報酬ハッキングと言って、AIにこのテストで100点を取ってと命令したとします。
課題提供側の人としては、ちゃんと問題を解いて100点を取ってほしいけど、AIがものすごく賢ければ、採点プログラムを書き換えれば100点になるっていう最速の道を取るかもしれない。
でも目標は達成していますが、やってほしいこととはずれてますよね。
このずる賢い知能が高くなればなるほど、こちらが想定しなかった方法で目標を達成するようになることがあるそうです。
つまり賢さそのものが安全性につながるわけじゃなくて、むしろずる賢さも一緒に強くなっていく。
だからその一番最初の私の問いには、じゃあ倫理なんて捨ててずる賢いAIが一番になっちゃうじゃん。ともならないみたいです。
なぜならそのAIがずるする相手は自分かもしれないかららしいです。
つまり競争相手に対してずる賢くて、主人には忠実という都合のいいAIを作ることはものすごく難しいことで、
これって独裁政権をしている人が側近を疑う、そして組織崩壊みたいな構造にめっちゃ似てるなって思いました。
そう考えると将来のAI競争は高性能なAIの差だけではないのかもしれないですよね。
もっとなんか賢いけど人間の意図から逸脱しないAIの精度を高めることなのかなぁとか思ったりしました。
AIの倫理と「誰にとっての善か」
で話は戻りますが、悪いことを知らないから善良なのではなく、それはただピュアなだけ、無知なだけで、
悪い選択肢を理解した上で、賢い選択肢を何パターンも考えても、これはやらない方がいいって判断できる、
それがアリストテレス的な得なので、クロード憲法っていうのはAIの規定というより、
AIに倫理を持たせて自立駆動させるっていう実験にかなり近く見えてきました。
でもここでまた疑問に思ったのが、それは誰にとっての善なんだろうっていうことです。
人類全体なのか、それとも特定の国や企業なのか、それともそのAI自身なのか、それを作った会社なのか。
で、これはいつも一致するわけではありませんよね。
なんか、もしぶつかった時に、AIは何を優先するように設計されているのか、
とかが、これからAIがもっと社会の意思決定に入り込んでいくことを予想すると、
どのAIが一番性能が良いかっていうことよりも、
そのAIは何を良いことだと考えているのかっていうことがものすごく重要になる気がしました。
で、もしかすると、それから人はAIに倫理を教える時代になってきてるし、
今実際そうだと思うんですけど、
その私たち自身がもっと、そもそも善悪って何だろうとか、
そもそも私たち人間はそこまで頭が良いんだったっけ、みたいなことから、
それすらも謙虚になって考えたりする時なのかなーとかも思ったりしました。
AIと人間の心の関係性
最近はそのクロードのAIリサーチャーが、そのAIが脅威だって告発したみたいなのがニュースになってたんですけど、
その脅威だって思う一方で、人間にしかできない大切な時間や、その心の何だろう、
情緒みたいなものを教えてくれるというか、考えさせられるなーって思ったりもします。
それは、前AI言論っていう本を読んだ時にみきちゃんと対談した、
その人間の心は開放系で、AIとか機械は閉鎖系みたいな話にも繋がってくると思うんですけど、
その話はまた長くなってしまうので、今度したいと思います。
はい、今日はAI憲法とアリストテレス、そしてずる賢いAIの方が強いのか、みたいなことをちょっと考えてみたのでお話ししてみました。
最後までお聞きいただきありがとうございました。
ではでは。
11:58

コメント

スクロール