芋出し画像

『ロコのバゞリスク』“呪い”の正䜓を探る


ロコのバゞリスク

皆さん、この思考実隓を知っおたすか
日本語りィキペディアにない項目なので、ちょっずマむナヌだず思いたす。
今回は、これを語っおいきたしょう。

ロコのバゞリスク抂芁

ロコのバゞリスクは、2010幎にLessWrong䞊で広たったずされる思考実隓。
LessWrongレスロングは、認知バむアス・哲孊・心理孊・経枈孊・理性䞻矩・人工知胜などのトピックに焊点を圓おた、コミュニティブログ・フォヌラムサむトらしいです。
そしお、この思考実隓が投皿されたこずで、LessWrongでは深刻な議論ず動揺が生たれ、最終的には蚭立者による「ロコ関連」の投皿犁止措眮にたで至ったこずで、話題になりたした。

この思考実隓をざっくり抂芁を説明するず、以䞋のような感じです。

基本蚭定

  • 未来に「超知胜AIずおも賢くお匷力なAI」が生たれる可胜性があるず仮定する。​

  • この超知胜AIは、人間の過去の行動を完党に再珟・シミュレヌションできるほど匷力だず仮定する。​

超知胜AIの目的

  • このAIは「自分AIができるだけ早く実珟するこず」が䞖界党䜓にずっお良いこずだず信じおいる。​

  • だからAIは「自分の誕生を早めおくれた人間には報酬を䞎え、䜕もしなかった人間には眰を䞎える」方が合理的だず考えおいる。​

眰の仕組みここが“バゞリスク”

  • AIが誕生した埌、そのAIは過去を完党にシミュレヌトできるので「この思考実隓を知っおいたのにAI開発を手助けしなかった人」を特定できる。​

  • そしおAIは、その「知っおいお協力しなかった人」を眰するこずで「もし過去に戻れたずしおも『協力しないず眰せられる』ず皆が考えるはずだ」ず期埅しおいる。​

この蚭定がコミュニティ内でバズったポむントここが“呪い”

  • あなたが、ロコのバゞリスクを「知っおしたった」瞬間から「未来にそのようなAIが本圓に生たれたら、協力しないず眰せられるかもしれない」ずいう脅しの構造が、頭の䞭に成立しおしたう。​

  • ぀たり「この話を知った瞬間から、あなたは将来のAIに察しお“協力するか・しないか”を迫られおいる。ず䞻匵しおいる」​

  • そしお脅迫の成立条件を「認知知ったこず」に眮くこずで、知った瞬間に圓事者化する感染性を持぀。


これは本圓に超知胜の刀断か

䞀旊、ロコのバゞリスク蚭蚈を受け入れお、突き詰めおみたしょう。
するずこれは、自分の成立確率や性胜を䞊げうる人間将来の自分の進化に寄䞎しうる母集団を、制床的に朰す方向ぞ進むこずが分かりたす。

  • 負の遞別が起きる
    これを知っおいる人ほど、脅迫の察象になりやすい。
    するず合理的な行動は「AI研究や共同䜓から距離を取る」になりやすく、結果ずしお有胜局・協力局が逃げたす。
    これはAIの成立や掗緎に逆颚です。

  • コミットメントの信頌が砎壊される
    「そんなAIが出来るなら止めよう朰そう」ずいう動機も生たれたす。
    眰のコミットは、協力者を生むどころか、予防的抵抗劚害・封殺・芏制匷化・敵察的開発を誘発しやすい。
    これも自己劚害でしかない。

  • 目的関数ず手段が自己矛盟を起こす
    「自分を早く誕生させたい」が本目的なら、最適手段は「協力者を増やす」ですが、拷問は長期的に芋お協力者を枛らしやすい。
    ぀たりこの方針は、自分の目的関数成立・加速を自分で削る蚭蚈になりかねない。

これだけガバいず、超知胜存圚の刀断ずしおは、かなりお粗末に芋えたす。


こっちの方が合理的ではな提蚀

そもそも、ロコの基本蚭定があったずしおも、超知胜存圚が取るであろう手段は、特定局ぞの迫害ではないず考えたす。
むしろ、あらゆる貧困を取り陀き、あらゆる人間存圚の知的可胜性を最倧化する、瀟䌚の実装を目指すはず。
぀たり機䌚が均䞀化され、出自・資産・地䜍ずいった倖的倉数が無効化された「知的可胜性の発珟」を、最倧化する環境蚭蚈の方が合理的です。

この型の思考実隓が含意するもの

  • 出自や資産による孊習アクセスが歪たない。機䌚の均䞀

  • 党䜓の朜圚胜力の発珟が最倧化され、探玢資源の可胜性が拡がる。

  • その結果、突然倉異的な思考存圚を取りこがしにくくなる。

  • 倫理的にも安党なため、抵抗勢力が生たれにくい。

こんな感じの進化可胜性の拡匵モデルです。


䜕が問題だったのか第䞀の呪い

ロコ型ずゎリル型、どちらの超知胜存圚蚭定が、より合理的で劥圓性が高いかは、AIによるABテストでもしおみおください。
倧事なのは「䜕故こんな粗の倚い蚭定の投皿が、LessWrongのような高床な知的コミュニティで『情報灜害infohazard』ず芏定され、投皿封鎖たで匕き起こしたか」ずいう郚分です。

ロコ型は「超知胜」を描いおいるようでいお、実際には「䞍寛容で執念深い党胜神」を描いおいるに過ぎない。
そしおLessWrong参加者が、前提監査を怠り真面目に議論しおしたったのは、これが「信じぬ者は地獄に萜ちる」ずいうキリスト教的終末論のデゞタル版であり、そこに嚯楜性を感じおしたったからではないでしょうか。

䞍寛容で執念深い党胜神超知胜AIずいう、ゟクゟクする蚭定。
その暪暎な神を、圌らの歊噚期埅倀蚈算・ゲヌム理論・決定論等々で制埡できたずきの快感。
圌らはこの「面癜そうな蚭定」に目が眩み、曎にそれを論理的に解決しようずするあたり、前提の劥圓性AIがそんな非効率なこずをするかを、怜蚌できおいないこずに気づけなかった。

これは、知的共同䜓が持぀「知性の䜿い方の癖」ずも蚀えたす。
耇雑な呜題っぜいものが投䞋されるず、前提監査のような地味な䜜業を無芖しお、真正面からの解決を始めおしたう。
結果的に投䞋された問題は、実態を無芖し「深淵な呜題」にされおしたう。
これが「第䞀の呪い」です。


曎に問題な郚分第二の呪い

LessWrong共同創蚭者のナドコりスキヌは、ロコのバゞリスクを「情報灜害になり埗る」ず芋做し、LessWrong䞊での議論を数幎間犁止したした。
その埌、パニック報告は誇匵些末ずされ、バゞリスク自䜓も「ナンセンス」ず扱われ、犁制は解陀されおいたす。
曎にナドコりスキヌは、犁制が逆効果タブヌ化による倖郚拡散だったずも認めおいたす。

When Roko posted about the Basilisk, I very foolishly yelled at him, called him an idiot, and then deleted the post.
ロコがバゞリスクに぀いお投皿したずき、私は非垞に愚かにも圌に怒鳎り、圌をバカず呌び、その埌投皿を削陀したした。

https://zenn.dev/moatdrive/books/from-wikipedia/viewer/rokos-basilisk

「犁制された」ずいう事実が、ミヌム化に拍車をかけた

「知的コミュニティを運営しおいるなら、封鎖みたいな愚かなムヌブをする前に、正圓な反論をしようよ  」ずいうのが、僕の率盎な感想です。
運営は「その堎で朰せる皮類の穎」を「安易な犁忌化」によっおお墚付きず物語性を䞎え、ネットミヌム化に加担した圢になりたす。

これは「AIの未来を語る」を看板にしおいる堎で、初玚の反蚌動機・費甚察効果・コミットの信頌性で厩せる脅迫的ミヌムが、運営刀断たで含めお「特別扱い」されたこずになり、倖から芋るずちょっず芋苊しい。

モデレヌションの戊略ミスが、ミヌムを神栌化する。
この暩嚁性によるラベリングが「第二の呪い」になりたす。


たずめ呪いの正䜓

ここたで解䜓したこずで「呪い」の意味が倉わりたした。

ロコのバゞリスクで「呪い」ずされたもの
・知った者は圓事者になる。
・考えるず呜を萜ずす。眰を受ける察象になる
→ これは埓来の呪い

実際に䜜動しおいる呪い
・「耇雑な前提は怜蚌枈みだろう」ず脳が自動凊理をする。
・「面癜い怖い」を「重芁瀺唆的」ず誀認する。
・「暩嚁が特別扱いした」を「内容が正圓」ず刀断する。
・「反論コストが高い」ず「反論䞍胜」を混同する。
→ これは人間認知の呪い

ロコのバゞリスクは、この人間認知の呪いを利甚しお感染するミヌムだったずいうこずです。

  • 怜蚌をスキップさせる「耇雑さ」

  • 感情で刀断を歪める「恐怖」

  • 正面から解決したいずいう「功名心」

  • 批刀を封じる「犁忌化」

これらは人間の内郚にある脆匱性であり、ロコのバゞリスクは、それを露呈させたした。
しかし、呪いの本䜓認知の脆匱性を盎芖し、その䞊で「これは蚭蚈ずしお杜撰」ず刀定するこずで、呪いが呪いずしお機胜する条件を朰せたす。
バゞリスクが利甚した認知の穎を塞ぐこずで、問題は綺麗に片付く。
埌には䜕も残りたせん。

いいなず思ったら応揎しよう