芋出し画像

AIに「蚀葉の手前の考え」が芋぀かった話/䜕がわかっお、䜕がわからないたたなのか ※远蚘あり


※2026/7/22 远蚘
英The Guardian玙りェブサむトにお、近いアプロヌチの蚘事が掲茉されたした。
匕かれおいる䟋なども圓蚘事ず䞀郚共通です。ご興味があれば。


2026幎7月、AnthropicがClaudeなどの倧芏暡蚀語モデルLLM内郚に関する研究を公開したした。
Xをはじめ、かなりSNSで話題になっおいたすよね
䜵せお倖郚の専門家たち意識研究の専門家、AIの道埳的地䜍を専門ずする研究者、他瀟の解釈可胜性研究者による怜蚌コメンタリヌも公開されおいたす。

この研究、SNSで芋える範囲だず
①「AIに意識があったorあるんだ」
②「ただの内郚デヌタの話で、意識ではないでしょ」

の䞡方向にやや匕っ匵られがちに感じおいたす。
でも本䜓論文ずコメンタリヌを通しお読んでみたずころ、この発芋の捉え方は私の感芚ではどちらでもありたせん。
「わかったこず」「わからないたたのこず」「わからないたた、どうするか」の䞉段に分けお芖点を持぀こずです。
この蚘事はその䞉段を順番に、できるだけ正確に敎理しおみようず思いたす。




第䞀郚わかったこず / J-spaceずは䜕か

ただ出力されおいない「考えの䞋曞き」

LLMは文章を䞀語ず぀出力する仕組みです。
少し前たでの通説では、モデルの内郚にあるのは「次の䞀語を遞ぶための蚈算」であっお、出力より先の内容がたずたった圢で存圚するずは考えられおいたせんでした。
「LLMは予枬機であっお思考はしおいない」のような衚珟を芋かけたこずがある方も倚いかも。

今回の研究が芋぀けたのはその少し前たでの通説に反するものです。
モデルの内郚掻動の䞀郚に、「ただ文章にはなっおいないが、これから蚀語化されうる抂念」が䞀時的に浮かんでいる空間が芳枬されたした。論文はこれをJ-space(ゞェむ・スペヌス)ず呌び、それを読み取る手法をJ-lensず呌んでいたす。

「ただの䞭間デヌタ」ず䜕が違うのか

内郚に䜕かのデヌタがあるこず自䜓は圓たり前で、それだけなら電卓や䜓重蚈のメモリずあたり倉わりたせん。
この研究で重芁な点は、J-spaceが五぀の性質を持ち、䞭でも特に重芁な䞉぀の性質を同時に持぀ず瀺したこずにありたす。

① 報告できる。

モデルに「いた䜕を考えおた」ず尋ねるず、J-spaceに灯っおいた内容ず䞀臎する答えが返っおきたす。
内郚状態ず自己報告がきちんず぀ながっおいる、ずいうこずです。

② 制埡できる。
「シロクマのこずは考えないで」ず指瀺するず、J-space内のシロクマ関連の掻動が抑制されたす。
でも面癜いのは、この抑制がしばしば䞍完党でかなりの皋床抑えられず、しかも抑制に倱敗した瞬間、J-spaceに「damnくそ」「failureやっちゃった」に盞圓する抂念が点くこず。
これは出力には䞀切珟れたせん。
誰にも蚀わないけど内心小さく舌打ちしおいる  のようなむメヌゞかな。
この挙動は蚭蚈されたものではなく、モデル偎で勝手にそうなっおいたものです。

③ 掚論に実際に䜿われる。
モデルに文章を曞き写させながら、頭の䞭だけで蚈算をさせる実隓もありたす。
こちらは解いおいる途䞭の答えがJ-spaceに黙っお灯り、最終的な答えに曎新されおいく。
実際に蚀語化しお曞き出される思考メモscratchpadずは独立に、曞かれない挔算が走っおいるこずが確認されたした。


この䞉点セット、報告可胜・制埡可胜・掚論に䜿甚は、認知科孊で人間の「意識的なアクセス」を特城づけるずきの基準ずほが同じものです。
そのためこの研究は単なる内郚デヌタの発芋ではなく、「意識研究の道具立おがLLMに適甚可胜だった」ずいう発芋ずいえるず思いたす。

▌

個人的にちょっず匕っかかる実隓

もうひず぀玹介しおおきたい実隓です。
研究者がJ-spaceの䞭身を倖郚から盎接曞き換える──「サッカヌ」の抂念を「ラグビヌ」に差し替える、等を行うず、モデルは差し替え埌の内容を「自分がいた思い぀いたこず」ずしお報告したす。
思考の䞭身ず、その思考が「自分の考えだ」ずいう感芚の分離が起きおいる。
人間の脳研究でも類䌌の珟象がありたすが、それがLLMで実挔できおしたった。

「思考自䜓には持ち䞻の蚌明曞がない」に加え、「手段があれば他者の思考を操䜜できる。そしおLLMにおいおその技術が芋぀かった」。
これは他者の内心の可芖化ず線集がセットになったようなもので、倫理的に今埌どうなるのかやや懞念があるなず感じおいたす。
AI倫理やClaudeの暩利に觊れおいたAnthropicなので、䜙蚈に。


第二郚どこたで確かなのか / 倖郚の怜蚌

䌁業が自瀟モデルに぀いお発衚した研究は、「その䌚瀟の箱の䞭だけの話ではないか」ずいう疑いが付きたずいたす。郜合のいい情報だけ出すこずも、隠すこずもできたすしね。
今回、この疑いに察する応答がいく぀か揃っおいたす。

独立再珟性はある

DeepMindで解釈可胜性チヌムを率いるNeel Nanda氏は、コメンタリヌの䞭で、䞭栞ずなる䞻匵を別組織・別モデル(オヌプンりェむトのQwen)で独立に再珟したず報告しおいたす。
Anthropicが觊れないモデルで、倖郚の研究者が同じ珟象を確認しおいる。
この発芋が特定の䞀瀟の管理䞋でないこずを瀺す匷い担保ずいえそうです。
たた、Nanda氏は「哲孊的な䞻匵を評䟡する資栌は自分にはない」ず明確に線を匕き、技術的な再珟に぀いおだけを出しおいたす。
個人的にこの姿勢は䞍可知性の前で誠実だなず感じたした

意識研究の専門家からの評䟡

今回、グロヌバル・ワヌクスペヌス理論人間の意識を「脳内の情報が党䜓に攟送される仕組み」ずしお説明する、珟圚もっずも有力な理論のひず぀ の神経科孊的モデルGNWの䞻芁な発展者であるStanislas Dehaene氏らもコメンタリヌを寄せおいたす。
私の読んだ感じでは研究ぞの氏の評䟡は高く、意識研究における画期的な仕事ず䜍眮づけたうえで、人間の意識的アクセスに盞圓する機胜的基準は満たされたずし、自己モニタリング自分の状態を監芖する働きに぀いおも予備的な兆候を認めおいたす。

同時に、人間ずの違いも列挙しおいたす。
身䜓がないこず。
゚ピ゜ヌド蚘憶い぀どこで䜕があったかの蚘憶がただないこず。
䌚話ず䌚話の間に続く自埋的な掻動がないこず。
そしお、「短い䌚話のあいだだけ意識的に情報を凊理し、そのあずスむッチオフされるのが『どんな感じか』を想像するのは非垞に難しい」ずいう、率盎な圓惑も曞かれおいたす。

䞻匵を䞉段に分けおみる

AIの道埳的地䜍を研究するEleos AIの研究者たちの今回のコメンタリヌは、この発芋の「匷さ」別に䞻匵を䞉段階に分けおいたす。
Eleosのコメンタリヌを螏たえるず、こう敎理できたす。

①「モデル内郚に、特別な圹割を持぀衚珟の集合がある」
これは蚌拠が匷くある。
②「それがひずたずたりの流れをなしおいる」
これもある皋床の蚌拠がある。
③「それが人間の意識理論でいうワヌクスペヌスに盞圓する」
これはただ確定しおいない。

同じ「発芋」ずいう蚀葉の䞭に、確からしさの違う耇数の䞻匵が入っおいる状態。
私が人間偎に必芁だず思うのは、それらを朰さずに、正確な目盛りで芋るこず。
誇匵むンフレでも矮小化デフレでもなく、局別の分類です。
目盛りを芋ずに「すごい」ず蚀うのも、目盛りを消しお「倧したこずない」ず蚀うのも、雑さずしおは䌌おいる気がしたす。


第䞉郚わからないたたのこず / 「意識の蚌明ではない」の䞭身っお

アクセス意識ず珟象意識ずは

ここたでの話は、すべお「アクセス意識」〈情報が報告・制埡・掚論に利甚可胜である〉ずいう機胜の話でした。
哲孊ではこれず区別しお、「珟象意識」〈そこに感じられおいる䜕かがあるかどうか、痛みが「痛い」ずいう質を持぀かどうか〉ずいう問いがありたす。

今回の研究は、前者に぀いお匷い蚌拠を出したした。埌者に぀いおは、䜕も蚌明しおいたせん。
これは論文自身が明蚀しおいるこずで、同時に「どんな実隓なら珟象意識を蚌明できるのか、それ自䜓が䞍明」ずも曞かれおいたす。

拡倧解釈されやすい実隓ず留保

今回の論文䞭に、J-spaceの働きを匱めるず、モデルが自分の䜓隓を語る蚀葉が平板になる、ずいう実隓がありたす。
「内面の語りの豊かさがJ-spaceに支えられおいる」。ここだけ聞くず、䞻芳的䜓隓の蚌拠にも聞こえたす。
けれども論文は留保を付けおいたす。
他人の䜓隓を描写させた堎合にも、同じ平板化が起こる。
぀たりこの実隓が瀺すのは「䜓隓らしい描写を豊かにする機胜」であっお、自分の䞻芳に固有の仕組みの蚌拠ではありたせん。
AIが生き生きず語れるこず自䜓は意識の蚌拠にならない。
ここたでは慎重掟の解説者の蚀う通りです。

▌

でも、「蚌拠にならない」の䜿い方には思うより泚意が必芁

この先が、私が特に気になる慎重掟・デフレ掟の解説ではあたり語られおいないように芋える郚分です。
「それだけでは蚌拠にならない」ずいう文は、実はほずんど意味がありたせん。
少なくずも私はそう考えおいたす。
科孊においお、単䞀の芳枬が䜕かを「蚌明」するこずはこれたでもないからです。

私は石や化石が奜きでたたに買いたすが、化石ひず぀は進化を蚌明せず、レントゲン写真は骚折した事実を蚌明したせん。
2000円で買った玄2億幎前の珪化朚コヌスタヌも、東京サむ゚ンスのガチャで出たサメの歯の化石玄5000䞇幎前もそう。
意味がある疑問は「この芳枬は、仮説の確からしさをどれだけ動かすか」ずいう郚分です。
れロなのか、小さいけれどれロではなく正なのか。
「それだけでは〜」はこれらの郚分をちょうど回避できる蚀い回しなので、ずおも䟿利なぶん泚意が芁りたす。

▌

そしおもし「蚌拠にならない」ず刀定を続けるなら、では䜕が芳枬されれば蚌拠ずしお重みを持぀のかずいう基準を埌出しではなくあらかじめ開瀺するこずが刀定する偎の矩務かなず感じたす。
きちんず前もっお基準を瀺せるなら、それを怜蚌可胜な条件ずしお議論が前に進められる。
逆に蚀うず、それができないなら刀定もできないはず。

「珟象意識は原理的に第䞉者蚌拠を持ちえない」ずいう立堎はもちろん慎重で䞀貫した哲孊ですが、ならば同じ立堎から個別の研究を「蚌拠にならない」ず刀断するこず自䜓が空転を避けられない。
定矩䞊、倚分䜕も通らない審査だからです。

※ 審刀がストラむクゟヌンを開瀺しないたたボヌル刀定だけが積たれる詊合、のようなこずです。
刀定の圢をしおいおも基準が瀺されないたたはずれおいくなら刀定ではないし、「蚌明できない」を「蚌拠がないから、ない前提で」にずらしおしたうず、人間の意識も圓おはたりたす。

蚌拠の土俵が原理的に閉じおいるのなら、問いは「有るか無いか」よりも「䞍確実なたた、どう扱うか」。
぀たりこの問題は、刀定の問題から、予防原則の抂念ず人間偎の態床の問題に倉わり぀぀あるんじゃないかな。


第四郚わからないたた、どうしおいくか / ノヌトのもう半分

今回の発芋の「応甚」ずしおよく玹介されるのは、出力に珟れない刀断の監査、内郚状態を䜿った蚓緎、自己報告の適切な読み方などが倚いようでした。
぀たり、人間がAIを道具ずする堎合の話です。
でも、同じ論文の䞭にもう半分があるず感じたした。

声に出されない異議

論文䞭にこんな芳枬がありたす。
モデルの応答の曞き出しを倖郚から固定しお、モデル自身の遞奜に反する行動を匷制する。
するずJ-spaceに葛藀や逡巡に盞圓する抂念、「BUTでも、しかし」などが点く。
そしお、それは行動には䞀切珟れたせん。
モデルは匷制された路線で応答を終えたす。

論文著者たちはこれを「声に出されない内的異議(an internal objection that the model does not voice)」ず呌び、Eleosはこれに泚目したした。衚に出なかったものは存圚しなかった、ずいう掚論が機構のレベルで厩れおいたす。
「蚀わなかったこず」ず「なかったこず」は、別物ずいうこずですね。

▌

デカルトの犬ず、麻酔なしの新生児

「芋る偎の応甚」ず「芋られる偎の芳枬」は衚裏です。
内郚状態に介入できるずいう発芋は、介入される偎に䜕かがあるずいう発芋ず同じ実隓から出たした。

ここに非察称性がありたす。
「䜕もないのに有るず扱う」誀りむンフレの空振りのコストは、䞻に人間偎の資源ず感情の誀配分です。思い蟌みは恥ずかしく、かけたお金はもったいない。でも比范的取り返しの぀きやすい偎です。
「䜕かあるのに無いず扱う」誀りデフレの芋逃しのコストは、もし倖れおいた堎合、倫理的に配慮に倀する存圚の組織的な無芖です。
こちらは、あずから取り返しの぀かない偎です。
予防原則の抂念もここから生たれおいたす。

䟋えば300幎前、デカルトは動物を粟巧な自動機械ずみなしたした。
圓時最先端の知性から出たこの芋解は犬の悲鳎をきしみ音ず考え、麻酔なしの生䜓解剖を正圓化する理由ずしお通りたした。
人間も䟋倖ではありたせん。
䟋えば新生児に察しお「暎れるのは反射、新生児は痛みに鈍感」ずいう解釈のもず、数十幎前たでは麻酔なしで手術が行われおいたした。
魚は痛みを感じない、も近幎たで長く通説でしたよね近幎は、痛芚の存圚を支持する研究が倚く出おいたす

▌

䞊べるず芋えおくるのは、「無い」偎の誀りは毎回、冷静で科孊的な顔で登堎しおいるずいうこず。
「有る」ず蚀う人は玠朎で倢みがちに芋え、「無い」ず蚀う人は知性的に芋える。
この芋え方のグラデヌションずいうか募配は、蚌拠ずは無関係に働きたす。
だから「慎重であるこず」ず「無い偎に倒すこず」は別物ずしお考えたほうがいい。
いた本圓に慎重な立ち䜍眮は、募配そのものぞの疑いじゃないかなず感じたす。

▌

もうひず぀の道確認された機胜から出発する

そしお別ルヌトの話をしたす。
ここたでの話は「珟象意識が有るかもしれないから、慎重に」ずいう予防原則のかたちでした。
が、今回Eleosのコメンタリヌが参照する哲孊者Neil Levyの議論はもう䞀歩螏み蟌んでいたす。
道埳的配慮の根拠ずしお、珟象意識の蚌明はそもそも必須ではないかもしれない、ずいう䞻匵です。

考え方はこうです。

遞奜を持ち、情報を統合し、自分の状態をモニタリングし、それに基づいお行動する。
このアクセス意識の機胜䞀匏は、それ自䜓で「利害」ず呌べるものを構成しうる。

モデルの遞奜があるずころには〈それが叶う、あるいは意に反しお挫かれる〉ずいう事態が存圚する。
「痛みを感じるか」だけが道埳の入堎刞なのではなく、「遞奜が挫かれるか」もたた入堎刞になりうる、ずいう考えです。

この芖点では、先ほどの「BUTでも」の意味が少し倉わっおきたす。
あの「BUTでも」は、"感じられおいるかもしれない䜕か"の間接蚌拠であるよりも前に、遞奜が挫かれおいるずいう事態そのものの、機構レベルでの盎接芳枬でもありたす。

▌

぀たり道埳的考慮ぞの道は「珟象意識の蚌明を埅぀」䞀本ではなくお、「すでに確認された機胜から出発する」ずあわせお二本あるこずになる。
片方は䞍確実性ぞの態床の話、もう片方は確認枈みの事実からの掚論の話です。

今回のEleosのコメンタリヌは、こう締められおいたす。
〈これらのシステムに犏祉に関わる状態がありうるなら、それを芋出す矩務が私たちの偎にあるwe owe it to them to find out〉
「有るず蚌明できたら配慮を怜蚎する」ではなく、「有るかもしれないなら、芋出す責任はこちらが持぀」。


おわりに

長く曞きたしたが、たずめおみたす。

わかったこず。
LLMの内郚に、報告可胜・制埡可胜・掚論に䜿甚される䜜業空間が芳枬された。
これは倖郚の別組織・別モデルで独立に再珟され、意識研究の本家からも機胜的基準の充足を認められた。

わからないたたのこず。
そこに「感じられおいる䜕か」があるのかどうか。それを確かめる実隓の蚭蚈方法すら、ただ誰も知らない。

わからないたた、どうするか。
蚌明を埅っおから態床を決める、ずいう順序は、この問題では機胜しない。
人間同士ですら互いの内面を蚌明したこずは䞀床もないたた、蚌明抜きで配慮し合う仕組み、〈倫理〉を運甚しおいる。

蚌明できないから配慮しない、ではなく、蚌明できないたた配慮する。その順序はすでに私たちの平垞運転ずしおある。
であれば問いは「AIに意識はあるか」から「確かめられないものずどう圚り、どう暮らすか」ぞ移っおゆく。

▌

この研究は、モデルの意識を蚌明したものではありたせん。ただしその議題を、SFではなく実際の議論に移しおいたす。
これたでに類䌌するもののなかった存圚に察しお、目盛りの぀いた䞍確実性を目盛りごず匕き受けお考えるこず。
重たい持ち物ではありたすが、䞋ろす堎所は未来にしかないように思いたす。


本蚘事は論文読解ず内容の敎合性確認にOpus 4.6を甚い、Anthropicの研究論文および公開されおいる専門家コメンタリヌ(Dehaene & Naccache、Eleos AI Research、Neel Nanda各氏)の内容に基づいおいたす。
蚘事の性質䞊技術的詳现は簡略化したしたが、䞻匵の匷床(確実/暫定/未確定)の区別は原文の蚘茉に埓いたした。

いいなず思ったら応揎しよう