
画像: Unsplash
Transformer言語モデルにおける状況モデリングとメンタライジングの発達的軌跡
ニュース概要(出典記事の要点)
最近の研究では、大規模言語モデル(LLM)が、誤信念課題(FBT)で測定される、テキストで記述されたエージェントの信念状態に敏感であることが示唆されていますが、構成概念妥当性に関する継続的な懸念が残っています。本研究では、Olmo2およびPythia言語モデルスイートの複数のトレ…
※ 上記は出典記事の要約です。本サイト独自の分析・背景解説は下記をご覧ください。
解説
最近、AI(人工知能)の進化が目覚ましいですが、その中でも特に注目されているのが「大規模言語モデル(LLM)」です。これは、私たちが普段使っている言葉を理解し、文章を生成する能力に長けたAIのこと。たとえば、ChatGPTなんかもこの仲間です。最近の研究で、こうしたLLMが、まるで人間のように「相手が何を考えているか」を推測する能力を持っているのではないか、ということが分かってきました。具体的には、「誤信念課題(FBT)」というテストで、AIがテキストに書かれた登場人物の「思い込み」をどれだけ理解できているかを調べています。でも、このテストのやり方や結果の解釈については、まだ「本当に相手の心を理解しているのか?」という疑問の声も上がっていました。
そこで、今回の研究では、AIが「心の状態を推測する能力」をどのように発達させていくのか、という「成長の過程」に注目しました。AIには「Olmo2」や「Pythia」といった、いくつかの種類があります。これらのAIが、学習を進めていく中で、どのように「相手の心を読む力」を身につけていくのかを、段階を追って見ていったのです。その結果、AIが「相手の思い込み」を理解できるようになるのは、AI自体の性能(モデルサイズ)と、十分な学習量がある場合に限られることが分かりました。しかも、その能力は、学習のかなり後の方で、ようやく現れてくるようです。さらに、AIに「誤った信念」について教えたり、より良い応答ができるように追加で学習させたりする(後トレーニング介入)ことで、この「心を読む力」は改善されることも確認されました。
ただ、この能力はまだ「もろさ」も抱えています。以前の研究でも指摘されていたように、「~と思う」といった、事実とは異なる可能性のある言葉(非事実的動詞)が使われると、たとえ本当は正しいことを考えている状況でも、AIは「間違った思い込み」をしていると判断してしまう傾向があるのです。これは、AIがまだ言葉のニュアンスや文脈を完全に掴みきれていないことを示唆しています。
そこで研究者たちは、AIが「相手の心を読む力」を身につける前に、まずは「目の前で起きていることの基本的な事実を理解する能力」、つまり「状況モデリング」の能力がどのように発達するのかも同時に追跡しました。これは、AIが物語の舞台設定や登場人物の行動といった、基本的な情報をどれだけ正確に把握できるかを見るものです。この「状況モデリング」の能力が、AIの「心を読む力」の発達にどう影響するのか、今後の研究でさらに明らかになっていくことが期待されます。
関連データ
ニュースタイムライン
2026年6月16日
生理信号からのマルチモーダル感情認識のための深層時間モデリングとアンサンブル融合arXiv cs.CL
2026年6月16日
融合は万能ではない:イベント発生までの時間モデリングのためのクロスモーダル表現アラインメントarXiv cs.AI
2026年6月16日
運転軌跡予測におけるインタラクションモデリングのためのグラフニューラルネットワーク層選択の比較研究arXiv cs.LG
2026年6月19日
REVEAL++:アルツハイマー病リスクの視覚言語網膜モデリングのための微分可能な表現型グルーピングarXiv cs.AI
2026年6月30日
テンソルネットワークを用いた子供の感情記憶のモデリングarXiv cs.LG
参考引用
“構成概念妥当性に関する懸念
― arXiv cs.CL
記事AI質問チャット
PREMIUMこの記事についてAIが質問に答えます。背景・要約・影響まで深堀り。
ログインして利用関連記事
こんな記事も読まれています
この記事について疑問がありますか?
事実誤認や不適切な内容について通報できます (要ログイン)。
異議申し立て・通報












