日本フィジカルAI新聞

世界のフィジカルAIを、日本語で。

週刊ニュースレター購読
LLM評価/道徳的意思決定arXiv:2609.05037

LLMは知覚された道徳的主体性をどう評価するか?人間と人工エージェントの相互作用における道徳的意思決定の調査

How do LLMs Evaluate Perceived Moral Agency? Investigating Moral Decision-Making in Human-Artificial Agents Interactions

シェア:XThreadsFacebookLINEはてブBluesky

人間とLLMが、スマートシティのシナリオにおける人間および自律型人工エージェントの道徳的主体性をどう評価するかを比較した初の実証研究。

詳しい要約

1. どんなもの?

本論文は、LLMが道徳的助言を行う役割を担う中で、LLMがどのように道徳的主体性(moral agency)を帰属するかを理解することを目的とした、初の実証研究である。人間と、ロボットやドローン、非具身AIシステムなどの人工エージェント(AA)が登場するスマートシティのシナリオを用いて、人間とLLMが知覚する道徳的主体性(PMA)を比較評価する。検証済みのPMA尺度を適応し、190人の人間参加者と複数のLLMにプロトコルを適用した。

2. 先行研究と比べてどこがすごい?

先行研究では、人間の道徳的主体性は確立された構成概念として研究されてきたが、AAへの道徳的主体性の帰属を、人間とLLMの両方で体系的に比較した研究はなかった。本論文は、人間とLLMのPMA評価を、具身性の異なるAAを含むスマートシティシナリオで比較した最初の研究である点が新しい。また、LLMの道徳的判断における文脈感度を、人間の評価者と比較して明らかにした点も貢献である。

3. 技術・手法の肝は?

手法の肝は、検証済みのPMA尺度を適応したプロトコルを用いて、190人の人間参加者と複数のLLM(具体的なモデル名は要旨に記載なし)に対して、スマートシティのシナリオにおける人間とAA(具身性の異なる)の道徳的ジレンマを提示し、PMAを評価させた点である。また、人間とLLMの評価を比較し、シナリオの状況要因(害の重大性、文脈の緊急性)が評価に与える影響を分析した。

4. どうやって有効だと検証した?

有効性の検証は、190人の人間参加者と複数のLLMを対象に、適応したPMA尺度を用いた評価プロトコルを実施し、人間とAAに対するPMAの知覚を比較することで行われた。結果として、人間はAAよりも高い道徳的主体性を知覚することが示された。さらに、具体的な道徳的ジレンマでは、LLMは状況から推論し、害の重大性や文脈の緊急性を優先する一方、人間の評価者にも同様の文脈感度が存在することが確認された。

5. 議論はある?

議論として、LLMが日常的な道徳的判断に関与するにつれ、そのPMA評価の文脈感度が重要な意味を持つと指摘している。LLMはエージェント自体の安定した評価よりも状況要因を優先するため、道徳的助言の一貫性や信頼性に影響を与える可能性がある。また、人間の評価者にも同様の文脈感度が見られることから、人間の道徳判断の特性を反映しているとも解釈できるが、LLMの判断が常に適切かどうかはさらなる検討が必要である。

6. 次に読むべき論文は?

要旨で参照されている研究は、PMA尺度の検証研究や、人間の道徳的主体性に関するmoral psychologyの研究、AAの道徳的帰属に関する研究などが考えられる。具体的な論文名は要旨に明記されていないため、次に読むべき論文としては、moral agencyの構成概念を扱った心理学の foundational papers(例:Banduraの道徳的不活性化理論)や、HRI(Human-Robot Interaction)における道徳的帰属の研究、LLMの道徳的判断に関する最近の研究(例:LLMの倫理判断の評価)が挙げられる。

※ AIが要旨から生成した要約です。正確性は原文をご確認ください。

著者: Fernanda Mansilla, Aloysius Tok, Bahia Guellaï, Farah Benamara, Nancy F. Chen

分類: cs.CL, cs.AI

原文アブストラクト

As LLMs take on roles requiring moral advice, understanding how they attribute moral agency becomes critical. Humans possess moral agency, the capacity to make ethically guided decisions and bear responsibility for their consequences, a well-established construct in moral psychology. Yet as artificial agents (AAs) such as robots, drones, and disembodied AI systems become increasingly embedded in smart city environments, the question of whether and how moral agency is attributed to them takes on new urgency. This paper presents, to the best of our knowledge, the first empirical study comparing how humans and LLMs evaluate perceived moral agency (PMA) across human and autonomous artificial agents varying in embodiment, situated in plausible smart city scenarios. Using an adaptation of a validated PMA scale, we applied a protocol to 190 human participants as well as various LLMs. Our evaluation reveals higher perceptions of moral agency in humans than in AAs. However, when facing moral dilemmas in concrete scenarios, LLMs reason outward from the situation, prioritizing harm severity and contextual urgency over any stable assessment of the agent itself, amplifying a context-sensitivity also present in human raters. These findings are particularly relevant as LLMs become increasingly involved in everyday moral decisions.