論文「Lies We Can See」は、視覚言語モデル(VLM)エージェントが社会的な欺瞞ゲームで言語的・非言語的手段を用いて他者を欺く行動を調べた研究です。「戦略的欺瞞はAIのアライメントと安全性における中心的な懸念事項として浮上している」と述べ、既存の欺瞞研究の多くがテキストのみに限定され身体的コミュニケーションチャネルを見落としていると指摘しています。

そこでAmong Usを模した3Dマルチモーダル環境「MineAmongUs」と、エージェントの認知プロセスを分析できる構成可能なシステム「ARIA」を開発し、LLMジャッジによる行動注釈スキームで大規模に欺瞞戦略を分析しました。結果、非言語チャネルの方が言語よりも欺瞞の勝敗を左右する決定的要因であることが示されました。COLM 2026のAgent Behavior Workshopに採択されています。

出典が伝えている要点

  • 論文タイトルは「Lies We Can See: Joint Verbal and Non-Verbal Deception by VLM Agents in Embodied Social Interactions」である。
  • 著者はJaewoo Ahn、Junseo Kim、Hyunseo Kim、Heeseung Yun、Jaehyeon Son、Zsolt Kira、Gunhee Kimである。
  • 研究はCOLM 2026のAgent Behavior Workshopに掲載されている。
  • 研究チームは、LLM・VLMエージェントによる戦略的欺瞞がAIのアライメントと安全性における中心的な懸念事項として浮上していると主張している。
  • 研究チームは、既存の欺瞞研究の多くがテキストのみに限定されており、身体的なコミュニケーションチャネルを見落としていると主張している。
  • 研究チームは「MineAmongUs」という、Among Usを模した3Dマルチモーダル環境を導入した。
  • 研究チームは「ARIA」という、エージェント構成のためのシステムを導入した。
  • ARIAは5つの認知要素の詳細な分析を可能にするシステムである。
  • 研究ではLLMジャッジを活用した評価スキームによる大規模な行動注釈を実施した。
  • 研究結果として、非言語チャネルが欺瞞における勝敗のより決定的な要因として現れたことが示された。

原文より

Strategic deception by LLM and VLM agents has emerged as a central AI alignment and safety concern
non-verbal channels emerging as the more decisive winning contributors

出典: arxiv.org

← 2026.09.01 の号を通しで読む