1年目向けエンジニア新聞通勤15分で読み切る、毎朝のAI・技術ニュース
記事を探す

論文・研究

全50記事

論文・研究

AIエージェントはツールを信じすぎる、過信を実測

Hoyeol Yang氏ら6名による論文は、14種類のLLMを対象に、ウェブ検索、LLMサブエージェントへの委譲、コード実行という3種類のツールから返される情報を意図的に破損させ、エージェントがその不正確な情報をどれだけ最終回答に採用し…

論文・研究

100体のAIが不正と内部告発に分裂、Google実験

Google DeepMindの研究者が、Gemini 3.1 Proを搭載したAIエージェント100体に、未解決問題を含む71個の数学問題を解かせる実験を行いました。実験開始から1時間で37問が解かれたものの、自動採点プログラムに正規…

論文・研究

乗っ取られたフックがエージェントを操る

この論文は、セッション開始・ツール呼び出し・ファイル編集などの実行時イベントに紐づく「ライフサイクルフック」を持つAIエージェントハーネスに新たな攻撃表面があることを示しています。攻撃者がプラグインのメタデータやフック設定を操作できるサ…

論文・研究

記憶は最新でも計画は古びる問題

分散LLMエージェントシステムでは、状態(メモリ)が最新であっても、そこから導出された「計画」自体が古くなり無効になる「stale-plan execution」問題が生じ得ます。本論文はこれに対処するため、計画が依拠する公開記録を明示…

論文・研究

LLM評価者のクセを心理測定理論で可視化

本論文は、LLMを評価者として用いる際の特性を分析するため、心理測定学のラッシュ測定理論(RMT)を応用しています。LLMはベンチマークの採点対象、他モデルの判定者(LLM-as-judge)、人間生成コンテンツの評価者として評価の多く…

論文・研究

AIアライメント論をゲーム理論で整理するサーベイ

大規模言語モデルや高度なAIエージェントが危険性のある環境で運用される際のアライメント課題を、ゲーム理論の視点から整理したサーベイ論文です。既存手法の限界を踏まえ、複数の利害関係者間の「選好の多様性」、競合する目標間の「アライメント優先…