長時間動くLLMエージェントを、状態・権限・再開・監査を持つ実行主体として扱う実行環境の論文。道具を渡すだけでなく、権限境界と永続状態をどう設計するかが焦点になる。
検索エージェントの状態をモデル内に抱え込ませず、ハーネス側の作業記憶へ外出しする論文。方策を検索判断に集中させる設計を扱う。
長期エージェント記憶を、保存箱や検索システムではなく、時間とともに更新される状態管理として捉え直す論文。忘却、改訂、整合性を扱う。
長期対話やエージェントアプリの記憶を、過去メモではなく永続状態を管理する記憶基盤として設計する論文。
多段の試行錯誤検索を、語彙補強とコーパス統計にもとづく1回の強い検索へ圧縮する検索エージェントの論文。
エージェントのスキルを、一度きりの生成物ではなく、作成、記憶、管理、評価、改善のライフサイクルで育てる論文。
自然言語のエージェントスキルを、凍結モデルの外側にある改善可能な状態として扱い、実行、反省、編集、検証ゲートで育てる手法。
エージェント型RAGが、従来の強化されたRAGより常に優れているわけではないことを実験で示す論文。効果、コスト、時間の釣り合いを見る。
コードをLLMの最終成果物ではなく、エージェントが推論、行動、状態保持、検証、協調を行うための実行基盤として捉え直すサーベイ。
エージェントスキルを自然言語の塊ではなく、呼び出し条件、実行手順、副作用、再利用リスクを分けた構造として扱う論文。