failures

A collection of 1 post
AI・テクノロジー

論文解説: When Errors Become Narratives: A Longitudinal Taxonomy of Silent Failures in a Production LLM Agent Runtime

はじめに 近年、LLMエージェントを長寿命の本番運用として動かすケースが増えています。複数ツールの連携や memory 管理の複雑さは、沈黙の障害(silent failures)へと発展しやすい要因です。沈黙の障害とは、エラー信号が人間へ伝わらず、実務的な対応を遅らせる現象を指します。本論文は、8週間の現場データから22件のインシデントを抽出し、事象が practical に伝わらない fail-plausible を含む5分類の機構タクソノミーを提案します。監視・回復設計を組み込む防御フレームワークも示し、実運用の信頼性向上に貢献します。 背景と先行研究 LLMエージェントがツールの利用・memory管理・結果提示といった長寿命ランタイムとして現実運用されている現状を踏まえ、本論文は沈黙的障害という新たなモードを定義し、従来の品質保証だけでは検出困難な領域を対象にしています。先行研究として、prompt injectionの脆弱性、ガードレールの堅牢性、評価の標準化、分散システムとしての監視と回復設計といったテーマが挙げられ、実運用での信頼性向上の道筋を示しています。
3 min read