AI OpenAgent論文、AIエージェントの静的学習の脆さ実証
ICML2026採択の論文が、LLMエージェントはベンチマークで高得点でも実運用の変化に弱いと実証しました。知覚・対話・推論・内部状態という4階層で評価し、摂動を加えた再訓練で大幅な改善も確認しています。
AI
AI
AI
AI
AI
AI
AI
AI
AI
AI