AI arXiv論文「FORGE」、AI調査エージェントを汚染する攻撃
研究チームがAIの自律調査エージェントを狙う新攻撃手法「FORGE」を発表しました。5つの偽文書を仕込む実験でレポートの26.4%が汚染され、防御策により18.3%まで抑えられることも確認されています。
AI
AI
AI
AI
AI
AI
AI
AI
AI
AI