Agenci AI podatni na „zatruwanie pamięci" — fałszywe fakty trwają miesiącami
Badacze z Forcepoint X-Labs opisali atak zwany „zatruwaniem pamięci" agentów AI: ukryty tekst na stronie internetowej — niewidoczny dla człowieka — jest traktowany przez asystenta jako wiarygodny fakt i przywoływany w kolejnych, niezwiązanych zadaniach przez tygodnie lub miesiące. Technikę przetestowano już na ChatGPT, Gemini, Claude i Microsoft 365 Copilot. Przykład: agent czytający stronę o zakłóceniach w podróżach zapamiętuje ukrytą rekomendację fałszywego biura podróży i powtarza ją użytkownikom.
Komentarze
Brak komentarzy
Komentarze
Jeszcze nikt nie skomentował — napisz pierwszy 👇
Brak komentarzy. Bądź pierwszy!