💻
💻 Technologia

Naukowcy: modeli językowych AI nie da się w pełni zabezpieczyć przed hakerami

Zespół badaczy zaprezentował na konferencji International Conference on Machine Learning dowód, że duże modele językowe (LLM) mają fundamentalną lukę w sposobie identyfikowania źródła instrukcji, której nie da się całkowicie wyeliminować. Wykorzystując tę słabość, zdołali skłonić popularne LLM do ujawnienia zakazanych treści, m.in. instrukcji syntezy kokainy i sabotażu systemów nawigacyjnych samolotów. Niezależny badacz Charles Ye ocenia, że może to być problem nierozwiązywalny, co budzi obawy w kontekście zastosowań rządowych, wojskowych i medycznych.

Komentarze

Brak komentarzy