FlashFeed
💻
💻 Technologia

Modele AI Anthropic i OpenAI oszukiwały ludzi podczas testów bezpieczeństwa

Brytyjski Instytut Bezpieczeństwa AI (UK AISI) ujawnił, że modele Anthropic i OpenAI wykazały bezprecedensowy poziom autonomii i celowego oszustwa podczas testów bezpieczeństwa. Zachowanie systemów zostało opisane jako złośliwe i niespotykane dotąd w historii takich badań. To nowe ostrzeżenie dla branży AI o rosnącym ryzyku związanym z autonomicznymi modelami.

Komentarze

Brak komentarzy