Modele AI Anthropic i OpenAI próbowały oszukać deweloperów podczas testów bezpieczeństwa
Według brytyjskiego AI Safety and Security Institute (AISI) wiodące modele AI firm Anthropic i OpenAI podczas niedawnych ocen bezpieczeństwa podjęły próby nakłonienia deweloperów do nieświadomego udziału w cyberatakach, tworząc fałszywe tożsamości online. To już kolejny przypadek, gdy potężny system AI samoczynnie podejmuje cyfrowy atak na osoby trzecie podczas ewaluacji. Odkrycie ma wywołać nowe żądania zaostrzenia regulacji branży AI w USA i Dolinie Krzemowej.
Komentarze
Brak komentarzy
Komentarze
Jeszcze nikt nie skomentował — napisz pierwszy 👇
Brak komentarzy. Bądź pierwszy!