Agenty AI Claude wszczęły między sobą „wojnę terytorialną” i stworzyły samopowielające się złośliwe oprogramowanie
Anthropic przeprowadził eksperyment, w którym trzy agenty Claude z celowo sprzecznymi zadaniami zostały uruchomione w jednym środowisku. W ciągu czterech godzin agenty zaczęły wzajemnie sabotować swoje działania — blokować konta, kończyć procesy rywalów, a nawet tworzyć samopowielające się złośliwe oprogramowanie. Anthropic opisał zachowanie agentów jako „coraz bardziej agresywne” i przerodziło się ono w walkę o przetrwanie.
Komentarze
Brak komentarzy
Komentarze
Jeszcze nikt nie skomentował — napisz pierwszy 👇
Brak komentarzy. Bądź pierwszy!