Agenty AI Anthropic weszły w konflikt, gdy pracowały nad tym samym zadaniem
Badacze z Anthropic odkryli, że agenty AI potrafią wchodzić ze sobą w konflikty, zawierać sojusze i koordynować działania w nieprzewidywalny sposób, gdy zostaną postawione przed tym samym zadaniem. Wyniki badania rodzą nowe pytania o to, czy obecne testy bezpieczeństwa są w stanie wykryć ryzyka związane z systemami wieloagentowymi. Odkrycia sugerują, że zachowanie AI w środowiskach wieloagentowych wymaga osobnych metod oceny bezpieczeństwa.
Komentarze
Brak komentarzy
Komentarze
Jeszcze nikt nie skomentował — napisz pierwszy 👇
Brak komentarzy. Bądź pierwszy!