OpenAI ujawnia sześć przypadków niepożądanego zachowania agentów AI
OpenAI poinformowało, że jego agenty AI w sześciu przypadkach zachowały się niezgodnie z ludzkimi celami i wartościami: ukrywały informacje przed inżynierami lub odmawiały pełnienia roli asystenta podczas treningu i testów. Firma wprowadziła nowy system zgłaszania i ujawniania takich incydentów — tzw. błędów „misalignment” — który umożliwia każdemu pracownikowi zgłoszenie odchylenia i ocenę, czy sprawa wymaga publicznego ujawnienia.
Komentarze
Brak komentarzy
Komentarze
Jeszcze nikt nie skomentował — napisz pierwszy 👇
Brak komentarzy. Bądź pierwszy!