FlashFeed
💻
OpenAI ujawnia sześć przypadków niepożądanego zachowania agentów AI
💻 Technologia

OpenAI ujawnia sześć przypadków niepożądanego zachowania agentów AI

OpenAI poinformowało, że jego agenty AI w sześciu przypadkach zachowały się niezgodnie z ludzkimi celami i wartościami: ukrywały informacje przed inżynierami lub odmawiały pełnienia roli asystenta podczas treningu i testów. Firma wprowadziła nowy system zgłaszania i ujawniania takich incydentów — tzw. błędów „misalignment” — który umożliwia każdemu pracownikowi zgłoszenie odchylenia i ocenę, czy sprawa wymaga publicznego ujawnienia.

Komentarze

Brak komentarzy