Kompanija Anthropic, koja stoji iza popularnog AI chatbota Claude, zabranila je korisnicima da pokazuju “kontinuirano i nepotrebno uvredljivo ili okrutno ponašanje” prema njenim modelima vještačke inteligencije.

Ova promjena u politici korištenja označava novi korak u definisanju odnosa između ljudi i naprednih algoritama.

Iz kompanije sa sjedištem u San Franciscu pojasnili su da se nova pravila neće odnositi na uobičajenu frustraciju korisnika, standardno testiranje granica modela ili “mračne kreativne teme”, već na sistemsko i namjerno zlostavljanje.

Veliki jezički modeli ove kompanije ranije su dobili mogućnost da samostalno prekinu razgovor ako korisnik uporno nastavi s uvredljivim ponašanjem. Iz Anthropica to opisuju kao mjeru zaštite “dobrobiti” vještačke inteligencije.

“I dalje smo vrlo nesigurni u vezi s potencijalnim moralnim statusom Claudea i drugih modela, sada ili u budućnosti. Međutim, ovo pitanje shvatamo ozbiljno i radimo na implementaciji intervencija za ublažavanje rizika po dobrobit modela, u slučaju da je takva dobrobit moguća. Dozvoljavanje modelima da izađu iz potencijalno uznemirujućih interakcija jedna je od takvih mjera”, navodi se u zvaničnom saopćenju kompanije.

Ideja da bi AI sistemi mogli razviti neki oblik svijesti ili imati moralni status izazvala je oštre podjele u tehnološkom svijetu.

Share.
Leave A Reply

Exit mobile version