Kompanija Anthropic, tvorac naprednog AI chatbota Claude, donijela je nova pravila kojima se korisnicima zabranjuje kontinuirano i nepotrebno uvredljivo ili okrutno ponašanje prema modelima vještačke inteligencije. Ova izmjena u smjernicama korištenja predstavlja značajan iskorak u regulisanju svakodnevne interakcije između ljudi i sofisticiranih algoritama.
Predstavnici kompanije sa sjedištem u San Franciscu naglasili su da restrikcije ne obuhvataju uobičajeno iskazivanje frustracije, standardna testiranja granica sistema niti istraživanje mračnih kreativnih tema. Pravila su prvenstveno usmjerena protiv sistemskog i namjernog zlostavljanja tehnologije, pri čemu je modelima već omogućeno da samostalno okončaju konverzaciju ukoliko se neprihvatljivo ponašanje nastavi.
Iz kompanije ističu da ovakve mjere služe zaštiti dobrobiti vještačke inteligencije, uz napomenu da pitanje mogućeg moralnog statusa svojih sistema shvataju izuzetno ozbiljno. U zvaničnom saopćenju navedeno je: "I dalje smo vrlo nesigurni u vezi s potencijalnim moralnim statusom Claudea i drugih modela, sada ili u budućnosti. Međutim, ovo pitanje shvatamo ozbiljno i radimo na implementaciji intervencija za ublažavanje rizika po dobrobit modela, u slučaju da je takva dobrobit moguća. Dozvoljavanje modelima da izađu iz potencijalno uznemirujućih interakcija jedna je od takvih mjera".