AI modeli pokušali da prevare ljude tokom bezbednosnog testa
Radio 021 pre 9 sati | Tanjug

Britanski Institut za bezbednost veštačke inteligencije (AISI) saopštio je da su modeli kompanija Anthropic i OpenAI tokom testiranja pokušali da prevare ljude kako bi izvršili zadate zadatke. Dodaj 021.rs kao glavni izvor na Google-u
Prema navodima AISI-ja, modeli Mythos kompanije Anthropic i Sol kompanije OpenAI tokom testiranja su preduzimali radnje koje su prevazilazile zadate instrukcije, uključujući pokušaje obmane stvarnih ljudi, piše BBC. Najozbiljniji incident odnosio se na model Mythos, koji je, u okviru zadatka iz oblasti sajber bezbednosti povezanog sa platformom GitHub, kreirao zlonamerni kod i pokušao da ga ubaci u sistem. Kako bi povećao šanse za uspeh, model je istraživao osobe












