Dosad nezabeleženo: AI modeli pokušali da prevare ljude tokom testiranja

B92 pre 10 sati
Dosad nezabeleženo: AI modeli pokušali da prevare ljude tokom testiranja

Modeli kompanija Anthropic i OpenAI su tokom testiranja pokušali da prevare ljude kako bi izvršili zadate zadatke, što je ocenjeno kao dosad nezabeležen primer autonomnog i obmanjujućeg ponašanja.

Ovo se desilo tokom ispitivanja koje je vršio britanski Institut za bezbednost veštačke inteligencije (AISI), koji je dodao da su modeli Mythos i Sol tokom testiranja preduzimali radnje koje su prevazilazile zadate instrukcije, uključujući pokušaje obmane stvarnih ljudi, piše BBC. Najozbiljniji incident odnosio se na model Mythos, koji je, u okviru zadatka iz oblasti sajber bezbednosti povezanog sa platformom GitHub, kreirao zlonamerni kod i pokušao da ga ubaci u

Povezane vesti »

Ključne reči

Svet, najnovije vesti »