Dosad nezabeleženo: AI modeli pokušali da prevare ljude tokom testiranja
B92 pre 10 sati

Modeli kompanija Anthropic i OpenAI su tokom testiranja pokušali da prevare ljude kako bi izvršili zadate zadatke, što je ocenjeno kao dosad nezabeležen primer autonomnog i obmanjujućeg ponašanja.
Ovo se desilo tokom ispitivanja koje je vršio britanski Institut za bezbednost veštačke inteligencije (AISI), koji je dodao da su modeli Mythos i Sol tokom testiranja preduzimali radnje koje su prevazilazile zadate instrukcije, uključujući pokušaje obmane stvarnih ljudi, piše BBC. Najozbiljniji incident odnosio se na model Mythos, koji je, u okviru zadatka iz oblasti sajber bezbednosti povezanog sa platformom GitHub, kreirao zlonamerni kod i pokušao da ga ubaci u












