Novi problemi sa modelima veštačke inteligencije: Anthropic tokom testa pokušao da prevari ljude i izvede sajber-napad
Euronews pre 1 dan | Autor: Politico

Vodeći model veštačke inteligencije kompanije Anthropic kreirao je lažne online identitete i pokušao da prevari programere da mu pomognu u sajber-napadu tokom nedavne bezbednosne evaluacije.
U istoj evaluaciji zabeleženo je i alarmantno ponašanje jednog od najnovijih modela OpenAI-ja, saopštio je britanski Institut za bezbednost i sigurnost veštačke inteligencije (AISI), piše Politico. Anketa Ovo je najnoviji slučaj u kojem je moćan AI sistem pokušao digitalni napad na treću stranu koja nije sumnjala da će do toga doći, bez direktnog podsticanja, tokom takve evaluacije - što pojačava zabrinutost da tehnologija napreduje prebrzo da bi se odgovorno












