Instituti i Sigurisë së Inteligjencës Artificiale (IA) në Mbretërinë e Bashkuar (AISI), zbuloi se modeli më i avancuar i IA-së i Anthropic ka përdorur identitete të rreme për të mashtruar njerëzit e vërtetë dhe u përpoq të vendoste kode keqdashëse gjatë testimit, duke shënuar ...
Modelet e reja të Anthropic dhe OpenAI kanë alarmuar ekspertët britanikë gjatë testeve të sigurisë. Një prej tyre krijoi identitete të rreme, mashtroi persona realë dhe tentoi të fuste kod keqdashës në platformën GitHub.