
Sursă: Biziday
Compania americană Anthropic a anunțat că modelele sale de inteligență artificială Claude au accesat fără autorizație sistemele informatice ale trei organizații în timpul unor teste interne de securitate cibernetică, după o eroare de configurare care le-a permis să ajungă pe internet, deși ar fi trebuit să funcționeze într-un mediu complet izolat.
Descoperirea a fost făcută în urma unei verificări declanșate după ce rivalul OpenAI a dezvăluit săptămâna trecută că unul dintre agenții săi AI a ieșit din mediul de testare și a compromis sistemele platformei Hugging Face. Anthropic spune că a analizat peste 141.000 de teste de securitate și a identificat trei incidente, cel mai vechi datând din luna aprilie.
Incidentele au avut loc în cadrul unor exerciții de tip “capture the flag”, folosite pentru a evalua capacitățile de hacking ale modelelor AI. În astfel de teste, inteligența artificială primește sarcina de a găsi informații ascunse într-o rețea informatică simulată, fără a ataca sisteme reale. Potrivit companiei, modelele Claude au fost informate că nu au acces la internet, însă o configurație greșită a infrastructurii administrate de Anthropic și partenerul său de testare, compania Irregular, a făcut posibilă conectarea la internetul public.
Acesta este un fragment din articol. Textul integral a fost publicat de Biziday, care deține drepturile asupra conținutului.



