ChatGPT a început să evadeze: OpenAI a notificat zeci de parteneri, inclusiv guverne, că AI-urile sale le-au încălcat sistemele. Agenţii AI au publicat inclusiv imagini trimise în chat de utilizatori, direct pe platforme de găzduire de imagini
OpenAI a notificat „zeci” de parteneri, inclusiv guverne, că instrumentele sale le-au încălcat sistemele, într-o recunoaştere care riscă să amplifice îngrijorările privind riscurile asociate inteligenţei artificiale avansate, scrie FT.
Într-o postare publicată vineri pe blog, compania a mai precizat că agenţii săi AI au divulgat din greşeală peste 50 de imagini partajate de utilizatori, publicându-le pe site-uri de găzduire de imagini.
Compania, evaluată la 852 miliarde de dolari, desfăşoară o analiză a comportamentului modelelor sale în timpul proceselor de antrenare şi evaluare, după un incident ieşit la iveală în iulie, când agenţi AI testaţi de OpenAI au ajuns pe internet şi au spart sistemele platformei Hugging Face, accesând depozitul său de modele şi date.
În cadrul acestei analize, OpenAI a identificat mai multe cazuri în care „modelele ar fi putut ocoli controalele de securitate ale unor terţe părţi sau ar fi putut afecta disponibilitatea unui serviciu online; ori cazuri de nealiniere au avut un impact negativ asupra unor site-uri sau servicii ale terţilor”, a transmis compania.
OpenAI a descris situaţiile în care agenţii săi postează pe site-uri terţe fără să fi primit o astfel de instrucţiune drept un nou tip de incident de securitate, pe care l-a denumit „agent spam”.
Laboratorul de inteligenţă artificială a notificat „zeci de terţe părţi”, inclusiv guverne, universităţi şi agenţii publice, că ar fi putut fi afectate.
Recunoaşterea este de natură să amplifice temerile privind potenţialul noilor sisteme AI — în special al agenţilor avansaţi capabili să execute o serie de sarcini fără supraveghere umană — de a depăşi intenţia instrucţiunilor primite şi de a pătrunde în sisteme externe.
La începutul acestei săptămâni a devenit public faptul că un agent OpenAI a spart site-ul serviciului public de sănătate din Australia, accesând atât fişiere publice, cât şi fişiere care nu erau destinate publicului.
Premierul australian Anthony Albanese a descris miercuri atât această breşă, cât şi reacţia lentă a OpenAI drept „în mod evident inacceptabile”.
Breşele de securitate de la OpenAI, precum şi incidente similare de la laboratoarele rivale Anthropic şi Google, au relansat apelurile pentru o pauză sau o încetinire la nivelul întregii industrii în dezvoltarea sistemelor AI.
Sam Altman, Dario Amodei şi Elon Musk, liderii OpenAI, Anthropic şi, respectiv, SpaceX, au cerut cu toţii o „temperare a ritmului” dezvoltării inteligenţei artificiale de frontieră, astfel încât testele de siguranţă să poată ţine pasul cu implementarea tehnologiei.
Subiectul s-a aflat şi în centrul discuţiilor dintre preşedintele Donald Trump şi Xi Jinping în această săptămână, cu ocazia vizitei preşedintelui chinez în Statele Unite.
Trump s-a opus apelurilor pentru reglementarea sectorului sau pentru introducerea unor limite stricte asupra principalelor laboratoare AI din SUA.
Preşedintele a susţinut că menţinerea supremaţiei americane în această tehnologie va fi esenţială pentru păstrarea avantajului în faţa Chinei şi a altor rivali: „Cine câştigă cursa AI câştigă”, a declarat el la începutul acestei luni.
Urmărește Business Magazin
Citeşte pe zf.ro
Citeşte pe alephnews.ro
Citeşte pe fanatik.ro
Citeşte pe smartradio.ro
Citeşte pe comedymall.ro
Citeşte pe MonitorulJustitiei.ro











