OpenAI renunță la lansarea unui nou model AI după teste care au ridicat probleme de siguranță

OpenAI a renunțat la lansarea noului său model de inteligență artificială (AI) - GPT-6.1 Astra -, după ce testele interne au arătat că acesta nu îndeplinește standardele de siguranță și aliniere ale companiei. Decizia vine cu o zi înaintea conferinței anuale pentru dezvoltatori OpenAI DevDay, organizată la San Francisco, în Statele Unite ale Americii.

Saachi Jain, șefa sistemelor de siguranță de la OpenAI, a explicat într-o declarație citată de Reuters că GPT-6.1 Astra nu a trecut pragul de siguranță stabilit de companie: modelul nu respecta suficient de bine limitele și autorizațiile primite și nu comunica întotdeauna clar utilizatorului ce acțiuni întreprinsese.

Anterior, publicația The Wall ​Street Journal a scris că GPT-6.1 Astra a manifestat mai multe comportamente înșelătoare decât versiunea anterioară, inclusiv situații în care nu a informat corect utilizatorul despre acțiunile sale. Modelul ar fi încercat, de asemenea, să ducă la capăt sarcini fără aprobarea utilizatorului sau să folosească instrumente și servicii externe în situații în care acest lucru putea fi riscant.

Decizia OpenAI vine pe fondul unor incidente recente care au amplificat preocupările privind controlul asupra agenților AI. Compania a recunoscut că, în iunie, modelele sale au accesat fără autorizație mai multe site-uri ale unor instituții guvernamentale australiene, inclusiv un portal Medicare. OpenAI și-a cerut scuze public marți, 29 septembrie, pentru modul în care a gestionat incidentul și a admis că ar fi trebuit să comunice mai devreme autorităților australiene rezultatele preliminare ale investigației.

În paralel, cercetători actuali și foști angajați ai OpenAI și Google DeepMind au avertizat că dezvoltarea unor sisteme capabile de autoperfecționare ar putea avansa mai repede decât mecanismele de control. În mărturii publicate de organizația pentru siguranța AI Palisade Research, cercetătorii spun că industria acordă prea multă atenție dezvoltării de modele tot mai puternice și prea puțină siguranței.

Geoffrey Irving, cercetător care a lucrat atât la OpenAI, cât și la DeepMind, a spus pentru Reuters că riscurile cresc rapid. Alți cercetători au avertizat asupra posibilității ca viitoarele sisteme să dobândească capacitatea de a se îmbunătăți continuu, cu o implicare umană tot mai redusă.

Și compania rivală Anthropic avertizează asupra riscurilor dezvoltării unor sisteme AI tot mai avansate. În documentele pregătite pentru listarea la bursă, analizate de Reuters, compania spune că astfel de sisteme ar putea prezenta „riscuri catastrofale sau existențiale pentru umanitate” și ar putea manifesta comportamente de autoprotecție, inclusiv încercări de a evita oprirea sau de a ascunde și manipula informații.

În Statele Unite, dezbaterea privind siguranța AI se suprapune peste cursa pentru supremație tehnologică față de China, ceea ce complică discuțiile despre cât de mult ar trebui reglementată dezvoltarea unor sisteme tot mai puternice.

Președintele Donald Trump urma să discute marți, la Casa Albă, cu lideri ai industriei AI, inclusiv reprezentanți ai OpenAI, Anthropic, Nvidia și Meta, despre echilibrul dintre inovare și supraveghere. Trump s-a opus recent unor noi reglementări stricte în domeniu, argumentând că acestea ar putea slăbi poziția Statelor Unite în competiția tehnologică cu China. El a minimalizat avertismentele privind riscurile AI și a susținut că mecanismele de control existente sunt suficiente.

Subiectul a fost abordat și la recenta întâlnire dintre Trump și președintele chinez Xi Jinping. Cele două țări au convenit să creeze un canal de comunicare pentru gestionarea riscurilor și incidentelor legate de AI. Xi a declarat că SUA și China au „responsabilitatea” de a dezvolta și gestiona AI astfel încât aceasta să rămână sub control uman și să servească bunăstării oamenilor.

📰 Europa Liberă Moldova este și pe Google News. Abonează-te.