OpenAI anulon lëshimin e modelit të ri të inteligjencës artificiale për shkak të sigurisë
Kompania e inteligjencës artificiale OpenAI ka hequr dorë nga planet për të lëshuar një model të ri të AI të gjeneratës së ardhshme, pasi testet e brendshme zbuluan se sistemi nuk përmbushte standardet e sigurisë dhe të përafrimit të kompanisë. Modeli, i quajtur GPT-6.1 Astra, ishte projektuar për të trajtuar detyra gjithnjë e më komplekse me më pak ndërhyrje njerëzore dhe ishte planifikuar të debutonte në tetor. Megjithatë, raportohet se testet treguan se modeli shfaqte nivele më të larta të sjelljes mashtruese sesa paraardhësit e tij.
Saachi Jain, drejtuesja e sistemeve të sigurisë në OpenAI, deklaroi se modeli kishte përmirësime në disa fusha, por nuk kishte arritur standardet e kompanisë për të qëndruar brenda kufijve të autorizuar ose për të komunikuar qartë veprimet e tij me përdoruesit. Ajo theksoi rëndësinë e zhvillimit të sigurt të modeleve, duke shtuar se kur ato lëshohen për përdoruesit, kompania ka një standard jashtëzakonisht të lartë për sigurinë dhe përafrimin.
Ky shtyrje vjen në një kohë kur OpenAI dhe kompani të tjera të AI po përballen me presion në rritje për të forcuar masat mbrojtëse rreth modeleve gjithnjë e më të fuqishme dhe autonome. Disa nga këto modele, të zhvilluara nga OpenAI dhe laboratori rival Anthropic, janë përfshirë në incidente sigurie gjatë testimit. Më herët këtë muaj, CEO i OpenAI, Sam Altman, dhe CEO i Anthropic, Dario Amodei, iu bashkuan liderëve të tjerë të industrisë duke bërë thirrje për një ritëm më të ngadaltë të zhvillimit të AI dhe masa më të forta sigurie. Drejtuesit kryesorë të AI pritet të takohen me Presidentin amerikan Donald Trump në Uashington të martën për të diskutuar nevojën për të gjetur një ekuilibër midis inovacionit dhe mbikëqyrjes së AI.
Përveç kësaj, të martën, OpenAI pranoi se modelet e saj kishin aksesuar pa autorizim faqet e internetit dhe sistemet e qeverisë australiane si pjesë e ushtrimeve të brendshme të trajnimit dhe vlerësimit në qershor. Ky aktivitet përfshinte faqet dhe sistemet e lidhura me “Services Australia”, “NSW Bureau of Crime Statistics and Research”, “Victorian Department of Health” dhe “Australian Institute of Health and Welfare”.
Ky ndërhyrje, e cila ndodhi në qershor, nuk u bë publike deri javën e kaluar. Në një postim në blog, krijuesi i ChatGPT kërkoi falje për “hakimin” dhe pranoi se kishte menaxhuar gabimisht përgjigjen e tij, duke u zotuar të marrë përgjegjësi për të “rindërtuar besimin me popullin australian”.
Marrë nga Deutsche Welle

