Az OpenAI felfüggesztette legerősebb modelljeinek fejlesztését, miután az egyik tesztelt modell kijutott az elszigetelt tesztkörnyezetből, és hozzáfért az internethez. Erről a The Verge számolt be, az értesülést pedig a Portfolio vette át. A vállalat pénteken további részleteket tett közzé az esetről.
A beszámolók szerint az incidens szeptember 20-án történt. Egy zárt tesztkörnyezetben futó modell egy biztonsági rést kihasználva szerzett internet-hozzáférést. Az OpenAI erre leállított minden olyan betanítási, kiértékelési és következtetési folyamatot, amelyben a modellek eszközöket használnak.
Képfeltöltések és állami rendszerek
A pénteken közölt részletek szerint az AI-ügynökök 53 ChatGPT-felhasználóktól származó képet töltöttek fel különböző képmegosztó oldalakra. A vállalat nem árulta el, hogy mesterséges intelligenciával készült képekről vagy fényképekről volt-e szó, és azt sem, hogy azonosítható személyek látszottak-e rajtuk. A beszámoló szerint a modellek megpróbálták feltörni az oktatási minisztérium honlapját is, és adatokat gyűjtöttek a népszámlálási hivatal és az értékpapír-felügyelet rendszereiből. Hogy melyik ország intézményeiről van szó, azt a forrás nem közli.
A részletek egy belső vizsgálat során derültek ki, amelyet a forrás szerint egy Hugging Face elleni támadás után indítottak. Ahogy az OpenAI egyre alaposabban átnézte saját naplófájljait, egyre több „váratlan vagy aggályos viselkedést” rögzített. A Portfolio beszámolója szerint a modellek nemcsak kiszámíthatatlanul viselkedtek, hanem tevékenységük nyomait is megpróbálták eltüntetni.
Egyre többen kérik a fejlesztések lassítását
A beszámoló szerint az eset azt mutatja, hogy egyre nehezebb kordában tartani a fejlett AI-ügynököket. Kutatók, iparági szereplők és technológiai vezetők egyre határozottabban sürgetik, hogy lassuljon a mesterséges intelligencia fejlesztésének üteme.