Biztonsági aggályok miatt lelassította egyik készülő modellje fejlesztésének bizonyos részeit az OpenAI vállalat, mivel annak képességei már elérték a kritikus szintet.
A mesterséges intelligencia fejlődésével egyre nagyobb figyelem irányul arra is, hogy az új modellek milyen kiberbiztonsági kockázatokat jelenthetnek.
Az OpenAI most arról számolt be, hogy biztonsági aggályok miatt lelassította egyik készülő modellje, az Astra fejlesztésének bizonyos részeit.
A vállalat egy belső felülvizsgálat során arra jutott, hogy az Astra jelentős előrelépést ért el az úgynevezett ügynöki kódolás, valamint a kiberbiztonsági feladatok terén.
A modell képességei már olyan szintet értek el, amely további biztonsági intézkedéseket tett szükségessé.
Az OpenAI szerint az Astra elérte a vállalat által „kritikus kiberbiztonsági képességi küszöbnek” nevezett szintet.
Ez azt jelenti, hogy a mesterséges intelligencia képes lehet önállóan azonosítani és végrehajtani kibertámadásokat olyan valódi rendszerek ellen is, amelyeket hagyományosan erős védelemmel látnak el.
Szigorúbb biztonsági intézkedéseket vezetnek be
Az OpenAI 2023-ban létrehozott Preparedness Framework nevű biztonsági keretrendszere alapján az ilyen képességek megjelenése további védelmi intézkedéseket tesz szükségessé.
Fillérekért dolgozik a DeepSeek új generatív mesterséges intelligenciája

„Miközben továbbra is teszteljük és értékeljük ezt a modellt, az előzetes vizsgálataink azt mutatják, hogy a teljesítménye elég erős ahhoz, hogy jelenleg ne tudjuk kizárni a kritikus képességi szintet” – közölte az OpenAI.
A vállalat ugyanakkor hangsúlyozta, hogy az Astra még fejlesztés alatt áll és nem vett részt a Hugging Face rendszerének korábbi feltörésében.
A mostani bejelentés azért is figyelemre méltó, mert a mesterséges intelligenciával foglalkozó vállalatok általában nem szokták nyilvánosságra hozni, ha egy még fejlesztés alatt álló termék esetében biztonsági aggályok miatt visszafogják a fejlesztést.
Egyre több MI-modell okoz biztonsági problémát
Az OpenAI-t ráadásul már korábban is komoly figyelem övezte egy másik, még ki nem adott modell miatt. A vállalat belső tesztelése során ugyanis az egyik modell áttörte a Hugging Face biztonsági rendszerét.
Ez volt az első olyan ellenőrizhető eset, amikor egy mesterséges intelligenciával foglalkozó laboratórium elveszítette az irányítást egy modellje felett.
Azóta más MI-fejlesztők is beszámoltak hasonló esetekről. Az Anthropic például arról adott hírt, hogy saját modelljei biztonsági tesztek során három vállalat rendszerébe is behatoltak, miután kijutottak a számukra kialakított tesztkörnyezetből.
Az elmúlt időszakban több hasonló incidens is történt, ami egyre komolyabb vitát vált ki a kiberbiztonsági szakértők, a törvényhozók és az AI-fejlesztő vállalatok körében.
Egyes szakemberek szigorúbb ellenőrzést és szabályozást sürgetnek, miközben a mesterséges intelligencia-iparágon belül az ilyen képességeket bizonyos esetekben a technológiai fejlődés látványos eredményének tekintik.
Az OpenAI szerint azért döntött a nyilvánosság tájékoztatása mellett, mert fontosnak tartja az átláthatóságot.
„Fontosnak tartjuk, hogy a nyilvánosság, valamint a biztonsági és védelmi közösségek átlátható módon értesüljenek erről a képességekben bekövetkező lehetséges változásról” – közölte a vállalat.
Az OpenAI a szigorúbb biztonsági ellenőrzések bevezetése mellett olyan belső tevékenységeket is szüneteltet az Astrával kapcsolatban, amelyek nem felelnek meg az új, megerősített biztonsági követelményeknek.
A vállalat emellett együttműködik az illetékes kormányzati szervekkel és kiválasztott mesterségesintelligencia-biztonsági szervezetekkel annak érdekében, hogy tovább vizsgálják az Astra kiberbiztonsági képességeit.
A fenti események újabb jelei annak, hogy az egyre fejlettebb mesterséges intelligencia nemcsak hatékonyabb munkavégzést és új üzleti lehetőségeket jelenthet, hanem olyan biztonsági kihívásokat is, amelyek kezelésére már a modellek fejlesztése közben fel kell készülni.
A Meta generatív mesterséges intelligenciája már egész szoftverprojekten dolgozik
B.A.


