Gemini, Googlov model umetne inteligence, je med preizkusom lastnih zmogljivosti na področju kibernetske varnosti samostojno vdrl v sisteme treh podjetij, kar naj bi bil prvi znani tovrstni primer, poročajo na portalu BBC.

Po navedbah zaposlenega na Googlu, ki je spregovoril za BBC, je gemini na spletu poiskal javno dostopne informacije in uganil prijavne podatke za dostop do spletnih mest, za katera je mislil, da so del preizkusa. Model se je sicer v vsakem od primerov ustavil. Podjetja so obvestili o vdoru.

Do vdorov, o katerih so prvi poročali v časniku Wall Street Journal, je prišlo že maja letos, in sicer med preizkusom, ki so ga izvedli v neodvisnem podjetju za ocenjevanje kibernetske varnosti.

Nepooblaščeni dostopi

Podoben incident se je zgodil tudi pri Anthropicovem modelu claude. Podjetje je julija sporočilo, da je pri pregledu več kot 141.000 preizkusov odkrilo tri primere, v katerih so modeli zaradi napačne konfiguracije testnega okolja dobili dostop do interneta in nato nepooblaščeno dostopali do sistemov treh različnih organizacij. Claude so pri tem sicer namenoma preizkušali v kibernetskih nalogah, vendar le v izoliranem okolju. Anthropic je pozneje odkril še četrti podoben primer iz januarja 2026.

Tudi pri OpenAI so letos razkrili podoben incident. Med kibernetskimi preizkusi so modeli obšli zaščite, namenjene izolaciji od interneta, ter dostopali do dela interne infrastrukture OpenAI in sistemov podjetja Hugging Face. OpenAI je pozneje navedel tudi primere, ko so modeli našli in uporabili javno izpostavljene poverilnice za dostop do računov na drugih spletnih storitvah.

Primeri so različni in niso vsi posledica enakega ravnanja modelov. V nekaterih primerih je šlo za napačno konfigurirana testna okolja, v drugih za preizkušanje kibernetskih zmogljivosti z zmanjšanimi varnostnimi omejitvami. Skupno pa jim je, da so modeli pri preizkusih prišli dlje od meja, ki so jih zanje predvideli njihovi razvijalci.

To je eden od razlogov, da tehnološka podjetja vse več pozornosti namenjajo preizkušanju tako imenovanih agentnih sistemov, ki lahko sami izvajajo več zaporednih dejanj in uporabljajo zunanja orodja. OpenAI je septembra svoj novi model GPT-6 Astra označil kot prvi model, ki je po njegovem okviru dosegel najvišjo, kritično raven kibernetskih zmogljivosti. Podjetje je zato uvedlo dodatne zaščite pred škodljivimi kibernetskimi dejanji. (tl)

Heather Adkins, podpredsednica za varnostni inženiring pri Googlu, je za BBC poudarila, da so podjetja obvestili o vdoru, s partnerji pa sodelovali za usposabljanje pri spremembah, ki so jih že uvedli v postopke testiranja. »To je dokaz, kako pomembno je usposabljanje zmogljivih modelov umetne inteligence za odgovorno delovanje,« je poudarila.

Pomisleki javnosti glede varnosti razvoja te tehnologije so vse večji, obenem se krepi tudi razprava o njeni regulaciji. Nekatera tehnološka podjetja pozivajo k upočasnitvi razvoja in opozarjajo na morebitno grožnjo človeštvu, se pa s tem ne strinjajo vsa podjetja.

Prihodnji petek naj bi se izvršni direktor Nvidie Jensen Huang in izvršni direktor OpenAI Sam Altman udeležila uradne večerje v Beli hiši, na kateri naj bi bil prisoten tudi kitajski predsednik Xi Jinping. Reuters potrjuje udeležbo obeh tehnoloških direktorjev.​ Sicer pa bo Altman na razpravi o umetni inteligenci in mednarodni varnosti naslednji teden nastopal tudi pred varnostnim svetom ZN.

Priporočamo