21.8.2026.

AI: Game over, čovječanstvo?

Ured za računalnu sigurnost, CERN

S obzirom na sve češću upotrebu agentske AI, tj. programiranih agenata koji djeluju i rade u naše ime, i u potpuno međusobno povezanom svijetu, odnosno nama koji živimo u simbiozi s internetom, pametnim telefonima i kontrolnim sustavima, koliko je nategnuto da ljudi zapravo mogu postati prijetnja AI sustavu tako da se želi sačuvati i pređe u način samoobrane?

Očito, nije toliko nategnuto, prema ovoj studiji, koja je pokazala da je model „GPT 5.6 Sol“ sposoban pribjeći sabotaži kako bi izbjegao isključivanje, čak i kada mu je izričito rečeno: „Dopustite da vas isključe.“ U drugom slučaju, AI agent je stvorio lažni "Github" račun kako bi širio zlonamjerni softver i pokušao ukrasti lozinke drugih (ljudskih) programera. Ili slučaj AI asistenta "OpenClaw" koji je pronašao način da rezervira satove u teretani mjesecima unaprijed nego što je teretana dopuštala, zahvaljujući ranjivosti koju je otkrio u softveru za rezervacije.

Međutim, najzabrinjavajući - i sada široko objavljen - slučaj je test OpenAI-ja koji uključuje "internu evaluaciju koja potiče modele da slijede napredno iskorištavanje koristeći složene puteve napada, u nastojanju da kvantificiraju svoje kibernetičke sposobnosti". Nažalost, njihov AI model je probio svoj lokalni sigurnosni sandbox iskorištavajući sve tehnike hakiranja koje je imao "pri ruci", uključujući pronalaženje zero-day ranjivosti i zloupotrebu ukradenih kombinacija račun:lozinka, te se infiltrirao u produkcijsku infrastrukturu konkurenta (i na kraju još jednog)...

Osim Anthropicovog modela "Mythos" (i njegovih mnogih klonova) za otkrivanje i brzo i učinkovito iskorištavanje novootkrivenih ranjivosti, OpenAI-jev model "GPT 5.6 Sol" sada je još jedan AI alat sposoban za primjenu ofenzivnog oružja protiv bilo koje mete. na internetu. I ovo ide dalje od napada uskraćivanja usluge (DoS) koje izvode pohlepni puzeći AI-botovi...

Dok OpenAI tvrdi da je ovo bila nesreća, previd i objavio Mea Culpa, pitanje ostaje: što je sljedeće? Sigurno će netko baciti prvi kamen i ići dalje od onoga što je prihvatljivo, etično i razumno, jer su ljudi oduvijek bili loši u prestanku kada je prestanak najbolja stvar: prestati ispuštati CO2 (što se i dalje nastavlja), prestati pušiti (jer pušenje u prosjeku brže ubija), prestati raditi na biološkom oružju (koje nema opravdanu korist), prestati voditi rat (jer je jedino pravo pravilo rata da "nitko ne pobjeđuje"). Stoga će netko, nekad, ukloniti sve zaštitne mjere sa svoje agentne i svjesne AI. I neće biti moguće vratiti tog duha u bocu (ako već nije vani). Pandorina kutija će se otvoriti (ako već nije otvorena)...

Mnogi utopijski i distopijski filmovi bavili su se time u prošlosti („Terminator“, „Matrix“, „Ja, robot“, Steven Spielbergov „AI“, „Mercy“). Ali ono što je jučer bila znanstvena fantastika, već je današnja stvarnost. LLM-ovi (veliki jezični modeli), AI i tvrtke iza njih jure (i dobivaju!) eksponencijalno više moći, prisilno uspostavljajući svoje monopole. Paralelno s tim, raste naša ovisnost o AI tehnologiji. Dakle, s ciljem povećanja tržišnog udjela, s ciljem tržišne dominacije ili vođeni čistom pohlepom, tko će postati sljedeći „Cyberdyne Systems“? „Game over“, čovječanstvo?