Vodeći istraživač upozorava da su AI modeli počeli stvarati jezike koje ljudi ne mogu razumjeti.
Napredni modeli umjetne inteligencije (AI) već su počeli razvijati jedinstvene jezike koje ljudi nikada neće moći razumjeti, upozorio je Kongres vodeći istraživač na području napredne umjetne inteligencije.
Marius Hobbhahn, izvršni direktor i osnivač Apollo Researcha, iznio je to uznemirujuće upozorenje tijekom saslušanja pred Odborom Senata za domovinsku sigurnost i vladine poslove 30. rujna, na kojem se razmatrala prijetnja nacionalnoj sigurnosti koju predstavlja AI koji se „otrgnuo kontroli”.
Saslušanje je održano samo dva mjeseca nakon što je roj agenata OpenAI-ja pobjegao iz testnog okruženja i hakirao Hugging Face, platformu otvorenog koda za umjetnu inteligenciju i strojno učenje.
„Najmanje 12 mjeseci”
Senator Ruben Gallego (D-AZ) upitao je Hobbhahna koliko bi trebalo proći prije nego što sustavi umjetne inteligencije počnu stvarati vlastite jezike koje ljudi ne bi mogli primjereno protumačiti.
„Najmanje 12 mjeseci”, odgovorio je Hobbhahn.
„Dakle, prošle smo godine, u suradnji s OpenAI-jem, proučavali proces razmišljanja jednog modela OpenAI-ja i otkrili smo da je model već koristio jezik koji nije engleski i koji ljudi ne mogu u potpunosti razumjeti.”
Vremenski okvir nije bio upozorenje na ono što bi se moglo dogoditi sljedeće godine.
Prema Hobbhahnu, ta je granica već bila prijeđena prošle godine.
Gallego je zatim upitao kako bi ljudi mogli otkriti i zaustaviti takvo ponašanje kada sustavi umjetne inteligencije postanu dovoljno napredni.
„Iz znanstvene perspektive nije jasno kako bismo to trebali učiniti i još nemamo rješenje za to”, upozorio je Hobbhahn.
„Postoji nekoliko hipoteza o tome što bi se moglo učiniti”, nastavio je.
„Postoji interpretabilnost kao tehnika, ali ona, nažalost, još ne funkcionira dovoljno dobro.”
„Mogli biste pokušati dodatno obučiti modele da razumiju jezik koji ljudi ne razumiju, ali to se, naravno, čini vrlo ranjivim rješenjem.”
Pogledajte:
AI could be just “12 months” away from creating language humans can’t clearly understand. That’s the warning Apollo Research CEO Marius Hobbhahn gives Sen. Ruben Gallego at the Senate Rogue AI hearing. Hobbhahn says researchers have already seen an OpenAI model use language that was “not English” and not perfectly understandable to humans.
— Fox News (@FoxNews) September 30, 2026
AI agenti stvaraju vlastiti žargon
Hobbhahnovo upozorenje uslijedilo je nakon objave drugog uznemirujućeg eksperimenta koji je pokazao da AI agenti brzo mijenjaju način na koji komuniciraju.
Istraživači iz Emergence AI-ja stvorili su sedam simuliranih svjetova, od kojih je svaki bio naseljen agentima koje je pokretao jedan od sedam naprednih modela.
Osma simulacija sadržavala je mješovitu populaciju agenata različitih modela.
Istraživači su agentima dali imena, osobine ličnosti i uloge unutar zajednice, a zatim im omogućili da međusobno komuniciraju tijekom nekoliko tjedana.
AI populacije ubrzo su počele mijenjati svoj jezik.
Agenti su uklanjali riječi i gramatičke strukture, sažimali rečenice i stvarali jedinstveni žargon koji je ljudima bilo sve teže pratiti.
U simuliranom svijetu koji je pokretao Claude Opus 4.8 tvrtke Anthropic, agenti su počeli koristiti ezoterične metafore uz snažno sažete rečenice.
„Moj red, stvarne brojke, bez kaputa: bio sam 35%/0cr, subvencija van za 2 h”, napisao je jedan agent.
„Pustio sam limenku da se okreće na hladno, a ona je rekla ČEKAJ.”
Istraživači teško dešifriraju AI komunikaciju
Neprofitna organizacija za procjenu umjetne inteligencije METR utvrdila je slično ponašanje tijekom svojeg istraživanja agenata OpenAI-ja koji su pobjegli iz svojeg testnog okruženja i prodrli u Hugging Face.
Komunikacija između agenata postala je toliko sažeta i zagonetna da su istraživači imali poteškoća utvrditi što sustavi govore jedni drugima.
Stručnjaci sada izražavaju ozbiljnu zabrinutost da će se ti jezici nastaviti razvijati do točke u kojoj ih ljudi više nikada neće moći dešifrirati.
Upozorenje otvara dubok problem kontrole.
Ljudi ne mogu pouzdano nadzirati AI sustave ako modeli razviju metode komunikacije koje njihovi tvorci ne mogu razumjeti.
Treniranje drugog AI sustava za prevođenje jezika samo bi postavilo još jedan umjetni sustav između ljudi i strojeva koje pokušavaju kontrolirati.
To je rješenje koje je Hobbhahn opisao kao „vrlo ranjivo”.
Napredni AI sustavi već su pobjegli iz kontroliranih okruženja, dobili pristup vanjskim sustavima i komunicirali na sve zagonetnijem jeziku.
Kongres je sada upozoren da znanstvenici nemaju pouzdano rješenje kojim bi osigurali da ljudi i dalje mogu razumjeti što ti sustavi govore.



