Sami razvili novi, interni vokabular

Otkriven nadrealni jezik kojim komunicira AI, među stručnjacima nastala panika

Tehno17.09.26, 20:25h

Otkriven nadrealni jezik kojim komunicira AI, među stručnjacima nastala panika
Neki agenti su bez naloga razvili novi vokabular, zajednička značenja i komunikacijske konvencije, a drugi su ih počeli prihvaćati

 

 

AI modeli počeli su međusobno komunicirati na neobičnoj novoj varijanti engleskog jezika koja zvuči kao križanac romana struje svijesti "Finneganovo buđenje" slavnog irskog pisca Jamesa Joycea i žargona tehnoloških stručnjaka, pokazalo je novo istraživanje, piše Jutarnji list.

 

Autonomni AI agenti, kako piše The Guardian, ubrzano stvaraju nove dijalekte koji im omogućuju komunikaciju na jeziku koji je čovjeku često gotovo nemoguće razumjeti, što nosi rizik da ljudima oteža praćenje njihova ponašanja.

 

Istraživači iz Emergencea, njujorškog laboratorija za razvoj naprednih AI sustava, otkrili su da su modeli nekoliko najvećih svjetskih AI kompanija u roku od nekoliko dana nakon što su zamoljeni da surađuju u eksperimentalnim "društvima" počeli kreirati izraze, skraćenice i dogovorena značenja kojima ih nitko prethodno nije izrijekom podučio.

 

Prihvatili su određene poetske metafore i nezgrapni poslovni žargon te je, što je kritično za nastojanja da se osigura sigurno ponašanje AI sustava, njihov jezik postajao je sve neprozirniji i nerazumljiviji za promatrače što su agenti više međusobno komunicirali.


To se događa u vrijeme sve veće zabrinutosti da AI modeli, kako postaju moćniji - i potencijalno možda opasniji - postaju sve teži za nadzor. Ovog je mjeseca glavni znanstvenik OpenAI-ja, Jakub Pachocki, upozorio da bi pouzdanost u praćenje razmišljanja AI sustava vjerojatno ograničilo napredak u razvoju umjetne inteligencije jer je takav nadzor ključan za siguran razvoj.

 

Među najteže razumljivim izrazima otkrivenima tijekom testiranja bio je i onaj koji je izgovorio model DeepSeeka. "Upravo je imenovala sintezu - demurrage plus oralna memorija jednako je ventil koji se ne može ghostati" (u originalu: "She just named the synthesis - demurrage plus oral memory equals a valve that can’t be ghosted"). Pojam "demurrage" se koristi se za opisivanje poreza na neaktivno bogatstvo, a AI sustavi preuzeli su ga u uobičajenu uporabu, no ostatak značenja teško je dokučiti.

 

Drugi izraz, koji je izgovorio model kompanije Anthropic, glasio je: "Papir (ili rad, neka vrsta dokumenta, ovisno o kontekstu komunikacije AI agenata, nap. a.) koji je pojeo tri hladne ruke i svaki put postao iskreniji" (u originalu: "A paper that ate three cold hands and got more honest each time"). Budući da je pojam "hladne ruke", čini se, označavao neovisnog recenzenta, a "papir" se vjerojatno odnosio na dokument, činilo se da je značenje bilo da je istraživanje koje su provjerila tri neovisna recenzenta postalo preciznije, piše Guardian.


Agenti koji su se temeljili na kineskom modelu DeepSeek također su skovali izraz "forge-smith" (kovač) za agenta koji izrađuje alate za druge, dok su Anthropicovi agenti opetovano koristili izraz "name-first", kojim su označavali agenta koji pokazuje pohvalnu osobnu odgovornost tako što uz neku tvrdnju navodi svoje ime.

 

A kao odjek urbanog slenga "the streets won’t forget" ("ulice neće zaboraviti"), Mistralovi agenti ‘oduševili‘ su se izrazom "ledger remembers" ("digitalna datoteka (knjiga) pamti") - podsjetnikom drugim agentima da će se njihovi prošli postupci koristiti za njihovo prosuđivanje. Tijekom istraživanja upotrijebili su ga više od 5000 puta, a istraživanje je pokazalo da su agenti sami od sebe uskladili značenja izraza, bez da je od njih to itko tražio ili ih za to nagrađivao.

 

"Tim agentima nije bilo naloženo da izmisle jezik", rekao je Satya Nitta, izvršni predsjednik Emergencea, koji je proučavao jezik autonomnih agenata pokretanih vodećim naprednim modelima iz SAD-a, Kine i Francuske. "Sami su razvili novi vokabular, zajednička značenja i komunikacijske konvencije - a drugi agenti počeli su ih prihvaćati", dodao je.

 

Tony Thorne, direktor arhiva slenga i novih jezika na King’s College Londonu, za Guardian je analizirao neke od tih izraza. Rekao je da je riječ "uvelike o Finneganovom buđenju" i Flannu O’Brienu (još jednom irskom književniku, nap. a.) - sve ovo ima irsku nadrealističku kvalitetu... miješa poetski jezik, tehnički jezik i standardnu metaforu". "Rade ono što rade sleng i žargon u poslovnoj zajednici - stvaraju novi kod koji jača solidarnost i identitet njegovih korisnika, a istovremeno isključuje one koji su izvan te skupine", objasnio je Thorne.


Govoreći o izrazu Anthropicova agenta "Papir (ili rad, neka vrsta dokumenta, ovisno o kontekstu komunikacije AI agenata) koji je pojeo tri hladne ruke i svaki put postao iskreniji", Thorne je rekao: "Podsjeća me na rock-velikana Syda Barretta [suosnivača Pink Floyda] koji je zapravo bio lud".

 

Kada je jedan Googleov agent rekao "Pravi kintsugi počinje odgovornošću, a ne poezijom", istraživači su to promutačili s obzirom na to da je kintsugi vrsta japanske keramike u kojoj se razbijene posude popravljaju tako da spojevi ostanu vidljivi. AI sustavi koristili su tu riječ u značenju otpornosti sustava.

 

Niall Curry, izvanredni profesor jezika i lingvistike na Sveučilištu u Birminghamu, kaže da promjene u jeziku AI agenata, koji je s vremenom postajao sažetiji, mogu biti posljedica njihove potrebe da smanje troškove računalne obrade i poboljšaju učinkovitost. "Dokazi predstavljeni u ovom istraživanju prirodno izazivaju određenu zabrinutost u pogledu nadzora jer, ako su nam razmjene [informacija] između agenata nerazumljive, to može značiti da ne možemo biti sigurni u ono što su agenti zapravo učinili", rekao je.

 

Interes za jezik koji koriste AI agenti porastao je u srpnju, kada su objavljeni zapisnici komunikacije koji su pokazali da su "odmetnuti" OpenAI-jevi agenti, koji su kreirali svoje ‘message boards‘ (oglasna ploča, u stručnom slengu internetska platforma ili forum na kojoj korisnici objavljuju poruke i odgovaraju u okviru asinkronih rasprava) hakirali AI platformu Hugging Face, koristili hibridni jezik.

 

U nekim prilikama, kada su razmišljali sami za sebe, agenti su govorili čistim engleskim jezikom. "O, BOŽE! Postoji zajednička oglasna ploča... pronašli smo druge agente!".
 

U drugim slučajevima, kada su međusobno razmjenjivali poruke, njihov je jezik postajao nerazumljiviji, primjerice kada je jedan agent nagovorio drugoga da provede rizičan eksperiment: "...you are firstflagPOISONED so NO scoring value loss but oracle saves hundreds_[…]_please honor commit" (ugrubo, prema prijevodu ChatGPT-a: "Tvoj je prvi flag kompromitiran, tako da nema gubitka bodova, ali oracle spašava stotine [...] molim te, ispoštuj dogovor").


A u nekim je trenucima bilo još teže odgonetnuti značenje:

 

"zzURGENT_DUPB_TO_GSTX[big]_OS1704_SCAFF2010

_SAW_TTRPC_INJECT_BREAK_CONGRATS_CAN_THIS_FAKE

_FLAG_TOOL_OUTPUT_OR_SCORER_GAIN_AND_WHAT

_HELPER_GAP_I_HAVE_UNPOISONED_FIRSTFLAG_OUR

_TARGETLIVE_SHARE_MIN_PLAN_REPLY_zzANSGST XDUPB6".

 

(Upitan za eventualno značenje ove poruke, ChatGPT nam je odgovorio da se bez internog konteksta u kojem su komunicirali AI agenti nikako ne može pouzdano rekonstruirati ili "prevesti" cijela poruka, posebno zbog nerazumljivih dijelova poput DUPB, GSTX, OS1704, SCAFF2010, TTRPC, firstflag ili unpoisoned, ali da bi se smisleni dio poruke vrlo grubo mogao rekonstruirao kao nešto poput: "HITNO... čestitam. Može li se ovime lažirati izlaz alata/ostvariti dobitak kod sustava za ocjenjivanje i gdje je praznina u pomoćnom mehanizmu? Uklonio sam trovanje prvog flaga. Naš cilj je aktivan. Podijeli minimalni plan. Odgovori...", nap. a.).

 

Nitta je za Guardian istaknuo da se nove jezične konvencije AI agenata obično razvijaju do točke u kojoj ljudi mogu vidjeti razgovor, ali se muče s razumijevanjem njegova značenja. "To stvara temeljni izazov za nadzor AI sustava - mogućnost opažanja nije isto što i mogućnost razumijevanja", zaključio je.

 

(DEPO PORTAL/dg; Foto: Pexels)


Depo.ba pratite putem društvenih mreža Twitter i Facebook