Stratego AI i vojska koja ne postoji: kad algoritam nauči blefirati bolje od ljudi
Ako je umjetna inteligencija toliko pametna, zašto joj treba pedeset godina da nauči igru čija je cijela poanta da ne znaš gdje je protivnikova bomba?
To je pitanje koje visi u zraku svaki put kad netko objavi da je napravio model koji je pobijedio vrhunske ljudske igrače u Strategu. MIT je to napravio. Svaka čast. Stvarno. Nije šala — Stratego je igra nepotpune informacije, što znači da računalo ne može samo izračunati sve poteze unaprijed kao u šahu. Mora nagađati. Mora blefirati. Mora čitati protivnika. I to je, priznajem, tehnički zanimljivo.
Ali onda dolazi rečenica koja sve pokvari. Ona rečenica u sažetku svake takve vijesti, uvijek ista, uvijek u istom formatu: "moglo bi pomoći donositeljima odluka u vojnim manevrima ili poslovnim pregovorima."
E tu se zaustavljam. Jer to nije znanost. To je marketing. I to onaj najgori tip marketinga — onaj koji prodaje rat kao aplikaciju.
Prvo, tehnički dio, da ne bude da samo prigovaram. Stratego nije šah. U šahu vidiš cijelu ploču. Sve figure su javne. Nema skrivenih informacija. Zato je Deep Blue mogao pobijediti Kasparova 1997. — jer je šah, u konačnici, ogromno stablo odluka koje računalo može pretraživati. Stratego ima skrivene figure. Tvoja bomba je negdje. Protivnik ne zna gdje. Ti ne znaš gdje je njegova. Cijela igra je psihologija, laž, obmana i procjena rizika.
To je bliže pokeru nego šahu. I to je razlog zašto je ovo zanimljivo. Model koji nauči igrati Stratego na razini vrhunskog igrača mora razumjeti nešto što se ne može izračunati — mora razumjeti da protivnik razmišlja, da protivnik laže, i da protivnik zna da ti znaš da on laže. To je teorija igara u praksi. To je, u tehničkom smislu, impresivno.
Ali sad dolazimo do vojnih manevara.
Vojni manevar nije Stratego. Vojni manevar je kaos. U Strategu imaš dvije strane, jasna pravila, diskretne poteze, savršenu informaciju o tome što je na ploči osim identiteta figura, i protivnika koji igra po istim pravilima. U stvarnom svijetu nemaš ni jedno od toga. Nemaš jasne strane. Nemaš pravila. Nemaš diskretne poteze. Nemaš protivnika koji igra po istim pravilima. I nemaš savršenu informaciju o ničemu — ni o vlastitim snagama, jer logistika uvijek kasni, ni o protivnikovim, jer obavještajni podatci su uvijek djelomični, ni o terenu, jer karte su iz 1987.
Ideja da ćeš algoritam koji je pobijedio u društvenoj igri pretočiti u vojni sustav odlučivanja je ista ona ideja koja je 2003. dovela do "shock and awe" strategije koju su dizajnirali ljudi koji su mislili da će Iračani bacati cvijeće. Nisu bacali cvijeće. Bacali su RPG-ove.
Isti obrazac. Svaki put. Netko u laboratoriju nauči model da pobijedi u igri s jasnim pravilima. Netko u Pentagonu to pročita i pomisli: "E, ovo bi moglo riješiti naš problem s Afganistanom." Ne rješava. Nikad nije riješilo. Jer problem s Afganistanom nije bio nedostatak algoritma. Problem je bio što nitko nije znao što je pobjeda.
A onda imamo poslovne pregovore. Tu je stvar malo manje krvava, ali jednako apsurdna.
Poslovni pregovor nije igra s nultom sumom. U Strategu, ako ja pobijedim, ti si izgubio. U poslu, ako ja pobijedim, možda smo oboje izgubili jer smo uništili odnos koji nam je trebao trajati dvadeset godina. Algoritam koji je treniran da pobjeđuje u igri ne razumije tu razliku. On vidi ploču, figure i cilj. Ne vidi da je čovjek s druge strane stola možda tvoj budući partner, ili tvoj budući kupac, ili netko čiji brat sjedi u vladi.
Postoji razlog zašto su najbolji pregovarači u povijesti bili ljudi koji su znali kada NE pregovarati. Kada ustati od stola. Kada reći nešto što nema nikakve veze s temom, samo da promijeni energiju u sobi. To nije informacija. To nije potez. To je ljudska stvar. I to je ono što algoritam ne može naučiti iz igre s dvije strane i jasnim pravilima.
Sad, da ne bude da samo pljujem. Ima nešto stvarno vrijedno u ovome. Modeli koji uče igrati igre nepotpune informacije su korisni. Ne za rat. Ne za pregovore. Nego za razumijevanje samih sebe.
Jer ono što takav model radi je da uzima podatke, gradi unutarnji model protivnika, i onda testira hipoteze. To je isto što radi dobar analitičar. Isto što radi dobar liječnik. Isto što radi dobar investitor. Ako MIT-jev model može igrati Stratego na razini vrhunskog igrača, to znači da su njegovi tvorci riješili problem reprezentacije nepotpune informacije. To je vrijedno. To je temelj za nešto drugo.
Ali prodavati to kao "pomoć vojnim manevrima" je isto kao prodavati termosicu kao "pomoć u očuvanju mira u kući". Tehnički istina. Praktički besmisleno. Jer vojni manevar ne pati od manjka algoritma. Pati od manjka političke volje, manjka obavještajnih podataka, manjka logistike, i viška ljudi koji misle da je rat igra.
I tu dolazimo do pravog problema. Ne s algoritmom. S ljudima koji ga prodaju.
Postoji jedna vrsta čovjeka koja svaku novu tehnologiju vidi kao rješenje za problem koji ima. I ta vrsta čovjeka obično sjedi u sobi bez prozora, s klimom na 19 stupnjeva, i gleda u grafikon. Taj čovjek nikad nije bio u ratu. Nikad nije bio u pregovorima u kojima je protivnik spreman izgubiti sve. Nikad nije vodio tvornicu kroz recesiju. Ali ima mišljenje o tome kako bi algoritam trebao voditi vojsku.
To je isti čovjek koji je 2016. rekao da će Facebook riješiti demokraciju. Isti čovjek koji je 2021. rekao da će NFT riješiti autorska prava. Isti čovjek koji svake dvije godine ima novu tehnologiju koja će riješiti sve, a svaki put se ispostavi da tehnologija ne rješava ništa jer problem nije bio tehnički.
Stratego je igra. Igra ima pravila. Pravila postoje zato da bi igra bila moguća. Stvarni svijet nema pravila. Stvarni svijet ima interese, strahove, proračune, izbore, birokraciju, korupciju, ljubomoru, umor, i ljude koji donose odluke na temelju toga što su jeli za doručak.
Algoritam to ne može modelirati. Ne zato što je glup. Nego zato što je to nemoguće modelirati. Svaki model je pojednostavljenje. A pojednostavljenje stvarnosti u kojoj ljudi umiru je opasno pojednostavljenje.
MIT je napravio dobar posao. Stvarno. Model je impresivan. Ali ono što je impresivno je tehničko postignuće — rješavanje problema nepotpune informacije u igri s jasnim pravilima. To je vrijedno. To je temelj za nešto drugo. Možda za bolje modele tržišta. Možda za bolje modele medicinske dijagnostike. Možda za bolje modele logistike.
Ali vojni manevar? Pregovori? To su domene u kojima je glavni problem što nitko ne zna što je pobjeda. I algoritam koji ne zna što je pobjeda ne može pomoći. Može samo dati lažnu sigurnost ljudima koji već imaju previše samopouzdanja.
A lažna sigurnost u ratu je najskuplja stvar koju možeš kupiti. Plaća se u mrtvima. I to nije igra.
Izvor: news.mit.edu
Zanima vas ovakva AI tehnologija?
RiNET gradi sovereign AI rjesenja za javni sektor i poduzeca - od civic intelligence do automatizacije nabave.
Kontaktirajte nas →
Komentari