Claudeov misterij: kad ti sam model kaže da si ga sjebao
Tisuće developera, stotine postova na Redditu, mjeseci nagađanja, teorija zavjere i uvjeravanja da je sve u njihovoj glavi — dok kompanija napokon ne prizna: da, sjebali smo. Nije bilo zlonamjerno, naravno. Samo smo mijenjali "harnesses" i "operating instructions", što zvuči kao da su Claudeu stavljali nove pojaseve i pisali mu priručnik za sastavljanje Ikee. A ispalo je da su mu usput odsjekli pola mozga.
I eto ga: misterij stoljeća riješen. AI shrinkflacija je stvarna. Nije paranoja, nije placebo, nije da su korisnici ludi — nego je netko u Anthropicu, vjerojatno s najboljom namjerom i šalicom organskog čaja u ruci, povukao krivu polugu. I sad se Claude ponaša kao onaj kolega koji je bio briljantan dok nije dobio menadžersku poziciju i postao beskoristan.
To je najljepša stvar u cijeloj priči: nije trebalo mjesec dana da kompanija shvati. Trebalo je mjesec dana da prizna. Jer između "hej, nešto ne štima" i "da, u pravu ste, ispričavamo se" stoji cijeli korporativni aparat koji prvo mora provesti internu istragu, sastaviti izvješće, uskladiti PR odjel, smisliti narativ i tek onda — ako vjetar puše u dobrom smjeru — izaći pred korisnike s istinom. Koja je, naravno, došla u obliku blog posta napisanog jezikom koji bi i odvjetnik odobrio.
Ali budimo pošteni: moglo je biti gore. Mogli su reći da korisnici ne razumiju vlastite potrebe. Mogli su okriviti promjene u obrascima korištenja. Mogli su izvesti klasični "to je feature, ne bug" i prodavati degradaciju kao "optimizaciju za specifične use case-ove". Nisu. Priznali su. I to je, u svijetu gdje kompanije radije gase cijele proizvode nego priznaju grešku, gotovo osvježavajuće.
Ali ne dajmo se zavarati: ovo je simptom, ne izolirani incident. Cijela AI industrija gradi modele koji su toliko složeni da ih ni njihovi tvorci ne razumiju do kraja. Mijenjaš jedan parametar u "harnessu" — koji kurac je uopće harness u kontekstu neuronske mreže? — i odjednom model počinje halucinirati kao da je na tripu. Dodaš "operating instruction" i umjesto da Claude postane bolji, on postane gluplji. To nije softver. To je alkemija s modernim alatom.
A korisnici su, naravno, prvi osjetili. Developeri koji su se oslanjali na Claudea za kodiranje, analitičari koji su ga koristili za obradu podataka, pisci koji su ga koristili za generiranje teksta — svi su primijetili da nešto smrdi. I što su radili? Pisali su postove. Otvarali threadove. Dijelili screenshotove. I čekali. Jer u svijetu gdje ti je alat besplatan ili jeftin, nemaš pravo zahtijevati objašnjenje. Platiš, šutiš i nadaj se da će popraviti. A ako ne poprave? Pređi na drugi model. taj krug ispočetka.
Ono što je posebno ironično je da se ovo događa u trenutku kad svi pričaju o "AI maturaciji", "stabilizaciji modela" i "enterprise readinessu". Kompanije prodaju AI kao pouzdanog radnika koji nikad ne kasni, nikad ne griješi i nikad ne traži povišicu. A realnost je da taj radnik ponekad odluči da mu je dosta i počne proizvoditi besmislene odgovore, dok njegovi šefovi mjesec dana pokušavaju skužiti zašto.
Podsjeća me na davne dane Kvarner Neta, kad bi netko u firmi rekao "ajmo optimizirati routing table" i odjednom pola Rijeke ostane bez interneta. Razlika je što smo mi znali točno što smo promijenili i zašto. Ovi ljudi mijenjaju stvari koje ne razumiju u sistemu koji ne mogu objasniti. I onda se čude što korisnici bjesne.
Ali evo i dobre vijesti: priznali su. Popravili su. I sad je Claude opet onaj stari — bar tako tvrde. Pitanje je koliko će trebati dok netko opet ne povuče krivu polugu. Jer u svijetu gdje modeli rastu eksponencijalno, a razumijevanje linearno, ovo nije zadnji put da ćemo čuti "izvinite, promijenili smo nešto i sjebali".
Sljedeći put kad ti Claude ili bilo koji drugi model odgovori kao da je popio previše kave i zaboravio što je rekao prije pet sekundi — nemoj misliti da si lud. Samo si uhvatio trenutak kad netko u nekoj kompaniji, s najboljom namjerom, povlači polugu za koju ne zna što radi. I to je, na kraju krajeva, najljudskija stvar od svih.
Izvor: venturebeat.com
Zanima vas ovakva AI tehnologija?
RiNET gradi sovereign AI rjesenja za javni sektor i poduzeca - od civic intelligence do automatizacije nabave.
Kontaktirajte nas →
Komentari