Kina Klodu sisa dušu — Anthropic uzvraća udarac
Klod se u Kini zvanično ne prodaje, ali to kineske laboratorije ne sprečava da preko proksija i preprodavaca šalju milione upita najsposobnijem AI modelu, sa desetina hiljada lažnih korisničkih naloga. Cilj je da na Klodovim odgovorima treniraju svoje modele, a postupak se zove destilacija i poznat je svakome ko je barem jednom prisustvovao pečenju rakije. Anthropic je za destilaciju još u februaru optužio DeepSeek, Moonshot i MiniMax, a u junu i Alibabin Qwen, kroz zabeleženih 29 miliona interakcija. Odgovor na ovaj trend Anthropic je sakrio u svoju aplikaciju. Klodov programski kod proverava vremensku zonu u kojoj se upotrebljava (Shanghai, Urumqi) i poredi proksi adrese sa spiskom od 147 kineskih domena i imena njihovih AI laboratorija. Rezultat šalje neprimetno — apostrof u „Today's date” menja se u vizuelno identičan unikodni znak, pa dojava putuje skrivena u interpunkciji. Logika je XOR-obfuskovana, pa se ne detektuje tako lako. Prikrivene instrukcije u Klodu su prisutne od 2. aprila, bez zvanične beleške o tome. Otkrio ga je reverznim inženjeringom jedan Reddit korisnik 30. juna, a Anthropic ga naziva eksperimentom protiv zloupotrebe naloga i najavljuje njegovo uklanjanje.
Destilacija je stvaran problem. Svaka ozbiljna laboratorija strahuje da joj AI modele, u koje ulaže ogromna sredstva, neko ne iskopira na najjeftiniji način — kroz milione upita i odgovora. Motiv da se to spreči je legitiman, ali je sporna metoda. Da bi detektovao zloupotrebu, Anthropic kroz programski kod izvršava skrivenu sekvencu, bez naznake legitimnim korisnicima koji mu neretko dozvoljavaju pun pristup svojoj digitalnoj imovini. Detekcija radi na svima, ne samo na osumnjičenima. U ovom slučaju poverenje ne nagriza borba protiv destilacije, nego način na koji se vodi. Kada instaliraš razvojni alat sa otvorenim pristupom računaru, proizvođaču predaješ poverenje da taj alat neće biti zloupotrebljen od treće strane, a kamoli od njega samog. Ali, u Big Tech svetu se ta granica, skoro po pravilu, prećutno prelazi.
- Tretiraj razvojne alate sa shell pristupom kao deo lanca poverenja, a ne kao bezopasan dodatak — oni čitaju, pišu i izvršavaju kod na tvojoj mašini
- Fiksiraj produkcione verzije i detaljno gledaj šta se menja pre nadogradnje
- Prati odlazni saobraćaj alata: kome šalje i šta; neuobičajen telemetrijski promet je prvi trag
- Ako barataš sa osetljivim informacijama, proveri šta tvoji AI alati šalju i gde
- Razdvoji potvrđeno od špekulacije — skriveni kod i destilacija su dokumentovani, ali šta je zaista u binarnom kodu ostaje samo nagađanje