Drugi problem Silicijumske doline sa Kinom: Pomaže joj da trenira vještačku inteligenciju

TEHNOLOGIJA Forbes 10. avg 2026. 07:00
featured image

10. avg 2026. 07:00

Kada su američki prodajni timovi velikih startapa iz Silicijumske doline koji se bave označavanjem podataka ove godine stigli na Međunarodnu konferenciju o mašinskom učenju u Seulu, bili su spremni da privuku najveće potrošače u industriji.

Kompanije za podatke, zajedno vrijedne desetine milijardi dolara i sa milijardama dolara godišnjih prihoda od isporuke podataka za treniranje klijentima poput OpenAI-ja i Anthropica, navikle su da se bore za AI laboratorije poznate po tome što su izuzetno zahtjevne, nepredvidive i teško ih je zadovoljiti.

Tamo ih je čekao još jedan veoma zainteresovan kupac: kineska industrija vještačke inteligencije.

Neke kineske kompanije imaju detaljne spiskove za kupovinu. Tencent, koji je američka vlada ranije označila kao kompaniju povezanu sa kineskom vojskom, što ta kompanija osporava, potencijalnim dobavljačima dostavio je detaljan zahtjev za podatke za treniranje iz oblasti finansija, sajber bezbjednosti i jednog od najvažnijih ciljeva istraživanja vještačke inteligencije: sistema sposobnih da sami sebe unapređuju.

Iako SAD već dugo zabranjuju Kini kupovinu čipova koji pokreću najnaprednije američke AI modele, nijesu preduzele iste mjere kada je riječ o podacima potrebnim za njihovo treniranje.

To upakovano ljudsko znanje, koje stvaraju mreže stručnjaka i oblikuju dizajn zadataka, kriterijumi ocjenjivanja i sistemi kontrole kvaliteta, dio je skupe infrastrukture podataka koja modele uči da rješavaju zahtjevne profesionalne zadatke poput finansijskog modeliranja i programiranja.

Taj biznis vrijedi stotine miliona dolara godišnje i pomaže kineskim AI modelima da smanjuju zaostatak za američkim konkurentima.

„Poslije računarske snage potrebne za treniranje modela, kvalitetni podaci su najvažnija stvar“, rekao je za Forbes Nejtan Lambert (Nathan Lambert), bivši istraživač Instituta Alen za vještačku inteligenciju (Allen Institute for AI).

„Kako pokušavamo da modele uvedemo u nove i zahtjevnije oblasti, kvalitetni podaci predstavljaju element sa najvećim učinkom koji može da učini model zaista upotrebljivim.“

Dokumentacija i komunikacija kineskih AI laboratorija koje kupuju podatke, kao i zaposlenih na vodećim platformama iz Silicijumske doline poput Surge AI-ja i Mercora, u koje je Forbes imao uvid, otkrivaju gotovo neprimjetnu trgovinu podacima za treniranje vrijednu stotine miliona dolara.

Isti američki startapi koji snabdijevaju OpenAI, Antropik (Anthropic), a u nekim slučajevima i američke savezne institucije, istovremeno prodaju podatke i vodećim laboratorijama u Pekingu.

Silicijumska dolina, sve više, trenira obje strane AI trke u naoružanju.

Za kineske AI laboratorije koje pokušavaju da dostignu performanse američkih sistema postoje tri brza načina.

Prvi je privlačenje istraživača iz konkurentskih kompanija.

Drugi je destilacija, odnosno prikupljanje izlaznih rezultata iz ČetGPT-ja (ChatGPT) ili Kloda (Claude) i njihovo korišćenje za treniranje kineskih modela. Iako to nije nezakonito, praksa izričito krši uslove korišćenja OpenAI-ja i Antropika, a nedavno ju je kritikovao i savjetnik Trampove administracije za nauku i tehnologiju Majkl Kracios (Michael Kratsios).

Treći način je jednostavniji i ne nosi potencijalne regulatorne probleme: kupiti iste podatke za treniranje koje kupuju američke AI laboratorije, od istih dobavljača.

Naučiti AI model da obavlja složeno računovodstvo ili laboratorijske protokole za internet nije samo pitanje prikupljanja sirovog rezultata rada.

Foto: Shutterstock

Prava vrijednost je u specifikacijama

Prava vrijednost nalazi se u specifikacijama podataka: u tome na koju vrstu podataka treba usmjeriti pažnju, kao i u detaljnim kriterijumima koje sastavljaju stručnjaci i koji podstiču model da nauči kako da obavlja složene kancelarijske i profesionalne poslove.

Kupovinom tih skupova podataka kineske laboratorije zapravo efikasno kupuju teško stečeno, vlasničko stručno znanje koje pokreće najbolje modele Silicijumske doline.

Konsultant za AI podatke Šon Kaj (Sean Cai), koji objavljuje blog o podacima i učenju uz potkrepljenje, kaže to vrlo direktno:

„Ako zaista proučite strukturu industrije podataka u Kini, a zatim i čitav lanac snabdijevanja podacima, shvatićete da se veliki dio istih američkih podataka koji omogućavaju napredak američkih modela prodaje i kineskim laboratorijama.“

Tajni lanac snabdijevanja podacima u Kini vrijedan 500 miliona dolara

Lanac vodi direktno od američkih kompanija za označavanje podataka do najvećih kineskih tehnoloških giganata, uključujući Tencent, kompaniju koju je Pentagon označio kao povezanu sa kineskom vojskom.

U jednoj poruci u koju je Forbes imao uvid, izvršni direktor Tencenta zadužen za nabavku podataka naveo je da se kompanija oslanja na Surge AI za snabdijevanje podacima.

Među klijentima Surge AI-ja ranije su bili američka vojska, američko ratno vazduhoplovstvo i Antropik.

Mercor, koji je krajem prošlog mjeseca zaposlenima saopštio da je dobio ugovor sa američkom saveznom vladom, takođe sarađuje sa Tencentom.

Druga komunikacija koju je pregledao Forbes pokazuje slična preklapanja.

U razmjeni poruka, jedan izvršni direktor Ant Groupa, kineske tehnološke i finansijske kompanije koja stoji iza Alipaya, potvrdio je blisku saradnju sa američkom kompanijom za AI podatke AfterQuery.

Transkripti audio-razgovora sa zaposlenim kineskog giganta za e-trgovinu Alibaba ukazuju na ugovore o kupovini sa AfterQueryjem i Mercorom.

Interna projektna dokumentacija sugeriše da je američki startap za označavanje podataka Turing sarađivao sa Bajtdensom (ByteDance), kineskom matičnom kompanijom TikToka.

Bajtdens, Alibaba, Moonshot, Tencent i Ant Group nijesu odgovorili na zahtjeve za komentar, dok je Mercor odbio da komentariše.

AfterQuery i Surge saopštili su da ne objavljuju podatke o klijentima.

Turing je u saopštenju naveo:

„Pokrećemo sam vrh razvoja vještačke inteligencije, što uključuje i vlasničke i open-source modele. Vjerujemo da će oba segmenta nastaviti da rastu, a neki od najjačih open-source modela danas dolaze iz laboratorija van SAD.“

Ukupno, šest najvećih kineskih AI laboratorija godišnje troši oko 500 miliona dolara kod američkih kompanija za označavanje podataka, prema riječima dvojice preduzetnika iz te industrije koji su procjene veličine tržišta dobili od rukovodilaca Tencenta i Bajtdensa.

Prema jednoj osobi koja je sarađivala sa više kineskih laboratorija, one sebe ne vide kao direktne konkurente u nabavci. Umjesto toga, posmatraju se kao zajednička grupa kupaca koja traži najkvalitetnije zapadne skupove podataka.

Američke kompanije rado im ih prodaju.

Prema izvoru upoznatom sa situacijom, prihod Mercora od kineskih AI laboratorija u drugom kvartalu činio je dva odsto ukupnih prihoda. Godišnji prihod Mercora premašio je dvije milijarde dolara u junu, a kompanija je zaposlila posebnog menadžera za saradnju sa Kinom.

Veći dio poslovanja AfterQueryja, najmanje 50 miliona dolara ponavljajućih prihoda, dolazi od kineskih AI laboratorija, rekli su izvori Forbesu.

Surge AI, jedan od prvih igrača na tom tržištu, aktivno je pokušavao da privuče kineske kupce, a izvršni direktor Edvin Čen (Edwin Chen) putovao je u Kinu kako bi se direktno sastao sa rukovodiocima laboratorija.

Kompanije za označavanje podataka kineskim AI laboratorijama prodaju prilagođene jednokratne projekte, ali i takozvane „off-the-shelf“ (OTS) skupove podataka – standardizovane, unaprijed pripremljene pakete za treniranje koji se mogu preprodavati većem broju laboratorija.

To može djelovati bezazleno, ali takvi skupovi podataka nijesu nimalo beznačajni.

Oni se proizvode koristeći iste „lance znanja“ razvijene tokom prilagođenih projekata za OpenAI ili Antropik.

To znači da kineske kompanije koje ih kupuju imaju koristi od istih mreža stručnjaka sa doktoratima, algoritama za kontrolu kvaliteta i kriterijuma za dodatno treniranje koji se koriste u vodećim američkim AI laboratorijama.

To im donosi ogromnu prednost.

U mnogim slučajevima kineske laboratorije mogu da preskoče mjesece pokušaja i grešaka kupovinom OTS podataka koji već sadrže provjerene strukture rezonovanja.

„Morate razumjeti da oblik ovih podataka ponekad dolazi od istih kompanija koje su prvobitno prilagođavale pravce skaliranja za Anthropic“, objasnio je Kaj.

„Dobavljaču podataka koji je radio za Antropik izuzetno je lako da koristi isti sistem kako bi proizveo podatke za kinesku laboratoriju.“

Zbog toga su gotovi skupovi podataka veoma privlačan izvor profita za dobavljače.

Pošto se mogu preprodavati većem broju AI laboratorija, imaju najveće profitne marže.

Kineske AI laboratorije američkim kompanijama za označavanje podataka otvoreno govore da žele da kupe sve podatke koje su američke laboratorije već kupile, rekao je jedan izvršni direktor koji je razgovarao sa kineskim laboratorijama.

Maks Gazor (Max Gazor), osnivač kompanije Striker Venture Partners, koja je investirala u brojne američke kompanije za razvoj AI modela, priznaje da ta tržišna realnost nosi određene komplikacije.

„To bih prije svega opisao kao etičku odluku o tome da li kompanija želi da prodaje podatke kineskim AI kompanijama“, rekao je.

Regulatorni Divlji zapad

Foto: Shutterstock

Vašington je godinama gradio svojevrsnu geopolitičku tvrđavu oko naprednih čipova.

Ali ljudsko znanje koje se koristi za treniranje vještačke inteligencije prelazi granice gotovo bez ikakvog nadzora.

To je pomoglo vodećim platformama za podatke iz Silicijumske doline da postanu kompanije vrijedne više milijardi dolara.

Mercor, osnovan 2023. godine, trenutno cilja procjenu vrijednosti od 20 milijardi dolara, dok Surge AI navodno vrijedi najmanje 25 milijardi dolara.

Relativno novi AfterQuery je za samo tri mjeseca povećao godišnje ponavljajuće prihode sa 100 miliona dolara na nekoliko stotina miliona.

Iako velika većina prihoda i dalje dolazi od etabliranih američkih giganata, prodaja stranim klijentima vjerovatno predstavlja izuzetno privlačan dodatni izvor prihoda.

Neki smatraju da je prodaja ovakvih podataka Kini pitanje nacionalne bezbjednosti.

„Neke kompanije koje rade sa ljudskim podacima sarađuju sa stranim protivnicima. Rezultati toga danas se vide u Kimi K3“, objavio je nedavno na mreži X Ali Ansari, 25-godišnji izvršni direktor kompanije Micro1.

„Smatramo sramotnim tvrditi da želite američku dominaciju u vještačkoj inteligenciji, a istovremeno prodavati podatke vrijedne milione dolara državama sa kojima smo u strateškom rivalstvu.“

Micro1 navodi da ne prodaje podatke van SAD.

Scale AI je takođe razmatrao ugovor sa Bajtdensom, ali je 2024. odustao od njega zbog zabrinutosti za nacionalnu bezbjednost.

Zagovornici ovakve trgovine, međutim, tvrde da bi ograničavanje prodaje podataka Kini moglo ugušiti globalne inovacije u open-source vještačkoj inteligenciji.

„Nije moguće lako ograničiti izvoz podataka ili vještačke inteligencije, a da se pritom ozbiljno ne naškodi američkom open-source sektoru“, rekao je Kaj, naglašavajući da nema stav o tome kako bi ovo pitanje trebalo regulisati.

„Time bi OpenAI i Antropik dobili nepravedan duopol, a to sa sobom nosi sopstvene probleme.“

Anna Tong, Forbes

Silicon Valley’s Other China Problem: It’s Training Their AI