Iedomājieties triljonu parametru mākslīgo intelektu, kas darbojas nevis uz Rietumu GPU, bet uz aparatūras, kas ražota Ķīnā. Tas skan kā tehnoloģiju pārrakstīšana, un tieši to DeepSeek cenšas īstenot ar savu nākamās paaudzes modeli.
Ziņojumi liecina, ka DeepSeek V4 darbosies ekskluzīvi uz Huawei jaunākajām Ascend mikroshēmām. Tas nav neliels pagrieziens. Tas atspoguļo plašāku centienu sasaistīt modernus modeļus ar vietējo silikonu, jo eksporta ierobežojumi apgrūtina piekļuvi Nvidia H sērijas čipiem Ķīnas izstrādātājiem.
Kāpēc šāda maiņa? Daļēji tāpēc, ka mērogs tagad prasa ciešu koordināciju starp modeļa arhitektūru un čipu, kas to palaidīs. DeepSeek plāno izvietot aptuveni triljonu parametrus, un uzņēmums, kā ziņots, grasās izmantot simtiem tūkstošu Ascend 950PR procesoru, lai sasniegtu mērķa inferencēšanas ātrumus un kapacitāti. Mērķis: aptuveni 1.8 reizes ātrāka inferencēšana, konteksta logs, kas tuvojas miljonam tokenu, un efektivitātes pieaugums, ko nodrošina Engram stila optimizācijas.

Šī detaļa ir svarīga. Engram tehnikas pārstrādā to, kā modeļi glabā un atgādina informāciju, samazinot atmiņas noslodzi, vienlaikus saglabājot secināšanas dziļumu. V4 līmeņa modelim šādi triki ir atšķirība starp iespējamu un fantastisku risinājumu. Kā ziņots, DeepSeek mēnešiem ilgi pārstrādājis kodu un testējis to kopā ar Huawei un Cambricon inženieriem, lai izspiestu maksimālu veiktspēju no jaunās tehnoloģiskās kaudzes.
Citi Ķīnas tehnoloģiju giganti liek līdzīgas likmes. Alibaba, ByteDance un Tencent ir veikuši lielas Ascend 950PR mikroshēmu pasūtījumu sērijas, kas signalizē, ka vietējās čipu ekosistēmas strauji kļūst par noklusējuma platformu lieliem AI projektiem Ķīnā. Šajā nozīmē DeepSeek pāreja ir gan stratēģiska, gan praktiska.
Ir arī laika aspekts. Nvidia H20 čipiem pēdējā laikā ir bijusi stingrāka eksporta uzraudzība, mudinot jaunuzņēmumus un mākoņpakalpojumu sniedzējus paātrināt pāreju uz vietējiem paātrinātājiem. DeepSeek jau bija izmantojis Ascend variācijas agrākos modeļos, tāpēc pilnīga migrācija uz Huawei centrētu infrastruktūru ir esošo darbu paplašinājums, nevis strauja lēkme.
Funkcionāli V4 tiek uzsvērts kā uzlabots kodēšanas palīgs ar spēcīgāku daudzsolu spriešanu. Vienkāršiem vārdiem: tas ir labāks sarežģītu programmu rakstīšanā, spēj noturēt garākas sarunas un salikt loģiku pāri milzīgiem teksta apjomiem. Kā ziņots, tiek izstrādātas arī divas papildu V4 variācijas, pielāgotas citiem Ķīnā ražotiem čipiem, un tās var parādīties vēl šogad.
Ir plašāka mācība. AI sacensība fragmentējas aparatūras ekosistēmās, katra pielāgota savai kompilatoru, izpildlaiku un optimizācijas paņēmienu kaudzei. Jaunuzņēmumiem, piemēram, DeepSeek, ceļš uz augstākās veiktspējas sasniegšanu var tagad iet tikpat caur vietējo silikonu kā caur algoritmu inovācijām.
Vai šī pieeja atmaksāsies, būs atkarīgs no tā, cik labi programmatūras komandas spēs pārvērst neapstrādātas mikroshēmas lietojamos, uzticamos pakalpojumos, un cik ātri globālā AI aparatūras ainava turpinās mainīties.



.webp)
Diskusija
Atstāt komentāru
Komentāri
Vēl nav komentāru. Esiet pirmais.