Kuvittele biljoonan parametrin tekoäly, joka ei toimi länsimaisten GPU:iden vaan Kiinassa valmistetun laitteiston päällä. Se kuulostaa tekniseltä uudelleenkirjoitukselta, ja juuri sitä DeepSeek yrittää seuraavan sukupolven mallillaan.
Raporttien mukaan DeepSeek V4 toimii yksinomaan Huawein uusimmilla Ascend-piireillä. Tämä ei ole vähäinen käännös. Se heijastaa laajempaa pyrkimystä sitoa edistyneet mallit kotimaiseen piiriin, kun vientirajoitukset vaikeuttavat kiinalaiskehittäjien pääsyä Nvidian H-sarjan piireihin.
Miksi muutos? Osittain siksi, että laajuus edellyttää nyt tiivistä yhteensovittamista mallin arkkitehtuurin ja sen isännöivän piirin välillä. DeepSeek pyrkii käyttöönottoon noin biljoonalla parametrilla, ja startupin odotetaan hyödyntävän satoja tuhansia Ascend 950PR -prosessoreita saavuttaakseen tavoitellut päättelynopeudet ja kapasiteetin. Tavoitteena on noin 1,8-kertaisesti nopeampi inferenssi, kontekstiväli joka lähestyy miljoonaa tokenia, sekä tehokkuushyödyt Engram-tyyppisten optimointien ansiosta.

Viimeisellä yksityiskohdalla on merkitystä. Engram-tekniikat uudistavat tapaa, jolla mallit tallentavat ja hakevat tietoa, vähentäen muistikuormaa samalla kun päättelysyvyys säilyy. V4:n kokoiselle mallille tällaiset kikat voivat ratkaista, onko toteutus realistinen vai pelkkää haavetta. Raporttien mukaan DeepSeek on käyttänyt kuukausia ydinkoodin uudelleenkirjoittamiseen ja penkki testaukseen yhdessä Huawein ja Cambriconin insinöörien kanssa saadakseen suorituskyvyn irti uudesta pinosta.
Muut kiinalaiset teknologiajätit lyövät vetoa samankaltaisesti. Alibaba, ByteDance ja Tencent ovat tehneet suuria tilauksia Ascend 950PR -piireistä, mikä viestii, että kotimaiset piiriekosysteemit ovat nopeasti muodostumassa oletusalustaksi suurten tekoälyprojektien toteutuksissa Kiinassa. Tässä mielessä DeepSeekin siirto on sekä strateginen että käytännöllinen.
Aikataulullakin on merkitystä. Nvidian H20-piirejä on kohdannut tiukempi vientivalvonta, mikä on kannustanut startuppeja ja pilvipalveluntarjoajia nopeuttamaan siirtymistä paikallisesti tuotettuihin kiihdyttimiin. DeepSeek oli jo käyttänyt Ascend-versioita aiemmissa malleissa, joten täydellinen siirtymä Huawein keskittämään infrastruktuuriin on ennemminkin olemassa olevan työn jatke kuin äkillinen loikka.
Toiminnallisesti V4:n kerrotaan korostavan kehittyneitä koodausominaisuuksia ja parannettua monivaiheista päättelyä. Yksinkertaisesti sanottuna: parempi monimutkaisten ohjelmien kirjoittamisessa, parempi pitämään pitkiä keskusteluja ja parempi loogisten yhteyksien muodostamisessa laajojen tekstikokonaisuuksien yli. Kaksi lisävarianttia V4:stä, jotka on räätälöity muille kiinalaisille piireille, ovat raporttien mukaan kehitteillä ja saattavat ilmestyä ennen vuoden loppua.
Tältä on suurempi opetus. Tekoälykisa pirstaloituu laitteistoekosysteemeiksi, joista kukin on hienosäädetty omalle kääntäjä-, ajonaikais- ja optimointipinolleen. Startupeille kuten DeepSeek tie huipputason suorituskykyyn voi nyt kulkea kotimaisen piirin kautta yhtä lailla kuin algoritmisen innovaation kautta.
Onnistuminen riippuu siitä, kuinka hyvin ohjelmistotiimit osaavat puristaa raaka piiri käyttökelpoisiksi ja luotettaviksi palveluiksi, sekä siitä, kuinka nopeasti globaali tekoälylaitteistomaisema muuttuu.




Keskustelu
Jätä kommentti
Kommentit
Ei vielä kommentteja. Ole ensimmäinen.