DeepSeek on paljastanut DeepSeek-V4 Previewin, ja luvut ovat vaikeita ohittaa. Kiinalainen tekoälyyritys tarjoaa nyt kahta uutta mallia, V4 Prota ja V4 Flashia, molemmat rakennettu miljoonan tokenin konteksti-ikkunoille, mikä nostaa pitkien dokumenttien käsittelyn, koodianalyysin ja monimutkaisen päättelyn valokeilaan.
Mallit ovat jo saatavilla DeepSeekin verkkosivuilla Instant-tilassa ja Expert-tilassa, ja myös API on päivitetty ja toimii jo nyt. Markkinassa, jossa kontekstin pituudesta on tullut yksi tekoälyn kovimmista kilpailukentistä, DeepSeek tekee suoran liikkeen: tarjota merkittäviä kyvykkyyksiä ilman korkeaa hintaa.
Kaksi mallia, yksi suuri lupaus
Paperilla erot kahden variantin välillä ovat merkittäviä. DeepSeek-V4 Pro sisältää 1,6 biljoonaa kokonaisparametriä ja 49 miljardia aktiivista parametria, kun taas V4 Flash on kevyempi: 284 miljardia kokonaisparametriä ja 13 miljardia aktiivista parametria. Molemmat tukevat samaa massiivista 1M kontekstipituutta, mutta ne on selvästi suunnattu eri käyttäjille ja budjeteille.
DeepSeekin mukaan Pro-malli on perheen raskassarjalainen. Se on suunniteltu vahvemmilla agenttisilla kyvyillä, laajemmalla maailmantuntemuksella ja kehittyneellä päättelyllä, joiden DeepSeekin mukaan se päihittää nykyiset avoimet mallit matematiikassa, STEM-alueilla ja koodauksessa. DeepSeek lisää, että Pro kilpailee huippuluokan suljetun lähdekoodin järjestelmien kanssa, mutta varoittaa, että se jää joissain osa-alueissa jälkeen Gemini 3.1 Protusta.
Flash on puolestaan terävämpi arvolupaus. DeepSeek kuvailee sen tarjoavan päättelykykyä, joka lähestyy Prota, ja vastaavan Prota yksinkertaisemmissa agenttitehtävissä. Todellinen vetovoima on hinta. Flash on asemoitu edullisemmaksi vaihtoehdoksi kehittäjille, jotka haluavat pitkän kontekstin tekoälyä ilman että budjetti kuluu liikaa.
Hinnoittelu heijastaa tätä strategiaa. Flashin syötekustannukset alkavat $0.028:sta välimuistiosumalla ja $0.14:sta välimuistivirheellä, kun taas ulostulo maksaa $0.28. Pro on paljon kalliimpi: syötteen hinta on $0.145 tai $1.74 välimuistin tilasta riippuen, ja ulostulo maksaa $3.48.
Käyttäjille, jotka haluavat kokeilla malleja heti, DeepSeek on avannut pääsyn DeepSeekin chat-palveluun. Yritys kertoo myös, että avoimet painot ovat saatavilla sekä tekninen raportti kaikille, jotka haluavat perehtyä arkkitehtuuriin, benchmarkkeihin ja koulutuksen yksityiskohtiin.
Kyseessä on rohkea julkistus, joka vie pitkän kontekstin keskustelua jälleen eteenpäin. DeepSeek ei tyydy vain metsästämään otsikkolukuja. Yritys pyrkii osoittamaan, että massiiviset tekoälymallit voivat silti olla käytännöllisiä, saavutettavia ja edullisia.




Keskustelu
Jätä kommentti
Kommentit
Ei vielä kommentteja. Ole ensimmäinen.