Artikkeli

DeepSeek julkaisee V4 Pro ja V4 Flash: 1M konteksti

DeepSeek esitteli DeepSeek-V4 Previewin: V4 Pro ja V4 Flash tukevat miljoonan tokenin konteksteja. Julkaisu keskittyy pitkien dokumenttien käsittelyyn, koodianalyysiin ja edulliseen pitkän kontekstin tekoälyyn.

DeepSeek julkaisee V4 Pro ja V4 Flash: 1M konteksti
Lukuaika: 2 Minuuttia
Seuraa Googlessa

DeepSeek on paljastanut DeepSeek-V4 Previewin, ja luvut ovat vaikeita ohittaa. Kiinalainen tekoälyyritys tarjoaa nyt kahta uutta mallia, V4 Prota ja V4 Flashia, molemmat rakennettu miljoonan tokenin konteksti-ikkunoille, mikä nostaa pitkien dokumenttien käsittelyn, koodianalyysin ja monimutkaisen päättelyn valokeilaan.

Mallit ovat jo saatavilla DeepSeekin verkkosivuilla Instant-tilassa ja Expert-tilassa, ja myös API on päivitetty ja toimii jo nyt. Markkinassa, jossa kontekstin pituudesta on tullut yksi tekoälyn kovimmista kilpailukentistä, DeepSeek tekee suoran liikkeen: tarjota merkittäviä kyvykkyyksiä ilman korkeaa hintaa.

Kaksi mallia, yksi suuri lupaus

Paperilla erot kahden variantin välillä ovat merkittäviä. DeepSeek-V4 Pro sisältää 1,6 biljoonaa kokonaisparametriä ja 49 miljardia aktiivista parametria, kun taas V4 Flash on kevyempi: 284 miljardia kokonaisparametriä ja 13 miljardia aktiivista parametria. Molemmat tukevat samaa massiivista 1M kontekstipituutta, mutta ne on selvästi suunnattu eri käyttäjille ja budjeteille.

DeepSeekin mukaan Pro-malli on perheen raskassarjalainen. Se on suunniteltu vahvemmilla agenttisilla kyvyillä, laajemmalla maailmantuntemuksella ja kehittyneellä päättelyllä, joiden DeepSeekin mukaan se päihittää nykyiset avoimet mallit matematiikassa, STEM-alueilla ja koodauksessa. DeepSeek lisää, että Pro kilpailee huippuluokan suljetun lähdekoodin järjestelmien kanssa, mutta varoittaa, että se jää joissain osa-alueissa jälkeen Gemini 3.1 Protusta.

Flash on puolestaan terävämpi arvolupaus. DeepSeek kuvailee sen tarjoavan päättelykykyä, joka lähestyy Prota, ja vastaavan Prota yksinkertaisemmissa agenttitehtävissä. Todellinen vetovoima on hinta. Flash on asemoitu edullisemmaksi vaihtoehdoksi kehittäjille, jotka haluavat pitkän kontekstin tekoälyä ilman että budjetti kuluu liikaa.

Hinnoittelu heijastaa tätä strategiaa. Flashin syötekustannukset alkavat $0.028:sta välimuistiosumalla ja $0.14:sta välimuistivirheellä, kun taas ulostulo maksaa $0.28. Pro on paljon kalliimpi: syötteen hinta on $0.145 tai $1.74 välimuistin tilasta riippuen, ja ulostulo maksaa $3.48.

Käyttäjille, jotka haluavat kokeilla malleja heti, DeepSeek on avannut pääsyn DeepSeekin chat-palveluun. Yritys kertoo myös, että avoimet painot ovat saatavilla sekä tekninen raportti kaikille, jotka haluavat perehtyä arkkitehtuuriin, benchmarkkeihin ja koulutuksen yksityiskohtiin.

Kyseessä on rohkea julkistus, joka vie pitkän kontekstin keskustelua jälleen eteenpäin. DeepSeek ei tyydy vain metsästämään otsikkolukuja. Yritys pyrkii osoittamaan, että massiiviset tekoälymallit voivat silti olla käytännöllisiä, saavutettavia ja edullisia.

Jari Lehtonen

"Minua kiehtoo mobiililaitteet ja älypuhelimien kehitys. Kirjoitan artikkeleita uusista laitteista, testeistä ja käyttäjäkokemuksista."

Jätä kommentti

Kommentit

Ei vielä kommentteja. Ole ensimmäinen.