Dodano v arhiv 1. oktobra 2026. Poročilo je datirano na dan dogodka.

Dolgo pričakovani DeepSeek V4 je 24. aprila 2026 izšel kot predogledna različica, z utežmi, ki si jih lahko prenese vsak, s programskim vmesnikom, ki je začel delovati isti dan, in z Huaweijevim sporočilom, da nove modele zdaj podpira celotna linija superozlišč Ascend.

Izšel je v dveh velikostih, V4-Pro in V4-Flash, oba pa lahko bereta milijon žetonov konteksta, kar je DeepSeek postavil za privzeto v vseh svojih storitvah. Podjetje iz Hangzhouja pravi, da je V4-Pro najmočnejši odprti model za agentno programiranje in da pri splošnem znanju zaostaja le za Googlovim Gemini 3.1 Pro. Druga velika novica je bila strojna oprema. Prejšnja DeepSeekova modela V3 in R1 sta bila naučena na Nvidiinih čipih, je opozoril Reuters, V4 pa je prilagojen za Huaweijeve procesorje Ascend, in to v času, ko ameriški izvozni nadzor Kitajski omejuje dostop do naprednih ameriških čipov.

  • Kaj: DeepSeek V4 Preview: V4-Pro (1,6 bilijona parametrov, 49 milijard dejavnih) in V4-Flash (284 milijard, 13 milijard dejavnih), odprte uteži pod licenco MIT.
  • Cena: cenik ob izidu 1,74 USD za milijon vhodnih in 3,48 USD za milijon izhodnih žetonov za Pro, 0,14 in 0,28 USD za Flash.
  • Zakaj je pomembno: odprt model vrhunskega razreda z milijonom žetonov konteksta kot standardom, prilagojen kitajskim čipom.

Dva modela, milijon žetonov

Oba modela uporabljata zasnovo mešanice strokovnjakov, pri kateri pri vsakem žetonu dela le del omrežja. Po opisu modela ima V4-Pro skupno 1,6 bilijona parametrov, od tega je pri vsakem žetonu dejavnih 49 milijard, V4-Flash pa 284 milijard s 13 milijardami dejavnih. DeepSeek je oba učil na več kot 32 bilijonih žetonov in uteži objavil na Hugging Face pod licenco MIT.

Glavna inženirska novost je v mehanizmu pozornosti, delu modela, ki odloča, kateri prejšnji žetoni so pomembni. DeepSeek je združil dve stisnjeni shemi pozornosti in pravi, da V4-Pro pri kontekstu milijon žetonov potrebuje le 27 odstotkov računskih operacij na ustvarjeni žeton in 10 odstotkov pomnilniškega predpomnilnika, ki ju je potreboval prejšnji model V3.2. Prav zato je lahko milijon žetonov privzeta nastavitev, ne pa doplačilo.

Programski vmesnik je začel delovati isti dan, sprejema zahteve v obliki OpenAI in Anthropic, DeepSeek pa pravi, da V4 deluje z agentnimi orodji, kot so Claude Code, OpenClaw in OpenCode. Stari imeni modelov deepseek-chat in deepseek-reasoner naj bi DeepSeek ukinil 24. julija.

Kje vodi po DeepSeekovih podatkih

DeepSeekova primerjava, pri kateri je V4-Pro nastavljen na najvišjo stopnjo sklepanja, temelji na podatkih proizvajalca in na tekmecih, ki so bili na voljo aprila. V4-Pro je na LiveCodeBench dosegel 93,5 točke in na Codeforces oceno 3.206, kar sta najboljša rezultata v tabeli, na SWE Verified pa 80,6 odstotka, enako kot Gemini 3.1 Pro in tik za Claude Opus 4.6 z 80,8 odstotka. Pri testih znanja je zaostanek jasen: 57,9 odstotka na SimpleQA Verified proti 75,6 odstotka za Gemini 3.1 Pro in 37,7 odstotka na testu Humanity's Last Exam proti 44,4 odstotka. Reuters je, sklicujoč se na DeepSeekov članek, povzel, da je pred vsemi drugimi odprtimi modeli, a na nekaterih področjih še za zaprtimi sistemi, kot sta Gemini 3.1 Pro in OpenAI-jev GPT-5.4.

Huawei in cena računske moči

Huawei je na omrežju Weibo zapisal, da je po tesnem sodelovanju obeh podjetij pri ključni tehnologiji modelov V4 podprt na celotni liniji superozlišč Ascend in da njegov Ascend 950 SuperPod doseže zakasnitev sklepanja 20 milisekund pri V4-Pro in 10 milisekund pri V4-Flash. DeepSeek je svoje cene povezal z računsko močjo. V4-Pro lahko stane do 12-krat toliko kot Flash zaradi »omejitev pri zmogljivosti vrhunske računske moči«, je po poročanju Reutersa navedel DeepSeek, ki pričakuje, da bo cena modela Pro občutno padla, ko bodo v drugi polovici leta Huaweijeva superozlišča Ascend 950 v množični proizvodnji in uporabi, je poročal Huawei Central. Ob izidu je DataCamp za V4-Pro navajal 1,74 USD za milijon vhodnih in 3,48 USD za milijon izhodnih žetonov, za V4-Flash pa 0,14 in 0,28 USD.

Bolj zadržan odziv

Izid ni ponovil šoka iz leta 2025, ko je odziv na V3 in R1 »sprožil svetovno razprodajo tehnoloških delnic«, kot je 27. aprila zapisal Reuters. Tokrat je bil odziv trgov »zadržan«. »Ta objava je sledila precej predvidljivi poti,« je dejal Lian Jye Su, glavni analitik pri Omdii. Reuters se je skliceval na podatke Artificial Analysis, po katerih je V4-Pro med vodilnimi modeli z odprtimi utežmi, ne pa jasno pred njimi, saj kitajska tekmeca, kot sta Kimi in Qwen, zmanjšujeta razliko.

Zdaj je pomembno, ali lahko Kitajska še naprej napreduje pri razvoju umetne inteligence in to morda počne z lastnimi čipi.
Alfredo Montufar-Helu, direktor pri Ankura China Advisors, za Reuters, 27. aprila 2026

Kaj se je zgodilo pozneje

DeepSeek je V4-Pro iz predogleda prestavil v splošno dostopnost 13. avgusta in napovedal, da bodo od 16. avgusta za API veljale ločene cene v konici in zunaj nje, pri čemer so cene zunaj konice pol nižje. Dne 10. septembra je izdal V4.1-Flash, model z 552 milijardami parametrov in novo zasnovo s kodirnikom in dekodirnikom, ki za vhod aktivira 8 milijard parametrov, za izhod pa 16 milijard, in ki izvorno razume slike. DeepSeek pravi, da so testi več strani V4.1-Flash postavili pred V4-Pro po zmogljivosti, ceni in hitrosti, in je najprej napovedal postopno ukinitev V4-Pro: od 14. septembra naj bi vse zahteve zanj obdeloval V4.1-Flash, dokler ne izide V4.1-Pro. Nato si je premislil. »Zaradi povpraševanja uporabnikov« V4-Pro ostaja na voljo tudi po 14. septembru, obračun pa se ne spreminja, zdaj piše v dnevniku sprememb API. Pet mesecev po predogledu DeepSeek sam pravi, da je model, ki je aprila polnil naslovnice, že prehitel manjši naslednik iz iste hiše.