Forrás: deepseek.com - Egy MoE modell 552 milliárd paraméterrel és natív látással.
- Csak 8 milliárd paraméter aktiválódik a bemeneten.
- A KV cache 890 bájtra esett tokenenként.
- Az API ára akár 60%-kal csökkent, a V4 Pro pedig 14. szeptemberén leáll.
A DeepSeek szeptember 10-én indította el a modellt V4.1 Flash és közben olyat csinált, amit a nagy nyelvi modellek világában ritkán látsz — az új család legkisebb tagja a tesztekben legyőzte a saját zászlóshajóját. A kínai cég ezért rögtön bejelentette, hogy A V4 Pro 14. szeptemberén leáll. A helyére a felhasználók egy olcsóbb és gyorsabb modellt kapnak, amely ráadásul első alkalommal natívan érti a képeket.
A család legkisebb modellje, amely kinőtte a zászlóshajót
A V4.1 Flash egy MoE modell 552 milliárd paraméterrel, teljesen új Causal-Encoder-Decoder struktúrára építve. Egyszerűbben: a modell egy húszrétegű kauzális enkódert használ, utána pedig egy húszrétegű dekódert, miközben a bemeneti és a kimeneti oldal nem szimmetrikus. A bemenet olvasásakor csak 8 milliárd paraméter aktiválódik, a válasz generálásakor pedig 16 milliárd — innen jön az az igazán alacsonyabb ár az összehasonlítható méretű modellekhez képest.
A második újdonság a natív multimodális látás. A modell magától dolgozza fel a képeket, segédfutószoftver nélkül, amit a DeepSeek eddig különálló kísérleti verzióként kínált. A kontextusablak mérete akár egymillió token, a vállalat pedig a súlyokat Hugging Face-en tette közzé MIT licenc alatt, így bárki letöltheti és elindíthatja, aki rendelkezik a megfelelő hardverrel.
Hol nyer a V4.1 Flash, és hol még lemaradásban van
A DeepSeek hivatalos eredményei szerint az új modell főleg ott múlja felül a V4 Pro-t, ahol a rendszernek magának kell cselekednie és kódot írnia. Codeforces-on 3471 pontot ért el a 3348-hoz képest, a DeepSWE v1.1 teszten 74,2 pontot szerzett 62,7 helyett, a Terminal-Bench 3.0 pedig 30,0-ra ugrott a korábbi 11,8-ról. Ugyanez a lemaradás látszik az Automation-Bench és a CyberGym tesztjeiben is, amelyek eszközhasználatot és biztonsági feladatokat mérnek.

Csakhogy ez nem teljes körű győzelem, és ezt érdemes egyenesen kimondani. A tudás-tesztben a GPQA Diamond-nál a V4.1 Flash minimálisan elmarad a régebbi V4 Pro-tól (90,9 vs. 92,4 pont), és a nehéz Humanity’s Last Exam feladatnál az eltérés még látványosabb, 36,8 vs. 42,7. A nyugati csúcsokkal szemben, vagyis a GPT 5.6-Sol és a Claude Opus 5 ellen csak a diszciplínák egy részében erősebb. Az új modell igazi ereje az ár-teljesítmény arány az ügynöki feladatoknál, nem a tudásbeli abszolút rekord.
A KV cache 890 bájtra csökkent tokenenként
A bejelentés technikailag legérdekesebb része a memória. A DeepSeek drasztikusan csökkentette a KV cache-t, vagyis azt a részt, ahol a modell az addigi beszélgetés kontextusát tárolja. Az előző generációhoz képest a gyors memóriaigény HBM a negyedére esett, a tároló SSD igénye pedig nyolcadára csökkent.

Abszolút számokban ez 890 bájt tokenként. Az első cégmodell ugyanarra a tokenre 389 120 bájtot kért, így alig három év alatt ez 437-szeresre csökkentette magát. Ez elsőre elvontnak hangzik, de az ügynöki feladatoknál a cache teszi ki a számla nagy részét — a modell benne tartja a teljes munkatörténetet, és minden egyes újraolvasásáért fizetni kell.
Lejjebb mennek az árak, főleg a cache-ből történő belépésnél
A hardveren elért spórolás egyenesen az árszabásban csapódott le. Az a bemenet, ami a cache-ben található, 60%-kal olcsóbb, a cache nélküli bemenet nagyjából harmadával, a kimenet pedig körülbelül 11%-kal. A csúcsidőn kívül így egymillió bemeneti token kb. 0,15 dollár, egymillió kimeneti token pedig kb. 0,60 dollár, vagyis átszámítva nagyjából 0,13 és 0,52 euró. Csúcsidőben a díjak pontosan duplák.

Elég kellemes hír számunkra. A DeepSeek csúcsteljesítménye a hétköznapokon 1:00 és 4:00, valamint 6:00 és 10:00 UTC között tart, ami nyári időszámításunk szerint 3:00 és 6:00, illetve 8:00 és 12:00. A délután vagy este a géphez ülő szlovák fejlesztő tehát automatikusan a fél árat fizeti — ugyanígy van ez a hétvégén és ünnepnapokon is. Az új árak 2024. szeptember 10-től érvényesek.
A V4 Pro 2024. szeptember 14-én kikapcsol
Az API felületen az új modell egyszerűen ezt a nevet kapta: deepseek-flash. A régebbi elnevezések, a deepseek-v4-flash és a deepseek-v4-flash-vision-exp a cégnél átmenetileg erre az új modellre lettek átirányítva, hogy a meglévő alkalmazásokban ne legyen gond. Elsőként a Tencent partnerei vették fel az újdonságot a WorkBuddy és CodeBuddy szolgáltatásokban, illetve az OpenCode fejlesztői eszköz is.
A fizetős V4 Pro verziót használók számára nagyobb változás vár. Szeptember 14. után az összes ehhez a modellhez intézett kérést a V4.1 Flash felé terelik, és a kedvezőbb árazása szerint fognak díjat számolni — egészen addig, amíg a cég be nem mutatja a V4.1 Pro-t. A kínai oldal, az IT Home ugyanakkor felhívta a figyelmet arra, hogy a lekapcsolás eredeti időpontja korábbi volt, és a DeepSeek az utolsó pillanatban eltolta — erről a felhasználóknak kiküldött e-mailben tájékoztatták azokat, akik az API felületet használják.
| - | DeepSeek V4.1 Flash |
|---|---|
| A modell típusa | MoE / natív multimodális |
| Paraméterek | 552 milliárd |
| Aktív paraméterek | 8 milliárd bemenetre / 16 milliárd kimenetre |
| Architektúra | Causal-Encoder-Decoder / 40 réteg |
| Kontekts | akár 1 millió token |
| KV cache | tokenenként 890 bájt |
| Név az API-ban | deepseek-flash |
| Licenc | MIT / súlyok a Hugging Face-en |
Kövesd a China Planet weboldalát, iratkozz fel havi hírlevelünkre, és mindenképp nézd meg a Facebook oldalunkat, a(z) China Planet csoportot, valamint a Telegram csatornánkat, ahol nap mint nap a legjobb kínai akciókat és kuponokat tesszük közzé.
Ne maradj le a legjobb kuponokról 📩
Iratkozz fel, és az új kuponokat e-mailben elküldjük, mielőtt lejárnak. Csak havonta egyszer küldjük — nincs spam.






Hozzászólások (0)