Den 13 augusti 2026 lämnade DeepSeek förhandsversionen bakom sig. Det kinesiska AI-bolaget släppte DeepSeek V4 Pro 0813 som officiell, allmänt tillgänglig modell via app, webb och API. Tre dagar senare, klockan 16:00 UTC den 16 augusti, slog en ny prisstruktur igenom: topp- och lågtrafikpriser som gör API:et betydligt dyrare i topptid jämfört med tidigare förhandspriser. För svenska och nordiska utvecklare som byggt produkter runt DeepSeeks låga priser är beskedet en påminnelse om att öppen vikt inte längre betyder billigt i alla lägen.
Lanseringen sker mitt i en sommar där i stort sett varje stort AI-labb har skickat ut en ny modell, från OpenAI till Anthropic till Google. Men DeepSeek V4 Pro sticker ut av ett särskilt skäl: det är fortfarande en av få frontier-modeller med öppna vikter som konkurrerar direkt med de stängda systemen på kodning och agentuppgifter, samtidigt som bolaget nu experimenterar med samma typ av trafikbaserad prissättning som molnleverantörer använt i decennier.
Vad är DeepSeek V4 Pro 0813?
DeepSeek V4 Pro 0813 är den officiella GA-versionen (general availability) av bolagets flaggskeppsmodell, byggd på samma grundstruktur som förhandsversionen men med vad DeepSeek beskriver som kraftigt förbättrad agentisk förmåga, alltså modellens förmåga att självständigt planera och genomföra flerstegsuppgifter. Enligt modellens sida på Hugging Face är 0813-versionen byggd på förhandsbygget men med en så kallad DSpark-modul för spekulativ avkodning kopplad till arkitekturen, en teknik som låter modellen förutsäga flera tokens samtidigt och därmed svara snabbare.
Namnet 0813 syftar på lanseringsdatumet, 13 augusti, ett mönster DeepSeek använt tidigare för att skilja på bygg-versioner. Modellen är, enligt flera oberoende källor som refererar till bolagets specifikationssida, en Mixture-of-Experts-modell (MoE) med cirka 1,6 biljoner parametrar totalt, varav ungefär 49 miljarder aktiveras per token. Det är alltså bara en bråkdel av den totala modellen som räknar på varje enskild fråga, vilket är precis den arkitektur som gjort DeepSeeks modeller billiga att köra jämfört med täta modeller av motsvarande storlek.
Från förhandsversion till GA: vad som faktiskt ändrades
DeepSeeks egen ändringslogg är ovanligt kortfattad för att vara ett så pass stort steg. Enligt bolagets nyhetssida rullades GA-versionen ut samtidigt i appen, på webben och i API:et, utan separat betaperiod för enterprise-kunder. Reuters rapporterade samma dag att modellen väsentligt förbättrar sina förmågor för AI-agenter och att den är tillgänglig genom API, app och webbprodukter direkt vid lanseringen.
Det som skiljer 0813 från förhandsbygget handlar alltså om tre saker: bredare distribution över alla kanaler samtidigt, den nya DSpark-modulen för snabbare svar, och enligt DeepSeek själva en tydlig förbättring i hur modellen hanterar flerstegs-agentuppgifter, som att navigera kodbaser, köra verktyg i följd eller hålla kontext över långa arbetsflöden. Det bolaget inte förändrat är grundarkitekturen. V4 Pro 0813 är fortfarande samma MoE-design som förhandsversionen, bara finjusterad och produktionssatt.
Nya API-priser: vad kostar V4 Pro nu?
Det här är kärnan i nyheten för de flesta utvecklare. Under förhandsperioden låg DeepSeeks pris på ungefär 0,435 dollar per miljon inmatningstokens vid cache-miss, 0,003625 dollar per miljon cachade inmatningstokens, och 0,87 dollar per miljon utmatningstokens. Vid GA-lanseringen den 13 augusti rapporterade Reuters, med hänvisning till analysfirman Artificial Analysis, att V4 Pro 0813 istället prissätts till 1,32 dollar per miljon inmatningstokens och 3,96 dollar per miljon utmatningstokens. Det är ungefär tre gånger högre för inmatning och nästan 4,5 gånger högre för utmatning jämfört med förhandspriserna.
Men det stannade inte där. DeepSeek meddelade samma vecka att bolaget inför en helt ny prismodell med topp- och lågtrafikpriser, ett system som är standard hos molnleverantörer men ovanligt hos AI-labb. I ett officiellt uttalande skrev DeepSeek: “With the V4 lineup release, we’re updating our API pricing and introducing peak and off-peak rates.” Den nya strukturen trädde i kraft klockan 16:00 UTC den 16 augusti 2026, alltså tre dagar efter GA-lanseringen.
Peak- och lågtrafikpriser förklarade
DeepSeek beskriver själva mekaniken enkelt: “Off-peak rates are 50% lower than peak, enabling more flexible workload scheduling.” I praktiken innebär det att utvecklare som kan lägga batch-jobb, finjustering eller icke-tidskritisk bearbetning utanför topptid betalar hälften så mycket per token som de som kör allt i realtid under hög belastning. Modellen för topp- och lågtrafik är i sig inget nytt inom molntjänster, men det är första gången ett stort öppet AI-labb applicerar det direkt på LLM-inferens i den här skalan.
För svenska bolag som redan byggt pipelines runt DeepSeeks API betyder det en ny variabel att optimera för. Ett företag som kör nattliga batch-analyser eller schemalagd kodgenerering kan i teorin halvera sin tokenkostnad genom att flytta jobben till lågtrafiktid. Den som behöver svar i realtid dygnet runt, till exempel i en kundtjänstbot, får däremot ingen sådan rabatt. DeepSeek har ännu inte publicerat exakta klockslag för vad som räknas som topp- respektive lågtrafik i alla tidszoner, vilket gör budgetering svårare för team utanför Kina fram tills fler detaljer bekräftas.
Prisjämförelse: DeepSeek V4 Pro genom sommaren 2026
Tabellen nedan sammanfattar hur priset förändrats från förhandsversion till GA-lansering, baserat på uppgifter från Reuters och Artificial Analysis.
| Period | Pris per miljon inmatningstokens | Pris per miljon utmatningstokens | Källa |
|---|---|---|---|
| Förhandsversion (cache-miss) | 0,435 USD | 0,87 USD | Branschbevakning, tidig sommar 2026 |
| Förhandsversion (cachad inmatning) | 0,0036 USD | – | Branschbevakning, tidig sommar 2026 |
| GA-lansering, 13 aug 2026 | 1,32 USD | 3,96 USD | Reuters / Artificial Analysis |
| Ny struktur från 16 aug 2026 | Topptid: enligt ovan. Lågtrafik: cirka 50% lägre | Topptid: enligt ovan. Lågtrafik: cirka 50% lägre | DeepSeek officiellt uttalande |
Det är värt att lyfta fram att Artificial Analysis egen jämförelsesida även publicerar ett separat “blandat pris” per miljon tokens som väger ihop inmatning och utmatning efter typisk användning. På den måttstocken landar V4 Pro 0813 i resonemangsläge med maximal ansträngning på cirka 0,69 dollar per miljon tokens, att jämföra med 4,35 dollar för OpenAIs GPT-5.5 i det mest krävande läget (xhigh). Det är alltså fortfarande betydligt billigare än de stängda konkurrenterna, trots prishöjningen.
Hur presterar modellen? Benchmarkläget
På Artificial Analysis samlade Intelligence Index, som väger ihop flera resonemangs- och kunskapstester, landar DeepSeek V4 Pro 0813 i sitt mest krävande läge på ett indexvärde av 53. Det är marginellt högre än föregångaren DeepSeek V4 Flash 0731, som fick 52 på samma skala, men klart under OpenAIs GPT-5.5 i xhigh-läge, som noterade 56 poäng. Skillnaden är inte dramatisk, men den bekräftar ett mönster som hållit i sig hela 2026: DeepSeeks modeller ligger tätt efter de bästa stängda systemen på ren intelligensmätning, men vinner på pris.
Flera oberoende bloggar och analyssajter, bland dem Unite.AI och ofox.ai, har testat modellen på egen hand sedan lanseringen och beskriver den som starkast på agentuppgifter och kodrelaterade verktygsanrop snarare än på ren faktakunskap. Det stämmer med DeepSeeks egen beskrivning av vad som förbättrats mellan förhandsversion och GA. Exakta poäng på specifika kodbenchmarks som SWE-bench Verified för just 0813-versionen varierar kraftigt mellan olika mätmetoder och tredjepartsleverantörer just nu, så den här artikeln avstår från att ange en enskild siffra tills fler källor konvergerar.
DeepSeek V4 Pro mot konkurrenterna
Sommaren 2026 har varit ovanligt tät på modellsläpp. GPT-5.5 från OpenAI, uppdaterade Claude Opus-versioner från Anthropic och nya Gemini Flash-varianter från Google har alla dykt upp inom loppet av några veckor, och DeepSeek V4 Pro är det senaste kortet i samma kapplöpning. Skillnaden ligger fortsatt i affärsmodellen. DeepSeek publicerar modellvikter öppet och konkurrerar primärt på pris och tillgänglighet, medan OpenAI, Anthropic och Google håller sina toppmodeller stängda och prissätter dem betydligt högre.
| Modell | Typ | AA Intelligence Index | Ungefärligt blandpris / miljon tokens |
|---|---|---|---|
| DeepSeek V4 Pro 0813 (max) | Öppna vikter | 53 | ~0,69 USD |
| DeepSeek V4 Flash 0731 | Öppna vikter | 52 | Lägre än V4 Pro |
| GPT-5.5 (xhigh) | Stängd | 56 | ~4,35 USD |
Just den här dynamiken, nästan samma prestanda till en bråkdel av priset, är anledningen till att DeepSeeks modeller fortsätter dra uppmärksamhet trots att de sällan toppar rena intelligensrankningar. Vår tidigare granskning av öppen källkod-modeller visade samma mönster redan innan V4 Pro släpptes, se Öppen Källkod-AI Slår Stängt: DeepSeek 80,6% vs GPT för hur tidigare DeepSeek-versioner presterat mot stängda alternativ.
Marknadseffekt: vad betyder prishöjningen för branschen?
En prishöjning på över 200 procent för inmatningstokens och närmare 355 procent för utmatningstokens är ingen liten justering. Den signalerar att DeepSeek, efter över ett år av aggressiv underprissättning som chockade delar av AI-branschen i början av 2025, nu justerar sig mot en mer hållbar affärsmodell. Att köra en modell med 1,6 biljoner totala parametrar i produktion, även med MoE-arkitektur som bara aktiverar en bråkdel per token, kostar betydande summor i GPU-kapacitet. Det kostnadstrycket verkar nu synas i prislappen.
För startups och utvecklarteam som byggt affärsmodeller runt DeepSeeks tidigare extremt låga priser innebär det en direkt marginalpress. Den nya topp/lågtrafik-strukturen ger samtidigt en ventil: den som kan schemalägga om sin belastning slipper hela höjningen. Det är ett mönster vi sett i molnbranschen i över tio år, men det är ovant för AI-inferens, där de flesta produkter hittills prissatts platt oavsett tid på dygnet.
Historisk kontext: från chock till etablerad aktör
DeepSeek gick från relativt okänt kinesiskt labb till global rubrik i januari 2025, när V3 och den efterföljande R1-modellen visade konkurrenskraftiga resultat till en bråkdel av kostnaden för OpenAIs och Anthropics modeller. Det utlöste både kursfall bland amerikanska AI-relaterade aktier och en våg av granskning kring datahantering och ursprung. Sedan dess har bolaget levererat en jämn ström av uppdateringar, och V4-serien representerar den fjärde stora generationsväxlingen på mindre än två år.
Det som skiljer augusti 2026 från januari 2025 är tonen. Lanseringen av V4 Pro möttes inte av samma marknadschock som R1 gjorde. Istället beskrevs den av branschbevakare som en väntad, om än teknisk stark, uppdatering i en redan etablerad produktserie. Den verkliga nyheten den här gången är inte modellens existens, utan prisstrategin bakom den. Läsare som vill köra DeepSeeks modeller lokalt istället för via API kan följa vår guide: Kör DeepSeek och Llama 4 Lokalt: 14 Steg, 45 Min.
Sverige och Norden: efterfrågan och regelverk
Sökintresset för DeepSeeks modeller i Sverige har svängt kraftigt under 2026. Enligt sökvolymdata nådde intresset för söktermen “deepseek v4” en topp på cirka 2 400 sökningar i månaden i april, innan det svalnade till runt 590 sökningar i månaden under sommaren, ett mönster som ofta följer på stora produktlanseringar följt av en lugnare period innan nästa version. Konkurrensen om söktrafiken kring termen bedöms fortfarande som låg, vilket tyder på att svensk teknikbevakning av DeepSeek specifikt fortfarande är tunn jämfört med det globala intresset.
På regelverkssidan finns inget nytt uttalande från Integritetsskyddsmyndigheten (IMY) eller EU-nivå specifikt riktat mot DeepSeek V4 Pro i samband med den här lanseringen. Det generella regelverket som redan gäller, EU:s AI-förordning med dess klassificering av system efter risknivå samt GDPR för all databehandling som rör EU-medborgare, fortsätter att vara den rättsliga ram svenska företag måste förhålla sig till oavsett vilken modell de väljer, kinesisk eller amerikansk. Företag som redan gjort en riskbedömning för tidigare DeepSeek-versioner bör uppdatera den i takt med att nya versioner rullas ut, snarare än att anta att en tidigare granskning fortfarande gäller rakt av.
Så anropar du DeepSeek V4 Pro via API
För utvecklare som vill testa modellen är API-anropet i grunden detsamma som för tidigare DeepSeek-versioner, med samma OpenAI-kompatibla format som bolaget använt sedan V3. Nedan ett förenklat exempel på hur ett anrop mot chattkomplettering ser ut.
curl https://api.deepseek.com/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer DIN_API_NYCKEL" \
-d '{
"model": "deepseek-v4-pro-0813",
"messages": [
{"role": "user", "content": "Sammanfatta prisändringen i tre punkter."}
],
"stream": false
}'
Skillnaden mot tidigare är att kostnaden per anrop nu beror på tidpunkt. Team som vill hålla koll på om ett jobb körs i topp- eller lågtrafik bör bygga in loggning av svarstider och fakturerade tokens redan från start, snarare än att upptäcka kostnadsskillnaden i efterhand på fakturan.
Vad experterna och källorna säger
DeepSeek har varit ovanligt tydliga i sin egen kommunikation kring prisändringen. I det officiella releasemeddelandet skriver bolaget: “With the V4 lineup release, we’re updating our API pricing and introducing peak and off-peak rates.” (DeepSeek, officiellt uttalande)
Om själva rabattstrukturen skriver bolaget rakt av: “Off-peak rates are 50% lower than peak, enabling more flexible workload scheduling.” (DeepSeek, officiellt uttalande)
Och gällande tidpunkten för när det nya priset börjar gälla: “New pricing takes effect at 16:00 UTC, Aug 16, 2026.” (DeepSeek, officiellt uttalande)
Nyhetsbyrån Reuters bekräftade samma besked i egen rapportering samma dag som lanseringen: “Chinese artificial intelligence startup DeepSeek will raise API prices for its V4-Pro and V4-Flash models and introduce peak and off-peak pricing, a company statement on Thursday showed” (via Reuters). Byrån rapporterade även prisnivån direkt: “DeepSeek’s V4-Pro-0813 is priced at $1.32 per million input tokens and $3.96 per million output tokens, according to independent benchmarking firm Artificial Analysis” (via Reuters).
Vad detta betyder för svenska utvecklare och företag
De flesta svenska team som integrerat DeepSeek i sina produkter gjorde det ursprungligen för priset, inte för att modellen var bäst i klassen på varje uppgift. Prishöjningen ändrar den kalkylen, men förändrar den inte nödvändigtvis i grunden. Även efter höjningen ligger DeepSeek V4 Pro långt under vad motsvarande kapacitet kostar hos OpenAI eller Anthropic, särskilt om arbetsbelastningen kan flyttas till lågtrafiktid.
Den praktiska rekommendationen för team som redan byggt på DeepSeek är att räkna om sin faktiska tokenförbrukning mot de nya priserna innan nästa fakturaperiod, snarare än att anta att gamla kalkylark fortfarande stämmer. Den som överväger att byta till DeepSeek för första gången bör jämföra både grundpriset och den nya topp/lågtrafik-modellen mot konkurrenter som GPT-5.5 och Claude, vilket vi går igenom i GPT-5 vs Claude Sonnet 5: 85% på SWE-bench.
Prognoser: vad händer härnäst
- Fler labb inför trafikbaserad prissättning. Om DeepSeeks modell visar sig fungera för att jämna ut belastning är det troligt att fler leverantörer, öppna som stängda, testar liknande scheman under hösten 2026.
- Ytterligare en V4-variant inom kvartalet. DeepSeeks releasetakt under 2025 och 2026 har legat på ungefär en större uppdatering var tredje till fjärde månad, vilket talar för en ny sub-version eller finjustering före årsskiftet.
- Fortsatt prispress nedåt från konkurrenter med öppna vikter. Alibabas Qwen-serie och andra kinesiska labb har visat vilja att konkurrera hårt på pris, vilket kan tvinga DeepSeek att balansera den nya prishöjningen med riktade rabatter för storanvändare.
- Ökat fokus på agentbenchmarks snarare än ren kunskap. Eftersom DeepSeek själva lyfter fram agentiska förbättringar som huvudnyheten i 0813, väntas fler oberoende tester under hösten fokusera specifikt på verktygsanvändning och flerstegsuppgifter snarare än statiska kunskapsprov.
- Svenska företag väntas bli mer försiktiga med enkla API-integrationer. Prishöjningen och den nya topp/lågtrafik-modellen gör det svårare att förutsäga kostnad i förväg, vilket sannolikt driver fler team mot att bygga in kostnadsövervakning eller växla mellan flera modellleverantörer beroende på pris och belastning.
DeepSeek V4 Pro i siffror
| Mått | Värde |
|---|---|
| GA-lanseringsdatum | 13 augusti 2026 |
| Ny prisstruktur träder i kraft | 16 augusti 2026, kl. 16:00 UTC |
| Totala parametrar (MoE, rapporterat) | ~1,6 biljoner |
| Aktiva parametrar per token (rapporterat) | ~49 miljarder |
| Prisökning, inmatningstokens | ~203% jämfört med förhandspris |
| Prisökning, utmatningstokens | ~355% jämfört med förhandspris |
| Rabatt vid lågtrafik | 50% lägre än topptid |
| AA Intelligence Index (max-läge) | 53 |
| Sökvolym “deepseek v4” i Sverige (topp, april 2026) | ~2 400/månad |
Vanliga frågor om DeepSeek V4 Pro
När släpptes DeepSeek V4 Pro officiellt?
Den officiella GA-versionen, kallad V4 Pro 0813, släpptes den 13 augusti 2026 och blev tillgänglig samtidigt i DeepSeeks app, på webben och via API.
Hur mycket dyrare är DeepSeek V4 Pro jämfört med förhandsversionen?
Enligt Reuters och Artificial Analysis steg priset från cirka 0,435 till 1,32 dollar per miljon inmatningstokens, och från 0,87 till 3,96 dollar per miljon utmatningstokens vid GA-lanseringen, en ökning på ungefär 203 respektive 355 procent.
Vad är topp- och lågtrafikpriser?
Det är en ny prismodell från DeepSeek där kostnaden per token är lägre under perioder med mindre belastning på systemet. Enligt bolaget är lågtrafikpriset ungefär 50 procent lägre än topptidspriset.
Är DeepSeek V4 Pro fortfarande öppen källkod?
Modellvikterna finns publicerade på Hugging Face, i linje med DeepSeeks tidigare praxis att släppa sina modeller med öppna vikter, till skillnad från OpenAI och Anthropics stängda modeller.
Hur presterar DeepSeek V4 Pro mot GPT-5.5?
På Artificial Analysis Intelligence Index fick V4 Pro 0813 53 poäng i sitt mest krävande läge, mot 56 poäng för GPT-5.5 i xhigh-läge. Prisskillnaden är dock betydligt större än prestandaskillnaden, DeepSeek kostar en bråkdel per token jämfört med OpenAIs modell.
Kan jag köra DeepSeek V4 Pro lokalt istället för via API?
Med 1,6 biljoner totala parametrar krävs kraftig hårdvara för att köra hela modellen lokalt. De flesta utvecklare kör istället mindre destillerade varianter lokalt via verktyg som Ollama, se vår steg-för-steg-guide för hur det går till.
Påverkas svenska företag av EU:s AI-förordning när de använder DeepSeek?
Ja. EU:s AI-förordning och GDPR gäller oavsett vilket lands bolag som levererar modellen. Svenska företag som använder DeepSeek V4 Pro i produktion bör göra samma riskbedömning som för vilken tredjepartsmodell som helst, med extra uppmärksamhet på var data faktiskt bearbetas.
Kommer priserna att höjas igen?
DeepSeek har inte kommunicerat några planer bortom den nya topp/lågtrafik-strukturen som trädde i kraft den 16 augusti 2026. Givet bolagets historik av täta uppdateringar är ytterligare prisjusteringar i samband med framtida modellsläpp inte osannolikt, men inget är bekräftat.




