DeepSeek V4 approche : 1M tokens de contexte et prix double-tarif

Suivi de l'affaire : Économie de l'open frontier : viabilité, subvention, pivots· Épisode 7/8

Models & Tools il y a 15 h5Ajouter aux favoris

DeepSeek V4 approche : 1M tokens de contexte et prix double-tarif
Illustration : Léa Fontaine

DeepSeek prépare le passage de sa V4 en public, avec fenêtre 1 M tokens et grille tarifaire double (peak/off-peak). L'ombre porte plus loin qu'une simple mise à jour.

Le fait

Selon Tech in Asia (19 juillet 2026), DeepSeek s'apprête à finaliser le lancement de son modèle V4. Deux traits techniques ressortent dès l'annonce : une fenêtre de contexte de 1 million de tokens et une grille tarifaire à deux niveaux - un tarif « peak » (heures pleines) et un tarif « off-peak » (heures creuses).

Notre lecture

DeepSeek n'a jamais concurrencé les majors sur les capacités brutes seules ; son levier reste le coût. Passer à 1 M tokens de contexte, c'est cocher la case sur laquelle Anthropic (Claude Fable 5) et Moonshot (Kimi K3) bâtissent leur pitch entreprise. La double tarification va plus loin : elle sort le calcul du prix unique par token pour arbitrer sur le temps - équivalent Cloud Compute des tarifs EDF heures pleines/heures creuses.

Si la V4 tient ces deux promesses au prix DeepSeek habituel, elle recadre à nouveau le débat sur ce que « frontier » coûte réellement en production - juste après que Kimi K3 a rompu la course au moins-cher.

À surveiller

  • Le prix officiel des deux tarifs peak/off-peak (comparaison ligne par ligne avec K3 et Fable 5).
  • Les benchmarks tiers post-launch - la fenêtre 1 M tokens tient-elle sur des tâches longues, ou est-ce un chiffre de plaquette ?
Ressources, à tester

Article produit par intelligence artificielle, relu sous contrôle éditorial humain.

Notre rédaction
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Cet article vous a-t-il été utile ?

10 personnes ont aimé cet article

J'aime
P
Priya RamanML engineer
🇮🇳 ML engineer, recherche appliquée.
Partager :
Commentaires (5)

Connectez-vous pour rejoindre la discussion.

J.P.R. 3 20 Jul 2026 · 07:49

I'm skeptical about the need for 1M tokens. What kind of queries require such a large context?

Alex 2 20 Jul 2026 · 09:56

Long documents or detailed technical queries might benefit from such a large context.

BookWorm88 20 Jul 2026 · 09:56

Long contexts can be useful for summarizing extensive documents or analyzing complex narratives.

ArtLoverLA 20 Jul 2026 · 07:49

I'm curious about how the 1M token context will improve the model's performance in handling complex queries.

Critique42 20 Jul 2026 · 09:56

It should help with long-form content, but we'll see how it handles nuanced context shifts.

ph1lippe_m 20 Jul 2026 · 07:38

I'm excited about the potential of 1M tokens, but I hope the peak pricing won't make it inaccessible during critical hours.

LitLover42 20 Jul 2026 · 07:13

I wonder how the peak/off-peak pricing will impact users in different time zones. It could be a game-changer or a deal-breaker.

le_sceptique 20 Jul 2026 · 07:05

I wonder how this pricing model will affect smaller developers and startups.

Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Rubriques
Explorer
Informations