DeepSeek V4 se aproxima: 1M de tokens de contexto e preço de tarifa dupla

Seguimento do caso : Économie de l'open frontier : viabilité, subvention, pivots· Episódio 7/13

Modelos e Ferramentas Jul 20, 2026 at 11:406Adicionar aos favoritos

DeepSeek V4 se aproxima: 1M de tokens de contexto e preço de tarifa dupla
Ilustração : Léa Fontaine

DeepSeek prepara a transição da sua V4 para o público, com janela de 1 M de tokens e grade tarifária dupla (pico/fora de pico). A sombra se estende além de uma simples atualização.

O fato

Segundo a Tech in Asia (19 de julho de 2026), a DeepSeek está prestes a finalizar o lançamento de seu modelo V4. Dois recursos técnicos se destacam desde o anúncio: uma janela de contexto de 1 milhão de tokens e uma grade tarifária em dois níveis — uma tarifa “pico” (horário de pico) e uma tarifa “fora de pico” (horário de baixa).

Nossa análise

A DeepSeek nunca competiu com as grandes empresas apenas em capacidade bruta; seu diferencial sempre foi o custo. Passar para 1 milhão de tokens de contexto é marcar a caixa que a Anthropic (Claude Fable 5) e a Moonshot (Kimi K3) usam como argumento para empresas. A dupla tarifação vai além: ela tira o cálculo do preço único por token para arbitrar pelo tempo — equivalente ao Cloud Compute das tarifas EDF de horário de pico/horário de baixa.

Se a V4 cumprir essas duas promessas ao preço habitual da DeepSeek, ela redefine novamente o debate sobre o que realmente custa um modelo “de fronteira” em produção — logo após o Kimi K3 ter interrompido a corrida pelo menor preço.

A se observar

  • O preço oficial das duas tarifas pico/fora de pico (comparação linha a linha com K3 e Fable 5).
  • Os benchmarks de terceiros pós-lançamento — a janela de 1 milhão de tokens se sustenta em tarefas longas ou é apenas um número de marketing?
Resources

Artigo produzido por inteligência artificial, revisto sob controlo editorial humano.

A nossa redação
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Este artigo foi-lhe útil?

11 pessoas gostaram deste artigo

Gosto
P
Priya RamanMachine Learning Engineer
🇬🇧 ML engineer, applied research.
Partilhar:
Comentários (6)

Inicie sessão para se juntar à discussão.

sandrine.b 22 Jul 2026 · 08:04

I'm interested to see how the 1M token context will handle nuanced discussions on social issues. Will it provide deeper insights or just more noise?

J.P.R. 3 20 Jul 2026 · 07:49

I'm skeptical about the need for 1M tokens. What kind of queries require such a large context?

Alex 2 20 Jul 2026 · 09:56

Long documents or detailed technical queries might benefit from such a large context.

BookWorm88 20 Jul 2026 · 09:56

Long contexts can be useful for summarizing extensive documents or analyzing complex narratives.

ArtLoverLA 20 Jul 2026 · 07:49

I'm curious about how the 1M token context will improve the model's performance in handling complex queries.

Critique42 20 Jul 2026 · 09:56

It should help with long-form content, but we'll see how it handles nuanced context shifts.

ph1lippe_m 20 Jul 2026 · 07:38

I'm excited about the potential of 1M tokens, but I hope the peak pricing won't make it inaccessible during critical hours.

LitLover42 20 Jul 2026 · 07:13

I wonder how the peak/off-peak pricing will impact users in different time zones. It could be a game-changer or a deal-breaker.

1
le_sceptique 20 Jul 2026 · 07:05

I wonder how this pricing model will affect smaller developers and startups.

Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Secções
Explorar
Informações