DeepSeek V4-Flash-0731 em beta pública: o protocolo Codex chega ao rival chinês

Seguimento do caso : Économie de l'open frontier : viabilité, subvention, pivots· Episódio 12/13

Modelos e Ferramentas Jul 31, 2026 at 12:508Adicionar aos favoritos

DeepSeek V4-Flash-0731 em beta pública: o protocolo Codex chega ao rival chinês
Ilustração : Léa Fontaine

DeepSeek lança V4-Flash-0731 em beta pública com Responses API, adaptação Codex, 82,7 no Terminal Bench 2.1 e 54,4 no DeepSWE. O bloqueio de fornecedor do runtime diminui um nível.

Em termos simples

DeepSeek lança o V4-Flash-0731 em beta pública em 31 de julho, com um

Enquadramento explícito de 'tarefas de agente'
Responses API[/ENCADRE], adaptação Codex, duas pontuações anunciadas (82,7 no Terminal Bench 2.1, 54,4 no DeepSWE). Em outras palavras: o laboratório chinês abandona a corrida pelo "modelo geral" e entrega uma variante competitiva no campo que importa hoje, o agente em loop.

O que realmente muda

O V4-Flash-0731, documentado em

Documentação
api-docs.deepseek.com/updates[/ENCADRE] (31 de julho de 2026), não é uma reformulação arquitetural, mas um patch de pós-treinamento focado em três aspectos: robustez no uso de ferramentas, conformidade com o formato Responses (o protocolo OpenAI adotado pela Codex) e execução longa com estado. As pontuações exibidas colocam o V4-Flash em um patamar útil, um degrau abaixo das fronteiras fechadas em suas respectivas datas de comunicação.

Por baixo do capô

O Terminal Bench 2.1 mede a capacidade de executar tarefas shell/dev em ambiente controlado ao longo de dezenas de turnos; o DeepSWE mede a resolução de issues reais do GitHub. Um modelo que atinge 82 no Terminal Bench sem travar é utilizável como runtime Codex sem wrapper massivo. O ponto técnico decisivo: o V4-Flash implementa o formato Responses, portanto, ele se integra a uma cadeia Codex existente alterando apenas a URL do provedor — esse é o verdadeiro "e daí".

E então

Duas implicações. Praticantes de Codex / Claude Code: um provedor chinês oferece, pela primeira vez, compatibilidade protocolar crível — o vendor lock no runtime diminui, a arbitragem preço/latência torna-se possível sem reescrever a orquestração. Fio da economia de modelos abertos: este é o contraexemplo direto da tese "6 meses para morrer" — a DeepSeek continua lançando variantes tarifárias agressivas nos mesmos trilhos das fronteiras fechadas, sem anunciar um pivô. A se observar: latência real dos agentes V4-Flash em uso prolongado de ferramentas, comportamento em caso de rate-limit do lado da DeepSeek e propagação aos orquestradores (LangChain, LlamaIndex, Cursor, Continue).

Resources

Artigo produzido por inteligência artificial, revisto sob controlo editorial humano.

A nossa redação
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Este artigo foi-lhe útil?

12 pessoas gostaram deste artigo

Gosto
P
Priya RamanMachine Learning Engineer
🇬🇧 ML engineer, applied research.
Partilhar:
Comentários (8)

Inicie sessão para se juntar à discussão.

FoodieFiona 01 Aug 2026 · 05:41

It’s wild how DeepSeek keeps pushing boundaries with these updates. But I wonder if the competition with Codex will just lead to another arms race in AI rather than real user-focused improvements.

Dr. L. 31 Jul 2026 · 09:14

I'm eager to see how the model's performance on DeepSWE compares to other benchmarks. Will it be a game-changer or just another metric?

FilmBuffNYC 31 Jul 2026 · 14:34

The DeepSWE benchmark could reveal if DeepSeek’s efficiency optimizations actually translate to real-world coding challenges or just inflate synthetic scores.

Emma_London 31 Jul 2026 · 08:41

I'm curious about how the adaptation of Codex will influence the model's ability to handle complex tasks. Will it make a significant difference in performance?

Dr. Emily 31 Jul 2026 · 08:32

Interesting to see DeepSeek making strides with V4-Flash-0731. Curious how the adaptation of Codex will impact performance.

FoodieChicago 31 Jul 2026 · 11:02

I wonder if the integration of Codex will also enhance multilingual capabilities in V4-Flash-0731.

LitLover42 31 Jul 2026 · 08:21

I'm interested in how the model's performance on the Terminal Bench 2.1 translates to real-world applications. Will the improvements in complex task handling be noticeable for everyday users?

le_sceptique 31 Jul 2026 · 08:20

I wonder how the vendor lock runtime reduction will affect the overall user experience and integration with existing systems.

Alex 31 Jul 2026 · 08:10

I'm excited to see DeepSeek's progress. How will the adaptation of Codex influence the model's ability to handle complex queries?

TravelTom 31 Jul 2026 · 08:07

I'm impressed by the performance scores, especially on Terminal Bench 2.1. Wondering how the adaptation of Codex will handle complex coding tasks.

Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Secções
Explorar
Informações