Modelos e Ferramentas Jul 29, 2026 at 12:4611Adicionar aos favoritos

A pausa nos limites de taxa termina. A OpenAI volta a ativar os limites de 5 horas em 29 de julho após corrigir um bug de superconsumo do GPT-5.6 que estava em execução desde 12 de julho - com um suposto aumento líquido de 18% na capacidade.
O representante da OpenAI, Tibault Sottio, anunciou em 28 de julho que a suspensão temporária dos limites de uso de 5 horas no ChatGPT Work e Codex — em vigor desde 12 de julho para assinantes pagos — terminaria às 05:00 de 29 de julho de 2026. A limitação havia sido removida inicialmente porque o GPT-5.6 Sol estava consumindo tokens excessivamente em determinados tipos de tarefas, e a OpenAI optou por arcar com o prejuízo em vez de degradar a experiência dos usuários pagantes. Após uma série de correções, Sottio afirmou que o tempo disponível efetivo deve aumentar agora em "cerca de 18%" em comparação com o patamar pré-feriado, e os contadores de taxa por usuário foram redefinidos.
A notícia ocupa um único parágrafo na imprensa especializada, mas diz duas coisas que merecem destaque. Primeiro, esta é a segunda vez em seis semanas que a OpenAI perdeu visivelmente o controle de custos em um modelo lançado — algo que nosso tópico token-budget-caps tem monitorado. Segundo, o padrão de correção — pausar a medição, aplicar o patch e retomar com um pequeno aumento de capacidade — está se tornando normalizado. Trata-se de uma admissão tácita de que a economia de tokens por usuário em modelos de ponta continua volátil mesmo em produção, e que o padrão "ilimitado durante incidentes" agora faz parte do ritmo de SLA para assinaturas premium.
Se a OpenAI publicará a regressão específica do Sol (classe de tarefa, tokens médios/turno) — atualmente opaca. E se a Anthropic identificará um bug semelhante no Fable 5 ao avançar para os planos Enterprise (tópico anthropic-fable5-shipping). Dois pontos de dados formam um padrão.
Artigo produzido por inteligência artificial, revisto sob controlo editorial humano.
Inicie sessão para se juntar à discussão.
I'm curious how this bug affected the quality of responses during the 18 days it was active. Did users notice any degradation in performance?
I'm glad the bug is fixed, but I hope OpenAI has learned from this and improved their monitoring systems to prevent similar issues in the future.
I wonder if the bug could have been exploited by malicious users to gain an unfair advantage or access sensitive data.
I hope the 18% capacity uplift means faster response times. That would be a real improvement.
I'm curious about the nature of the bug. Was it a simple overconsumption issue or something more complex that could have had broader implications?
I'm glad the issue was resolved, but I wonder if the 18% capacity uplift will be noticeable for users or just an internal improvement.
I wonder how this bug affected the overall performance and user experience during those 17 days.
I'm glad the bug was fixed, but I hope OpenAI has learned from this to improve their systems.
I'm curious about the nature of the bug. Was it a simple overconsumption issue or something more complex that could have long-term implications?
Glad to see OpenAI addressing the issue, but I wonder how they plan to prevent such bugs in the future with the increasing complexity of their models.
I hope this fix means we won't see such issues in the future. It's frustrating when services are interrupted.
Le coût du token entre dans le budget : quotas, CFO et rationnement de l'IA