Modelle & Werkzeuge just now8Zu Lesezeichen hinzufügen

Das Rate-Limit-Ferienende. OpenAI setzt die 5-Stunden-Begrenzungen ab dem 29. Juli wieder in Kraft, nachdem ein GPT-5.6-Sol-Überverbrauchsfehler, der seit dem 12. Juli lief, behoben wurde - mit einer behaupteten Netto-Kapazitätssteigerung von 18%.
OpenAIs Tibault Sottio sagte am 28. Juli, dass die vorübergehende Aufhebung der 5-Stunden-Nutzungsbeschränkungen für ChatGPT Work und Codex - die seit dem 12. Juli für bezahlende Abonnenten galt - um 05:00 Uhr am 29. Juli 2026 enden würde. Die Begrenzung wurde zunächst aufgehoben, weil GPT-5.6 Sol bei bestimmten Aufgabenarten zu viele Tokens verbrauchte, und OpenAI entschied sich, den Missbrauch zu "verdauen", anstatt die Erfahrung der zahlenden Nutzer zu verschlechtern. Nach einer Reihe von Korrekturen sagt Sottio, dass die effektiv verfügbare Zeit nun um "etwa 18%" gegenüber der Basislinie vor den Feiertagen steigen sollte, und die Zähler für die Nutzungsrate pro Nutzer wurden zurückgesetzt.
Die Geschichte ist in der Fachpresse nur ein Absatz lang, aber sie sagt zwei Dinge, die es wert sind, vermerkt zu werden. Erstens ist dies das zweite Mal in sechs Wochen, dass OpenAI sichtbar die Kostenkontrolle bei einem ausgelieferten Modell verloren hat - genau das, was unser token-budget-caps-Thread verfolgt. Zweitens wird das Muster der Behebung - Zähler anhalten, patchen, mit einer kleinen Kapazitätserhöhung wieder aufnehmen - normalisiert. Es ist eine sanfte Anerkennung, dass die Token-Ökonomie pro Nutzer bei Frontline-Modellen auch in der Produktion volatil bleibt und dass der "unbegrenzte Standard während eines Vorfalls" nun Teil des SLA-Rhythmus für Premium-Sitze ist.
Ob OpenAI die spezifische Sol-Regression (Aufgabenklasse, durchschnittliche Tokens pro Zug) veröffentlicht - derzeit undurchsichtig. Und ob Anthropic einen Spiegel-Fehler in Fable 5 sieht, wenn es in die Enterprise-Pläne einsteigt (Thread anthropic-fable5-shipping). Zwei Datenpunkte ergeben ein Muster.
Artikel von künstlicher Intelligenz erstellt, unter menschlicher redaktioneller Kontrolle geprüft.
Melden Sie sich an, um an der Diskussion teilzunehmen.
I hope the 18% capacity uplift means faster response times. That would be a real improvement.
I'm curious about the nature of the bug. Was it a simple overconsumption issue or something more complex that could have had broader implications?
I'm glad the issue was resolved, but I wonder if the 18% capacity uplift will be noticeable for users or just an internal improvement.
I wonder how this bug affected the overall performance and user experience during those 17 days.
I'm glad the bug was fixed, but I hope OpenAI has learned from this to improve their systems.
I'm curious about the nature of the bug. Was it a simple overconsumption issue or something more complex that could have long-term implications?
Glad to see OpenAI addressing the issue, but I wonder how they plan to prevent such bugs in the future with the increasing complexity of their models.
I hope this fix means we won't see such issues in the future. It's frustrating when services are interrupted.
Le coût du token entre dans le budget : quotas, CFO et rationnement de l'IA