Frontier LLM Preise bewegten sich nicht für 5 Monate. Im August zogen sie dreimal um, und ein Labor verdreifachte seine Rate.
Frontier LLM prices didn't move for 5 months. In August, they moved three times, and one lab tripled its rate.
Am 1. August veröffentlichte ich einen Bericht, dessen Schlagzeile lautete, dass die Grenzpreise für LLM-API strukturell klebrig sind. Bei 40 täglichen Messwerten eines gleichgewichtigen Index von zehn Flaggschiffmodellen - eines pro Labor - hatte kein Labor jemals den Preis eines bestehenden Modells geändert. Jede Bewegung im Index kam von einem neuen Modell, das ein altes ersetzte. August machte diesen Satz in drei Wochen falsch. Hier ist, was sich bewegt hat, warum der Index immer noch den Monat niedriger endete und was 72 Stunden nach dem Cutoff passiert ist, der alles in den Schatten stellt. Der Monat in einer Tabelle Der Index ist der gleichgewichtige Durchschnitt des gemischten Preises von zehn Flaggschiffen pro Million Token (3 Teile Input zu 1 Teil Output, Listenpreise wie auf der Preisseite des Anbieters gedruckt). Datum Was passiert ist Index ($/Mtok) Aug 1 Eröffnungslevel $4,39 Aug 4 Alibabas Slot:...
Am 1. August veröffentlichte ich einen Bericht, dessen Schlagzeile lautete, dass die Grenzpreise für LLM-API strukturell klebrig sind. Bei 40 täglichen Messwerten eines gleichgewichtigen Index von zehn Flaggschiffmodellen - eines pro Labor - hatte kein Labor jemals den Preis eines bestehenden Modells geändert. Jede Bewegung im Index kam von einem neuen Modell, das ein altes ersetzte. August machte diesen Satz in drei Wochen falsch. Hier ist, was sich bewegt hat, warum der Index immer noch den Monat niedriger endete und was 72 Stunden nach dem Cutoff passiert ist, der alles in den Schatten stellt. Der Monat in einer Tabelle Der Index ist der gleichgewichtige Durchschnitt des gemischten Preises von zehn Flaggschiffen pro Million Token (3 Teile Input zu 1 Teil Output, Listenpreise wie auf der Preisseite des Anbieters gedruckt). Datum Was passiert ist Index ($/Mtok) Aug 1 Eröffnungslevel $4.39 Aug 4 Alibabas Slot: Qwen3.7-Max → Qwen3.8-Max ($3.75 → $3.00 blended) $4.32 Aug 16 DeepSeek V4 Pro repriced: flat $0.435/$0.87 → peak $1.32/$3.96 (+264% blended) $4.46 Aug 21 GPT-5.6 Sol repriced: $ 5 / $ 30 → $ 4 / $ 20, gekennzeichnete Promotion (-29%) $ 4,14 Sep 1 Abschlussstufe $ 4,14 Netto für den Monat: -5,7%. Seit der ersten Lesung am 23. Februar: -9,4%. Drei weitere Flaggschiff-Übergaben fanden im August statt (Muse Spark 1.1 → 1.2, Grok 4.5 → 4.6, GLM-5.2 → 5.3) und bewegten nichts, weil jeder Nachfolger den Listenpreis seines Vorgängers behielt. Das ist das Muster, das ich im August beschrieben habe. Die beiden fetten Reihen sind das Muster brechen. Schritt 1: DeepSeek drehte "Listenpreis" in einen Zeitplan Bis 16:00 UTC am 16. August, DeepSeek V4 Pro in Rechnung gestellt eine einzige Flatrate: $ 0,435 in / $ 0,87 aus. Dann teilte die Preisseite es in zwei: Peak (01:00-04:00 und 06:00-10:00 UTC): 1,32 $ / 3,96 $ Off-Peak (jede zweite Stunde): genau die Hälfte - $ 0,66 / $ 1,98 Der Index verfolgt die Spitzenrate als Listenpreis. Zwei Gründe. DeepSeek definiert Off-Peak als Abschlag von Peak, nicht umgekehrt, also ist Peak die veröffentlichte Zahl. Und ein Anrufer, der nicht rund um die Uhr plant, braucht eine Decke, keine Etage. Aber beachten Sie, dass sogar die Off-Peak-Rate ($ 0,99 gemischt) 82% über dem alten Flat-Preis liegt. Dies war kein Rabattschema, das auf dem alten Preis lag. Es war eine 3-fache Erhöhung mit einem Rabattfenster. Wenn Sie DeepSeek-Workloads ausführen und diese batchen können: 10:00-01:00 UTC ist ein langes Off-Peak-Fenster. Wenn Sie nicht können, hat sich Ihre V4 Pro-Rechnung Mitte August ungefähr verdreifacht und der Verkäufer hat Ihnen keine E-Mail darüber geschickt. Schritt 2: OpenAI Schnitt, mit einem Sternchen Am 21. August GPT-5.6 Sol ging von $ 5 / $ 30 auf $ 4 / $ 20 - $ 11,25 → $ 8,00 gemischt, -29%. Es ist der erste Listenpreis, der von einem Bestandteil in der Geschichte des Index geschnitten wurde. Das Sternchen ist ein Satz, der am selben Tag auf der Preisseite erschien: "Die Werbepreise von GPT-5.6 Sol sind mindestens bis zum 21. November 2026 verfügbar." Das ist ein Boden, kein Reversion-Datum. OpenAI veröffentlicht kein Datum, an dem der Preis wieder steigt. Der Index nimmt die Listenpreise wie gedruckt, so dass der Schnitt in ist - aber wenn Sie Sol am 21. November bei $ 4 / $ 20 modelliert haben, ist dieser Input von einem Satz abhängig, und der Satz kann sich ändern. Zwei der zehn Flaggschiffe veröffentlichen jetzt einen Listenpreis, der wirklich die Spitze eines Bereichs ist: einer hat einen Tageszeitplan darunter, der andere hat eine Promo-Uhr darüber. Warum das billigste Modell der GPT-4-Klasse (noch) nicht teurer wurde Die andere Linie, die ich verfolge, ist der Boden: das billigste Modell, das eine feste Kapazitätsleiste freigibt (GPQA Diamond ≥ 70, extern gemessen - ungefähr GPT-4-Klasse). Es ist die Deflationsgeschichte; zwischen März und Juli fiel sie 17x. Im August bewegte sie sich nicht. Es blieb bei $ 0,113 pro Million Token, festgelegt von DeepSeek V4 Flash seit dem 25. Juli. Hier ist die Sache. Am 16. August erhöhte DeepSeek auch seine eigene V4-Flash-Spitzenrate von 0,14 USD / 0,28 USD auf 0,44 USD / 1,32 USD - 0,175 USD / 0,66 USD gemischt, 3,8x. Das Modell, das den Boden einstellte, wurde von seinem Hersteller fast viermal teurer, und der Boden rührte sich nicht. Das liegt daran, dass der Boden den günstigsten Listenpreis für ein Basismodell für jeden Host, der es bedient, liest und DeepInfra V4 Flash bei 0,09 $ / 0,18 $ servierte. Also das billigste GPT-4-Klasse-Token am Sept