Zum Inhalt
← Zurück zu Einblicke

GPT-6 Sol und Luna werden günstiger: Ersparnis hängt von wiederverwendetem Kontext ab

AI OpenAI AI Agents Product Design Nachrichten

Kurzfassung

OpenAI startet GPT-6 Sol und Luna mit 50% niedrigeren Eingabepreisen gegenüber bisherigen Aktionspreisen. Cache-Lesezugriffe sparen zusätzlich; Schreibzugriffe, Wiederholungen und Datenänderungen beeinflussen die Gesamtkosten.

GPT-6 Sol und Luna werden günstiger: Ersparnis hängt von wiederverwendetem Kontext ab

OpenAI hat GPT-6 Sol und Luna mit Eingabepreisen eingeführt, die 50% unter den Aktionspreisen ihrer Vorgänger liegen. Öffentlich fehlen weiterhin Vergleiche der Gesamtrechnungen gewöhnlicher Teams für vollständig erledigte Aufgaben. Wenn günstigere Agenten zu zusätzlichen Durchläufen führen, sinken die Ausgaben nicht zwangsläufig im selben Verhältnis wie die Stückpreise. Diese Frage lässt sich nur mit tatsächlichem Verbrauch und angenommenen Ergebnissen gemeinsam beantworten. Preise

Das Ereignis trägt in den USA das Datum 2026-09-22. MacRumors veröffentlichte seinen Bericht an diesem Tag um 13:58 PDT; in Taipeh war es bereits der 23. September, 04:58 Uhr. Dieser Artikel verwendet das Taipeher Datum des 23. September und einen Rechercheschluss um 12:43 Uhr. Er behandelt eine neue Modellveröffentlichung. Die Uhrzeit des Berichts wird nicht mit dem Moment der Freischaltung gleichgesetzt; OpenAI nennt keinen genauen Veröffentlichungszeitpunkt. Unabhängiger Bericht

Die Standardpreise je Million Eingabe- und Ausgabetokens betragen bei Sol 2 und 10 US-Dollar, bei Luna 0,10 und 0,50 US-Dollar. Vergleichsbasis sind die Aktionspreise der gleichnamigen GPT-5.6-Modelle. Beide Sol-Preise halbieren sich; Lunas Ausgabepreis sinkt stärker, von 1,20 auf 0,50 US-Dollar. Preistabelle

Zahlende Nutzer von Plus, Pro, Business, Enterprise und Edu können beide Modelle in ChatGPT Work und Codex verwenden. Free- und Go-Nutzer erhalten Luna in der Desktop-Anwendung. Der gewöhnliche Chat-Modus wird noch nicht unterstützt; die Einführung in ChatGPT erfolgt schrittweise. Die API-Kennungen lauten gpt-6-sol und gpt-6-luna. Eine Produktankündigung bedeutet somit keine gleichzeitige Verfügbarkeit über sämtliche Oberflächen. Zugang

Cache-Lesezugriffe sparen Geld, Schreibzugriffe kosten zusätzlich

Lange Aufgaben enthalten wiederholt dieselben Hintergrundinformationen. Der GPT-6-Cache hält geeignete, übereinstimmende Prompt-Präfixe mindestens 30 Minuten nach dem letzten Schreiben oder Wiederverwenden vor. Lesezugriffe kosten 90% weniger als Standardeingaben; Cache-Schreibzugriffe werden mit dem 1,25-Fachen des Standardeingabepreises berechnet. Der Rabatt gilt nur für wiederverwendete Eingaben, nicht für Ausgaben oder die gesamte Aufgabe. Abrechnungsdokumentation

GitHub erklärt in OpenAIs Ankündigung, dass über Milliarden Anfragen der vergangenen Monate der Anteil erneut zu verarbeitender Prompt-Tokens um mehr als 50% sank. Das liefert eine Größenordnung für die tatsächliche Nutzung, bleibt aber eine Aussage des Partners. Der Messzeitraum liegt zudem vor dieser Veröffentlichung und darf nicht als bereits erzieltes Ergebnis der neuen Sol- und Luna-Modelle dargestellt werden. Nutzungsbeispiel

Mich interessiert besonders, was sich bei wiederholten Überarbeitungen verändert. OpenAI ermöglicht es, den Denkaufwand über einen dafür vorgesehenen Mechanismus anzupassen und den Cache zu erhalten. Funktionsbeschreibung Ein Produkt könnte ein Dokument zunächst mit geringerem Aufwand ordnen und anschließend unklare Passagen intensiver bearbeiten. So ließe sich Budget auf ungelöste Fragen konzentrieren, sofern die Hintergrundinformationen weiterhin gültig sind.

Angenommen, ein Team überarbeitet mit einem Agenten einen Vorschlag. Gleichbleibende Anforderungen und Referenzen können wiederverwendet werden, während neue Rückmeldungen hinzukommen. Wird nach jeder kleinen Änderung die gesamte Eingabe neu angeordnet, kann ein sonst nutzbarer Cache verloren gehen. Ich würde Dokumentversionen und Änderungsverläufe im Produkt erhalten, um unnötiges erneutes Übermitteln zu reduzieren. Das ist eine aus dem Cache-Mechanismus abgeleitete Gestaltungsentscheidung, kein gemessener Kundennutzen.

Aktualisierungen dürfen allerdings nicht verschoben werden, nur um einen Cache-Treffer zu erhalten. Hat sich ein Angebotspreis geändert, kann der alte Preis den Vorschlag unbrauchbarer machen, obwohl die Inferenzrechnung sinkt. Dann sollte der Inhalt aktualisiert und die notwendige erneute Verarbeitung bezahlt werden. Ein Cache kann weiterhin gültigen Hintergrund bewahren; er kann nicht entscheiden, ob Informationen veraltet sind.

Günstigere Eingaben würde ich deshalb nicht unmittelbar in mehr automatische Durchläufe übersetzen. Aussagekräftiger sind die Kosten je angenommenem Arbeitsergebnis bei unveränderten Anforderungen, einschließlich Cache-Schreibzugriffen, Ausgaben und erfolglosen Wiederholungen. Sinkt die Rechnung, während häufiger veraltete Informationen verwendet werden, muss zuerst die Inhaltsaktualisierung verbessert werden. Die Ersparnis bleibt daran gebunden, dass das Ergebnis verwendbar ist.

Das Titelbild übernimmt die GPT-6-Markengrafik der Website und zeigt keinen Produktscreenshot von Sol oder Luna. Der neue Bilddownload scheiterte an der Namensauflösung.

Quellen:

Abonnieren Sie die neuesten Erkenntnisse

Abonnieren Sie den Newsletter, um meine neuesten Artikel über AI Agents in Finanzinstituten, GenAI und Architektur zu erhalten.

Kein Spam. Jederzeit kündbar.