GPT-5.6 Luna: 80% Preissenkung stellt Budget-KI vor Gemini Flash

Auf den Punkt
OpenAI hat GPT-5.6 Luna am 30. Juli 2026 um 80% auf $0.20 pro Million Input-Tokens gesenkt. Damit unterbietet Luna Gemini Flash-Lite und liegt im Artificial Analysis Intelligence Index mit 51.2 Punkten vor Gemini 3.6 Flash – ein Signal, dass leistungsstarke KI für Schweizer KMU jetzt deutlich günstiger zugänglich ist.
Die 80-Prozent-Preissenkung im Detail
Am 30. Juli 2026 – nur drei Wochen nach dem Launch von GPT-5.6 am 9. Juli – hat OpenAI die Preise für sein Einstiegsmodell Luna um 80% gesenkt: von $1.00 auf $0.20 pro Million Input-Tokens und von $6.00 auf $1.20 pro Million Output-Tokens. Auch das mittlere Modell Terra wird günstiger, wenn auch moderater, um 20% auf $2.00/$12.00 (zuvor $2.50/$15.00). Das Flaggschiff Sol bleibt bei $5.00/$30.00 unverändert.
80%
Preissenkung bei GPT-5.6 Luna – neu $0.20 / $1.20 pro Million Input-/Output-Tokens
Warum eine Preisoffensive das Spiel verändert
Die Preissenkung ist mehr als ein taktischer Rabatt. Sie verschiebt die Frage, die sich Einkaufs- und IT-Verantwortliche stellen, von «Welches Modell ist am leistungsfähigsten?» zu «Welches Modell liefert am meisten Intelligenz pro investiertem Franken?». Wer diese Rechnung heute noch nicht systematisch aufstellt, verschenkt Budget. Eine strukturierte Übersicht dazu findest du in unserem Beitrag Welches KI-Modell für welches Budget? Intelligence per Dollar 2026.
Luna im direkten Vergleich: Gemini, DeepSeek und die eigene Modellfamilie
- GPT-5.6 Luna: $0.20 / $1.20 pro Million Tokens, Intelligence Index 51.2
- Gemini 3.5 Flash-Lite: $0.25 / $1.50 pro Million Tokens – teurer als Luna
- Gemini 3.6 Flash: $1.50 / $7.50 pro Million Tokens, Intelligence Index 50.2 – leistungsschwächer als Luna, trotz deutlich höherem Preis
- DeepSeek V4 Flash: $0.14 / $0.28 pro Million Tokens – günstiger im Token-Preis, aber mit spürbaren Abstrichen bei der Leistung
- GPT-5.6 Terra: $2.00 / $12.00 pro Million Tokens, Intelligence Index 55
- GPT-5.6 Sol: $5.00 / $30.00 pro Million Tokens, Intelligence Index 58.9
- Fable 5 bleibt mit einem Index-Wert von 59.9 die insgesamt leistungsstärkste Referenz im Artificial Analysis Intelligence Index
Das Ergebnis laut Artificial Analysis Intelligence Index ist bemerkenswert: Luna liegt im Benchmark noch vor Gemini 3.6 Flash – zu einem Bruchteil des Preises. Nur DeepSeek V4 Flash unterbietet Luna beim reinen Token-Preis, fällt aber in der Intelligenzmessung zurück. Für Aufgaben, bei denen Zuverlässigkeit zählt, kann das teurere Luna am Ende günstiger sein als das billigere DeepSeek-Modell. Wie sich die gesamte Modellfamilie einordnet, erklären wir im Detail unter GPT-5.6 Sol, Terra, Luna: Was OpenAIs Modellfamilie für Schweizer Unternehmen bedeutet.
Was die Preissenkung für Schweizer KMU konkret bedeutet
Für Schweizer KMU sinkt damit die Einstiegshürde für produktive KI-Nutzung ein weiteres Mal spürbar. Total Cost of Ownership für Standardaufgaben – Textverarbeitung, Klassifikation, einfache Automatisierung – fällt auf ein Niveau, das noch vor wenigen Monaten undenkbar war. Wie sich dieser Preisverfall über die gesamte Branche auswirkt, zeigen wir in KI-Preisverfall 2026: Warum sinkende Modellkosten die Einstiegshürde für Schweizer KMU jetzt senken.
Preis pro Aufgabe statt Preis pro Token
Der Token-Preis allein sagt wenig über die tatsächlichen Kosten aus. Entscheidend ist, wie viele Tokens ein Modell für eine gegebene Aufgabe benötigt und wie oft ein Ergebnis nachbearbeitet werden muss. Ein günstigeres Modell mit mehr Fehlversuchen kann teurer sein als ein teureres Modell mit hoher Trefferquote.
Modell-agnostische Architektur wird strategisch
Wenn sich das Preis-Leistungs-Verhältnis zwischen Anbietern innerhalb weniger Wochen verschiebt, wird die Fähigkeit, Modelle je nach Aufgabe flexibel zu wechseln, zu einem eigenständigen Wettbewerbsvorteil. Unternehmen, die ihre KI-Architektur fest an einen einzigen Anbieter oder ein einzelnes Modell binden, laufen Gefahr, laufend zu viel zu bezahlen oder Leistungspotenzial liegen zu lassen.
Was das für die Wahl deines KI-Partners bedeutet
Als externe KI-Abteilung setzen wir genau hier an: Wir bauen Architekturen, die zwischen Modellen wie Luna, Terra, Sol, Gemini oder DeepSeek dynamisch wählen können – abgestimmt auf Aufgabe, Budget und Qualitätsanspruch. So profitierst du automatisch von jeder Preissenkung und jedem Leistungssprung, ohne deine gesamte Infrastruktur neu aufsetzen zu müssen.
Der Blick nach vorn
Der Preiskampf zwischen OpenAI, Google und chinesischen Anbietern wie DeepSeek dürfte sich fortsetzen. Für Entscheidungsträger heisst das: Wer heute in eine flexible, modell-agnostische KI-Strategie investiert, sichert sich morgen die besten Konditionen – unabhängig davon, welcher Anbieter gerade vorne liegt.
Häufige Fragen
- Wie viel günstiger ist GPT-5.6 Luna nach der Preissenkung?
- OpenAI hat den Preis für GPT-5.6 Luna am 30. Juli 2026 um 80% gesenkt: Input-Tokens kosten neu $0.20 statt $1.00 pro Million, Output-Tokens $1.20 statt $6.00 pro Million.
- Ist Luna jetzt günstiger als Gemini Flash?
- Luna unterbietet Gemini 3.5 Flash-Lite ($0.25/$1.50 pro Million Tokens) und erreicht laut Artificial Analysis Intelligence Index mit 51.2 Punkten ein höheres Ergebnis als Gemini 3.6 Flash (50.2 Punkte), das $1.50/$7.50 pro Million Tokens kostet.
- Ist DeepSeek V4 Flash nicht noch günstiger als Luna?
- Im reinen Token-Preis ja: DeepSeek V4 Flash kostet $0.14/$0.28 pro Million Tokens. Im Artificial Analysis Intelligence Index liegt es jedoch hinter Luna, was die tatsächlichen Kosten pro erledigter Aufgabe wieder relativieren kann.
- Was passiert mit den Preisen von Terra und Sol?
- Terra wird um 20% günstiger und kostet neu $2.00/$12.00 pro Million Tokens (zuvor $2.50/$15.00). Sol bleibt bei $5.00/$30.00 unverändert und erreicht mit 58.9 Punkten weiterhin den höchsten Index-Wert der eigenen Modellfamilie; insgesamt führt Fable 5 mit 59.9 Punkten.
- Was bedeutet die Preissenkung für die IT-Budgetplanung von Schweizer KMU?
- Die Gesamtbetriebskosten für Standardaufgaben sinken spürbar, was den Einstieg in produktive KI-Nutzung erleichtert. Entscheidend bleibt jedoch, Kosten pro erledigter Aufgabe statt nur pro Token zu betrachten und die Architektur modell-agnostisch zu gestalten.
Quellen
- OpenAI cuts prices for two of its AI models as cost worries mount (CNBC, 30 July 2026)
- GPT-5.6: Frontier intelligence that scales with your ambition (OpenAI, 9 July 2026)
- AI price wars: OpenAI cuts GPT-5.6 Luna prices by 80% (VentureBeat, 30 July 2026)
- OpenAI discounts GPT-5.6 Luna and Terra (Axios, 30 July 2026)
Möchten Sie dieses Thema für Ihr Unternehmen vertiefen?
Kapazität prüfen