Nowości

OpenAI obniża ceny GPT-5.6 Luna o 80 procent, odpowiadając na presję z Chin

RynekPatryk Raba
OpenAI obniża ceny GPT-5.6 Luna o 80 procent, odpowiadając na presję z Chin
Fot. Steve Jennings / TechCrunch, Wikimedia Commons (CC BY 2.0)

OpenAI obniżyło ceny swojego najtańszego modelu GPT-5.6 Luna o 80 procent i średniego modelu Terra o 20 procent, reagując na konkurencję chińskich laboratoriów AI i rosnące skargi firm na rachunki za sztuczną inteligencję.

Spis treści
  1. Trzy tygodnie po premierze
  2. Presja z Chin
  3. Rachunki firm rosną szybciej niż budżety
  4. Co to oznacza dla rynku

OpenAI ogłosiło drastyczną obniżkę cen dostępu do dwóch ze swoich modeli językowych z rodziny GPT-5.6. Decyzja zapadła zaledwie trzy tygodnie po premierze tej generacji modeli i wpisuje się w narastającą wojnę cenową na rynku sztucznej inteligencji, napędzaną konkurencją z Chin oraz rosnącym niezadowoleniem firm z kosztów wdrożeń AI.

Od 30 lipca 2026 roku najtańszy i najszybszy model rodziny, GPT-5.6 Luna, kosztuje 0,20 dolara za milion tokenów wejściowych i 1,20 dolara za milion tokenów wyjściowych. To spadek o 80 procent względem wcześniejszej stawki 1 i 6 dolarów. Model średniej klasy, GPT-5.6 Terra, przeznaczony do codziennych zadań biznesowych, potaniał o 20 procent, z 2,50 i 15 dolarów do 2 i 12 dolarów za milion tokenów.

Trzy tygodnie po premierze

GPT-5.6 trafił do ogólnej dostępności 9 lipca 2026 roku, więc korekta cen nastąpiła zaledwie trzy tygodnie później. To wyjątkowo krótki odstęp jak na politykę cenową dużego dostawcy modeli i sygnał, jak szybko zmienia się otoczenie konkurencyjne w branży. OpenAI nie zmieniło cen najmocniejszego modelu z rodziny, GPT-5.6 Sol, ale wprowadziło dla niego nowy tryb Fast: przetwarzanie do 2,5 raza szybsze niż standardowe, kosztujące jednak dwukrotnie więcej, czyli 10 dolarów za milion tokenów wejściowych i 60 dolarów za wyjściowe. Tryb Fast zastąpił dotychczasową opcję Priority Processing.

Firma tłumaczy obniżki poprawą wydajności infrastruktury wnioskowania i oprogramowania produkcyjnego. Zoptymalizowane jądra procesorów graficznych pozwoliły zmniejszyć koszty obsługi zapytań o 20 procent, a usprawnienia w generowaniu tokenów podniosły wydajność o ponad 15 procent.

Presja z Chin

Za decyzją stoi przede wszystkim rosnąca konkurencja ze strony chińskich laboratoriów, które oferują modele o zbliżonej jakości za ułamek ceny amerykańskich rywali. Modele takie jak Kimi K3 od Moonshot AI, liczący 2,8 biliona parametrów, czy rodzina GLM od Z.ai zamykają lukę jakościową, jednocześnie kosztując według niektórych szacunków nawet trzydziestokrotnie mniej niż wiodące modele amerykańskie. Presję cenową wywierają też Google, które od miesięcy promuje tańsze warianty Gemini, w tym najnowszy Gemini 3.6 Flash, oraz Microsoft.

Nowa cena Luna przesuwa model z segmentu środkowego rynku do niższej półki cenowej, w której konkurują dziś mniejsze modele Google, Xiaomi, DeepSeek i MiniMax.

Rachunki firm rosną szybciej niż budżety

Drugim motorem zmian jest rosnące niezadowolenie klientów biznesowych z kosztów wdrożeń AI. Firma Uber przyznała, że po wdrożeniu Claude Code dla pięciu tysięcy inżynierów wyczerpała cały budżet na sztuczną inteligencję zaplanowany na 2026 rok w zaledwie cztery miesiące.

Na początku roku to był temat, który w ogóle się nie pojawiał, ludzie byli całkowicie zadowoleni z tego, ile wydają. Nagle stał się to ogromny problem - Sam Altman, dyrektor generalny OpenAI

Sam Altman przyznał to wprost podczas czerwcowego wydarzenia OpenAI Intelligence at Work, opisując gwałtowną zmianę nastrojów wśród klientów korporacyjnych wobec rosnących rachunków za tokeny.

Co to oznacza dla rynku

Obniżki cen tokenów mogą zwiększyć wolumen zapytań, ale jednocześnie nadwyrężają marże dostawców modeli w momencie, gdy zarówno OpenAI, jak i Anthropic przygotowują się do debiutów giełdowych. Obie firmy złożyły w czerwcu 2026 roku poufne dokumenty rejestracyjne IPO. Analitycy ostrzegają, że wojna cenowa toczona na oczach przyszłych inwestorów może postawić pod znakiem zapytania rentowność modelu biznesowego opartego na sprzedaży dostępu do tokenów.

Dla polskich firm i deweloperów korzystających z API OpenAI obniżka oznacza wymierną redukcję rachunków, zwłaszcza tam, gdzie Luna jest używana do prostszych zadań: klasyfikacji tekstu, streszczeń czy pierwszej linii obsługi zapytań w agentach AI. Wyższy koszt trybu Fast dla modelu Sol może z kolei skłonić część zespołów do przemyślenia, czy warto płacić za przyspieszenie, skoro tańsze modele konkurencji domykają lukę jakościową.

Wojna cenowa na rynku modeli językowych przybiera na sile z tygodnia na tydzień, a cena za token staje się dla dostawców równie ważnym polem rywalizacji jak sama jakość odpowiedzi. Kolejne posunięcia konkurentów OpenAI, w tym Google i Anthropic, prawdopodobnie nie każą sobie długo czekać.

Udostępnij: