Cursor AI czyta Twojego Gmaila. I potrafi odpisaćCzytaj →
News

GPT-5.6 Luna tańsza o 80%. OpenAI tnie ceny API

Od 30 lipca Luna kosztuje 0,20 USD za milion tokenów wejściowych zamiast 1 USD, a Terra staniała o 20%. Sprawdzamy, kogo to dotyczy i czego nie obejmuje.

Wykres z dwiema liniami: ciemna, oznaczająca cenę flagowego modelu, rośnie, a limonkowa, oznaczająca model tani, na końcu ostro spada

OpenAI obniżyło ceny dwóch tańszych modeli z rodziny GPT-5.6. Od 30 lipca 2026 Luna kosztuje o 80 procent mniej, a Terra o 20 procent mniej. W liczbach: Luna staniała z 1 USD do 0,20 USD za milion tokenów wejściowych i z 6 USD do 1,20 USD za milion wyjściowych. Terra z 2,50 USD do 2 USD oraz z 15 USD do 12 USD.

Zanim policzysz oszczędności, jedno zastrzeżenie: to jest cennik API, czyli tego, co płacisz, gdy Twoja aplikacja wysyła zapytanie do modelu. Abonamenty ChatGPT nie potaniały ani o grosz.

Nowy cennik GPT-5.6

Stawki za milion tokenów, taryfa standardowa:

Model Wejście przed Wejście po Wyjście przed Wyjście po
Luna 1,00 USD 0,20 USD 6,00 USD 1,20 USD
Terra 2,50 USD 2,00 USD 15,00 USD 12,00 USD
Sol 5,00 USD 5,00 USD 30,00 USD 30,00 USD

Sol, czyli flagowiec rodziny, ceny nie zmienił. Dostał za to płatny tryb przyspieszony. W dzienniku zmian OpenAI stoi, że nowy tryb Fast działa „up to 2.5× faster speeds than standard processing at twice the price“, czyli do 2,5 raza szybciej za podwójną stawkę.

Obniżka objęła też tańsze taryfy dla zadań, które nie muszą wykonać się natychmiast. Tryby Batch i Flex, w których model odpowiada z opóźnieniem, kosztują połowę stawki standardowej. Do tego jest pamięć podręczna: jeśli w kolejnych zapytaniach powtarza się ten sam fragment tekstu, na przykład stała instrukcja dla modelu, jego ponowne odczytanie jest tańsze o 90 procent. Luna korzystająca z obu tych rzeczy schodzi do groszowych kwot. Jeśli chcesz przeliczyć to na własnym ruchu, mamy do tego kalkulator kosztów API.

Rodzinę Sol, Terra i Luna opisywaliśmy przy premierze podglądu i przy otwarciu dostępu dla wszystkich.

Liczba, którą powtarzają wszyscy i prawie wszyscy przekręcają

Razem z obniżką OpenAI opublikowało 31 lipca wpis strategiczny dyrektorki finansowej Sarah Friar. Krąży z niego jedna liczba: że zadania wykonywane przez agentów w Codeksie odpowiadają dziś za 99,8 procent tygodniowych tokenów wyjściowych. Brzmi jak informacja o tym, że cały świat przesiadł się na agentów.

Nie o to chodzi. Liczba pochodzi z badania ekonomicznego OpenAI o przechodzeniu na agentów i dotyczy pracowników samego OpenAI, a nie klientów. Mierzy przy tym jedną konkretną rzecz: jaka część tekstu generowanego przez tych ludzi w Codeksie i ChatGPT przypada na Codeksa. Praca podaje obok dwie liczby, które w relacjach giną:

  • 63,3 procent u klientów firmowych,
  • 16,5 procent u użytkowników indywidualnych.

Autorzy dopisują zastrzeżenie wprost: „OpenAI usage is therefore not representative of the typical organization today“, czyli sposób pracy OpenAI nie jest reprezentatywny dla typowej organizacji. To uczciwe postawienie sprawy, bo firma budująca narzędzie pracuje nim inaczej niż jej klient. Jeśli więc trafisz na nagłówek sugerujący, że wszyscy już oddali kodowanie agentom, pamiętaj, że to opis wnętrza jednej firmy z San Francisco.

Najtańsze modele tanieją, najlepsze drożeją

Obniżka wpisuje się w narrację, którą OpenAI powtarza od miesięcy: skoro inteligencja tanieje, opłaca się jej używać do coraz większej liczby zadań. Friar opisuje to jako pętlę: lepsze modele napędzają szersze zastosowanie, szersze zastosowanie przyciąga inwestycje, a te poprawiają modele i ich wydajność.

Cennik pokazuje jednak, że dotyczy to tylko dolnej półki. Prześledźmy cenę wejścia najmocniejszego modelu OpenAI w ciągu roku:

  • sierpień 2025, GPT-5: 1,25 USD
  • grudzień 2025, GPT-5.2: 1,75 USD
  • marzec 2026, GPT-5.4: 2,50 USD
  • kwiecień 2026, GPT-5.5: 5,00 USD
  • lipiec 2026, GPT-5.6 Sol: 5,00 USD

To czterokrotny wzrost w niecały rok. W tym samym czasie Luna zeszła do 0,20 USD, czyli jest dziś ponad sześć razy tańsza na wejściu niż flagowiec sprzed roku i tańsza niż ówczesne modele oszczędnościowe. Wniosek jest więc dwustronny: tanie modele tanieją bardzo szybko, a za najlepszy model płaci się coraz więcej. To, który z tych trendów Cię dotyczy, zależy wyłącznie od tego, czego używasz.

Pułapka, o której cennik mówi drobnym drukiem

Jest jeszcze próg, który potrafi zepsuć rachunek. Powyżej 272 tysięcy tokenów w jednym zapytaniu stawki się podwajają. To mniej więcej tyle, ile ma gruba powieść, więc próg jest realny do przekroczenia. Luna kosztuje wtedy 0,40 USD za wejście i 1,80 USD za wyjście, Terra 4 i 18 USD, a Sol 10 i 45 USD.

Dotyczy to zwłaszcza osób, które budują aplikację bez zespołu programistów, bo najprostszy sposób na poprawę odpowiedzi to podać modelowi więcej materiału: cały plik, całą historię rozmowy, całą dokumentację. Przekroczenie progu nie wyświetli ostrzeżenia, po prostu podwoi koszt każdego zapytania. Jeśli pilnujesz budżetu, przydają się twarde limity wydatków, które OpenAI dodało w lipcu.

Co z tego masz

Jeśli Twoja aplikacja wysyła zapytania do modelu przez API, rachunek za prostsze zadania właśnie spadł pięciokrotnie i warto sprawdzić, czy to, co robisz na Terze, nie wyjdzie równie dobrze na Lunie. Jeśli klikasz w ChatGPT albo korzystasz z Codeksa w ramach abonamentu, nie zmieniło się nic.

I jedna rzecz warta zapamiętania na przyszłość: obniżki wśród najtańszych modeli są dziś regułą, więc przywiązywanie się do jednego modelu ma krótki termin ważności. Warto budować tak, żeby zmiana modelu na tańszy była kwestią jednej linijki w ustawieniach, a nie przepisywania aplikacji.

Newsletter

Opanuj AI‑coding w 5 minut. W każdy poniedziałek.

Konkretne premiery, analizy cen i jeden trik, który przyspieszy Twoją pracę. Po polsku, bez żargonu, prosto na maila.

Zero spamu · wypisujesz się jednym kliknięciem.