OpenAI znacząco obniża ceny modeli z nowej rodziny GPT-5.6 - wariant Luna tanieje o 80 proc., a Terra - o 20 proc. Firma odpowiada w ten sposób na rosnącą presję ze strony chińskich rywali oferujących tanie rozwiązania AI. Przełom cenowy umożliwiły wewnętrzne optymalizacje sprzętowe oraz ulepszone dekodowanie spekulatywne, w których projektowaniu pomagał flagowy model Sol. Ponadto w API zadebiutował nowy tryb Fast dla tej najpotężniejszej wersji. Zmiany pozwalają firmą na bardziej elastyczne i ekonomiczne zarządzanie złożonymi procesami AI.
Obniżka cen modeli GPT-5.6 Luna i Terra
OpenAI ogłosił znaczące obniżki cen dla dwóch modeli ze swojej niedawno wydanej rodziny GPT-5.6: GPT-5.6 Luna oraz GPT-5.6 Terra. Decyzja ta stanowi bezpośrednią odpowiedź na rosnącą konkurencję ze strony chińskich firm tworzących sztuczną inteligencję, takich jak Moonshot AI z modelem Kimi czy Z.ai z rodziną GLM, które oferują zaawansowane możliwości wnioskowania, kodowania i działań agentowych w znacznie niższych cenach, co władze USA tłumaczą podejrzeniami o tzw. destylacje amerykańskich modeli, czyli wykorzytywaniu ich odpowiedzi i wiedzy do trenowania i udoskonalania własnych, zazwyczaj mniejszych i tańszych systemów.
W praktyce proces ten polega na tym, że zamiast inwestować setki milionów dolarów w tworzenie wiedzy od zera (tzw. pre-training), chińskie firmy zadają amerykańskim modelom miliony skomplikowanych pytań i próśb o rozwiązanie zadań. Następnie używają tak uzyskanych danych (tzw. danych syntetycznych) jako wzorca dla własnych sieci neuronowych. W efekcie ich modele osiągają zbliżone możliwości w zakresie wnioskowania czy kodowania przy ułamku kosztów i czasu potrzebnych na ich stworzenie.
Ze względu na ograniczenia rządowe USA seria GPT-5.6 została po raz pierwszy uruchomiona w czerwcu w ramach prywatnego dostępu dla wybranej grupy przedsiębiorstw. Dopiero na początku tego miesiąca OpenAI udostępnił te rozwiązania klientom na całym świecie. W skład serii wchodzą trzy warianty: flagowy GPT-5.6 Sol przeznaczony do złożonych zadań i pracy agentowej, zbalansowany GPT-5.6 Terra i najmniejszy, najbardziej ekonomiczny GPT-5.6 Luna.
W pierwotnym cenniku GPT-5.6 Sol wyceniono na 5 USD za mln tokenów wejściowych i 30 USD za mln tokenów wyjściowych. Model Terra kosztował 2,50 USD za 1 mln tokenów wejściowych i 15 USD za 1 mln wyjściowych, natomiast Luna - 1 USD za 1 mln wejściowych i 6 USD za 1 mln wyjściowych.
Sztuczna inteligencja OpenAI zoptymalizowała samą siebie
OpenAI zoptymalizował działanie swoich modeli na podstawie doświadczeń zebranych podczas obsługi globalnych użytkowników. Główną rolę w tych usprawnieniach odegrał sam model GPT-5.6 Sol, który w ramach procesu nadzorowanego przez ludzi autonomicznie przepisał i zoptymalizował jądra produkcyjne GPU, a także zaprojektował i przeprowadził setki eksperymentów. Przełożyło się to na obniżenie kosztów serwowania modeli o 20 proc. oraz wzrost wydajności generowania tokenów o ponad 15 proc. dzięki ulepszonemu spekulatywnemu dekodowaniu.
Wypracowane oszczędności zostały przeniesione na klientów, co jest chwalebną praktyką. Cena GPT-5.6 Luna spada o 80 proc. i wynosi obecnie 0,20 USD za mln tokenów wejściowych i 1,20 USD za mln tokenów wyjściowych. Model GPT-5.6 Terra stanie się tańszy o 20 proc., osiągając stawki 2 USD za mln tokenów wejściowych i 12 USD za mln tokenów wyjściowych.
Aktualizacja opłat weszła w życie 30 lipca i obejmuje API, AWS oraz rozliczenia w ramach płatnych subskrypcji w serwisach Codex i ChatGPT Work. Nowe zasady sprawiają również, że funkcja Auto-review w aplikacji ChatGPT oraz Codex CLI, przełączona z modelu GPT-5.4 na GPT-5.6 Luna, stanie się około 10-krotnie tańsza w eksploatacji.
Zmiany te oznaczają również, że wzrośnie wydajność działania GPT-5.6 w Microsoft 365 Copilot, który niemal od samego początku oferuje dostęp do najnowszej serii modeli.
GPT-5.6 Sol z nowym trybem Fast
Cena flagowego modelu GPT-5.6 Sol pozostaje bez zmian, jednak w interfejsie API udostępniono dla niego nowy tryb Fast, który zastępuje dotychczasową opcję Priority Processing (z zachowaniem wstecznej kompatybilności dla dawnych zapytań).
Nowy tryb pozwala na uzyskanie do 2,5-krotnie wyższej prędkości przetwarzania w porównaniu do standardowego trybu przy dwukrotnie wyższej cenie, zachowując przy tym pełny poziom inteligencji modelu.
Modele AI elastycznie dopasowują się do zadań
OpenAI podkreśla, że nowa struktura cenowa ma na celu ułatwienie firmom dopasowywania odpowiedniego poziomu inteligencji do konkretnego etapu pracy. Luna pozwala na realizację zadań wysokonakładowych na poziomie jakości porównywalnym z modelami flagowymi sprzed roku przy ułamku dotychczasowych kosztów. W benchmarku "Agents' Last Exam" Luna przewyższa model Claude Fable 5 przy koszcie jednostkowym niższym o niemal 99 proc.
W praktycznych zastosowaniach firmy mogą wykorzystywać najpotężniejszy model Sol do planowania i rozstrzygania złożonych kwestii, a zadania wykonawcze, testowanie czy analizę dokumentów delegować do tańszych modeli Luna i Terra. Firma kontynuuje prace nad rozbudową swojej infrastruktury, łącząc wzrost mocy obliczeniowych z optymalizacją ich wykorzystania.


