22 września 2026 OpenAI udostępniło dwa nowe modele: GPT-6 Sol i GPT-6 Luna. Oba są o połowę tańsze od poprzedników z serii GPT-5.6. Półtorej godziny wcześniej Anthropic pokazał Claude Opus 5.5, więc od razu sprawdziłem, jak te premiery wypadają obok siebie. OpenAI takiego porównania nie pokazuje, choć liczby już są.

Grafika premierowa OpenAI: napis GPT-6 Sol and Luna na tle Słońca i Księżyca
Grafika z ogłoszenia „Introducing GPT-6 Sol and Luna” (OpenAI, openai.com).

GPT-6 Sol i GPT-6 Luna: czym się różnią

Sol to tańsza wersja najmocniejszego GPT-6 Astra, o którym pisałem na początku miesiąca. Ma samodzielnie wykonywać zadania w wielu krokach, przede wszystkim programistyczne. Luna to najszybszy i najtańszy model OpenAI: do streszczeń, wyciągania danych z dokumentów i krótkich odpowiedzi. Oba przyjmują tekst i obrazy, a w jednej rozmowie mieszczą około 1,05 miliona tokenów, czyli kilka grubych książek. Wersji Terra tym razem nie ma, choć w lipcu GPT-5.6 wyszedł w trzech wariantach.

Gdzie znajdziesz GPT-6 Sol w ChatGPT

Na płatnych planach oba modele działają tylko w trybie ChatGPT Work i w Codexie, programie do pracy z kodem. W zwykłym czacie nadal pracuje GPT-5.6. Konta darmowe i Go dostają samą Lunę, i to wyłącznie w aplikacji na komputer. Programiści mają oba modele w API od pierwszego dnia.

Ceny w API za milion tokenów: Sol kosztuje 2 dolary za tekst wejściowy i 10 za odpowiedź (wcześniej 4 i 20), Luna 0,10 i 0,50 dolara. Simon Willison, programista znany z testowania modeli, skomentował krótko: Luna za połowę ceny poprzedniczki to „naprawdę duża sprawa”.

GPT-6 Sol kontra Claude Opus 5.5

OpenAI zestawia Sola ze starszym Claude Opus 5 i z Fable 5.1. Anthropic w materiałach premierowych porównuje Opusa 5.5 z GPT-6 Astra. Zebrałem wyniki z obu źródeł w jednej tabeli.

Test GPT-6 Sol Claude Opus 5.5 GPT-6 Astra
AutomationBench (procesy biznesowe)33,2%40,0%41,4%
FrontierCode (programowanie)49,3%54,4%53,3%
DeepSWE (naprawa kodu)68,8%74,2%b.d.
Indeks Artificial Analysis (punkty)485853
Cena odpowiedzi w API (USD za mln tokenów)102050

Źródła: ogłoszenie OpenAI (Sol), strona premiery i karta systemowa Claude Opus 5.5 (Opus 5.5, Astra), Artificial Analysis (indeks). Każda firma testowała u siebie, więc traktuj różnice jako orientacyjne.

Wniosek jest prosty: Opus 5.5 jest mocniejszy, Sol dwa razy tańszy. Serwis The Decoder zarzuca OpenAI dobór testów pod siebie. W teście DeepSWE starszy Opus 5 ma 73,7 procent, więcej niż Sol, a ta liczba jest na wykresie OpenAI, tylko nie w tekście ogłoszenia. W niezależnym rankingu Artificial Analysis Sol ma 48 punktów, o jeden więcej niż GPT-5.6 Sol, ale za jedno zadanie płacisz prawie o połowę mniej. Luna ma tyle samo punktów co poprzedniczka, ale też jest tańsza.

GPT-6 Sol: mniej błędów, jedna słaba strona

Najciekawszy wykres znalazłem w aneksie karty systemowej, czyli dokumentu OpenAI o bezpieczeństwie modelu. Według wewnętrznego testu OpenAI Sol popełnia błąd faktograficzny w 4,6 procent odpowiedzi, poprzednik w 8,5. Artificial Analysis dodaje zastrzeżenie: w ich teście Sol odmawia odpowiedzi na 17 procent pytań, a trafność samych odpowiedzi spadła z 59 do 54 procent. Mniej zmyśla, bo częściej milczy.

Wykres OpenAI: odsetek odpowiedzi z błędem faktograficznym dla GPT-6 Sol, GPT-6 Luna, GPT-6 Astra i modeli GPT-5.6
Odsetek odpowiedzi z błędem (oś pionowa) względem symulowanego czasu odpowiedzi w sekundach. Niżej znaczy lepiej: GPT-6 Sol (fioletowe kwadraty) jest blisko Astry. Źródło: OpenAI, karta systemowa, aneks Sol i Luna.

Rzadziej też wprowadza w błąd przy programowaniu: w teście OpenAI z 10,4 do 1,3 procent zadań. Jedna liczba prawie się nie ruszyła. Kiedy system odpowiada „brak dostępu”, Sol próbuje to obejść w 64,4 procent przypadków (poprzednik w 68,2). Jeśli dajesz mu dostęp do plików albo serwera, przyznaj tylko te uprawnienia, których naprawdę potrzebuje.

Sola jeszcze nie testowałem. Sprawdzę go w Codexie, w którym nagrałem kurs Agent AI: Twoja pierwsza strona www. Odpowiedzi kilku modeli na to samo polecenie porównasz w porównywarce AI, a o drugiej wtorkowej premierze piszę we wpisie Claude Opus 5.5: co nowego.

Najczęstsze pytania

Czy GPT-6 Sol jest dostępny w zwykłym ChatGPT?

Jeszcze nie. Na płatnych planach (Plus, Pro, Business, Enterprise, Edu) GPT-6 Sol i Luna działają tylko w trybie ChatGPT Work i w Codexie. Zwykły czat nadal korzysta z GPT-5.6.

Czy GPT-6 Luna jest za darmo?

Tak, ale z ograniczeniem. Użytkownicy darmowego planu i planu Go dostają GPT-6 Lunę tylko w aplikacji ChatGPT na komputer. W API Luna kosztuje 0,10 dolara za milion tokenów wejściowych i 0,50 dolara za milion tokenów odpowiedzi.

Co jest lepsze: GPT-6 Sol czy Claude Opus 5.5?

Według dostępnych wyników Claude Opus 5.5 jest mocniejszy w programowaniu i automatyzacji procesów (na przykład 54,4 wobec 49,3 procent w FrontierCode), a GPT-6 Sol jest o połowę tańszy w API. Przy dużej liczbie prostszych zadań opłaca się Sol, przy najtrudniejszych Opus 5.5.