22 września 2026 OpenAI udostępniło dwa nowe modele: GPT-6 Sol i GPT-6 Luna. Oba są o połowę tańsze od poprzedników z serii GPT-5.6. Półtorej godziny wcześniej Anthropic pokazał Claude Opus 5.5, więc od razu sprawdziłem, jak te premiery wypadają obok siebie. OpenAI takiego porównania nie pokazuje, choć liczby już są.
GPT-6 Sol i GPT-6 Luna: czym się różnią
Sol to tańsza wersja najmocniejszego GPT-6 Astra, o którym pisałem na początku miesiąca. Ma samodzielnie wykonywać zadania w wielu krokach, przede wszystkim programistyczne. Luna to najszybszy i najtańszy model OpenAI: do streszczeń, wyciągania danych z dokumentów i krótkich odpowiedzi. Oba przyjmują tekst i obrazy, a w jednej rozmowie mieszczą około 1,05 miliona tokenów, czyli kilka grubych książek. Wersji Terra tym razem nie ma, choć w lipcu GPT-5.6 wyszedł w trzech wariantach.
Gdzie znajdziesz GPT-6 Sol w ChatGPT
Na płatnych planach oba modele działają tylko w trybie ChatGPT Work i w Codexie, programie do pracy z kodem. W zwykłym czacie nadal pracuje GPT-5.6. Konta darmowe i Go dostają samą Lunę, i to wyłącznie w aplikacji na komputer. Programiści mają oba modele w API od pierwszego dnia.
Ceny w API za milion tokenów: Sol kosztuje 2 dolary za tekst wejściowy i 10 za odpowiedź (wcześniej 4 i 20), Luna 0,10 i 0,50 dolara. Simon Willison, programista znany z testowania modeli, skomentował krótko: Luna za połowę ceny poprzedniczki to „naprawdę duża sprawa”.
GPT-6 Sol kontra Claude Opus 5.5
OpenAI zestawia Sola ze starszym Claude Opus 5 i z Fable 5.1. Anthropic w materiałach premierowych porównuje Opusa 5.5 z GPT-6 Astra. Zebrałem wyniki z obu źródeł w jednej tabeli.
Źródła: ogłoszenie OpenAI (Sol), strona premiery i karta systemowa Claude Opus 5.5 (Opus 5.5, Astra), Artificial Analysis (indeks). Każda firma testowała u siebie, więc traktuj różnice jako orientacyjne.
Wniosek jest prosty: Opus 5.5 jest mocniejszy, Sol dwa razy tańszy. Serwis The Decoder zarzuca OpenAI dobór testów pod siebie. W teście DeepSWE starszy Opus 5 ma 73,7 procent, więcej niż Sol, a ta liczba jest na wykresie OpenAI, tylko nie w tekście ogłoszenia. W niezależnym rankingu Artificial Analysis Sol ma 48 punktów, o jeden więcej niż GPT-5.6 Sol, ale za jedno zadanie płacisz prawie o połowę mniej. Luna ma tyle samo punktów co poprzedniczka, ale też jest tańsza.
GPT-6 Sol: mniej błędów, jedna słaba strona
Najciekawszy wykres znalazłem w aneksie karty systemowej, czyli dokumentu OpenAI o bezpieczeństwie modelu. Według wewnętrznego testu OpenAI Sol popełnia błąd faktograficzny w 4,6 procent odpowiedzi, poprzednik w 8,5. Artificial Analysis dodaje zastrzeżenie: w ich teście Sol odmawia odpowiedzi na 17 procent pytań, a trafność samych odpowiedzi spadła z 59 do 54 procent. Mniej zmyśla, bo częściej milczy.
Rzadziej też wprowadza w błąd przy programowaniu: w teście OpenAI z 10,4 do 1,3 procent zadań. Jedna liczba prawie się nie ruszyła. Kiedy system odpowiada „brak dostępu”, Sol próbuje to obejść w 64,4 procent przypadków (poprzednik w 68,2). Jeśli dajesz mu dostęp do plików albo serwera, przyznaj tylko te uprawnienia, których naprawdę potrzebuje.
Sola jeszcze nie testowałem. Sprawdzę go w Codexie, w którym nagrałem kurs Agent AI: Twoja pierwsza strona www. Odpowiedzi kilku modeli na to samo polecenie porównasz w porównywarce AI, a o drugiej wtorkowej premierze piszę we wpisie Claude Opus 5.5: co nowego.
Najczęstsze pytania
Czy GPT-6 Sol jest dostępny w zwykłym ChatGPT?
Jeszcze nie. Na płatnych planach (Plus, Pro, Business, Enterprise, Edu) GPT-6 Sol i Luna działają tylko w trybie ChatGPT Work i w Codexie. Zwykły czat nadal korzysta z GPT-5.6.
Czy GPT-6 Luna jest za darmo?
Tak, ale z ograniczeniem. Użytkownicy darmowego planu i planu Go dostają GPT-6 Lunę tylko w aplikacji ChatGPT na komputer. W API Luna kosztuje 0,10 dolara za milion tokenów wejściowych i 0,50 dolara za milion tokenów odpowiedzi.
Co jest lepsze: GPT-6 Sol czy Claude Opus 5.5?
Według dostępnych wyników Claude Opus 5.5 jest mocniejszy w programowaniu i automatyzacji procesów (na przykład 54,4 wobec 49,3 procent w FrontierCode), a GPT-6 Sol jest o połowę tańszy w API. Przy dużej liczbie prostszych zadań opłaca się Sol, przy najtrudniejszych Opus 5.5.