9 lipca OpenAI udostępniło szerokiej publiczności rodzinę modeli GPT-5.6 – flagowego Sol, „zbalansowaną” Terrę i najtańszą Lunę. Tego samego dnia zadebiutował ChatGPT Work – agent, który z jednego polecenia ma tworzyć gotowe dokumenty, arkusze, prezentacje, a nawet strony internetowe. Dwa produkty, jedna premiera, jeden komunikat: OpenAI przestaje sprzedawać czatbota i zaczyna sprzedawać pracownika.
OpenAI ogłasza rodzinę modeli GPT-5.6: Sol, Terra i Luna.
— OpenAI (@OpenAI) x.com/OpenAI/status/2082878156483219672
Ciekawe w tej premierze nie jest jednak to, że Sol jest najmocniejszym modelem OpenAI. Ciekawe jest to, że wcale nie musi być najmocniejszy na rynku, żeby premiera miała sens.
Prawie tak dobry, dużo tańszy
Według własnych danych OpenAI Sol przy najwyższym trybie wnioskowania mieści się w granicy jednego punktu od Claude Fable 5 Anthropic w Artificial Analysis Intelligence Index – ogólnym teście obejmującym pracę agentową, kodowanie i wnioskowanie naukowe. Różnica: Sol robi to w czasie krótszym o 61 proc. i przy koszcie niższym o połowę. W teście Agents’ Last Exam, sprawdzającym długie, wieloetapowe zadania zawodowe w 55 dziedzinach, Sol w trybie średniego wnioskowania notuje wynik 52,7 proc. wobec 40,5 proc. dla Fable 5 – przewaga rzędu 12 punktów procentowych, przy oszczędności kosztowej rzędu czterokrotnej. W teście kodowania Artificial Analysis Coding Agent Index Sol ustanawia nowy wynik na poziomie 80 punktów, używając przy tym mniej niż połowy tokenów wyjściowych i mniej niż połowy czasu w porównaniu z Fable 5.
To wszystko liczby podane przez samo OpenAI, nie zweryfikowane niezależnie – warto o tym pamiętać, zanim ktoś potraktuje je jako obiektywny ranking. Firmy testujące modele od lat publikują wyniki dobrane tak, by pokazać swój produkt w najlepszym świetle, i GPT-5.6 nie jest tu wyjątkiem. Ciekawsze niż same liczby jest to, co OpenAI nie ukrywa: w opublikowanej przez firmę tabeli porównawczej inny model Anthropic, Claude Mythos 5 – zorientowany bardziej stricte na kodowanie – bije Sol na benchmarku SWE-Bench Pro wynikiem 80,3 proc. do 64,6 proc. OpenAI nie twierdzi więc, że Sol jest najlepszy we wszystkim. Twierdzi, że jest najlepszy w przeliczeniu na dolara i sekundę.
Nowy tryb: więcej agentów zamiast więcej myślenia
Obok standardowych trybów wnioskowania GPT-5.6 wprowadza ultra – ustawienie koordynujące domyślnie cztery instancje modelu pracujące równolegle nad tym samym zadaniem, z możliwością rozszerzenia do szesnastu. W testach takich jak BrowseComp czy SEC-Bench Pro dodanie równoległych agentów przesuwa wynik w górę, a czas realizacji w dół – dokładnie odwrotnie niż zwykle bywa przy zwiększaniu mocy obliczeniowej pojedynczego modelu.
To rozwiązanie ustawia GPT-5.6 w konkretnym miejscu wyścigu: nie tam, gdzie liczy się czysta inteligencja pojedynczego zapytania, tylko tam, gdzie liczy się przepustowość – ile złożonych zadań agent skończy w ciągu dnia pracy, i ile to będzie kosztować.
ChatGPT Work wchodzi na terytorium Microsoftu, Google’a i Anthropic
ChatGPT Work, zasilany przez GPT-5.6, ma czerpać kontekst z połączonych aplikacji i plików, planować kroki potrzebne do wykonania celu i realizować wieloetapowe projekty w czasie – z prośbą o zatwierdzenie przed działaniami wrażliwymi. Produkt trafia na komputery z Windows i macOS dla wszystkich planów cenowych, z wersją webową w kolejce.
To bezpośrednie starcie z Microsoft 365 Copilot i Google Workspace – ale też, jak zwracają uwagę komentatorzy rynkowi, z Claude Cowork Anthropic, który Anthropic wprowadził kilka miesięcy wcześniej jako narzędzie do samodzielnego planowania i wykonywania wieloetapowych zadań biznesowych. OpenAI nie ukrywa, komu chce zabrać klientów korporacyjnych: dostęp do Sol, Terry i Luny w ChatGPT Work różnicuje się według planu, od darmowego Go (tylko Terra) po Enterprise, gdzie użytkownicy mogą wybierać model i poziom wysiłku obliczeniowego dla każdego zadania osobno.
Ceny modeli w interfejsie API pokazują tę samą logikę segmentacji: Sol kosztuje 5 dolarów za milion tokenów wejściowych i 30 dolarów za milion wyjściowych, Terra – 2,5 i 15 dolarów, a Luna – 1 i 6 dolarów. To już nie jest jeden model dla wszystkich zastosowań, tylko drabina cenowa, po której klient sam decyduje, ile dokładności chce kupić.
Bezpieczeństwo rośnie razem z możliwościami
Wraz ze wzrostem możliwości modelu OpenAI wzmocniło też zabezpieczenia. Firma podaje, że system ochrony cybernetycznej GPT-5.6 Sol blokuje około dziesięciokrotnie więcej potencjalnie szkodliwej aktywności niż poprzednie modele. W testach ExploitBench, mierzących zdolność do przechodzenia od podatnego kodu do jego pełnego wykorzystania, Sol notuje wynik 73,5 proc. wobec 47,9 proc. dla GPT-5.5. Dostęp do pełni możliwości ofensywnych i defensywnych w obszarze cyberbezpieczeństwa OpenAI zastrzega dla zweryfikowanych użytkowników programu Trusted Access for Cyber – a od 1 września warunkiem zachowania dostępu do najmocniejszych modeli ma być włączenie sprzętowych kluczy dostępu (passkeys).
Dla użytkownika nic, dla budżetu API sporo
Dla przeciętnego użytkownika ChatGPT różnica może być na razie niewidoczna – Sol trafia do planów Plus, Pro, Business i Enterprise, a darmowi i tańsi użytkownicy dostają Terrę lub Lunę. Dla firm i deweloperów budujących własne narzędzia na bazie API konsekwencje są bardziej namacalne: ten sam budżet pozwala teraz uruchomić więcej zapytań albo bardziej złożone, wieloagentowe przepływy pracy niż jeszcze kwartał temu. To właśnie ten kierunek – tańsza inteligencja porównywalnej jakości, nie inteligencja rekordowa za każdą cenę – wydaje się dziś realnym polem rywalizacji między OpenAI a Anthropic, przynajmniej dopóki żadna ze stron nie ogłosi kolejnego, wyraźnego skoku możliwości.








