Codex czy Claude Code. Ceny, limity i możliwości we wrześniu 2026
Za 20 USD miesięcznie można pracować z Astrą w Codex albo z Opus 5.5 w Claude Code. Opus 5.5 ma przewagę w opublikowanych testach programowania, a Codex łączy pracę nad kodem z generowaniem obrazów i wygodną przeglądarką. Do tego dochodzi wartość wykorzystanego limitu: w przykładowych kalkulacjach aktywność odpowiada setkom, a dla największych planów tysiącom dolarów według cen API. Jak to policzyć i czy większa kwota oznacza lepszy zakup?
Porównanie dotyczy indywidualnych abonamentów i warunków sprawdzonych 27 września 2026. Obejmuje też zmianę istotną dla nowych klientów: OpenAI wstrzymało zakup Pro 20× za 200 USD. Dotychczasowi abonenci zachowują ten plan; nowy użytkownik nie powinien traktować go jako dostępnej opcji zakupu. OpenAI opisuje również wyjątek pozwalający części wcześniejszych klientów na jednorazowy powrót.
Ile kosztuje dostęp do obu narzędzi
Codex jest częścią abonamentu ChatGPT, a Claude Code — płatnych planów Claude. Poniżej miesięczne ceny katalogowe w USD przy zakupie przez stronę producenta. Dla osoby kupującej w Polsce wiążąca jest kwota w lokalnym formularzu płatności, z uwzględnieniem podatku i waluty rozliczenia; 20 USD w tabeli nie oznacza polskiej ceny brutto po prostym przeliczeniu kursu.
| Poziom | Codex w ChatGPT | Claude Code w Claude |
|---|---|---|
| Podstawowy | Plus: 20 USD/mies. | Pro: 20 USD/mies. |
| Większy limit | Pro 5×: 100 USD/mies. | Max 5×: 100 USD/mies. |
| Największy z porównywanych | Pro 20×: 200 USD/mies.; nowe zakupy i podwyższenia planu wstrzymane | Max 20×: 200 USD/mies. |
| Dostęp bez płatnego abonamentu | Ograniczony dostęp do GPT-6 Luna w aplikacji desktopowej, zależny od wdrożenia | Darmowy czat Claude nie zawiera Claude Code |
Źródła cen i zakresu: cennik Codex, warianty ChatGPT Pro, cennik Claude oraz zasady Claude Max.
Claude Pro można też opłacić rocznie: 200 USD z góry, czyli około 16,67 USD miesięcznie. To oszczędność wobec dwunastu płatności po 20 USD, ale wymaga opłacenia roku z góry. ChatGPT Plus i Pro nie oferują analogicznego rozliczenia rocznego.
Oznaczenia 5× i 20× odnoszą się do bazowego planu danego producenta. Anthropic określa nimi limit pięciogodzinnej sesji; Max ma również osobny limit tygodniowy. Nie mówią, że Claude Max 5× wykona tyle samo pracy co ChatGPT Pro 5×. Z samych mnożników można policzyć tylko relację wewnątrz oferty: pięciokrotna cena kupuje pięciokrotny deklarowany limit, a dziesięciokrotna — dwudziestokrotny. Wariant 20× daje więc dwa razy więcej deklarowanego limitu za dolara niż plan bazowy. To własne obliczenie na podstawie cenników, przydatne dopiero wtedy, gdy rzeczywiście wykorzystujesz większy pakiet.
Opus 5.5 zmienia porównanie modeli
Opus 5.5 jest dostępny już w Claude Pro, a także w Max. Nie trzeba dopłacać do Fable, żeby korzystać z modelu konkurującego z Astrą. Anthropic potwierdza dostępność Opus w płatnych planach.
W wynikach opublikowanych przez Anthropic Opus 5.5 wyprzedza Astrę w dwóch testach programowania:
| Test | Opus 5.5 | GPT-6 Astra |
|---|---|---|
| Terminal-Bench 4.0 | 66,4% | 57,9% |
| FrontierCode v1.1 Main | 54,4% | 53,3% |
To wyniki dla konfiguracji opisanych przez producentów. W Terminal-Bench zestawiono Opus na poziomie wysiłku xhigh z Astrą na high; wynik Astry pochodzi z pomiarów OpenAI. Anthropic podaje też, że przy domyślnym medium Opus osiąga we FrontierCode 54,6% przy około jednej piątej kosztu zadania Astry. To argument za sprawdzeniem Opus przy codziennym kodowaniu, a nie tylko za wybieraniem najwyższego poziomu rozumowania.
Niezależne pomiary Artificial Analysis również pokazują przewagę Opus: 58 do 53 punktów w Intelligence Index v4.3.2. Różnica w ich Terminal-Bench jest jednak znacznie mniejsza: około 60% do 59%. Nie należy łączyć tych wyników z tabelą Anthropic w jeden pomiar. Opus ma mocne argumenty jako model do kodowania, ale Astra pozostaje lepsza w części zadań — choćby w Terminal-Bench-Science z zestawienia Anthropic: 64,6% wobec 58,7%.
To zmienia ocenę abonamentu. Ograniczenia Fable nie rozstrzygają opłacalności Claude Pro, skoro w jego cenie można wybrać Opus 5.5.
Limity Astry i dodatkowe warunki Fable
W tabeli limitów Codex OpenAI podaje dla Astry szacunkowo 5–45 lokalnych wiadomości na pięć godzin w Plus, 25–225 w Pro 5× i 100–900 w Pro 20×. Rozpiętość wynika z rodzaju pracy: długi kontekst, rozumowanie i kolejne wywołania narzędzi zużywają więcej zasobów. To orientacyjne zakresy, nie gwarantowana liczba poleceń. Mogą obowiązywać także limity tygodniowe, a praca lokalna i chmurowa korzysta ze wspólnej puli.
Osobne zasady dotyczą Fable. W Pro Fable 5.1 od początku zużywa dodatkowo płatne kredyty. W Max jest objęty abonamentem, lecz modele Fable mogą wykorzystać najwyżej 50% tygodniowego limitu. Zużywają go szybciej niż pozostałe modele. Po wyczerpaniu tej części można dopłacać albo przejść na inny model. Te 50% pochodzi ze wspólnej puli; nie jest dodatkowym pakietem ponad cały limit Max ani ograniczeniem przypisanym do Opus.
Do lżejszych zadań pozostają m.in. GPT-6 Sol i Luna oraz Sonnet 5. Według dokumentacji OpenAI Sol służy do codziennej i złożonej pracy programistycznej, a Luna do węższych, powtarzalnych zadań.
Ile dolarów według cen API może odpowiadać abonamentowi
„Wartość w API” to koszt zarejestrowanych tokenów wejściowych, odczytów z pamięci podręcznej i tokenów wyjściowych według cennika danego modelu. Poniższe kwoty są scenariuszami ekstrapolowanymi z krótkich próbek, a nie zmierzonymi miesięcznymi limitami ani kredytami do wydania w API.
Po stronie Codex punktem wyjścia jest około 34 USD aktywności wycenionej według API, której towarzyszył wzrost tygodniowego wskaźnika Pro 20× o 3 punkty procentowe podczas około 43 minut pracy. Przy założeniu stałej relacji kosztu do wskaźnika i wykorzystania całego limitu co tydzień rachunek wygląda tak:
34 USD / 0,03 × 30 / 7 ≈ 4857 USD w 30 dni
Po zaokrągleniu daje to około 4900 USD. Podzielenie przez cztery dla Pro 5× i przez dwadzieścia dla Plus daje około 1200 i 240 USD. Tańszych planów nie zmierzono bezpośrednio — to przeskalowanie według deklarowanych mnożników.
Po stronie Claude próbka dotyczyła Sonneta w Pro: około 0,13 USD aktywności i wzrost pięciogodzinnego wskaźnika o 4 punkty procentowe. Oszacowanie pełnej sesji wynosiło około 3,35 USD. Przy jednej w pełni wykorzystanej sesji dziennie przez 30 dni otrzymujemy około 101 USD; mnożniki Max prowadzą do około 503 i 2013 USD. Kwoty wejściowe są zaokrąglone, więc nie pozwalają odtworzyć końcowych wyników co do dolara.
| Miesięczny abonament | Scenariusz Codex, próbka z Astrą | Scenariusz Claude, próbka z Sonnetem |
|---|---|---|
| 20 USD | Plus: około 240 USD w API | Pro: około 101 USD w API |
| 100 USD | Pro 5×: około 1200 USD w API | Max 5×: około 503 USD w API |
| 200 USD | Pro 20×: około 4900 USD w API; nowe zakupy wstrzymane | Max 20×: około 2013 USD w API |
Przy tych założeniach każdy dolar abonamentu odpowiada około 12 USD aktywności API w niższych planach Codex i 24,5 USD w Pro 20×. Dla Claude wychodzi około 5 USD w Pro i Max 5× oraz 10 USD w Max 20×. Wykorzystanie połowy przyjętego limitu obniża te wartości o połowę, choć cena abonamentu się nie zmienia.
Kolumny nie dowodzą, że Codex daje 2,4 razy więcej użytecznej pracy. Codex przeliczono z limitu tygodniowego, a Claude z założonej jednej sesji dziennie, bez potwierdzenia wystarczającego limitu tygodniowego. Liczniki procentowe są zaokrąglane i mogą aktualizować się z opóźnieniem. Co więcej, próbka Claude nie mierzyła Opus 5.5; wraz z jego premierą Anthropic zwiększyło limity pięciogodzinne płatnych planów. Do aktualnego porównania Astry z Opus potrzeba nowych próbek na tych samych zadaniach.
Tańszy model może dawać mniej „dolarów”, a więcej wykonanej pracy
Opus 5.5 kosztuje w standardowym API 4 USD za milion tokenów wejściowych i 20 USD za milion wyjściowych, a Astra odpowiednio 10 i 50 USD. Odczyt miliona tokenów z pamięci podręcznej to 0,20 USD w Opus i 1 USD w Astrze. Źródła: cennik Opus i cennik Astry. Dla Astry powyżej 272 tys. tokenów wejściowych obowiązują wyższe stawki; przykład poniżej dotyczy krótszych zapytań.
Gdyby wykonanie zadania wymagało w obu modelach 100 tys. nowych tokenów wejścia i 20 tys. tokenów wyjścia, koszt wyniósłby 0,80 USD dla Opus oraz 2 USD dla Astry. To własne obliczenie dla identycznych wolumenów, bez cache. Astra wykazałaby 2,5 razy większą „wartość w API”, nawet gdyby oba modele oddały dokładnie ten sam poprawny rezultat.
Rzeczywiste zużycie zależy też od ustawień i długości rozumowania. W porównaniu Artificial Analysis na poziomie max średni ważony koszt zadania z Intelligence Index wynosi 5,98 USD dla Opus i 3,26 USD dla Astry. To inny zestaw zadań i ustawienia niż przywołane wyżej testy kodowania Anthropic. Niższa cena tokena nie przesądza o koszcie zadania, tak jak wyższa wycena zużycia nie przesądza o wartości abonamentu.
Pamięć podręczna dodatkowo zmienia rachunek. W próbkach do kalkulacji miesięcznej około 94% wejścia Astry i 79% wejścia Sonneta pochodziło z cache. Powtarzany kontekst powiększa liczbę przetworzonych tokenów; nie oznacza kolejnych milionów tokenów nowego kodu. Lepsze wykorzystanie cache może pozwolić zmieścić więcej pracy w tej samej puli, lecz nie należy równocześnie podnosić liczby tokenów i dolarowej wartości tej puli — to dwukrotne policzenie tej samej oszczędności. Szczegóły opisuję w porównaniu kosztów pamięci podręcznej w API.
Aplikacja, przeglądarka i grafiki
Oba narzędzia potrafią czytać projekt, zmieniać pliki i uruchamiać polecenia. Oba mają też interfejs terminalowy oraz aplikację desktopową. Różnice zaczynają być bardziej widoczne, gdy zadanie obejmuje cały interfejs aplikacji: kod, ilustracje, uruchomienie strony i sprawdzenie jej zachowania.
| Zadanie | Codex | Claude Code |
|---|---|---|
| Praca w terminalu | Codex CLI, także uruchomienia nieinteraktywne | Claude Code CLI, także tryb claude -p |
| Sprawdzenie działającej strony | Wbudowana przeglądarka w aplikacji desktopowej, klikanie i inspekcja strony | Panel Browser, uruchamianie serwera i automatyczne sprawdzanie zmian |
| Tworzenie ilustracji i zasobów do gry | Wbudowane generowanie i edycja obrazów w ramach zadania | Do generowania takich obrazów potrzebne jest osobne narzędzie; Claude może tworzyć wizualizacje kodem, np. SVG |
| Dostosowanie do projektu | Instrukcje, skills i podłączenie narzędzi | Instrukcje, skills, wtyczki i podłączenie narzędzi |
Codex pozwala wygenerować ilustrację, tło lub zestaw sprite’ów obok kodu. Przy tworzeniu landing page’a można więc zamówić grafikę i poprosić o wstawienie jej do projektu w tej samej rozmowie. Generowanie obrazów zużywa wspólny limit; dokumentacja podaje przeciętnie 3–5 razy większe zużycie niż podobna tura bez obrazu, zależnie od jakości i rozmiaru. Anthropic rozróżnia tworzone przez Claude diagramy i wizualizacje HTML/SVG od generowania zdjęć oraz ilustracji.
Przeglądarka nie daje już tak prostego rozróżnienia. Codex może otwierać lokalne aplikacje, klikać i sprawdzać rezultat. Claude Code Desktop również uruchamia serwer, robi zrzuty ekranu, sprawdza strukturę strony i wypełnia formularze. Warto oceniać, czy agent faktycznie sprawdził ważną czynność: wysłanie formularza, zapis danych albo przejście między ekranami. Sama obecność przeglądarki w menu nie dowodzi, że wykonał taki test.
Osoba pracująca głównie w terminalu będzie przywiązywać mniejszą wagę do paneli desktopowych. Wtedy liczą się sposób przeglądania zmian, sterowanie sesją i dopasowanie do własnych skryptów. Oba CLI warto porównać na tym samym zadaniu. Wbudowana przeglądarka aplikacji OpenAI nie jest dostępna w Codex CLI, więc nie należy automatycznie przypisywać terminalowi wszystkich funkcji wersji desktopowej.
Przy automatyzacji trzeba też rozróżnić logowanie abonamentem od użycia klucza API. Anthropic wstrzymało zapowiedzianą zmianę rozliczania Agent SDK: Agent SDK i claude -p nadal korzystają z limitów subskrypcji. Zapowiadane osobne miesięczne kredyty nie są dostępne.
Co wybrać, gdy Pro 20× nie można kupić
Przy budżecie 20 USD i nacisku na jakość kodowania zacząłbym od Claude Pro z Opus 5.5. Przemawiają za nim wyniki programistyczne i dostęp w podstawowym płatnym planie. Codex Plus ma mocne argumenty dla osoby, która chce Astrę, generowanie grafik oraz wspólny proces budowania i sprawdzania aplikacji. Same projekcje 240 wobec 101 USD nie wystarczają, żeby uznać go za lepszy zakup.
Przy 100 USD porównujemy Codex Pro 5× z Claude Max 5×. W Claude dopłata może służyć przede wszystkim dłuższej pracy z Opus, bez uzależniania wyboru od Fable. W Codex trzeba pamiętać, że ocena oparta na doświadczeniach z Pro 20× nie dowodzi równie swobodnej pracy w Pro 5×: jego deklarowany mnożnik jest cztery razy mniejszy.
Przy 200 USD oferta dla nowego klienta przestaje być symetryczna. Claude Max 20× można kupić, a nowego Codex Pro 20× — obecnie nie. Po stronie Codex pozostaje Pro 5× i ewentualny zakup dodatkowych kredytów. Taki zestaw trzeba oceniać według faktycznego zużycia; dopłata 100 USD w kredytach nie jest obietnicą uzyskania limitu Pro 20×. Dla osoby intensywnie pracującej z Opus dostępność Max 20× jest konkretnym argumentem za Claude. Limit połowy tygodniowej puli ma znaczenie, jeśli wybierze Fable.
Dotychczasowy abonent Codex Pro 20× podejmuje inną decyzję: może zachować odnawiający się plan i porównywać jego przydatność z Claude Max. Zadowolenie takiego użytkownika z relacji ceny do możliwości nie przekłada się automatycznie na rekomendację zakupu dla kogoś, kto dopiero wybiera narzędzie.
Przed przejściem z 20 na 100 USD warto przez tydzień zapisywać trzy rzeczy: ukończone zadania, czas własnych poprawek i przerwy wymuszone limitami. Gdy agent regularnie kończy pracę, a limit pozostaje niewykorzystany, sam większy limit nie rozwiąże żadnego problemu. Gdy przerywa użyteczną pracę w połowie dnia, koszt dodatkowego pakietu można już porównać z konkretnym straconym czasem.
Źródła
- OpenAI: cennik i limity Codex, ChatGPT Pro i wstrzymanie nowych subskrypcji 20×.
- Anthropic: cennik Claude, zasady planów Max, Fable w abonamentach.
- Jakość i koszty modeli: wyniki Opus 5.5 opublikowane przez Anthropic, niezależne porównanie Artificial Analysis.
- OpenAI: modele Codex, przeglądarka, generowanie obrazów.
- Anthropic: Claude Code — przegląd funkcji, aplikacja desktopowa, możliwości tworzenia obrazów, aktualizacja zasad Agent SDK.
- Ceny i dostępność modeli: GPT-6 Astra, Claude Opus 5.5, modele Claude.
Wykorzystuję treści generowane przez AI jako część mojego codziennego procesu nauki.