Claude Opus 5.5: Nowości, ceny i alternatywy (2026)

Claude Opus 5.5 to najnowszy ogólny model firmy Anthropic, wydany 22 września 2026 roku. Jest to pierwszy model z rodziny Claude 5.5. Ceny API to $4 za milion tokenów wejściowych i $20 za milion tokenów wyjściowych. Anthropic pozycjonuje go do długotrwałych zadań programistycznych i pracy z wiedzą, w tym do obsługi arkuszy kalkulacyjnych, raportów i prezentacji.
Ten przewodnik omawia to, co zostało wydane, oraz wyniki testów premierowych dotyczących gotowych efektów pracy. Obejmuje również kwestie dostępu, kosztów i alternatyw wartych porównania. Wszystkie dane pochodzą z oficjalnych stron Anthropic według stanu na 23 września 2026 roku.
Co Anthropic wydało 22 września
Anthropic opublikowało ogłoszenie we wtorek, 22 września 2026 roku. Ta sama data pojawia się w informacjach o wydaniu Claude Platform, więc data premiery została potwierdzona przez dwa oficjalne kanały.
Główne hasło jest krótkie. Anthropic twierdzi, że model „działa na poziomie Claude Fable 5.1 w większości zadań”. Fable 5.1 to większy i droższy model firmy, więc propozycja to wyniki klasy Fable w niższej kategorii cenowej.
Informacje o wydaniu opisują Opus 5.5 jako „model do długotrwałego, agentowego kodowania i pracy z wiedzą”. Domyślnie oferuje on okno kontekstowe o rozmiarze 1M tokenów oraz maksymalnie 128k tokenów wyjściowych. Funkcja adaptacyjnego myślenia (adaptive thinking) jest zawsze włączona.
Identyfikator modelu dla programistów to claude-opus-5-5. Anthropic zaznacza również, że kolejni członkowie rodziny 5.5 pojawią się w nadchodzących tygodniach.
Dwa testy premierowe, które mają znaczenie dla gotowych efektów pracy
Większość artykułów premierowych zaczyna się od benchmarków programistycznych. Dwa z testów w tym przypadku są bardziej przydatne, jeśli efektem Twojej pracy ma być dokument, prezentacja lub raport.
Model w Excel, który stał się prezentacją dla kadry zarządzającej
Anthropic dało modelom Opus 5.5 i Opus 5 to samo zadanie: przeanalizować proponowaną fuzję dwóch fikcyjnych firm tworzących oprogramowanie HR. „Każdy z nich zbudował model finansowy w Excel, a następnie przekształcił go w prezentację dla kadry zarządzającej na temat tego, czy transakcja ma sens przy danej cenie”.
Oba modele doszły do tego samego wniosku w sprawie transakcji. Różnica tkwiła w gotowym efekcie. Anthropic informuje, że model stworzony przez Opus 5.5 „był bardziej szczegółowy, a jego prezentacja łatwiejsza w odbiorze”, podczas gdy wersja starszego modelu zawierała drobne błędy.
To realistyczny scenariusz zadania. Arkusz kalkulacyjny stanowi dowód, a prezentacja jest tym, co faktycznie czyta menedżer. Model, który dba o spójność obu tych elementów, pozwala pominąć etap weryfikacji, na którym zazwyczaj wyłapuje się niezgodne liczby.
Raport badawczy, w którym zmyślone liczby nie przeszły testu
Drugi test dotyczy dokładności, a nie estetyki. Anthropic poprosiło trzy modele o napisanie raportu na temat kwartalnych wyników firmy. Modele mogły korzystać wyłącznie z kopii sieci, w której sprawozdanie finansowe było trudne do znalezienia.
„Automatyczny system oceniający porównał każdą liczbę i cytat ze źródłami”. Anthropic podaje, że „16 na 18 raportów Opus 5.5 przeszło nasz test jakości, w którym jakakolwiek zmyślona liczba lub cytat oznaczałyby porażkę”. Dodaje również, że „ani Fable 5.1, ani Opus 5 nie przeszły tego testu w żadnej z prób”.
Dla każdego, kto publikuje dane liczbowe, jest to ważniejszy wynik. Płynnie napisany raport z jedną zmyśloną liczbą jest gorszy niż wolniej przygotowany raport bez żadnych błędów, ponieważ to właśnie ta zmyślona liczba zostanie później zacytowana.
Cennik i plany
Anthropic na swojej stronie z cennikiem opisuje Opus 5.5 jako „Narzędzie do codziennej pracy przy agentowym kodowaniu i zadaniach korporacyjnych”. Poniższe stawki API to ceny widoczne obecnie na tej stronie.
| Pozycja | Cena podana przez Anthropic |
|---|---|
| Opus 5.5 (wejście) | $4 za milion tokenów |
| Opus 5.5 (wyjście) | $20 za milion tokenów |
| Buforowanie promptów (odczyt) | $0.20 za milion tokenów |
| Buforowanie promptów (zapis, 5-minutowy bufor) | $5 za milion tokenów |
| Tryb szybki (Fast mode) | 2x standardowa cena |
| Plan Claude Free | $0 |
| Plan Claude Pro | $20 miesięcznie przy rozliczeniu miesięcznym lub $200 przy rozliczeniu rocznym |
| Plan Claude Max | Od $100 miesięcznie |
Plany subskrypcyjne to sposób, w jaki większość osób zetknie się z tym modelem. Anthropic informuje, że wraz z premierą zwiększa 5-godzinne limity użytkowania w planach Pro, Max, Team oraz Enterprise opartych na liczbie stanowisk. Subskrybenci otrzymują również reset limitu zapytań, który mogą zachować i wykorzystać później.
Przed zaplanowaniem budżetu warto poznać dwa szczegóły dotyczące kosztów. Odczyty z pamięci podręcznej (cache reads) to najtańsza stawka za token na liście, a Anthropic twierdzi, że stanowią one większość kosztów pracy agentowej i programistycznej. Tryb szybki (Fast mode) podwaja standardową stawkę w zamian za prędkość, więc lepiej nadaje się do pracy interaktywnej niż do zadań wsadowych.
Gdzie można korzystać z Opus 5.5
Informacje o wydaniu wymieniają pięć ścieżek dostępu. Są to: Claude API, Claude w Amazon Bedrock, Claude Platform na AWS, Claude w Google Cloud oraz Claude w Microsoft Foundry. W ogłoszeniu dodano, że model jest dostępny na wszystkich platformach.
Wewnątrz aplikacji Claude strona z cennikiem wymienia Claude Design, Slides i Docs as funkcje płatnych planów. Ma to znaczenie dla tej premiery, ponieważ wspomniany wyżej test prezentacji to dokładnie ten rodzaj pracy, do którego stworzono te narzędzia. Nasz wcześniejszy artykuł o Claude Slides wyjaśnia, jak działa ten interfejs wyjściowy.
Przegląd modeli Anthropic podaje prostą zasadę. Sugeruje programistom, aby „zaczynali od Claude Opus 5.5 w przypadku większości zadań”, a po Fable 5.1 sięgali wtedy, gdy testy porównawcze wciąż nie przynoszą zadowalających rezultatów.
Co zmieniło się w jego zachowaniu
Cztery zmiany w zachowaniu łatwo przeoczyć w ogłoszeniu.
Myślenie jest zawsze włączone. Informacje o wydaniu podają, że w tym modelu nie można wyłączyć funkcji myślenia (thinking). Zapytania próbujące ją wyłączyć zwracają błąd, więc starsze integracje mogą wymagać drobnej modyfikacji.
Styl pisania jest bardziej bezpośredni. Anthropic twierdzi, że model „umieszcza najważniejsze informacje na samym początku”. Pierwsi testerzy uznali jego styl pisania za wyraźniejszy niż w poprzedniej wersji. W przypadku raportów i tekstów na slajdy to różnica między gotowym do użycia pierwszym szkicem a wersją, którą trzeba całkowicie przebudować.
Jest bardziej ostrożny w działaniach. Anthropic twierdzi, że model jest znacznie mniej skłonny do podejmowania trudnych do odwrócenia działań niż ostatnie modele. Wykazuje również większą odporność na ataki typu prompt injection niż Opus 5.
Opcje zgodności z przepisami zostały zachowane. Anthropic informuje, że model jest dostępny z opcją zerowego zatrzymywania danych (zero data retention), podobnie jak poprzednie modele Opus. Zawiera również mechanizmy znakowania wodnego, których Anthropic używa w celu zachowania zgodności z unijnym aktem o sztucznej inteligencji (EU AI Act). Zespoły podlegające regulacjom mogą go przetestować bez konieczności wcześniejszej zmiany umów o przetwarzaniu danych.
Anthropic szczerze wypowiada się również o benchmarkach. Pisze, że „różnice w wynikach benchmarków stały się mniej wiarygodnym wskaźnikiem rzeczywistych różnic”. To przydatne przypomnienie, aby testować rozwiązania na własnych plikach, zamiast ślepo ufać rankingom.
Opus 5.5 czy Fable 5.1: który wybrać
Fable 5.1 pozostaje najwyższym modelem Anthropic, wycenionym na $10 za milion tokenów wejściowych i $50 za milion tokenów wyjściowych. Przegląd modeli zaleca go do wymagających zadań wnioskowania oraz długofalowej pracy agentowej.
W przypadku większości zadań związanych z raportowaniem i analizą, dane z premiery wskazują na Opus 5.5 jako domyślny wybór. Test raportu badawczego jest tego najwyraźniejszym sygnałem, ponieważ Fable 5.1 w żadnej próbie nie przeszedł testu braku zmyślonych liczb. Praktyczny podział wygląda następująco:
- Używaj Opus 5.5 do raportów okresowych, opracowań analiz oraz zadań typu „arkusz kalkulacyjny na prezentację”.
- Używaj Fable 5.1 do problemów, w których nowy model, mimo większego wysiłku, wciąż nie radzi sobie w Twoich własnych testach.
- Używaj Sonnet 5, wycenionego na $2 za wejście i $10 za wyjście za milion tokenów, do zadań o dużej objętości, gdzie koszt ma kluczowe znaczenie.
Alternatywy, które warto znać
Ten sam tydzień przyniósł dwie inne głośne premiery modeli. Oba są warte przetestowania w porównaniu z nowym Opus na Twoich własnych zadaniach.
| Model | Data wydania | Cena API za milion tokenów | Gdzie używać |
|---|---|---|---|
| Claude Opus 5.5 | 22 września 2026 r. | $4 wejście / $20 wyjście | Aplikacje Claude, API i główne chmury |
| GPT-6 Sol | 22 września 2026 r. | $2 wejście / $10 wyjście | ChatGPT Work, Codex, OpenAI API |
| GPT-6 Luna | 22 września 2026 r. | $0.10 wejście / $0.50 wyjście | ChatGPT Work, Codex, OpenAI API |
| Grok 4.7 | 21 września 2026 r. | $2 wejście / $6 wyjście | xAI API, Cursor, Grok Build |
GPT-6 Sol i GPT-6 Luna. OpenAI wydało oba te modele tego samego dnia, w którym odbyła się premiera Anthropic. OpenAI podaje, że są one dostępne w ChatGPT Work i Codex dla użytkowników Plus, Pro, Business, Enterprise oraz Edu. Użytkownicy wersji Free i Go mogą korzystać z Luna w aplikacji komputerowej. OpenAI wciąż opisuje GPT-6 Astra jako swój ogólnie najlepszy model.
Grok 4.7. SpaceXAI, firma stojąca za Grok, wydała go 21 września. Opisuje ten model jako swój „najpotężniejszy model do kodowania i pracy z wiedzą”. Jest on oferowany w tej samej cenie co Grok 4.6.
Najbardziej rzetelnym sposobem na dokonanie wyboru jest małe bezpośrednie porównanie. Wybierz jedno prawdziwe zadanie, np. raport z zeszłego kwartału, i uruchom je w każdym modelu przy użyciu tych samych plików źródłowych. Następnie porównaj każdą liczbę ze źródłem.
Użyj dokładnie tego samego promptu we wszystkich modelach. Zapisz czas wykonania, koszt pojedynczego zadania oraz każdą liczbę, którą trzeba było poprawić. Model wymagający najmniejszej liczby poprawek zazwyczaj wygrywa, nawet jeśli nie jest najtańszy w przeliczeniu na token.
Gdzie lepszy model przestaje pomagać
Silniejszy model zmniejsza wskaźnik błędów. Nie zwalnia to jednak z konieczności sprawdzania efektów pracy. Własny test raportu przeprowadzony przez Anthropic wykorzystywał automatyczny system oceniający, który śledził każdą liczbę aż do źródła. Czytelnik potrzebuje dokładnie takiego samego śladu.
W tym miejscu przestrzeń robocza ma większe znaczenie niż sama nazwa modelu. Powerdrill Bloom opiera się na tej samej idei, co wspomniany system oceniający. Jego strona główna opisuje go jako „Analityka danych AI, który pokazuje swoją pracę”. Dodaje również: „Każda liczba wraca wraz ze wskazaniem strony, wiersza i danych, które za nią stoją”.
Przepływ pracy w teście fuzji Anthropic odpowiada również powszechnemu zadaniu zawodowemu. Zaczynasz od arkusza kalkulacyjnego, a kończysz na prezentacji. Nasza strona Excel to PowerPoint opisuje tę ścieżkę dla Twoich własnych plików. Jeśli prezentacja wymaga slajdu wprowadzającego, nasz przewodnik po slajdzie z podsumowaniem menedżerskim (executive summary slide) wyjaśnia, co powinno się na nim znaleźć.
Wybierz model na podstawie testów, a następnie zachowaj ścieżkę źródłową obok wygenerowanych wyników. To połączenie sprawia, że raport można bezpiecznie wysłać.
Jak zacząć korzystać z Opus 5.5
Jeśli korzystasz z aplikacji Claude, otwórz nową konwersację i wybierz Opus 5.5 z menu modeli. Przekaż mu jeden prawdziwy plik i zleć jedno rzeczywiste zadanie do wykonania, a nie uproszczony prompt testowy.
Jeśli tworzysz rozwiązania w oparciu o API, zmień identyfikator modelu na claude-opus-5-5 i usuń wszelkie ustawienia wyłączające funkcję myślenia (thinking). Następnie uruchom ponownie swój istniejący zestaw testowy przed wprowadzeniem jakichkolwiek innych zmian. Porównaj koszt pojedynczego zadania, a nie tylko koszt tokena, ponieważ model zużywający mniej tokenów może okazać się tańszy nawet przy podobnej stawce.
Jeśli efektem Twojej pracy jest raport okresowy, przygotuj listę kontrolną najważniejszych danych liczbowych. Sprawdzaj je w pierwszej kolejności przy każdym uruchomieniu, niezależnie od wybranego modelu.
Jeśli chcesz, aby etap przejścia od arkusza kalkulacyjnego do prezentacji został wykonany z dołączonymi źródłami, możesz wypróbować Powerdrill Bloom na własnych plikach.
Najczęściej zadawane pytania
Czym jest Claude Opus 5.5?
Claude Opus 5.5 to model firmy Anthropic przeznaczony do długotrwałych zadań programistycznych i pracy z wiedzą, wydany 22 września 2026 roku. Jest to pierwszy model z rodziny Claude 5.5. Anthropic twierdzi, że w większości zadań działa on na poziomie Fable 5.1.
Ile kosztuje Claude Opus 5.5?
W przypadku API Anthropic podaje ceny $4 za milion tokenów wejściowych i $20 za milion tokenów wyjściowych. Odczyty z pamięci podręcznej (cache reads) kosztują $0.20 za milion tokenów. W aplikacjach Claude dostęp odbywa się w ramach planów subskrypcyjnych, przy czym plan Pro kosztuje $20 miesięcznie przy rozliczeniu miesięcznym.
Czy Opus 5.5 jest dostępny w aplikacji Claude?
Tak. Anthropic informuje, że model jest dostępny na wszystkich platformach, a przy wdrożeniu zwiększono limity użytkowania w planach Pro, Max, Team oraz Enterprise opartych na liczbie stanowisk. Programiści mogą z niego korzystać również za pośrednictwem Claude API oraz w usługach Amazon Bedrock, Google Cloud i Microsoft Foundry.
Czym różni się Opus 5.5 od Fable 5.1?
Fable 5.1 to większy model Anthropic, kosztujący $10 za wejście i $50 za wyjście za milion tokenów. Anthropic zaleca Opus 5.5 do większości zadań, a Fable 5.1 do najtrudniejszych zadań wymagających wnioskowania. W premierowym teście raportu badawczego tylko Opus 5.5 przeszedł pomyślnie test braku zmyślonych danych liczbowych.
Czy można wyłączyć funkcję myślenia w Opus 5.5?
Nie. Informacje o wydaniu Claude Platform podają, że w tym modelu nie można wyłączyć funkcji myślenia (thinking). Zapytania próbujące ją wyłączyć zwracają błąd, więc integracje stworzone dla starszych modeli mogą wymagać aktualizacji.
Źródła: Anthropic, Introducing Claude Opus 5.5 · Claude Platform release notes · Claude models overview · Claude pricing · OpenAI, Introducing GPT-6 Sol and Luna · Introducing Grok 4.7. Ceny i szczegóły planów odczytane ze stron dostawców 23 września 2026 roku.