Anthropic ogłosiło 24 lipca 2026 roku Claude Opus 5 - najnowszy model z rodziny Opus, który ma oferować niemal pełną inteligencję flagowego Claude Fable 5 przy dokładnie tej samej cenie co poprzednia wersja, Opus 4.8. To już czwarty nowy model tej firmy w niecałe dwa miesiące, po premierach Mythos 5, Fable 5 i Sonnet 5 w czerwcu.
Opus 5 nie jest kolejną, drobną aktualizacją numerku wersji. To model, który Anthropic wprost pozycjonuje jako "niemal pełną inteligencję Fable 5 za połowę kosztu" - i to przy niezmienionej cenie względem poprzednika.
Fakty: cena, dostępność, pozycjonowanie
Największa zmiana nie leży w samej cenie, tylko w tym, co za nią dostajesz. Anthropic twierdzi, że Opus 5 zbliża się do poziomu Fable 5 - modelu, który do tej pory był wizytówką firmy pod względem surowej inteligencji - jednocześnie zostając w tańszym, szybszym segmencie Opus. Dla użytkowników API oznacza to model, który realnie konkuruje z najdroższą ofertą Anthropic, bez podnoszenia rachunku.
Benchmarki: co konkretnie się poprawiło
Na ARC-AGI 3, teście mierzącym zdolność do rozwiązywania zupełnie nowych, nieszablonowych problemów, Anthropic podaje wynik trzykrotnie wyższy niż najlepszy konkurencyjny model. To duża różnica jak na pojedynczą aktualizację, i akurat ten benchmark jest zaprojektowany tak, by trudno było go "wykuć" przez trenowanie na podobnych zadaniach - mierzy raczej elastyczność rozumowania niż pamięć wzorców.
Na GDPval-AA v2, teście łączącym kodowanie z pracą wiedzową, oraz na Frontier-Bench v0.1, Opus 5 ustanawia nowe najlepsze wyniki wśród modeli Anthropic, podwajając rezultat Opus 4.8 na tym drugim teście. Na OSWorld 2.0, benchmarku mierzącym obsługę komputera (nawigację po interfejsie, klikanie, wypełnianie formularzy), model przewyższa wynik Fable 5 przy koszcie stanowiącym mniej więcej jedną trzecią tego, co płaci się za Fable 5. Na CursorBench 3.2, teście związanym z asystowaniem przy kodzie, Opus 5 mieści się w granicach pół procenta wyniku Fable 5, kosztując o połowę mniej za zadanie.
Nowy parametr effort
Opus 5 wprowadza ustawienie effort z czterema poziomami: niskim, średnim, wysokim i bardzo wysokim. Wyższy poziom oznacza, że model poświęca więcej tokenów na rozumowanie przed odpowiedzią, co podnosi zarówno jakość, jak i koszt pojedynczego zapytania. To pozwala deweloperom świadomie wybierać między szybką, tańszą odpowiedzią na proste pytanie a głębszym, kosztowniejszym rozumowaniem tam, gdzie faktycznie jest ono potrzebne - zamiast płacić pełną stawkę za każde zapytanie niezależnie od jego złożoności.
Bezpieczeństwo i dostosowanie modelu
Anthropic opisuje Opus 5 jako najbardziej dostosowany (aligned) model w swojej historii według wewnętrznego audytu behawioralnego, ze znacznie niższym wskaźnikiem niedopasowania niż poprzednie wersje. Firma podaje też, że model wymagał o około 85% mniej interwencji klasyfikatorów bezpieczeństwa związanych z cyberbezpieczeństwem niż Fable 5, co sugeruje rzadsze fałszywe alarmy przy legalnych zastosowaniach związanych z bezpieczeństwem IT.
Jednocześnie Opus 5 pozostaje w tyle za modelem Mythos 5 w zakresie odporności na próby wykorzystania go do zadań związanych z cyberbezpieczeństwem ofensywnym oraz badaniami biologicznymi wysokiego ryzyka - Anthropic utrzymuje więc wyraźną hierarchię modeli pod względem restrykcyjności w najbardziej wrażliwych obszarach, zamiast stosować jeden uniwersalny próg dla całej rodziny Opus.
Dlaczego to już czwarty model w dwa miesiące
Opus 5 to czwarta premiera modelu Anthropic w niecałe dwa miesiące, licząc od Mythos 5, przez Fable 5, po Sonnet 5 w czerwcu. Tempo to wyraźnie kontrastuje z wcześniejszymi cyklami wydawniczymi firmy, gdzie odstępy między głównymi modelami liczyło się w kwartałach, nie tygodniach. Częściowym wyjaśnieniem tego tempa jest kontekst biznesowy: Anthropic przygotowuje się do planowanego jeszcze w tym roku IPO, a seria szybkich, konkretnych premier modeli to naturalny sposób na pokazanie rynkowi ciągłego postępu technologicznego tuż przed debiutem giełdowym.
Co to oznacza dla użytkowników i deweloperów
Dla kogoś korzystającego z Claude Pro lub Claude Max, zmiana jest praktycznie natychmiastowa i bezpłatna - Opus 5 zastępuje poprzedni model jako domyślny lub najsilniejszy dostępny wariant, bez potrzeby dodatkowej konfiguracji. Dla deweloperów korzystających z API sytuacja jest równie prosta: identyfikator modelu zmienia się na "claude-opus-5", cena zostaje taka sama, a nowy parametr effort daje dodatkową kontrolę nad kosztem pojedynczych zapytań, której wcześniej brakowało w tej formie.





Komentarze
Dyskusja
Dołącz do rozmowy pod publikacją.
Dołącz do dyskusji
Zaloguj się, aby komentować i odpowiadać innym użytkownikom.
Zaloguj sięBrak komentarzy
Rozpocznij dyskusję jako pierwszy.