Claude Opus 4.7: Model rozumowania Anthropic
Flagowy model Claude 4 firmy Anthropic. Najlepszy wybór w rodzinie do długoterminowych pętli agentów, trudnego rozumowania i pierwszych edycji kodu.
1M tokens · Text / Vision / Code · Prompt cache
Okou nie uruchamia już Claude Opus 4.7. Ta strona jest zachowana jako odniesienie do jej specyfikacji, cen i benchmarków. Do tego samego rodzaju pracy użyj GPT 5.6 Luna.
Zobacz GPT 5.6 LunaClaude Opus 4.7 to model, po który sięgasz, gdy praca musi być wykonana poprawnie za pierwszym razem: kod, który kompiluje się czysto, wieloetapowe plany, które nie gubią wątku w długich łańcuchach narzędzi, abstrakcyjne łamigłówki, na których potykają się mniejsze modele. Testy porównawcze dostawców (SWE-bench Verified, Terminal-Bench 2.0, ARC AGI 2, OSWorld, BrowseComp) podają konkretne liczby dotyczące zysków w porównaniu do Opus 4.6.
Cena katalogowa dostawcy wynosi 5 USD / 25 USD za 1 milion tokenów z buforowanym wejściem za 0,50 USD / 1 milion, co jest najwyższą ceną w rodzinie Claude. Opłacalnym wzorcem jest utrzymanie Sonnet 4.6 jako domyślnego i kierowanie tylko najtrudniejszych kroków do Opus.
Czym jest Claude Opus 4.7?
Kwiecień 2026 (następca Opus 4.6) · Najwyższa warstwa rodziny Claude 4. Zalecana aktualizacja Anthropic dla użytkowników Opus 4.6.
Claude Opus 4.7 to flagowy model rodziny Claude 4 firmy Anthropic, wydany w kwietniu 2026 roku jako zalecana aktualizacja z Opus 4.6. Anthropic przedstawia go jako przełomowe ulepszenie w zakresie kodowania agentowego i abstrakcyjnego rozumowania, a nie odświeżenie powierzchni API. Okno kontekstowe 1M tokenów i adaptacyjne poziomy wysiłku myślowego wprowadzone w 4.6 pozostają bez zmian, więc istniejący kod agenta działa bez przepisywania.
W porównaniu do Sonnet 4.6 (konia roboczego z tej samej rodziny), Opus inwestuje więcej mocy obliczeniowej na token. Korzyści behawioralne objawiają się w trzech miejscach: mniej pominiętych instrukcji w długich pętlach agentów, znacznie lepsze poprawki kodu przy pierwszej próbie oraz silniejsze przypominanie sobie, gdy historia rozmów przekroczy 100 tys. tokenów. Kompromisem jest najwyższa cena katalogowa w rodzinie Claude (5 USD / 25 USD za 1 mln tokenów) i wolniejsza prędkość wyjściowa na token, dlatego sam Anthropic pozycjonuje Opus jako orkiestratora lub poziom eskalacji, a nie domyślne rozwiązanie wszędzie.
Niezależne rankingi (Artificial Analysis, Vellum) potwierdzają względne uporządkowanie w stosunku do Opus 4.6, ale liczby bezwzględne zmieniają się co tydzień, a OpenAI zgłosił zanieczyszczenie danych treningowych na SWE-bench Verified we wszystkich modelach granicznych. Traktuj publiczne wyniki jako wskazówkę, a nie autorytatywne; ustrukturyzowane różnice behawioralne (spójność długich pętli, jakość poprawek za pierwszym razem, niezawodność routingu wielu narzędzi) są trwalszym sygnałem.
Specyfikacje w skrócie
Benchmarki Claude Opus 4.7
Wyniki zgłoszone przez dostawców z materiałów prasowych Opus 4.7 Anthropic, z pokazanymi różnicami w stosunku do publicznych danych Opus 4.6. Niezależne recenzje plasują 4.7 przed GPT-5.2 w większości zadań związanych z kodowaniem agentowym i w kilku punktach od Gemini 3 Pro w zakresie abstrakcyjnego rozumowania. Traktuj bezwzględne wartości procentowe jako kierunkowe; OpenAI zgłosił zanieczyszczenie danych treningowych w SWE-bench Verified we wszystkich modelach granicznych.
Cennik Claude Opus 4.7
Cena katalogowa dostawcy, za 1M tokenów.
Jak Claude Opus 4.7 zachowuje się w praktyce
Obserwowane zachowanie z uruchomień agentów produkcyjnych.
Routing narzędzi
Najniższy wskaźnik błędnie skierowanych wywołań narzędzi w rodzinie Claude. Różnica w stosunku do Sonnet 4.6 powiększa się w trudnych przypadkach brzegowych, takich jak warunkowy wybór narzędzi, głęboko zagnieżdżone argumenty i wywołania narzędzi wysyłane po długich okresach rozumowania.
Przywoływanie długiego kontekstu
Spójne w ponad 200 tys. tokenów transkrypcji agentów. Okno 1M tokenów utrzymuje się znacznie lepiej niż poprzednicy dzięki ulepszeniom kontekstu-rot, które Anthropic wprowadził w Opus 4.6 i udoskonalił dla 4.7. Zgłoszony przez dostawcę MRCR v2 przy 1M pokazuje mierzalny wzrost w porównaniu do 76% Opus 4.6.
Edycje kodu pierwszej próby
Najwyższa jakość poprawek w rodzinie Claude. Właściwy wybór, gdy agent musi modyfikować kod, który musi nadal kompilować się i przechodzić testy, zwłaszcza gdy poprawka obejmuje wiele plików. Wynik Anthropic w Terminal-Bench 2.0 odzwierciedla to bezpośrednio.
Prędkość
Wolniejszy niż Sonnet 4.6 i zauważalnie wolniejszy niż Kimi K2.7 Code. Anthropic publikuje ~41 tokenów/sekundę przy maksymalnym wysiłku dla Opus 4.6, a 4.7 jest w podobnym zakresie. Zarezerwuj go dla kroków, które faktycznie wymagają dodatkowej głębi rozumowania i uruchamiaj lżejsze poziomy równolegle.
Zachowanie halucynacji
Opus 4.7 zachowuje konserwatywną postawę odmowy Anthropic i ma tendencję do przyznawania się do niepewności, zamiast konfabulować, co jest powodem, dla którego zespoły produkcyjne nadal płacą premię za rozumowanie wysokiego ryzyka, pomimo tańszych alternatyw o otwartym kodzie, takich jak Kimi K2.7 Code i DeepSeek V4 Pro, które teraz dorównują mu w benchmarkach.
Najlepsze zadania agenta dla Claude Opus 4.7
Przegląd PR, który wychwytuje to, co ludzie pomijają
Kiedy żądanie ściągnięcia zmienia 30 plików, Opus 4.7 utrzymuje całą zmianę w pamięci roboczej i pisze recenzję, która łączy to, co zmieniło się w auth/middleware.ts, z testem, który zepsuło w routes/admin.test.ts. Młodsi recenzenci otrzymują rodzaj informacji zwrotnej między plikami, którą starsi inżynierowie zazwyczaj wychwytują w drugim przejściu, a zespół wysyła mniej poprawek, które przechodzą CI, ale psują się w produkcji.
Przeprowadzone badanie, które czyta cały stos
Wrzuć 200-stronicowy projekt umowy, trzy propozycje konkurencji i opinie prawne z ostatniego kwartału do okna kontekstowego 1M tokenów, a następnie poproś Opus o oznaczenie każdej klauzuli, która jest bardziej restrykcyjna niż rynkowa, i wymienienie prawdopodobnych punktów negocjacyjnych. Mniejsze modele zaczynają gubić wcześniejsze sekcje po 100K tokenów; Opus utrzymuje cały obraz w zasięgu wzroku i odwołuje się do dokładnego akapitu, który cytuje.
Orkiestrator realizujący plan wielonarzędziowy
Użyj Opus 4.7 jako planisty, który dzieli prośbę klienta na dziesięć kroków, wysyła każdy krok do Sonnet- lub oszczędnego podagenta i łączy wyniki. Uruchamianie Opus tylko na warstwie planisty (i tańszych warstwach wszędzie indziej) kosztuje ułamek kosztów uruchamiania Opus od początku do końca, z zachowaniem większości jakości.
Pierwsze próby edycji kodu, które nie marnują uruchomienia CI
Poproś Opus 4.7 o migrację bazy kodu składającej się z 50 plików z jednego ORM do drugiego, refaktoryzację splątanego modułu lub zastosowanie poprawki bezpieczeństwa w całym repozytorium. Poprawka stosuje się czysto za pierwszym razem częściej niż jakikolwiek inny model w rodzinie, co odzwierciedla raportowany przez dostawcę Terminal-Bench 2.0, i co również odzwierciedli Twój rachunek CI.
Kiedy pominąć Claude Opus 4.7
Pomiń Opus 4.7 w przypadku rutynowych prac o dużej objętości, gdzie Sonnet 4.6 osiąga tę samą jakość za ułamek kosztów, w przypadku odpowiedzi na czacie wrażliwych na opóźnienia, gdzie Kimi K2.7 Code jest znacznie szybszy, oraz w przypadku zadań masowej klasyfikacji lub ekstrakcji, gdzie GPT-5.4 Mini jest tańszą obsługiwaną opcją masową.
Claude Opus 4.7 vs inne modele
Claude Opus 4.7 vs Claude Sonnet 4.6
Sonnet 4.6 to domyślny koń roboczy w rodzinie Claude i właściwy wybór dla większości agentów. Przejdź na Opus 4.7 tylko wtedy, gdy Sonnet wyraźnie zawodzi w trudnym rozumowaniu, długim kontekście lub edycjach kodu przy pierwszej próbie, zazwyczaj jako orkiestrator, który deleguje w dół do Sonnet- lub oszczędnych sub-agentów.
Claude Opus 4.7 vs Claude Opus 4.6
To samo okno kontekstowe (1M tokenów), te same ceny dostawcy i ta sama architektura adaptacyjnego myślenia. Opus 4.7 to nowsza generacja z zgłoszonymi przez dostawcę zyskami w SWE-bench Verified, Terminal-Bench 2.0, ARC AGI 2 i OSWorld. Wybierz 4.7 dla nowych agentów; przypnij 4.6 tylko wtedy, gdy istniejący agent został zweryfikowany pod kątem tej wersji i potrzebujesz stabilności zachowania.
Podsumowując: czy powinieneś używać Claude Opus 4.7?
Opus 4.7 to poziom eskalacji. Domyślnie Sonnet 4.6; awansuj do Opus tylko na tych konkretnych krokach, gdzie Sonnet wyraźnie zawodzi.
Często zadawane pytania
Jakie jest okno kontekstowe Claude Opus 4.7?
1 milion tokenów, z maksymalnie 64 tysiącami tokenów wyjściowych na odpowiedź. Pełne okno jest rozliczane według standardowych stawek. Żądanie 900 tysięcy tokenów ma taką samą stawkę za token jak żądanie 9 tysięcy tokenów.
Czy Claude Opus 4.7 obsługuje obrazy?
Tak. Opus 4.7 jest multimodalny. Akceptuje dane wejściowe obrazu wraz z tekstem i kodem, więc agenci sterowani zrzutami ekranu i wizją dokumentów działają natywnie.
Kiedy powinienem wybrać Opus 4.7 zamiast Sonnet 4.6?
Gdy (a) agent jest planistą / orkiestratorem, a decyzje kaskadowe, (b) uruchomienie jest wystarczająco długie, aby Sonnet zaczął pomijać instrukcje, lub (c) wynik musi być czysto zastosowany przy pierwszej próbie (edycje kodu, ustrukturyzowane ładunki).
Czy Opus 4.7 obsługuje buforowanie promptów?
Tak. Buforowane dane wejściowe są rozliczane po 0,50 USD za 1 milion tokenów. 10-krotna zniżka na buforowaną część. Warto używać zawsze, gdy Twój prompt systemowy lub schemat narzędzi jest stabilny w różnych wywołaniach.
Alternatywy
Dostępność Claude Opus 4.7 na Okou
Claude Opus 4.7 został usunięty z oferty Okou, więc nie można go już wybrać w czacie ani w przepływie pracy, i nie jest dostępny z własnym kluczem API. GPT 5.6 Luna obejmuje ten sam poziom oszczędności kosztów.

