Claude Sonnet 5.5 firmy Anthropic zbliża się do wydajności Opus, obniżając koszty zadań nawet o 30%
Najważniejsze informacje
- •Anthropic uruchomiło Claude Sonnet 5.5 jako drugi model w rodzinie Claude 5.5, ukierunkowany na programowanie, codzienną produktywność i pracę z dokumentami w niższym przedziale kosztowym.
- •Model generuje wyniki ponad 30% szybciej niż Sonnet 5 i obniża koszty na zadanie nawet o 30% dzięki efektywności tokenowej, przy czym cena za token pozostaje na poziomie 2 USD za milion tokenów wejściowych i 10 USD za milion tokenów wyjściowych.
- •Sonnet 5.5 uzyskał wyższy wynik niż Opus 5.5 w Terminal-Bench 4.0 (70,6% do 66,4%) i zmieścił się w granicy dwóch punktów w GDPval-AA, zdobywając 1844 punkty wobec 1846 dla Opusa.
- •W ocenach programistycznych Sonnet 5.5 poprawił się o około 10 punktów względem Sonnet 5 w FrontierCode przy wysokim poziomie wysiłku, kosztując około piętnastokrotnie mniej na zadanie.
- •To pierwszy model Sonnet z zabezpieczeniami cyberbezpieczeństwa porównywalnymi z wyższymi poziomami Anthropic — zmiana, która może kierować żądania cyberbezpieczeństwa o wyższym ryzyku z powrotem do Sonnet 5.

Anthropic uruchomiło Claude Sonnet 5.5, drugi model w rodzinie Claude 5.5, pozycjonując go jako szybszą i bardziej ekonomiczną opcję do programowania, codziennej pracy i tworzenia dokumentów.
Model generuje wyniki ponad 30% szybciej niż jego poprzednik, Sonnet 5, i w testach firmy kosztuje nawet o 30% mniej na zadanie, według ogłoszenia Anthropic. Oszczędności wynikają głównie z efektywności: Sonnet 5.5 wymaga mniej tokenów do wykonania tej samej pracy. Sama cena za token pozostaje bez zmian: 2 USD za milion tokenów wejściowych i 10 USD za milion tokenów wyjściowych. To rozróżnienie ma znaczenie dla zespołów uruchamiających model na dużą skalę: ponieważ ceny katalogowe się nie zmieniły, oszczędności pojawiają się na poziomie zadania, gdzie koszty rosną wraz z użytkowaniem.
Anthropic przedstawia Sonnet 5.5 jako tańsze uzupełnienie Claude Opus 5.5. Opus pozostaje ukierunkowany na złożoną, otwartą pracę wymagającą długotrwałego osądu, podczas gdy Sonnet jest projektowany do lepiej zdefiniowanych zadań, takich jak naprawa błędów oraz tworzenie dokumentów, prezentacji i arkuszy kalkulacyjnych.
W niektórych ocenach różnica między tymi dwoma modelami jednak znacznie się zmniejszyła. Sonnet 5.5 uzyskał wyższy wynik niż Opus 5.5 w Terminal-Bench 4.0, notując 70,6% wobec 66,4%. W GDPval-AA, benchmarku mierzącym realną pracę knowledge work, oba modele były niemal równe — Sonnet 5.5 zdobył 1844 punkty wobec 1846 dla Opus 5.5. Anthropic podało, że przy niektórych ustawieniach poziomu wysiłku Sonnet 5.5 działa na poziomie Opus 5.5, choć firma nadal uważa Opus za mocniejszy model do złożonych zadań wymagających długotrwałego osądu. Dla kupujących rozważających oba poziomy wyniki te stanowią punkt odniesienia dla tego, jaką część zmierzonej zdolności zachowuje się przy niższym koszcie zadania w Sonnecie.
Programowanie to jeden z największych obszarów poprawy. Anthropic poinformowało, że Sonnet 5.5 zkał około 10 punktów względem Sonnet 5 w FrontierCode przy wysokim poziomie wysiłku, kosztując przy tym około piętnastokrotnie mniej na zadanie. Najlepszy wynik modelu w CursorBench również znalazł się około dwa punkty od wyniku Opus 5.5.
Szersza praca knowledge work również odnotowała znaczące zyski. Anthropic podało, że Sonnet 5.5 zbliżył się do Opus 5.5 w zakresie korzystania z komputera i rozpoznawania wykresów, przewyższając Sonnet 5 we wszystkich wewnętrznych i zewnętrznych ocenach firmy.
Sonnet 5.5 to również pierwszy model Sonnet wydany z zabezpieczeniami cyberbezpieczeństwa porównywalnymi z tymi w wyższych modelach Anthropic, po znaczącej poprawie jego zdolności cybernetycznych względem poprzedniej generacji. W efekcie żądania cyberbezpieczeństwa o wyższym ryzyku mogą być przekierowywane do Sonnet 5, podczas gdy rutynowe zadania deweloperskie pozostają dostępne — to kompromis między ostrzejszymi zabezpieczeniami a dostępnością zadań, który zespoły używające modelu do prac związanych z bezpieczeństwem będą musiały uwzględnić.
Model jest dostępny na platformach Anthropic, a także za pośrednictwem Amazon Web Services, Google Cloud i Microsoft Azure. Deweloperzy mogą korzystać z niego przez Claude Platform, używając identyfikatora claude-sonnet-5-5.
Anthropic dodało, że Claude Haiku 5.5, model przeznaczony do zastosowań o dużej objętości i wrażliwych na koszty, dołączy do rodziny Claude 5.5 w najbliższych tygodniach. Po premierze rodzina ma pokrywać pełen zakres poziomów Anthropic — od długotrwałej pracy złożonej po wdrożenia o dużej objętości.