← BlogBlog

Migracja na Claude Sonnet 5.5: 7 wskazówek, żeby przejście poszło gładko

Migracja na Claude Sonnet 5.5 wygląda na zmianę jednej linijki i w wielu aplikacjach prawie nią jest: cena za token i tokenizer są takie same jak w Sonnet 5. Tyle że pięć ustawień, które działały wczoraj, dziś zwraca błąd 400, a zespoły z wymogami RODO mogą stracić routing ograniczony do UE. Siedem wskazówek idzie w kolejności, w jakiej sami byśmy to robili.

$2/$10Za MTok wejście / wyjście, jak Sonnet 5
5Breaking changes względem Sonnet 5
1MOkno kontekstu, 128K wyjścia
28.09Premiera w 2026

1. Claude Sonnet 5.5 zachowuje cenę, ale zmienia domyślne ustawienia

Co nowego. Anthropic wypuścił Claude Sonnet 5.5 28 września 2026. Przegląd modelu podaje ID claude-sonnet-5-5 bez daty (anthropic.claude-sonnet-5-5 na Bedrocku), okno 1M tokenów i 128K wyjścia, a w Message Batches z nagłówkiem output-300k-2026-03-24 nawet 300K. Adaptive thinking jest domyślnie włączony, effort ma poziomy od low do max, domyślnie high.

Polskie portale opisały premierę przez pryzmat ceny i tu warto uważać. Instalki dały tytuł „Szybszy od poprzednika i o wiele tańszy”, choć w treści same przyznają, że cena się nie zmieniła. Portal Technologiczny podaje poprawnie 2 dolary za milion tokenów wejściowych i 10 za milion wyjściowych, tyle samo co Sonnet 5. „Taniej” dotyczy kosztu zadania, a ten zależy od ustawień. Cennik potwierdza też, że zapowiadana podwyżka Sonnet 5 do $3 / $15 nie wejdzie w życie, więc zostanie na nim chwilę dłużej nic nie kosztuje.

Najważniejsze różnice. Według strony co nowego w Sonnet 5.5 ten sam tekst daje tyle samo tokenów co w Sonnet 5. Przy przejściu z 4.x przewodnik migracji liczy około 30% więcej tokenów dla tekstu i około 2,5 raza więcej dla obrazu 2000×1500.

Co się zmienia, zależnie od punktu startu
WłaściwośćZ Sonnet 5Z Sonnet 4.6 / 4.5 / Haiku 4.5
Tokeny dla tego samego tekstuBez zmianOkoło 30% więcej
Minimalny prompt do cache512 (było 1 024)512 (było 1 024; 4 096 w Haiku 4.5)
Wyłączenie thinkingdisabled daje 400; użyj between_toolsThinking działa, gdy pole jest pominięte
budget_tokens, parametry próbkowaniaNic nowegoZamień na effort; usuń temperature / top_p / top_k
W benchmarkach agentowych Claude Sonnet 5.5 zbliża się do Opus 5.5Źródło: ogłoszenie Anthropic o Claude Sonnet 5.5 (pobrano 29 wrz 2026)
CursorBench 4.0 - Sonnet 5.5
55,5%
CursorBench 4.0 - Sonnet 5
34,1%
CursorBench 4.0 - Opus 5.5
57,8%
OSWorld 2.1 - Sonnet 5.5
80,1%
OSWorld 2.1 - Sonnet 5
57,0%
OSWorld 2.1 - Opus 5.5
81,8%

Ogłoszenie Anthropic mówi o odpowiedziach szybszych o ponad 30% i o tym, że na Low lub Medium Sonnet 5.5 bije najlepszy wynik Sonnet 5 za około dziesiątą część kosztu zadania. Artificial Analysis zmierzyło drugi koniec skali: na max model ma 56 punktów w Intelligence Index, dwa mniej niż Opus 5.5, ale zużywa około 193K tokenów wyjściowych na zadanie i kosztuje $7,60 za zadanie, mniej więcej 50% więcej niż Sonnet 5. Porównanie Rajesha Beriego pokazuje, że Opus 5.5 na xhigh osiąga te same 56 punktów za $3,46.

Koszt zadania zależy więc głównie od poziomu effort, a „taniej” trzeba sprawdzić na własnym ruchu, nie w tytule newsa.

2. Migracja na Claude Sonnet 5.5 zaczyna się od grepa i ewaluacji

Inwentaryzacja. Przy aktualizacji z Sonnet 5 do 5.5 zwykłe wyszukiwanie w repozytorium znajduje prawie wszystko, jeśli obejmuje konfigurację i ustawienia bibliotek, a nie tylko własne wywołania API.

Czego szukać
SzukajNa Claude Sonnet 5.5
"disabled" w obiekcie thinking400
budget_tokens400, także z between_tools
tool_choice z any lub tool400, również w count_tokens
Prefill asystenta, niedomyślne temperature / top_p / top_k400
computer_20251124400 w Claude API i Google Cloud
Nazwy modeli advisor400 dla Opus 4.8, 4.7, 4.6, Sonnet 5, Sonnet 4.6
Kod edytujący messages, system lub tools w trakcie rozmowy400 na nowszych kontach przy odtwarzaniu starych bloków thinking

Ewaluacja przed zmianą ID. Punkt odniesienia zbierz na obecnym modelu, inaczej porównanie opiera się na pamięci. Poradnik Anthropic o ewaluacjach radzi odwzorować realny rozkład zadań i przedkłada więcej pytań z automatyczną oceną nad kilka ocenianych ręcznie.

Narzędzia. W Claude Code polecenie /claude-api migrate this project to claude-sonnet-5-5 uruchamia wbudowany skill migracyjny: podmienia ID, przepisuje łamiące parametry i prefille, a na koniec daje listę rzeczy do ręcznej weryfikacji. CLI ant z przykładów w przewodniku, według strony o Bedrocku, nie działa z Bedrockiem.

Sprawdź, gdzie model będzie działał. Dla zespołów związanych RODO to może być ważniejsze od benchmarków. W Claude API inference_geo ma według dokumentacji rezydencji danych tylko us i global, przy czym us kosztuje 1,1x stawki. Wartości eu nie ma.

Na Bedrocku karta modelu w AWS pokazuje, że w eu-central-1 (Frankfurt) i w każdym innym regionie UE Sonnet 5.5 jest dostępny tylko przez profil globalny, który „routes worldwide with no residency constraints”. Jeśli dziś wywołujesz Claude przez profil ograniczony do UE, przejście na Claude Sonnet 5.5 oznacza na razie utratę tego ograniczenia. Zanim podmienisz ID, porozmawiaj z osobą odpowiedzialną za ochronę danych.

W Google Cloud dokumentacja Vertex AI mówi, że nowsze modele korzystają z endpointu globalnego lub wieloregionalnego (us i eu, z dopłatą 10%). Dostępność Sonnet 5.5 w konkretnym multi-regionie nie jest tam wymieniona, więc sprawdź stronę modelu u Google.

3. Techniki promptowania pod Claude Sonnet 5.5 to głównie usuwanie

Strona o promptowaniu Sonnet 5.5 uspokaja, że prompty z Sonnet 5 powinny działać bez zmian. Kłopot siedzi w linijkach korygujących dopisywanych przez kilka generacji modeli, więc prompt engineering przy migracji zaczyna się od sprzątania.

Co usunąć. Dobre praktyki każą przyciszyć instrukcje przeciw lenistwu: zamiast „CRITICAL: You MUST use this tool when...” wystarczy „Use this tool when...”. Usuń „minimize tool calls” i „only use tools when strictly necessary”, a także „hold all findings for the final response”, które tłumi notatki pisane teraz między wywołaniami narzędzi.

Dwa usunięcia są ważniejsze od reszty. Prośba o mniej myślenia nie zmniejsza go w wiarygodny sposób, a z between_tools zwiększa szansę, że model wypisze wewnętrzne tagi XML w odpowiedzi. Obniż effort zamiast tego. Prośby o wypisanie rozumowania prowadzą teraz do odmów w kategorii reasoning_extraction.

Co dodać. Dokumentacja opisuje kilka linijek ze zmierzonym efektem, w oryginalnym angielskim brzmieniu.

Linijki warte dodania i efekt, który raportuje Anthropic
DodajGdzieRaportowany efekt
„Think the problem through before you answer.”Odpowiedzi w JSONNa high trafność bliska xhigh
Akapit o weryfikacji („When you change code that can be run... run a real check...”)Agenci kodujący na lowPominięte testy stają się rzadkie, bez zmiany jakości
Akapit o zatrzymaniu („When the work ... is done and its checks pass, stop and report...”)Długie sesje agentoweKoszt sesji na max niższy o około jedną trzecią
Akapit „search first” („Use the search tool to check specifics...”)Wsparcie i researchAktualne źródła zamiast wiedzy z treningu

Testowanie i dopracowanie. Effort to teraz główne pokrętło, a poziom z Sonnet 5 warto przetestować od nowa, zamiast go kopiować. Dokumentacja effort radzi zacząć od high, chyba że praca jest agentowa albo wrażliwa na opóźnienia. Dla agentowego kodowania: medium przy dobrze opisanych zadaniach, high przy trudniejszych. Dla czatu: medium albo low. Potem ewaluacja na dwóch lub trzech poziomach. Każdy nasz projekt agentowy przechodzi przez taki przegląd przed zmianą modelu i gdybyśmy mogli zostawić tylko jeden krok z tego artykułu, zostałby ten.

4. Pięć ustawień z Sonnet 5 zwraca teraz błąd 400

Release notes mówią wprost, że kod pod Sonnet 5 może się zepsuć na Sonnet 5.5 na pięć sposobów. To zmiany łamiące kompatybilność (breaking changes), ale każda wychodzi głośno w pierwszym przebiegu testów.

Ustawienie, błąd, poprawka
Kod z Sonnet 5 wysyłaClaude Sonnet 5.5 zwracaPoprawka
thinking: {"type": "disabled"}400 ze wskazaniem na between_toolsAdaptive thinking na low albo between_tools na high lub niżej
tool_choice z any / tool400: tool_choice: type "tool" and "any" are not supported for this model.auto plus strict: true albo structured outputs
Bloki thinking odtworzone po edycji historii400 na kontach założonych od 31.08.2026Historia tylko dopisywana; drop_block (tylko adaptive)
computer_20251124400 w Claude API i Google Cloudcomputer_toolset_20260801; Bedrock przyjmuje stare narzędzie
Advisor na Opus 4.8 / 4.7 / 4.6, Sonnet 5 lub 4.6400Opus 5 / 5.5, Sonnet 5.5, Fable lub Mythos 5 / 5.1

Wyłączony thinking ma zasady. between_tools działa tylko na effort high lub niżej, nie dopuszcza innych pól w thinking i odrzuca zmianę effort dla pojedynczej wiadomości. Najpierw sprawdź adaptive thinking na low, gdzie model pomija myślenie przy większości prostych zapytań. Addy Osmani pisze, że z between_tools czas odpowiedzi jest taki sam lub krótszy. Zmierz oba warianty.

Sprawdzaj biblioteki. W zgłoszeniu w projekcie kinby kod nigdzie sam nie ustawiał tool_choice. Robił to with_structured_output() z LangChaina, a poprawką było method="json_schema". auto nie gwarantuje wywołania, więc sprawdzaj, czy się odbyło. Na Bedrocku structured outputs i strict tool use nie są dostępne dla Sonnet 5.5, więc walidacja zostaje po twojej stronie.

Bloki thinking są powiązane. Sonnet 5.5 czyta bloki z Sonnet 5, więc trwające rozmowy przechodzą, ale żaden inny model nie czyta bloków Sonnet 5.5 i są po cichu pomijane. Dokumentacja preserved thinking dodaje kontrolę historii dla kont założonych od 31 sierpnia 2026 w Claude API, na Bedrocku i w Google Cloud: odtworzenie bloku po edycji system promptu, narzędzi lub wcześniejszych wiadomości daje 400. Beri opisuje, że automatyczna kompakcja w frameworku Turnstone wyłożyła się właśnie na tym.

Starsze modele i stare tutoriale. Z Sonnet 4.6 lub starszego budget_tokens trzeba zamienić na effort. Z Sonnet 4.5 i Haiku 4.5 prefill asystenta daje 400. Warto o tym pamiętać przy polskich poradnikach: tekst jsystems.pl o prompt engineeringu dla Claude z czerwca 2026 wciąż uczy budget_tokens i prefillu, a oba dają 400 na modelach Sonnet 5.x. Kto jest na Haiku 4.5, może poczekać: VentureBeat podaje, że Haiku 5.5 pojawi się w ciągu tygodni.

5. Nowe funkcje Claude Sonnet 5.5 oszczędzają na cache i opóźnieniach

Effort dla pojedynczej wiadomości (beta mid-conversation-output-config-2026-07-01) pozwala podnieść poziom dla jednego trudnego pytania w sesji na low. Ma to znaczenie, bo zmiana effort na poziomie całego zapytania unieważnia cache promptu. Wymaga adaptive thinking.

Wiadomości systemowe w trakcie rozmowy i narzędzia inline pozwalają dodać instrukcję lub narzędzie przez dopisanie, bez edycji system promptu, więc wcześniejsze bloki thinking zostają ważne. Jedno ostrzeżenie z dokumentacji: nigdy nie wkładaj tekstu użytkownika do bloku tool_result.

Kompakcja na żądanie (beta compact-2026-09-04, od 14 września) daje długim sesjom agentowym kontrolowany moment na zmniejszenie kontekstu zamiast ręcznej edycji historii.

Notatki o postępie zmieniły kształt. Tekst między wywołaniami narzędzi wraca w blokach thinking, domyślnie pustych, więc interfejs renderujący tylko text milknie bez błędu. Z adaptive thinking ustaw display: "updates" albo "summarized".

Drobiazgi też się sumują. Systemowy prompt dla tool use ma 286 tokenów zamiast 354, a krótkie prompty cache'ują się od 512 tokenów. Lovable raportuje w VentureBeat o jedną trzecią mniej wywołań narzędzi, ale to ich obciążenie, nie twoje.

6. Po przejściu mierz koszt ukończonego zadania

Przy tej samej cenie za token liczba, która się rusza, to koszt ukończonego zadania: wszystkie tokeny, łącznie z thinking, podzielone przez zadania, które przeszły ewaluację.

Metryki po migracji
MetrykaDlaczego się zmieniaNa co patrzeć
Koszt ukończonego zadaniaEffort steruje tokenami wyjściowymiPorównanie z punktem odniesienia dla każdego poziomu
Wywołania narzędzi na zadanieCzęsto mniej na Sonnet 5.5Zero wywołań narzędzia, które jest potrzebne
Czas do pierwszego tokenu (p50, p95)Thinking przed odpowiedziąlow pomija go przy prostych zapytaniach
Odmowy według kategoriicyber, bio, frontier_llm, reasoning_extraction, general_harmsSprawdzaj stop_reason przed content

Odmowy znowu kosztują. Odmowa to HTTP 200 ze stop_reason: "refusal". Od 24 września odmowy przed jakimkolwiek wyjściem w kategoriach bio, frontier_llm i reasoning_extraction są naliczane. Server-side fallback ponawia na Sonnet 5 tylko cyber i frontier_llm; resztę obsługujesz sam.

Ciche regresje. Niektóre awarie nie rzucają błędem. Po przełączeniu routera lub fallbacku kolejne tury lecą bez rozumowania Sonnet 5.5. stop_reason: "max_tokens" z JSON-em, który akurat się parsuje, to nadal porażka; dla agentowego kodowania dokumentacja zaleca max_tokens 128 000 i streaming.

Zamknij pętlę. W smoke teście sprawdzaj, czy response.model zaczyna się od claude-sonnet-5-5. Uwaga na prefiks: zaczyna się też od claude-sonnet-5, więc stary test pod Sonnet 5 przejdzie na obu. Niezmierzone zmiany to wspólny wątek tekstu dlaczego wdrożenia AI się nie udają, a zmiana modelu jest właśnie taką zmianą.

7. Następną zmianę modelu zaplanuj zawczasu

Najcenniejszym efektem tej migracji jest procedura, którą da się powtórzyć. Strona o wycofywaniu modeli obiecuje co najmniej 60 dni wyprzedzenia i podaje najwcześniejsze daty.

Najwcześniejsze daty wycofania, stan na 29 września 2026
ModelWycofanie
claude-sonnet-5-5Nie wcześniej niż 28.09.2027
claude-sonnet-5Nie wcześniej niż 30.06.2027
claude-sonnet-4-6Nie wcześniej niż 17.02.2027
claude-sonnet-4-5-20250929Nie wcześniej niż 29.09.2026 (data minęła; brak ogłoszenia wycofania na 29.09.2026)
claude-haiku-4-5-20251001Nie wcześniej niż 15.10.2026

Zapisz w zakładkach release notes, stronę o wycofywaniu modeli i stronę o promptowaniu konkretnego modelu. Dobre praktyki dodają zasadę stojącą za każdym punktem tutaj: prompt dopracowany pod jeden model sprawdź na własnych ewaluacjach, zanim użyjesz go z innym. Historia zmian na dole zapisze każdą naszą weryfikację dat.

To też dobry moment, żeby zapytać, czy dana ścieżka w ogóle potrzebuje modelu; ten kompromis opisuje tekst agenci czy workflow.

Checklista migracji do przejścia samodzielnie

Zbierz punkt odniesienia na obecnym modelu: wynik, tokeny, wywołania narzędzi, opóźnienie.

Sprawdź rezydencję danych, jeśli dziś korzystasz z routingu ograniczonego do UE.

Przeszukaj repozytorium według tabeli z punktu 2, łącznie z bibliotekami i konfiguracją.

Podmień ID na claude-sonnet-5-5 (anthropic.claude-sonnet-5-5 na Bedrocku).

Zastąp wyłączony thinking adaptive thinking na low albo between_tools na high lub niżej.

Zastąp wymuszony `tool_choice` przez auto ze strict: true lub structured outputs i sprawdzaj, czy wywołanie się odbyło.

Posprzątaj po 4.x: budget_tokens, parametry próbkowania, prefille.

Tylko dopisuj do historii i odsyłaj bloki thinking bez zmian.

Zaktualizuj computer use i advisora.

Obsłuż odmowy według kategorii, zanim przeczytasz content.

Popraw prompty: usuń prośby o mniej myślenia i o wypisanie rozumowania, dodaj udokumentowane akapity.

Przejdź przez poziomy effort i ustaw effort jawnie.

Porównaj koszt ukończonego zadania i opóźnienie p95, a w smoke teście sprawdzaj prefiks response.model.

Jeśli chcesz, żeby ktoś z zewnątrz spojrzał na agenta działającego na Claude, to jedna z rzeczy, które sprawdzamy, gdy umówisz bezpłatny audyt procesów. Checklista działa jednak bez nas, a dwa pierwsze punkty warto zrobić jeszcze w tym tygodniu, nawet jeśli samo przejście poczeka miesiąc.

FAQ

Jak pisać prompty do Claude Sonnet 5.5 po migracji?

Rdzeń promptów z Sonnet 5 zwykle może zostać. Usuń prośby o mniej myślenia i o wypisywanie rozumowania, a udokumentowane akapity dodaj tam, gdzie ewaluacja pokaże, że pomagają. Myślenie reguluj poziomem effort, nie treścią promptu.

Czy Claude Sonnet 5.5 jest tańszy od Sonnet 5?

Za token nie: oba kosztują $2 / $10 za milion tokenów. Za zadanie zależy to od effort. Anthropic podaje, że na low lub medium model bije najlepszy wynik Sonnet 5 za około dziesiątą część kosztu zadania, a Artificial Analysis zmierzyło około 50% więcej na zadanie na max.

Czy mogę zostawić wyłączony thinking?

Nie przez disabled, które zwraca 400. Najbliżej jest between_tools, ograniczone do effort high lub niżej i bez innych pól w thinking. Najpierw przetestuj adaptive thinking na low.

Czy da się utrzymać przetwarzanie danych w UE?

Na dziś ani Claude API, gdzie inference_geo ma tylko us i global, ani Bedrock, gdzie regiony UE obsługują Sonnet 5.5 wyłącznie przez profil globalny, tego nie zapewniają. Google Cloud ma multi-region eu z dopłatą 10%, ale dostępność Sonnet 5.5 w nim trzeba sprawdzić na stronie modelu.

Historia zmian
  • 29 września 2026Publikacja.
Bezpłatny audyt procesów

Zobacz, jak wyglądałoby to w Twoich procesach.

Skontaktuj się

30 minut · wskazujemy 3 najlepsze obszary do automatyzacji · bez zobowiązań