Aktualności, narzędzia i prawo AIPolska · codziennie
Narzędzia

Claude Haiku 5.5. Cena, możliwości i co zmienia się po migracji

Anthropic udostępnił Claude Haiku 5.5. Najmniejszy model rodziny 5.5 jest dużo tańszy od Haiku 4.5, ma okno 1 mln tokenów i regulowany poziom rozumowania.

Kobieta w okularach i brodaty mężczyzna w biurze z ceglanymi ścianami analizują na monitorze listę zgłoszeń klientów posortowanych w kolorowe kolejki
Ilustracja redakcyjna dailyAI

Claude Haiku 5.5 to nowy, najmniejszy model Anthropic, udostępniony 7 października 2026 roku w API, Amazon Bedrock, Google Cloud i Microsoft Foundry. Przy zapytaniach do 100 tys. tokenów kosztuje 0,10 USD za milion tokenów wejściowych i 0,50 USD za milion wyjściowych, czyli 10 razy mniej za token niż Haiku 4.5. Anthropic szacuje, że w praktyce model jest średnio o ok. 75 proc. tańszy w działaniu. Ma okno kontekstu 1 mln tokenów i regulowany poziom rozumowania, ale przejście z Haiku 4.5 wymaga zmian w kodzie.

Czym jest Claude Haiku 5.5

Haiku to najtańsza i najszybsza linia modeli Claude, przeznaczona do zadań wykonywanych masowo: klasyfikowania zgłoszeń, wyciągania danych z dokumentów, kierowania zapytań i obsługi agentów, którzy wykonują wiele krótkich kroków. Wersja 5.5 uzupełnia rodzinę, w której Anthropic wcześniej udostępnił Sonnet 5.5 i Opus 5.5. W dokumentacji firma opisuje ją jako model do zadań o dużej skali i wrażliwych na opóźnienia.

Najważniejsza zmiana techniczna to adaptacyjne rozumowanie sterowane parametrem effort. Model sam decyduje, ile myśleć przed odpowiedzią, a programista wybiera jeden z pięciu poziomów: low, medium, high, xhigh albo max. Według Anthropic to pierwszy model klasy Haiku z taką regulacją. Haiku 5.5 obsługuje też sterowanie komputerem i przeglądarką przez narzędzia computer_toolset i browser_toolset.

Ile kosztuje Claude Haiku 5.5 w API

Haiku 5.5 jako jedyny obecny model Claude ma cenę zależną od długości zapytania. Próg wynosi 100 tys. tokenów. Przeliczenie opiera się na średnim kursie NBP z 7 października 2026 roku (tabela 195/A/NBP/2026, 1 USD = 3,9111 zł). Ceny w cenniku Anthropic nie zawierają VAT.

  • wejście: 0,10 USD (ok. 0,39 zł) do 100 tys. tokenów, 0,50 USD (ok. 1,96 zł) powyżej,
  • wyjście: 0,50 USD (ok. 1,96 zł) do 100 tys. tokenów, 2,50 USD (ok. 9,78 zł) powyżej,
  • odczyt z pamięci podręcznej: 0,01 USD (ok. 0,04 zł) lub 0,05 USD (ok. 0,20 zł),
  • zapis do pamięci podręcznej na 5 minut: 0,125 USD (ok. 0,49 zł) lub 0,625 USD (ok. 2,44 zł),
  • Batch API, czyli przetwarzanie wsadowe bez odpowiedzi w czasie rzeczywistym: połowa powyższych stawek.

Porównanie z Haiku 4.5, Sonnet 5.5 i GPT-6 Luna

Dla porównania Haiku 4.5 kosztuje 1 USD za wejście i 5 USD za wyjście, a Sonnet 5.5 odpowiednio 2 USD i 10 USD za milion tokenów. Haiku 5.5 przy krótszych zapytaniach ma więc ceny identyczne z GPT-6 Luna, najtańszym modelem rodziny GPT-6 od OpenAI. Anthropic zestawia oba modele w swoich testach i deklaruje przewagę Haiku 5.5 w większości z nich.

Wyniki pochodzą z materiałów producenta. Niezależne rankingi jeszcze ich nie potwierdziły, a pojedynczy benchmark nie mówi, jak model poradzi sobie z polskimi dokumentami w konkretnej firmie.

  • OSWorld 2.1 (obsługa komputera): Haiku 5.5 72,4 proc., Haiku 4.5 15,7 proc., GPT-6 Luna 48,9 proc., Sonnet 5.5 83,9 proc.,
  • GDPval-AA v2.1 (zadania biurowe, ranking Elo): 1620 wobec 735 dla Haiku 4.5, 1437 dla GPT-6 Luna i 1840 dla Sonnet 5.5,
  • Terminal-Bench 4.0 (praca w terminalu): 39,2 proc. wobec 0 proc. Haiku 4.5, 16,4 proc. GPT-6 Luna i 70,6 proc. Sonnet 5.5,
  • Humanity's Last Exam bez narzędzi: 45,9 proc. wobec 10,2 proc. Haiku 4.5 i 56,9 proc. Sonnet 5.5.

Ile realnie można zaoszczędzić

Spadek ceny za token nie przekłada się jeden do jednego na rachunek. Haiku 5.5 używa nowszego tokenizera, który według dokumentacji zamienia ten sam tekst na ok. 30 proc. więcej tokenów niż Haiku 4.5. Domyślnie włączone rozumowanie generuje też dodatkowe tokeny wyjściowe. Dlatego Anthropic podaje, że model jest średnio o ok. 75 proc. tańszy w działaniu, a nie o 90 proc., jak wynikałoby z samego cennika.

W naszym szacunku firma, która klasyfikuje 100 tys. zgłoszeń po ok. 3 tys. tokenów wejścia i 400 tokenów odpowiedzi (licząc tokenizerem Haiku 5.5), zapłaci za Haiku 5.5 ok. 50 USD, czyli ok. 196 zł. Ten sam tekst w Haiku 4.5 zajmie mniej tokenów, ale przy starych stawkach koszt wyniesie ok. 385 USD, czyli ok. 1504 zł. Przy niskim poziomie effort i krótkich zapytaniach oszczędność będzie bliska tej różnicy, przy długim rozumowaniu mniejsza. Szerzej o tym, dlaczego liczyć koszt całego zadania, a nie samą cenę tokenu, piszemy w osobnym tekście.

Migracja z Haiku 4.5. Co przestanie działać

Anthropic opublikował osobny przewodnik migracji. Kilka parametrów, które działały w Haiku 4.5, w nowym modelu zwraca błąd 400. Najważniejsze zmiany przed przełączeniem modelu:

  1. Zmień identyfikator na claude-haiku-5-5. Nie ma wersji z datą ani osobnego aliasu.
  2. Zastąp thinking typu enabled z budget_tokens trybem adaptive i parametrem effort. Stary zapis zwraca błąd 400.
  3. Usuń temperature, top_p i top_k. Wartości inne niż domyślne zwracają błąd.
  4. Zrezygnuj z prefillu, czyli kończenia rozmowy rozpoczętą odpowiedzią asystenta. Format wyniku wymuszaj przez structured outputs albo narzędzia z polami enum.
  5. Czytaj bloki odpowiedzi po polu type, bo odpowiedź może zaczynać się od bloku rozumowania.
  6. Przelicz limity max_tokens i budżety kosztów na nowym tokenizerze.
  7. Obsłuż stop_reason o wartości refusal. Model ma klasyfikatory bezpieczeństwa, które mogą odmówić wykonania zapytania.

Ograniczenia i niewiadome

Wszystkie wyniki jakościowe pochodzą od Anthropic i klientów testujących model przed premierą. Asana deklaruje ponad 30 proc. niższe opóźnienie, Box wynik wyższy o 11 punktów przy mniej więcej o połowę krótszym czasie odpowiedzi niż Haiku 4.5, a AlphaSense 0,84 wobec 0,76 punktu w swoim teście. To dane z ich własnych testów.

Haiku 5.5 nie obsługuje Priority Tier, czyli płatnej gwarancji przepustowości, z której część firm korzysta przy Haiku 4.5. Zabezpieczenia w obszarze cyberbezpieczeństwa dopuszczają szerszy zakres zadań obronnych niż w Sonnet 5.5, ale blokują testy penetracyjne. Haiku 4.5 pozostaje na liście dostępnych modeli, a Anthropic zobowiązał się nie wycofywać Haiku 5.5 wcześniej niż 7 października 2027 roku.

Co oznacza to dla polskich firm

Dla zespołów, które przetwarzają duże ilości tekstu po polsku, na przykład zgłoszenia klientów, faktury czy umowy, Haiku 5.5 obniża próg opłacalności automatyzacji. W naszej ocenie najrozsądniej zacząć od równoległego testu na kilkuset prawdziwych przykładach z niskim poziomem effort i porównać trafność oraz koszt z dotychczasowym modelem.

W Amazon Bedrock i Google Cloud można wybrać punkty końcowe regionalne, które gwarantują przetwarzanie w określonym regionie. Kosztują one o 10 proc. więcej niż globalne, ale ułatwiają spełnienie wymogów RODO przy danych osobowych. W bezpośrednim API Anthropic domyślnie obowiązuje routing globalny.

Razem z Haiku 5.5 Anthropic obniżył cenę odczytu z pamięci podręcznej w Claude Sonnet 5.5 z 0,20 do 0,10 USD za milion tokenów. Według firmy obniża to koszt większości zadań agentowych o ok. 20 proc. Abonenci Claude Max 5x i Max 20x otrzymują też miesięczne kredyty do API o wartości 100 USD i 200 USD, a zespoły w planie Team do 500 USD wspólnej puli. Kredyty mają trafić do kont w tym tygodniu.

Źródła i data sprawdzenia

  1. Introducing Claude Haiku 5.5Anthropic, publikacja: 2026-10-07, sprawdzono: 2026-10-07
  2. PricingAnthropic Docs, publikacja: 2026-10-07, sprawdzono: 2026-10-07
  3. Claude Haiku 5.5 migration guideAnthropic Docs, publikacja: 2026-10-07, sprawdzono: 2026-10-07
  4. Models overviewAnthropic Docs, publikacja: 2026-10-07, sprawdzono: 2026-10-07
  5. Claude Haiku 5.5 arrives with massive price cuts proving the AI pricing arms race is far from overTHE DECODER, publikacja: 2026-10-07, sprawdzono: 2026-10-07
  6. Kursy średnie walut obcych, tabela A nr 195/A/NBP/2026Narodowy Bank Polski, publikacja: 2026-10-07, sprawdzono: 2026-10-07
Nota redakcyjna

Artykuł ma charakter informacyjny. Przy decyzjach prawnych, finansowych lub organizacyjnych warto zweryfikować wnioski w odniesieniu do konkretnej sytuacji.