Przejdź do treści

Claude Haiku 5.5: od 10 centów za milion tokenów. Kiedy mały model wystarczy

Rejestr pomiarowy: karta modelu Claude Haiku 5.5 ze stawkami 0,10 USD wejście i 0,50 USD wyjście za milion tokenów, miara amber ok. 75% taniej niż Haiku 4.5, pieczątka DOSTĘPNY, miary kontekstu 1 000 000 tokenów i pięć poziomów wysiłku, na wybrzeżu kapsuły Sonnet 5.5 cache przecięty o połowę i kredyt API 100-500 USD miesięcznie dla Max i Team

W środę, siódmego października wieczorem czasu polskiego, Anthropic dołączyło do rodziny Claude model Haiku 5.5, najmniejszy i najtańszy w stawce. Za milion tokenów wejścia płaci się od dziesięciu centów, za tyle samo tokenów wyjścia od pięćdziesięciu. Poprzedni Haiku kosztował dolara i pięć dolarów, więc przy typowych promptach rachunek spada o 90 procent. Producent liczy oszczędność średnio na 75 procent, bo rozbieżność bierze się z progu: prompty dłuższe niż 100 tysięcy tokenów są tańsze tylko o połowę. Model stoi od razu w API i u trzech dostawców chmur, a przy okazji premiery Anthropic przecięło o połowę ceny odczytu pamięci podręcznej Sonneta 5.5 i zapowiedziało miesięczne kredyty API dla planów Max i Team.

Ceną za te pieniądze jest klasa modelu, tylko że ta klasa właśnie przesunęła się o pokolenie. Haiku 5.5 bije własnego większego poprzednika w niemal wszystkich pomiarach z karty modelu, a w części wyprzedza też GPT-6 Lunę, odpowiednika do zadań szybkich u OpenAI. W skali pracy zawodowej GDPval-AA punktował 1620 wobec 735 u Haiku 4.5, 1437 u GPT-6 Luna i 1840 u Sonnet 5.5. W teście obsługi komputera OSWorld 2.1 zebrał 72,4 procenta, gdy Haiku 4.5 miał 15,7, a Sonnet 5.5 83,9. Przy rozumowaniu eksperckim w Humanity’s Last Exam wyszło 45,9 procenta bez narzędzi wobec 10,2 procenta poprzednika. Nawet w kodzie agenticznym, gdzie Haiku 4.5 nie zdobył ani jednego punktu Terminal-Bench 4.0, nowy zalicza 39,2 procenta, tylko że Sonnet 5.5 i tu jest ponad trzydzieści punktów przed nim, przy 70,6.

Co dostajesz za te pieniądze

Haiku 5.5 to pierwszy mały model Anthropic z regulacją wysiłku. Suwak ma pięć pozycji, od low do max, domyślnie stoi medium, a myślenie modelu dopasowuje się do zadania, więc ten sam identyfikator potrafi zarówno odpowiadać błyskawicznie, jak i myśleć dłużej nad trudniejszą sprawą. Kontekst wejścia to milion tokenów, wyjścia 128 tysięcy, wiedza sięga czerwca 2026, a Anthropic gwarantuje dostępność modelu co najmniej do października 2027.

Zastosowania producent opisuje wprost: praca dużej objętości, w której liczy się koszt i tempo. Streszczenia, kompresja kontekstu w dłuższych sesjach agenta, zapytania do baz, klasyfikacja zgłoszeń. Do tego rola podwykonawcy przy kodowaniu, gdzie Haiku 5.5 pracuje jako subagent obok Opusa 5.5 albo Sonnet 5.5, i zadania wrażliwe na opóźnienia, bo to najszybszy model w rodzinie. Firma Cognition podała, że jej narzędzie Devin Fusion z Haiku 5.5 jako asystentem trzyma wysoką pozycję FrontierCode 66,2 przy niższym koszcie i krótszym czasie odpowiedzi, a Box mierzył 11 punktów poprawy względem Haiku 4.5 przy połowie opóźnienia. AlphaSense, które odpala osiem milionów wywołań tygodniowo na samych pytaniach do dokumentów, widziało 0,84 wobec 0,76 w ich wewnętrznej skali.

W karcie modelu jest też rozdział o bezpieczeństwie. Zabezpieczenia cyber są ostrzejsze niż w Haiku 4.5, ale luźniejsze niż w Sonnecie 5.5: więcej zadań defensywnych przechodzi, natomiast testy penetracyjne i techniki blisko ataku dalej wpadają w filtr. Zasady dla biologii wyglądają jak w Sonnecie i Opusie. Anthropic zalicza mniejszą liczbę zachowań niezgodnych z intencją użytkownika niż u poprzednika, co przy małym modelu pracującym masowo ma znaczenie praktyczne: filtr rzadziej omyłkowo zatrzymuje zwykłe zadania.

Ile kosztuje Haiku 5.5

Cennik jest dwupoziomowy i to jest zmiana, na którą trzeba uważać przy szacowaniu rachunku. Do 100 tysięcy tokenów promptu płaci się 0,10 dolara za milion tokenów wejścia i 0,50 za wyjścia. Powyżej tego progu stawki rosną do 0,50 i 2,50 dolara. Odczyt z pamięci podręcznej kosztuje 0,01 dolara w tańszym przedziale, zapis 0,125. Anthropic uspokaja jedną liczbą: prompty do 100 tysięcy tokenów to około 90 procent zapytań, jakie trafiały do poprzedniego Haiku, więc większość ruchu trafi na niższą półkę.

ModelWejście (USD za 1M)Wyjście (USD za 1M)Odczyt cache
Haiku 5.50,10 (powyżej 100k: 0,50)0,50 (powyżej 100k: 2,50)0,01 / 0,05
Haiku 4.51,005,000,10
Sonnet 5.52,0010,000,10 od 7.10 (było 0,20)
Opus 5.54,0020,000,20
Fable 5.110,0050,000,25

Druga decyzja premiery dotyka ludzi płacących za Sonnet. Odczyt pamięci podręcznej Sonnet 5.5 potaniał z 0,20 do 0,10 dolara za milion tokenów, a skoro odczyty robią dużą część ruchu w pracy agentowej, Anthropic wylicza około 20 procent oszczędności na typowych zadaniach bez zmiany modelu. O Sonnecie 5.5 i tym, jak wypada wobec Opusa, pisaliśmy osobno w dniu jego premiery.

Trzeci element to miesięczne kredyty API dla abonamentów. Max z pięciokrotnością limitów Pro dostanie 100 dolarów kredytu na miesiąc, Max z dwudziestokrotnością 200 dolarów, a plany Team do 500 dolarów na wspólną pulę. Kredyty wchodzą w tym tygodniu, działają na dowolny model i pokrywają API, Agent SDK oraz Managed Agents, przy czym trzeba je odebrać do organizacji w konsoli Claude i zużywać z klucza API tej organizacji. Równolegle znika ogłoszony w czerwcu osobny kredyt na Agent SDK. Dla kogoś, kto buduje własne narzędzia po godzinach, to realna zmiana: część pracy przeniesie się z limitu subskrypcji na ten budżet, a Haiku 5.5 sprawia, że wydaje się on wyraźnie wolniej.

Kiedy mały model wystarczy

Najuczciwsza odpowiedź siedzi w samym ogłoszeniu. Anthropic pokazuje wykres Terminal-Bench 4.0, na którym Sonnet 5.5 i Opus 5.5 wygrywają z Haiku 5.5 z dużym zapasem, i pisze, że złożona praca agentowa nad kodem zostaje przy większych modelach. Haiku ma brać zadania wąsko zakrojone, które przy starych cenach w ogóle nie były opłacalne: skróty, podsumowania, praca subagenta. Ta zasada była tematem naszego tekstu o Sonnecie 5.5, codzienna robota na mniejszym modelu, ciężkie sprawy na flagowcu, tylko że teraz doszedł trzeci, najtańszy poziom tej drabiny.

Z pozamodelowych testów na Hacker News ktoś sprawdził generowanie złożonego interfejsu ze zrzutu ekranu i Haiku 5.5 nie dał rady tam, gdzie Opus 5.5 tak. Pojedyncza próba, nie benchmark, ale pasuje do ogólnego układu: przy zadaniach wymagających długiego, spójnego planowania mały model przepłaca klasą. Tam jednak, gdzie chodzi o liczbę wywołań na godzinę, wygrywa proporcją ceny do wyniku i realnie obniża rachunek.

Jak go dostać

W API model pracuje pod identyfikatorem claude-haiku-5-5, poziom wysiłku ustawia się parametrem effort. Poza infrastrukturą Anthropic model jest obecny od pierwszego dnia w Amazon Web Services, Google Cloud i Microsoft Azure. Czego materiały premiery nie mówią, to dostępność w aplikacji Claude, więc czy Haiku 5.5 pojawi się na planie darmowym lub Pro w aplikacji, nie potwierdzę. Jeśli się tam dostanie, dopiszę aktualizację.

Claude w Polsce

Z polskiej perspektywy niewiele się zmienia. Rozliczenie idzie w dolarach, polskiego cennika brak, a Polska jest na liście wspieranych krajów, sprawdziłem to dziś na stronie Anthropic. Jak wygląda ogółem praca z Claude z Polski, koszt planów i brak polskiego interfejsu, opisywaliśmy w poradniku o Claude po polsku. Ceny planów i modeli w jednym miejscu zbiera nasza tabela narzędzi AI.

Na koniec uczciwie: modelu nie testowaliśmy, bo tekst powstał kilka godzin po premierze. Wszystkie benchmarki pochodzą z materiałów Anthropic, w tym cytaty klientów, więc traktujcie je jak deklaracje producenta, nie jak niezależny pomiar. Ceny i dostępność sprawdziłem w oficjalnym cenniku, dokumentacji API i na liście wspieranych krajów 7 października 2026. Gdy pojawią się niezależne testy albo model trafi do aplikacji, zaktualizuję ten tekst.

Źródła

  • Anthropic, 7.10.2026: karta modelu Haiku 5.5 (benchmarki, ceny, zabezpieczenia, dostępność) → anthropic.com
  • Claude.com, dostęp 7.10.2026: cennik planów i API (Haiku 5.5 w dwóch przedziałach, cache read Sonnet 5.5 przecięty do 0,10 USD) → claude.com
  • Anthropic, dokumentacja API, dostęp 7.10.2026: przegląd modeli (kontekst 1M, wyjście 128K, cutoff czerwiec 2026, terminy wycofania) → platform.claude.com
  • Anthropic, dokumentacja API, dostęp 7.10.2026: tabela cen wszystkich modeli (wejście, wyjście, cache) → platform.claude.com
  • Anthropic Support, aktualizacja 7.10.2026: miesięczne kredyty API dla Max i Team obejmują Agent SDK i API, koniec osobnego kredytu z czerwca → support.claude.com
  • Hacker News, od 7.10.2026: wątek „Claude Haiku 5.5″, obserwacje użytkowników (test interfejsu ze zrzutu, dyskusja o cenniku dwupoziomowym) → news.ycombinator.com

Powiązane artykuły