W środę, siódmego października wieczorem czasu polskiego, Anthropic dołączyło do rodziny Claude model Haiku 5.5, najmniejszy i najtańszy w stawce. Za milion tokenów wejścia płaci się od dziesięciu centów, za tyle samo tokenów wyjścia od pięćdziesięciu. Poprzedni Haiku kosztował dolara i pięć dolarów, więc przy typowych promptach rachunek spada o 90 procent. Producent liczy oszczędność średnio na 75 procent, bo rozbieżność bierze się z progu: prompty dłuższe niż 100 tysięcy tokenów są tańsze tylko o połowę. Model stoi od razu w API i u trzech dostawców chmur, a przy okazji premiery Anthropic przecięło o połowę ceny odczytu pamięci podręcznej Sonneta 5.5 i zapowiedziało miesięczne kredyty API dla planów Max i Team.
Ceną za te pieniądze jest klasa modelu, tylko że ta klasa właśnie przesunęła się o pokolenie. Haiku 5.5 bije własnego większego poprzednika w niemal wszystkich pomiarach z karty modelu, a w części wyprzedza też GPT-6 Lunę, odpowiednika do zadań szybkich u OpenAI. W skali pracy zawodowej GDPval-AA punktował 1620 wobec 735 u Haiku 4.5, 1437 u GPT-6 Luna i 1840 u Sonnet 5.5. W teście obsługi komputera OSWorld 2.1 zebrał 72,4 procenta, gdy Haiku 4.5 miał 15,7, a Sonnet 5.5 83,9. Przy rozumowaniu eksperckim w Humanity’s Last Exam wyszło 45,9 procenta bez narzędzi wobec 10,2 procenta poprzednika. Nawet w kodzie agenticznym, gdzie Haiku 4.5 nie zdobył ani jednego punktu Terminal-Bench 4.0, nowy zalicza 39,2 procenta, tylko że Sonnet 5.5 i tu jest ponad trzydzieści punktów przed nim, przy 70,6.
- Co dostajesz za te pieniądze
- Ile kosztuje Haiku 5.5
- Kiedy mały model wystarczy
- Jak go dostać
- Claude w Polsce
- Źródła
Co dostajesz za te pieniądze
Haiku 5.5 to pierwszy mały model Anthropic z regulacją wysiłku. Suwak ma pięć pozycji, od low do max, domyślnie stoi medium, a myślenie modelu dopasowuje się do zadania, więc ten sam identyfikator potrafi zarówno odpowiadać błyskawicznie, jak i myśleć dłużej nad trudniejszą sprawą. Kontekst wejścia to milion tokenów, wyjścia 128 tysięcy, wiedza sięga czerwca 2026, a Anthropic gwarantuje dostępność modelu co najmniej do października 2027.
Zastosowania producent opisuje wprost: praca dużej objętości, w której liczy się koszt i tempo. Streszczenia, kompresja kontekstu w dłuższych sesjach agenta, zapytania do baz, klasyfikacja zgłoszeń. Do tego rola podwykonawcy przy kodowaniu, gdzie Haiku 5.5 pracuje jako subagent obok Opusa 5.5 albo Sonnet 5.5, i zadania wrażliwe na opóźnienia, bo to najszybszy model w rodzinie. Firma Cognition podała, że jej narzędzie Devin Fusion z Haiku 5.5 jako asystentem trzyma wysoką pozycję FrontierCode 66,2 przy niższym koszcie i krótszym czasie odpowiedzi, a Box mierzył 11 punktów poprawy względem Haiku 4.5 przy połowie opóźnienia. AlphaSense, które odpala osiem milionów wywołań tygodniowo na samych pytaniach do dokumentów, widziało 0,84 wobec 0,76 w ich wewnętrznej skali.
W karcie modelu jest też rozdział o bezpieczeństwie. Zabezpieczenia cyber są ostrzejsze niż w Haiku 4.5, ale luźniejsze niż w Sonnecie 5.5: więcej zadań defensywnych przechodzi, natomiast testy penetracyjne i techniki blisko ataku dalej wpadają w filtr. Zasady dla biologii wyglądają jak w Sonnecie i Opusie. Anthropic zalicza mniejszą liczbę zachowań niezgodnych z intencją użytkownika niż u poprzednika, co przy małym modelu pracującym masowo ma znaczenie praktyczne: filtr rzadziej omyłkowo zatrzymuje zwykłe zadania.
Ile kosztuje Haiku 5.5
Cennik jest dwupoziomowy i to jest zmiana, na którą trzeba uważać przy szacowaniu rachunku. Do 100 tysięcy tokenów promptu płaci się 0,10 dolara za milion tokenów wejścia i 0,50 za wyjścia. Powyżej tego progu stawki rosną do 0,50 i 2,50 dolara. Odczyt z pamięci podręcznej kosztuje 0,01 dolara w tańszym przedziale, zapis 0,125. Anthropic uspokaja jedną liczbą: prompty do 100 tysięcy tokenów to około 90 procent zapytań, jakie trafiały do poprzedniego Haiku, więc większość ruchu trafi na niższą półkę.
| Model | Wejście (USD za 1M) | Wyjście (USD za 1M) | Odczyt cache |
|---|---|---|---|
| Haiku 5.5 | 0,10 (powyżej 100k: 0,50) | 0,50 (powyżej 100k: 2,50) | 0,01 / 0,05 |
| Haiku 4.5 | 1,00 | 5,00 | 0,10 |
| Sonnet 5.5 | 2,00 | 10,00 | 0,10 od 7.10 (było 0,20) |
| Opus 5.5 | 4,00 | 20,00 | 0,20 |
| Fable 5.1 | 10,00 | 50,00 | 0,25 |
Druga decyzja premiery dotyka ludzi płacących za Sonnet. Odczyt pamięci podręcznej Sonnet 5.5 potaniał z 0,20 do 0,10 dolara za milion tokenów, a skoro odczyty robią dużą część ruchu w pracy agentowej, Anthropic wylicza około 20 procent oszczędności na typowych zadaniach bez zmiany modelu. O Sonnecie 5.5 i tym, jak wypada wobec Opusa, pisaliśmy osobno w dniu jego premiery.
Trzeci element to miesięczne kredyty API dla abonamentów. Max z pięciokrotnością limitów Pro dostanie 100 dolarów kredytu na miesiąc, Max z dwudziestokrotnością 200 dolarów, a plany Team do 500 dolarów na wspólną pulę. Kredyty wchodzą w tym tygodniu, działają na dowolny model i pokrywają API, Agent SDK oraz Managed Agents, przy czym trzeba je odebrać do organizacji w konsoli Claude i zużywać z klucza API tej organizacji. Równolegle znika ogłoszony w czerwcu osobny kredyt na Agent SDK. Dla kogoś, kto buduje własne narzędzia po godzinach, to realna zmiana: część pracy przeniesie się z limitu subskrypcji na ten budżet, a Haiku 5.5 sprawia, że wydaje się on wyraźnie wolniej.
Kiedy mały model wystarczy
Najuczciwsza odpowiedź siedzi w samym ogłoszeniu. Anthropic pokazuje wykres Terminal-Bench 4.0, na którym Sonnet 5.5 i Opus 5.5 wygrywają z Haiku 5.5 z dużym zapasem, i pisze, że złożona praca agentowa nad kodem zostaje przy większych modelach. Haiku ma brać zadania wąsko zakrojone, które przy starych cenach w ogóle nie były opłacalne: skróty, podsumowania, praca subagenta. Ta zasada była tematem naszego tekstu o Sonnecie 5.5, codzienna robota na mniejszym modelu, ciężkie sprawy na flagowcu, tylko że teraz doszedł trzeci, najtańszy poziom tej drabiny.
Z pozamodelowych testów na Hacker News ktoś sprawdził generowanie złożonego interfejsu ze zrzutu ekranu i Haiku 5.5 nie dał rady tam, gdzie Opus 5.5 tak. Pojedyncza próba, nie benchmark, ale pasuje do ogólnego układu: przy zadaniach wymagających długiego, spójnego planowania mały model przepłaca klasą. Tam jednak, gdzie chodzi o liczbę wywołań na godzinę, wygrywa proporcją ceny do wyniku i realnie obniża rachunek.
Jak go dostać
W API model pracuje pod identyfikatorem claude-haiku-5-5, poziom wysiłku ustawia się parametrem effort. Poza infrastrukturą Anthropic model jest obecny od pierwszego dnia w Amazon Web Services, Google Cloud i Microsoft Azure. Czego materiały premiery nie mówią, to dostępność w aplikacji Claude, więc czy Haiku 5.5 pojawi się na planie darmowym lub Pro w aplikacji, nie potwierdzę. Jeśli się tam dostanie, dopiszę aktualizację.
Claude w Polsce
Z polskiej perspektywy niewiele się zmienia. Rozliczenie idzie w dolarach, polskiego cennika brak, a Polska jest na liście wspieranych krajów, sprawdziłem to dziś na stronie Anthropic. Jak wygląda ogółem praca z Claude z Polski, koszt planów i brak polskiego interfejsu, opisywaliśmy w poradniku o Claude po polsku. Ceny planów i modeli w jednym miejscu zbiera nasza tabela narzędzi AI.
Na koniec uczciwie: modelu nie testowaliśmy, bo tekst powstał kilka godzin po premierze. Wszystkie benchmarki pochodzą z materiałów Anthropic, w tym cytaty klientów, więc traktujcie je jak deklaracje producenta, nie jak niezależny pomiar. Ceny i dostępność sprawdziłem w oficjalnym cenniku, dokumentacji API i na liście wspieranych krajów 7 października 2026. Gdy pojawią się niezależne testy albo model trafi do aplikacji, zaktualizuję ten tekst.
Źródła
- Anthropic, 7.10.2026: karta modelu Haiku 5.5 (benchmarki, ceny, zabezpieczenia, dostępność) → anthropic.com
- Claude.com, dostęp 7.10.2026: cennik planów i API (Haiku 5.5 w dwóch przedziałach, cache read Sonnet 5.5 przecięty do 0,10 USD) → claude.com
- Anthropic, dokumentacja API, dostęp 7.10.2026: przegląd modeli (kontekst 1M, wyjście 128K, cutoff czerwiec 2026, terminy wycofania) → platform.claude.com
- Anthropic, dokumentacja API, dostęp 7.10.2026: tabela cen wszystkich modeli (wejście, wyjście, cache) → platform.claude.com
- Anthropic Support, aktualizacja 7.10.2026: miesięczne kredyty API dla Max i Team obejmują Agent SDK i API, koniec osobnego kredytu z czerwca → support.claude.com
- Hacker News, od 7.10.2026: wątek „Claude Haiku 5.5″, obserwacje użytkowników (test interfejsu ze zrzutu, dyskusja o cenniku dwupoziomowym) → news.ycombinator.com
