Anthropic 7. října uvedl Claude Haiku 5.5 a u krátkých promptů snížil základní ceny vstupu i výstupu o 90 procent proti Haiku 4.5. Milion vstupních tokenů stojí 0,10 dolaru a milion výstupních 0,50 dolaru, pokud prompt nepřekročí 100 tisíc tokenů. Model přitom zvládá milionový kontext a nově umožňuje nastavit intenzitu uvažování.
Desetina ceny za token, ale dvě cenová pásma
Největší změna je vidět v oficiálním oznámení Anthropicu. Haiku 4.5 má základní sazby 1 dolar za milion vstupních a 5 dolarů za milion výstupních tokenů. Nové Haiku je do hranice 100 tisíc tokenů v promptu desetkrát levnější. Pokud je vstup delší, sazby Haiku 5.5 se zvyšují pětinásobně; proti předchůdci pak zůstává poloviční cena.
| Sazba za milion tokenů | Haiku 4.5 | Haiku 5.5: prompt do 100 000 tokenů | Haiku 5.5: prompt nad 100 000 tokenů |
|---|---|---|---|
| Vstup | 1,00 USD | 0,10 USD | 0,50 USD |
| Výstup | 5,00 USD | 0,50 USD | 2,50 USD |
| Čtení z cache | 0,10 USD | 0,01 USD | 0,05 USD |
| Zápis do cache na 5 minut | 1,25 USD | 0,125 USD | 0,625 USD |
Zdroj: ceník Anthropicu a oznámení modelu, ověřeno 9. října 2026. Cache umožňuje opakovaně používat uloženou část vstupu, například stejné zadání nebo dokumenty.
Pro představu: požadavek s 20 tisíci vstupními a 2 tisíci účtovanými výstupními tokeny vyjde bez cache na 0,003 dolaru místo 0,03 dolaru u Haiku 4.5. Jde o srovnání při stejné spotřebě tokenů. Anthropic uvádí, že provoz nového modelu vychází v průměru přibližně o 75 procent levněji; do tohoto odhadu zahrnuje rozdělení požadavků podle délky i změnu spotřeby tokenů mezi generacemi.
Parametry a ceny jsme doplnili do katalogového detailu Claude Haiku 5.5. Další modely a jejich ověřené sazby najdete v našem katalogu AI modelů.
Milionový kontext a uvažování podle úkolu
Haiku 5.5 přijímá text a obrázky, odpovídá textem a má kontextové okno o velikosti milionu tokenů. Maximální výstup dosahuje 128 tisíc tokenů. Kontextové okno určuje, kolik informací může model zpracovávat v jednom požadavku; cenový práh je ale mnohem nižší. Rozsáhlý dokument se tedy může vejít do kontextu a současně už spadat do dražšího pásma.
Poprvé v řadě Haiku lze nastavit také úsilí věnované uvažování, označované jako effort. Model podporuje adaptivní přemýšlení. Pro rychlé vytřídění záznamů lze zvolit nižší intenzitu, pro náročnější analýzu vyšší. Toto nastavení ovlivňuje nejen výsledky, ale také spotřebu tokenů.
Anthropic model směřuje hlavně na časté, úzce vymezené úkoly: shrnutí, klasifikaci, databázové dotazy nebo vyhledání konkrétního údaje v dokumentu. V agentním systému může Haiku obsluhovat dílčí práci, zatímco složitější rozhodování zůstane většímu modelu. Pro komplexní agentní programování výrobce nadále doporučuje Sonnet 5.5 a Opus 5.5.
Nezávislé testy ukazují posun i vyšší spotřebu
V testech Artificial Analysis získalo Haiku 5.5 na nejvyšší úrovni uvažování 43 bodů v Intelligence Indexu. Proti předchozímu Haiku si polepšilo o 26 bodů. V tomto nastavení je těsně před GLM-5.3 Flash se 42 body, Gemini 3.8 Flash se 41 body a GPT-6 Luna s 38 body. Sonnet 5.5 na nejvyšší úrovni dosáhl 56 bodů.
Stejná analýza však upozorňuje, že Haiku na úrovni max spotřebovalo přibližně 162 tisíc výstupních tokenů na úlohu Intelligence Indexu, zatímco GPT-6 Luna na své nejvyšší úrovni přibližně 50 tisíc. Přechod Haiku z úrovně xhigh na max přinesl dva body navíc za přibližně 1,8násobnou spotřebu. Levná sazba tak může při náročném uvažování vést k podstatně delší účtované odpovědi.
Artificial Analysis navíc v článku ze 7. října označuje své nákladové údaje za předběžné: tehdy ještě nezahrnovaly přechod do dražšího pásma nad 100 tisíc tokenů. Výsledky kvality a ceny za dokončený úkol proto nelze zaměňovat.
Kde může levnější Haiku dávat smysl
Pro aplikaci, která zpracovává mnoho krátkých požadavků, je nová sazba podstatnější než samotná velikost kontextu. Třídění zpráv, stručná shrnutí nebo získání konkrétního údaje z dokumentu odpovídají zaměření, které popisuje Anthropic. Celý archiv není nutné posílat s každým dotazem.
Haiku 5.5 je dostupné přes Claude Platform, Amazon Web Services, Google Cloud a Microsoft Azure. Jde o model nabízený jako služba, nikoli o zveřejněné váhy pro lokální provoz. Pro české nasazení je zatím otevřenou otázkou kvalita na konkrétních českých zadáních: citované výsledky neposkytují samostatné hodnocení češtiny a vlastní český benchmark nového Haiku jsme zatím neprovedli.
Novinka tedy přináší výrazně nižší ceny tokenů i lepší výsledky v uvedených testech. Její nejsilnější nabídka ale zůstává konkrétní: krátké, opakované úkoly do 100 tisíc tokenů v promptu. Právě tam lze využít desetinu základní sazby předchozí generace.
Jak se model jmenuje v API?
Na Claude Platform má identifikátor claude-haiku-5-5.
Změnil Anthropic při uvedení Haiku i ceny Sonnetu?
Ano. Čtení z cache u Claude Sonnet 5.5 zlevnil z 0,20 na 0,10 dolaru za milion tokenů. Podle výrobce to na většině agentních úloh snižuje náklady přibližně o 20 procent; nejde o plošné snížení ceny všech tokenů.
Podklady: The Decoder, oficiální oznámení a ceník Anthropicu, Artificial Analysis. Ceny jsou uvedeny v USD za milion tokenů.