Přejít k hlavnímu obsahu

Claude Opus 5.5 přepisuje ceník: Stojí o 40 % méně, thinking ale nevypnete

Futuristická vizualizace umělé inteligence a neurální sítě modelu Claude Opus 5.5

Anthropic představil Claude Opus 5.5, první přírůstek nové generace modelů rodiny 5.5. Nová vlajková loď míří na absolutní špičku v agentním programování, automatizaci systémů a náročné znalostní práci. Proti předchůdci Opus 5 přináší o 40 % nižší celkové provozní náklady, generuje o třetinu rychleji a v benchmarku Terminal-Bench 4.0 dosahuje úspěšnosti 66,4 %. Vývojáři v aplikačním rozhraní i koncoví uživatelé však narazí na nová pravidla: režim uvažování (thinking mode) je nyní nedílnou součástí architektury a nelze jej vypnout.

Shrnutí v bodech

  • Provozní úspora 40 %: Vstupní tokeny zlevnily na 4 dolary a výstupní na 20 dolarů za milion, čtení z mezipaměti (cache reads) kleslo o 60 % na 0,20 dolaru.
  • Rychlost a Fast mode: Základní generování zrychlilo o více než 30 %, pro náročné vývojové cykly přibyl Fast mode nabízející až 2,5násobné tempo za 8 a 40 dolarů na milion tokenů.
  • Povinné přemýšlení: Režim adaptivního uvažování už v rozhraní ani přes API nevypnete; model je navíc chráněn mechanismem proti neautorizované destilaci myšlenkových pochodů.
  • Bezpečnost a evropská pravidla: Anthropic nasazuje přísné mantinely srovnatelné s modelem Mythos 5.1 a plní požadavky evropského nařízení AI Act pomocí strojového vodoznaku.

Skok v kódování i autonomní práci v terminálu

Anthropic u modelu Claude Opus 5.5 zdůrazňuje především posun v agentních schopnostech, kde umělá inteligence nefunguje pouze jako pasivní našeptávač kódu, ale přebírá řízení nad celými softwarovými projekty. V benchmarku Terminal-Bench 4.0, který testuje vícekrokové řešení inženýrských úkolů přímo v příkazové řádce, dosáhl Opus 5.5 skóre 66,4 % při maximálním úsilí uvažování. Pro srovnání: dosavadní Fable 5.1 dosahoval 55,8 %, Opus 5 skončil na 52,3 % a konkurenční GPT-6 Astra od OpenAI vykazuje 57,9 %.

Výrobce uvádí, že Opus 5.5 při výchozím nastavení úsilí (medium) dokáže v testu FrontierCode porazit GPT-6 Astra při zhruba pětinových nákladech na vyřešený úkol. V hodnocení CursorBench, které simuluje reálné programování v editoru nad více soubory současně, dosahuje novinka 52,5 % úspěšnosti, zatímco GPT-5.6 Sol získal 41,7 %. V praxi to znamená podstatně menší počet zbytečných volání nástrojů a schopnost provádět rozsáhlé refaktoringy. Jeden z prvních testerů dokončil migraci kódu o rozsahu 680 000 řádků za necelý den, což by lidskému inženýrskému týmu zabralo několik týdnů.

Nový ceník: Proč agenti zlevní o desítky procent

Dlouhodobou slabinou velkých modelů řady Opus byla vysoká cena za token, která vývojáře často nutila nasazovat menší Sonnet. S příchodem verze 5.5 Anthropic výrazně sáhl do cenové struktury. Náklady na standardní provoz klesly v průměru o 40 %, což je dáno nejen nižší sazbou za jednotlivé tokeny, ale také menší upovídaností modelu při zachování přesnosti.

Ceník pro vývojáře v platformě Claude Platform a cloudových službách AWS Bedrock, Google Cloud Vertex AI a Microsoft Azure přináší konkrétní sazby za milion tokenů:

  • Vstupní tokeny (prompt): 4,00 USD (pokles o 20 % z původních 5,00 USD)
  • Výstupní tokeny (generování): 20,00 USD (pokles o 20 % z původních 25,00 USD)
  • Čtení z mezipaměti (cache reads): 0,20 USD (pokles o 60 % z původních 0,50 USD)
  • Zápis do mezipaměti (cache writes): 5,00 USD (pokles z 6,25 USD)

Právě razantní pokles ceny za čtení mezipaměti na 20 centů za milion tokenů představuje pro agentní systémy klíčový obrat. Agenti typu Claude Code opakovaně odesílají do kontextu celou strukturu projektu, soubory s pravidly i historii terminálu. Snížení této položky na méně než polovinu dramaticky snižuje faktury týmům, které nechávají agenty pracovat autonomně po celé hodiny.

Režim přemýšlení už nevypnete

S novými schopnostmi přichází i podstatná restrikce, která vzbudila okamžitou pozornost vývojářské komunity. Anthropic u modelu Claude Opus 5.5 trvale uzamkl režim přemýšlení (thinking mode). Model již není možné přepnout do čistě bezmyšlenkovitého generování odpovědí jedním rázem, jak tomu bylo u předchozích generací.

Důvodem je architektura modelu, která vnitřní myšlenkový proces využívá k plánování kroků, syntéze kontextu a průběžné sebekontrole. V rozhraní Claude.ai je k dispozici adaptivní rozpočet na přemýšlení, v API pak vývojáři nastavují rozsah úsilí. Pro uživatele to znamená spolehlivější výstupy u složitých logických zadání, ale zároveň nutnost počítat s tím, že každá odpověď spotřebuje určitou část myšlenkových tokenů. K tomu se přidává ochrana preserved thinking, která zabraňuje externím systémům manipulovat s myšlenkovým kontextem a extrahovat z modelu jeho vnitřní uvažování pro trénování konkurenčních systémů.

Bezpečnostní audit a soulad s pravidly Evropské unie

Společnost Anthropic model podrobila externímu hodnocení organizací Frontier Design a METR. V interním automatizovaném auditu chování, který testuje reakce v téměř dvou tisících simulovaných scénářů, získal Opus 5.5 nejvyšší skóre ze všech dosud hodnocených modelů. Výrazně kleslo riziko provedení nevratných systémových zásahů nebo překročení zadaných bezpečnostních mantinelů při práci v terminálu.

Vzhledem k vysoké úrovni schopností v oblastech biologie a kybernetické bezpečnosti nasazuje výrobce mechanismy známé z modelu Mythos 5.1. Pokud model narazí na úlohy spojené s biologickým výzkumem nebo hloubkovou penetrací sítí, automaticky zasáhnou bezpečnostní filtry, případně je úloha předána specializovaným ověřovacím programům pro prověřené instituce. Pro evropské uživatele a firmy je podstatné, že Opus 5.5 integruje kryptografické vodoznaky generovaného textu, čímž splňuje regulatorní požadavky aktuálního evropského nařízení AI Act (článek 50).

Dostupnost a limity předplatného

Claude Opus 5.5 je ode dneška dostupný pro předplatitele tarifů Claude Pro, Max a Team na webu i v aplikacích. Anthropic zároveň navýšil pětihodinové limity zpráv pro platící uživatele a zavedl novinku v podobě možnosti manuálního resetu limitu, kterou si uživatelé mohou uložit a využít v okamžiku největší pracovní zátěže. Pro vývojáře je model okamžitě k dispozici v API pod identifikátorem claude-opus-5-5 a v nástroji Claude Code. Během následujících týdnů plánuje Anthropic představit také odlehčenější verze Sonnet 5.5 a Haiku 5.5.

Kolik stojí provoz Claude Opus 5.5 přes API?

Základní cena je 4 dolary za milion vstupních a 20 dolarů za milion výstupních tokenů. Čtení z mezipaměti (cache read) vyjde na pouhých 0,20 dolaru za milion tokenů, což představuje 60% slevu proti předchozí verzi Opus 5.

Lze u Claude Opus 5.5 vypnout režim přemýšlení?

Ne, Anthropic u verze 5.5 možnost úplného vypnutí uvažování odstranil. Model funguje výhradně s adaptivním nebo nastaveným rozpočtem přemýšlení, který je pevnou součástí jeho architektury pro zachování přesnosti a bezpečnosti.

Kdy vyjdou modely Sonnet 5.5 a Haiku 5.5?

Anthropic potvrdil, že menší a rychlejší modely Claude Sonnet 5.5 a Haiku 5.5 budou následovat v nejbližších týdnech a převezmou většinu vylepšení v oblasti efektivity i architektury.

Diskuze

Zatím žádné komentáře — buďte první, kdo se podělí o svůj názor.
X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.