Od autonomní optimalizace k nižším účtům: Jak OpenAI srazila náklady
Současný vývoj v oblasti umělé inteligence se posunul od pouhého navyšování parametrů k hluboké optimalizaci výpočetní efektivity při inferenci. Jen den před tímto cenovým krokem, 29. července 2026, OpenAI odhalila, že model GPT-5.6 Sol dokázal sám autonomně optimalizovat své vlastní GPU kernely a algoritmy spekulativního dekódování. Tento technologický milník přinesl přímo v produkčním prostředí servování snížení hardwarových nákladů o 20 % a zvýšení efektivity generování tokenů o více než 15 %.
Místo toho, aby si výzkumné laboratoře tyto vnitřní úspory ponechaly jako marži, přenáší OpenAI získanou efektivitu přímo na vývojáře a firemní zákazníky. Vzhledem k tomu, že moderní pokročilé architektury využívající vnitřní plánování (tzv. test-time compute) vyžadují značné množství výpočetních operací ještě před samotným vygenerováním výsledného textu, představuje každé procento ušetřeného výkonu zásadní posun v celkové ekonomice provozu AI agentů.
Přehled cen a nových režimů: Luna za pětinu, Sol na plný plyn
Úpravy ceníku se týkají dvou ze tří úrovní modelové řady GPT-5.6 uvedené na trh v průběhu července 2026. Nejvýraznějšího zlevnění se dočkal nejlehčí model GPT-5.6 Luna, jehož ceníková cena klesla o 80 %. Z původních 1,00 USD za 1 milión vstupních a 6,00 USD za 1 milión výstupních tokenů se nová sazba dostává na 0,20 USD za vstupní a 1,20 USD za výstupní tokeny.
Střední vyvážený model GPT-5.6 Terra zaznamenal pokles o 20 %, což v praxi znamená posun z původních 2,50 USD / 15,00 USD na 2,00 USD za 1 milión vstupních a 12,00 USD za 1 milión výstupních tokenů.
U nejvýkonnějšího modelu GPT-5.6 Sol zůstává základní cena zachována na úrovni 5,00 USD za vstup a 30,00 USD za výstup na 1 milión tokenů. Vývojáři však v rozhraní API získávají novou volbu označenou jako Fast mode, která zcela nahrazuje dosavadní službu Priority Processing. Tento režim nabízí až 2,5× vyšší rychlost generování oproti standardnímu zpracování za dvojnásobek základní ceny (tedy 10,00 USD input / 60,00 USD output). Pro náročné produkční nasazení na specializovaném hardwaru, jako jsou akcelerátory Cerebras, přitom model GPT-5.6 Sol dosahuje propustnosti až 750 tokenů za sekundu.
Výhodou pro uživatele placených platforem je fakt, že snížení cen u Luny a Terry se automaticky započítává do systémů spotřeby v prostředí Codex a ChatGPT Work. Firemní předplatitelé a vývojářské týmy tak v rámci svých stávajících měsíčních limitů dokážou odbavit podstatně větší objem dotazů a komplexních agentních úloh.
Srovnání trhu: Válka o poměr cena/výkon se stupňuje
Červencové události na trhu umělé inteligence ukazují obrovské tempo konkurence mezi hlavními světovými hráči. Vlajkový model GPT-5.6 Sol v hodnocení náročných pracovních postupů Agents' Last Exam získal skóre 53,6 bodu, čímž překonal konkurenční model Claude Fable 5 od společnosti Anthropic (vydaný 9. června 2026 s cenou 10,00 USD / 50,00 USD) o výrazných 13,1 bodu.
Zajímavé srovnání nabízí také pohled na model GPT-5.6 Luna. Tento nejnižší model dnes dosahuje srovnatelného výkonu a přesnosti jako špičkové vlajkové systémy z loňského roku, ovšem za přibližně 6 % jejich tehdejších provozních nákladů na úlohu a s téměř 9× vyšší rychlostí odezvy.
Pro lepší přehlednost aktuální situace na trhu k 30. červenci 2026 uvádíme porovnání ceníkových relací vybraných konkurenčních modelů v API (ceny za 1 milión vstupních / výstupních tokenů):
- GPT-5.6 Luna (OpenAI): 0,20 USD / 1,20 USD
- DeepSeek V4 Flash: 0,14 USD / 0,28 USD
- DeepSeek V4 Pro: 0,435 USD / 0,87 USD
- Gemini 3.6 Flash (Google DeepMind): 1,50 USD / 7,50 USD
- GPT-5.6 Terra (OpenAI): 2,00 USD / 12,00 USD
- Grok 4.5 (xAI): 2,00 USD / 6,00 USD
- Kimi K3 (Moonshot AI): 3,00 USD / 15,00 USD (váhy dostupné jako open-weight)
- Claude Opus 5 (Anthropic): 5,00 USD / 25,00 USD
- GPT-5.6 Sol (OpenAI): 5,00 USD / 30,00 USD (Fast mode: 10,00 USD / 60,00 USD)