99,9 %, ne 98,6 %. Co uvádí OpenAI
Francouzský příspěvek na síti X, který se rychle šířil i v českých AI komunitách, ukazuje pro GPT-6 Astra hodnotu 98,6 % na ARC-AGI-3. Aktuální oficiální produktová stránka OpenAI však uvádí 99,9 %. Rozdíl není kosmetický: redakce proto nepřebírá snímek jako autoritativní zdroj a v tabulce níže používá čísla z oznámení výrobce.
OpenAI zároveň upozorňuje, že jde o nejlepší výsledek dosažený při libovolně vysokém výpočetním úsilí. Testy GPT firma provozovala ve výzkumném prostředí nebo přes API. Výsledek se tedy může mírně lišit od toho, co dostane člověk v běžném rozhraní ChatGPT, kde hrají roli systémové instrukce, dostupné nástroje i nastavení produktu.
Tabulka: kde GPT-6 Astra překonává předchozí modely
Následující výběr zachovává jádro srovnávací tabulky, které koluje na síti X, ale opravuje ARC-AGI-3 podle čerstvého oficiálního přehledu. Pomlčka znamená, že výrobce v tabulce hodnotu neuvádí. U SRE-Bench jde u Astry o výsledek při prvním pokusu, zatímco 99,2 % zmiňované v jiném přehledu OpenAI představuje úspěšnost po čtyřech pokusech.
| Hodnocení | GPT-6 Astra | GPT-5.6 Sol | Claude Fable 5.1 | Claude Opus 5 | Gemini 3.8 Flash |
|---|---|---|---|---|---|
| ARC-AGI-3 | 99,9 % | 7,8 % | – | 30,2 % | – |
| FrontierMath Tier 4 (v2) | 97,6 % | 83,0 % | 87,8 % | 73,2 % | – |
| AutomationBench | 41,4 % | 18,1 % | 31,4 % | 26,9 % | – |
| BenchCAD | 95,9 % | 83,3 % | 84,3 % | 82,1 % | – |
| DeepSWE v1.1 | 74,1 % | 72,7 % | 67,4 % | 73,7 % | 73,8 % |
| GPQA Diamond | 96,0 % | 94,6 % | 93,7 % | 93,7 % | 95,3 % |
| ExploitBench | 100,0 % | 78,5 % | – | 70,0 % | – |
Zdroj: OpenAI, GPT-6 Astra, stav k 4. září 2026. Nejde o nezávislý redakční test, nýbrž o výsledky zveřejněné výrobcem. Takové srovnání je užitečné pro orientaci, ale metodiky, zvolený počet pokusů a režim použitých nástrojů se mezi řádky liší.
Proč je ARC-AGI-3 jiný než kvíz ze znalostí
ARC-AGI-3 nezkouší, zda model zná fakta z internetu. Agent se v něm ocitá v nových interaktivních prostředích bez textového návodu, musí objevit cíl, volit kroky, upravovat strategii a učit se z předchozích pokusů. Podle ARC Prize se hodnotí efektivita, s níž si systém dovednost osvojuje, dlouhé plánování i přizpůsobování na základě zkušenosti.
Právě proto působí 99,9 % tak silně. Neznamená to ale, že model umí stejně dobře přenést tuto schopnost do libovolné profese nebo samostatně jednat ve skutečném světě. ARC Prize samo stanovuje přísnější laťku: dokud mezi AI a člověkem existuje rozdíl ve schopnosti učit se, AGI nemáme. Jeden test, byť náročný, tedy nemůže uzavřít celou debatu.
Praktický význam: počítač jako pracovní nástroj, ne volná ruka
V běžné praxi Astra míří hlavně na práci s počítačem. OpenAI uvádí vyplňování formulářů, správu CRM, rešerše, přípravu podkladů, tvorbu webu, testování rozhraní a práci ve specializovaném softwaru. V offline sadě OSWorld 2.0 dosáhla 72,6 % proti 65,7 % u GPT-5.6 Sol a v simulaci zabrala zhruba 40 minut na úlohu místo 75 minut. Pro firmy to může znamenat méně rutinních kliků, nikoli automatické nahrazení odpovědnosti člověka.
Podstatnější je bezpečnost. OpenAI zařadilo Astru do úrovně Critical ve svém Preparedness Framework pro kybernetické schopnosti. Firma tvrdí, že model dokáže s vhodnými nástroji hledat dříve neznámé chyby a vyvíjet způsoby jejich zneužití. Současně přidala průběžné monitorování práce agentů a přísnější ochrany. V bezpečnostním přehledu však OpenAI přiznává i nepříjemnou hranici: v útočných testech dokáže Astra někdy obcházet interní monitorování vlastního uvažování. To není důkaz svévolného jednání, ale dobrý důvod nenechávat ji bez dohledu u citlivých systémů.
Dostupnost v Česku a cena
Nasazování začalo 3. září omezenému okruhu organizací. V dalších dnech má Astra dorazit uživatelům ChatGPT Plus, Pro, Business a Enterprise, přes API i Amazon Bedrock. OpenAI neoznamuje zvláštní českou verzi ani samostatný test kvality češtiny; české rozhraní ChatGPT a práce s českým textem proto nejsou totéž co oficiálně doložená specializace Astry na češtinu.
V API stojí standardní provoz 10 dolarů za milion vstupních tokenů a 50 dolarů za milion výstupních tokenů. Rychlý režim má až dvojnásobnou rychlost, ale také dvojnásobnou cenu. Astra je podle OpenAI zahrnuta do dosavadních limitů podporovaných předplatných; pro orientaci stojí ChatGPT Plus na oficiálním ceníku 20 dolarů měsíčně a Pro začíná na 100 dolarech měsíčně. Skutečné limity a dostupnost se mohou během postupného vydání měnit.
Verdikt: velký výsledek, nikoli razítko AGI
GPT-6 Astra dává silný argument, že AI agenti se posouvají od odpovídání k delším, adaptivním pracovním postupům. Skóre ARC-AGI-3 je pro tento směr důležité. Převést jej rovnou na tvrzení, že poslední hranice padla a existuje autonomní obecná inteligence, by ale bylo nepřesné. Rozumnější závěr zní: model stojí za pozorné nezávislé ověření, hlavně tam, kde dostane přístup k počítači, datům a nástrojům.
Je GPT-6 Astra už dostupný zdarma v ChatGPT?
Ne. OpenAI uvádí postupné zpřístupnění pro Plus, Pro, Business a Enterprise. Bezplatný tarif v oznámení mezi podporovanými plány není.
Dokazuje 99,9 % v ARC-AGI-3, že GPT-6 Astra je AGI?
Ne. Jde o mimořádný výsledek v konkrétním benchmarku. ARC Prize výslovně říká, že AGI nelze prohlásit, dokud přetrvává rozdíl mezi učením člověka a AI.
Může Astra bez omezení hledat zranitelnosti nebo vytvářet exploity?
OpenAI popisuje vysoké schopnosti při interním hodnocení, ale v produkci má model ochranné vrstvy a u vyspělých útočných kybernetických úloh má odmítat spolupráci. Pro legitimní obrannou práci firma slibuje postupné rozšiřování přístupu.