Zcela otevřeně od začátku… ChatGPT jsem naposledy pořádně používal někdy před víc než rokem. Od té doby jedu na Claude, denně, přes Claude Code při programování, přes Claude Design na návrhy a prototypy, a v podstatě pro všechno ostatní taky. Takže když se kolem GPT-6 Astra strhl ten obrovský humbuk („éra AGI“, nejinteligentnější model na světě a tak dále), řekl jsem si, že si dnes konečně udělám čas, ChatGPT si znovu nainstaluju, zaplatím si vyšší tarif a pořádně to vyzkouším proti tomu, na co jsem zvyklý, tedy proti Claude Opus 5.
Beru to jako férové srovnání z mé strany a pocitů. Nepíšu článek za žádnou firmu, jen jako někdo, kdo jednu z těch dvou aplikací otevírá denně a druhou otevřel po dlouhé pauze. Snažil jsem se to nepsat jako slepý fanoušek jedné či druhé strany, takže kromě vlastního dojmu jsem si dohledal i veřejné benchmarky a samozřejmě diskuze ostatních, abych to nebylo jen „mně se to líbí, protože jsem na to zvyklý“.
Rychlé shrnutí: GPT-6 Astra vs Claude Opus 5 v kostce
- Astra je dražší (10 dolarů za milion vstupních tokenů, 50 dolarů za výstupní, oproti Opusu 5 s 5 a 25 dolary) a marketingově mnohem hlasitější, ale v běžném programování je rozdíl proti Opusu 5 podle mě i podle benchmarků minimální.
- Tam, kde Astra fakt exceluje, je ovládání počítače a prohlížeče, 3D a CAD práce a kybernetická bezpečnost. To jsou oblasti, kde jsem Claude nikdy moc nepoužíval, takže tohle byl pro mě upřímně nejzajímavější objev celého testování.
- To nejcitovanější číslo z launche, 99,9 procenta na benchmarku ARC-AGI-3, je zavádějící. Vychází ze speciálního nastavení, které je nesrovnatelně dražší než běžné použití. V normálním režimu je to skóre kolem 62 procent.
- Přechod z Claude na ChatGPT po roce mi přišel jako přechod z jednoho profesně vyladěného nástroje na jiný, taky profesně vyladěný nástroj, jen s jinými prioritami. Nikde jsem necítil generační skok, který by ospravedlnil ten mediální humbuk.
- Zůstávám u Claude jako hlavního nástroje. Astru bych si asi zapnul konkrétně na úlohy s ovládáním počítače nebo prohlížeče, kdybych je řešil pravidelně.
Jak jsem se do srovnání obou AI pustil?
Než jsem začal cokoliv psát, dal jsem si tři cíle. Chtěl jsem si vyzkoušet běžné programování, protože to je to, co s Claude Opus 5 dělám celý den. Chtěl jsem si projít, co se v komunitě (Reddit, Hacker News) říká o zkušenostech jiných lidí, protože jeden týden testování mi na definitivní verdikt nestačí. A chtěl jsem dohledat oficiální benchmarky obou firem a nezávislých srovnávačů typu Artificial Analysis, abych svůj dojem podložil čísly, ne jen pocitem „tohle se mi líbí víc“.
Jedna věc mě zarazila hned na začátku: Claude Opus 5 vlastně vůbec není momentálně nejsilnější model, jaký Anthropic nabízí. Nad ním je ještě takzvaná Mythos vrstva, konkrétně Claude Fable 5.1 a Claude Mythos 5.1, cílená na absolutní špičku výkonu, zatímco Opus 5 je spíš „nejlepší rozumná volba pro většinu lidí“ a výchozí model na placeném Claude Max.
Takže tohle srovnání ve skutečnosti není souboj dvou vlajkových lodí, je to spíš souboj OpenAI vlajkové lodi proti Anthropicově prostřednímu (ale pořád velmi solidnímu) modelu. Beru to na vědomí a v článku to zohledňuju.

Základní parametry: GPT-6 Astra a Claude Opus 5 vedle sebe
| GPT-6 Astra (OpenAI) | Claude Opus 5 (Anthropic) | |
|---|---|---|
| Vydání | 3. září 2026 | 24. července 2026 |
| Pozice v nabídce | Aktuální vlajková loď OpenAI | Prostřední flagship, nad ním stojí Fable 5.1 a Mythos 5.1 |
| Kontextové okno | zhruba 1,05 milionu tokenů | 1 milion tokenů |
| Maximální výstup | 128 000 tokenů | 128 000 tokenů |
| Cena API (vstup / výstup na milion tokenů) | 10 dolarů / 50 dolarů | 5 dolarů / 25 dolarů |
| Znalostní mezník | 30. duben 2026 | dřívější, oficiálně blíže neupřesněno |
První, co mě praštilo do očí: dvojnásobná cena. Jako člověk, který platí Claude Max ze svého, tohle beru vážně, protože u agentních úloh se to nasčítá hodně rychle.
Programování: GPT-6 Astra vs Claude Opus 5 v praxi
Tohle je oblast, kterou znám nejlíp, protože je to moje každodenní chleba s Claude Code. Takže jsem si dal záležet a kromě vlastních zkušeností jsem prošel i publikované výsledky.
Benchmarky v kódování: GPT-6 Astra vs Claude Opus 5
| Benchmark | GPT-6 Astra | Claude Opus 5 |
|---|---|---|
| Terminal-Bench 4.0 | zhruba 57,7 procenta | zhruba 52,3 procenta |
| DeepSWE v1.1 | zhruba 74,1 procenta | zhruba 73,7 procenta |
| FrontierCode 1.1 (hlavní skóre) | zhruba 53,3 procenta | zhruba 53,4 procenta |
| SWE-bench Verified | OpenAI toto číslo v přímém srovnání nepublikovala | 96,0 procenta (samostatně od Anthropicu) |
Co to znamená v praxi. Na Terminal-Bench, tedy delší úlohy typu „nastav prostředí, projdi víc kroků v terminálu, dotáhni to do konce“, Astra jasně vede. Na čistém psaní a opravování kódu (DeepSWE, FrontierCode) je to skoro remíza, doslova v jednotkách procentních bodů.
Co jsem zjistil ve vlastním testu kódování
Tenhle dojem jsem cítil i sám na sobě. Zadal jsem oběma modelům pár typických úloh, refaktoring menší části kódu, opravu chyby s ne úplně zjevnou příčinou, návrh komponenty od nuly.
Astra si vedla solidně, ale nezažil jsem moment, kdy bych si řekl, že tohle Claude neumí nebo neumí stejně dobře. Kde jsem naopak cítil rozdíl, byla ochota Astry samostatně pokračovat přes víc kroků bez toho, aby se ptala, jestli má opravdu pokračovat. To je fajn vlastnost, pokud jí věříte, a trochu nepříjemná, pokud chcete mít nad procesem kontrolu.
Obecná inteligence: GPT-6 Astra vs Claude Opus 5
Benchmarky obecné inteligence a matematiky
| Benchmark | GPT-6 Astra | Claude Opus 5 |
|---|---|---|
| FrontierMath Tier 4 (v2) | 97,6 procenta | 73,2 procenta |
| ARC-AGI-3 (standardní nastavení) | zhruba 62 až 67 procent | 30,2 procenta |
| ARC-AGI-3 (speciální nastavení OpenAI) | 99,9 procenta | není relevantní srovnání |
| Artificial Analysis Intelligence Index | 61 v jednom měření, jinde až 67 | 60,7 až 63 podle zdroje a dne měření |
ARC-AGI-3 a číslo 99,9 procenta: co je za tím
Tady musím být upřímný. Číslo 99,9 procenta na ARC-AGI-3 mě první den taky dostalo, přesně jak to bylo asi u všech ostatních. Pak jsem si ale dohledal komentář týmu, který ten benchmark provozuje (ARC Prize), a ukázalo se, že to číslo pochází ze speciálního, drahého testovacího nastavení, kde si model mezi kroky drží stav uvažování napříč celou konverzací.
V běžném, poskytovatelsky neutrálním nastavení, tedy v tom, co reálně použijete vy nebo já, je to skóre kolem 62 až 67 procent. Rozdíl mezi 62 a 99,9 procenty tak podle mě netvoří lepší model, ale výrazně dražší a propracovanější obal kolem něj.
Zajímavost na druhou stranu: Claude Opus 5 na tom samém benchmarku, standardním způsobem měření, dosáhl 30,2 procenta, což byl v době jeho vydání největší jednorázový skok, jaký kdy kdokoliv na tomhle žebříčku zaznamenal (předchozí maximum bylo kolem 7 až 8 procent). Obě čísla jsou tedy svým způsobem pravdivá, jen měří dost odlišné věci a nedají se prostě postavit vedle sebe jako „99,9 versus 30,2“.
Ovládání počítače: GPT-6 Astra vs Claude Opus 5
Tohle byla pro mě osobně nejzajímavější část celého testování, protože to je oblast, kterou jsem se Claude nikdy pořádně netestoval, používám ho hlavně na kód a text.
Ovládání prohlížeče a počítače v mém testu
| Benchmark | GPT-6 Astra | Claude Opus 5 |
|---|---|---|
| OSWorld 2.0 | zhruba 70,6 až 72,6 procenta | zhruba 70,2 procenta |
| Agents‘ Last Exam | 59,3 procenta | 55,5 procenta |
| Benchmark ovládání prohlížeče (třetí strana) | 77,3 procenta | 50,5 procenta |
Zkusil jsem Astře zadat pár úloh typu „otevři si prohlížeč a udělej mi rezervaci“ nebo „projdi mi tenhle formulář a vyplň ho podle zadaných údajů“, a musím uznat, že v tomhle si vedla líp, než jsem čekal.
Působí to sebejistěji a méně se zasekává na drobnostech v rozhraní. U Claude jsem podobnou zkušenost prostě nemám, protože jsem tuhle oblast dřív neřešil, takže tady beru svůj dojem s rezervou, je to spíš „poprvé jsem to zkusil a bylo to fajn“ než roky nabyté srovnání.
3D modelování a CAD práce
V komunitě se opakovaně objevují popisy 3D a CAD práce, kde má Astra navrhnout model podle pár naměřených hodnot nebo zrekonstruovat pohyb podle referenčního videa v Blenderu. To jsem sám netestoval, protože na to nemám vybavení ani potřebu, ale je to oblast, kterou i jinak skeptičtí uživatelé chválí nejčastěji.
Kybernetická bezpečnost u obou modelů
| Benchmark | GPT-6 Astra | Claude Opus 5 |
|---|---|---|
| ExploitBench | 100 procent | 70 procent |
| ExploitGym | 42,4 procenta | neuvedeno |
Tohle je oblast, kterou jsem netestoval sám, ani bych se do toho nepouštěl, ale je vidět, že tady jde o reálný a měřitelný rozdíl. OpenAI dokonce tvrdí, že Astra při testování sama objevila dvě dosud neznámé bezpečnostní díry.
Kvůli tomu prý Astra jako první model překročila jejich interní takzvanou kritickou hranici v rámci bezpečnostního rámce, a proto je plný přístup k pokročilým útočným schopnostem omezený jen na prověřené organizace v programu s názvem Daybreak. Anthropic naopak u Opusu 5 popisuje spíš opatrnější přístup, omezili mu možnost skenovat zkompilované binárky na zranitelnosti.
Jak si při testování nových AI nástrojů hlídám vlastní soukromí
Tahle část mě mimochodem přiměla zamyslet se i nad vlastní online bezpečností. Když modely umí samy dohledávat zranitelnosti a firmy kvůli tomu aktivují nejvyšší úroveň interních bezpečnostních opatření, začal jsem víc řešit i to, jak chráním sám sebe, hlavně teď, když jsem si kvůli testování zakládal nový účet u OpenAI a procházel jsem si nastavení plateb a osobních údajů na další cizí platformě.
Osobně na tohle dlouhodobě používám VPNky, a protože se mě na doporučení lidi celkem často ptají, nechávám tu rovnou dvě služby, které sám soukromě i firemně používám nejen já ale i kolegové a máme s nimi ověřenou nejlepší zkušenost. Jde o affiliate odkazy, takže z nákupu přes ně mám malou provizi z čehož platím provoz tohoto webu, ale urpímně vždy doporučuju jen to, co si sám platím a reálně používám!
Vyzkoušet NordVPN, aktuálně 77% sleva a 3 měsíce zdarma
Vyzkoušet Surfshark, aktuálně 87% sleva a 3 měsíce zdarma
Cena a dostupnost: GPT-6 Astra vs Claude Opus 5
Tohle byla asi moje nejméně příjemná zkušenost s návratem k ChatGPT.
Claude Pro a Max: Moje zkušenost
Na Claude Pro (17 až 20 dolarů měsíčně) mám Opus 5 rovnou v hlavním chatu, žádné hledání, žádné podmínky. Na Claude Max, který používám, je Opus 5 dokonce výchozí model s pěti až dvacetinásobnou kapacitou oproti Pro.

ChatGPT Plus a Pro: Proč mě to zmátlo?
U ChatGPT jsem si musel Astru doslova hledat. Na plánu Plus (20 dolarů měsíčně) Astra vůbec není v běžném chatovacím okně, dostupná je jen omezeně přes nástroje nazvané Work a Codex, s odhadovaným rozsahem 5 až 45 zpráv za pět hodin.
Teprve na dražším Pro plánu (100 nebo 200 dolarů měsíčně) se Astra objeví přímo v chatu, tam ale pod interním názvem „GPT-6 Pro“, s limitem 50 nebo 200 zpráv týdně, navíc sdíleným se starším modelem. Sám OpenAI navíc den po startu veřejně přiznal, že rollout byl neuklizený, a musel to dovysvětlovat.
Chápu, že jde o čerstvý a výpočetně náročný model, ale jako uživatel, který se po roce vrací, mi to přišlo zbytečně matoucí. U Claude jsem zvyklý na to, že za svoje peníze prostě dostanu nejlepší dostupný model bez skrývání za různé názvy a podmínky.
Co jsem si dohledal na interentu od ostatních uživatelů
Abych to nebylo jen o mém týdnu testování, prošel jsem si i diskuze na Redditu a Hacker News z prvních dní po launchi.
Opakovaně se chválí právě to, co jsem popsal výš, tedy ovládání počítače a prohlížeče, 3D a CAD práce a celková token efektivita na delších agentních úlohách.
Zároveň se ale často opakují stížnosti na extrémně rychlé vyčerpání limitu zpráv (někteří popisují, že jim celý pětihodinový limit spadl dřív, než model stihl odpovědět), na přehnanou opatrnost při odmítání i neškodných požadavků, a v rozsáhlejších projektech i na to, že model občas ignoruje pokyny uložené v projektových souborech a jede podle vlastního, méně kvalitního plánu.
K Opusu 5 (a nepřímo i k novějšímu Fable 5.1) jsou názory smíšenější. Část lidí ho popisuje jako spolehlivější na velké, byznys logikou obtížené kódové základny, jiná část dává přednost dražšímu modelu Fable právě na netriviální, dlouhodobé úlohy a Opus 5 vnímá jako rychlejší a levnější, ale ne nutně nejchytřejší volbu, což ostatně odpovídá tomu, jak ho pozicuje sám Anthropic.
Hodně komentářů taky poukazuje na to, že marketingová videa jsou pečlivě sestříhaná těsně před momentem, kdy by měla ukázat něco skutečně náročného, a že velká část nadšení pochází spíš z kreativních a vizuálních ukázek než z běžné vývojářské práce. S tímhle dojmem se po vlastním testování docela ztotožňuju.
Silné a slabé stránky: GPT-6 Astra vs Claude Opus 5
GPT-6 Astra: silné a slabé stránky
Co mě na Astře přesvědčilo
Ovládání počítače a prohlížeče, kybernetická bezpečnost, 3D a CAD práce, token efektivita na dlouhých úlohách.
Co mě na Astře štvalo
Dvojnásobná cena, matoucí a přísné limity zpráv, marketingové číslo na ARC-AGI-3, které bez kontextu zavádí, a chaotický start hned první dny.
Claude Opus 5: silné a slabé stránky
Co mě u Opusu 5 utvrdilo
Lepší poměr cena a výkon v běžném programování, jednoduchá a přímočará dostupnost rovnou v hlavním chatu, konzistentní dodržování pokynů, rekordní skok na ARC-AGI-3 měřený standardním způsobem.
Co bych Opusu 5 vytkl
V ovládání počítače a prohlížeče je znatelně slabší, a není to aktuálně nejsilnější model, jaký Anthropic nabízí, takže kdo chce absolutní špičku, měl by se podívat i na Fable 5.1.
Kdy bych sáhl po kterém modelu
Kdy bych zvolil Claude Opus 5
Pro běžné programování, opravy chyb a refaktoring bych zůstal u Claude Opus 5. Mám tam lepší poměr cena a výkon a v mých vlastních testech konzistentnější chování. Stejně tak pro práci s celým rozsáhlým repozitářem a delším kontextem, cena tam s rostoucím kontextem neroste tak, jak jsem četl, že roste u Astry. A pro hromadné zpracování textu a dat kvůli nižší sazbě za token.
Kdy bych zvolil GPT-6 Astra
Pro automatizaci prohlížeče, vyplňování formulářů a podobné úlohy s ovládáním počítače bych sáhl po Astře, tady byl rozdíl v můj prospěch i v mém vlastním testu nejcitelnější. Stejně tak pro 3D modelování a práci s CAD nástroji, i když jsem tuhle oblast sám netestoval do hloubky.
Kdy bych nezvolil ani jeden model
Pokud chcete absolutní špičku výkonu bez ohledu na cenu, ani jeden z těchhle dvou modelů podle mě není ta správná odpověď, spíš bych se podíval po Claude Fable 5.1, případně po Astřině nejvyšším režimu uvažování, pokud jde hlavně o matematiku nebo vědu.
Závěr: GPT-6 Astra vs Claude Opus 5
Po roce bez ChatGPTu jsem čekal buď zklamání, nebo naopak pocit, že jsem něco zásadního propásl. Nestalo se ani jedno. Astra je solidní, silná v konkrétních oblastech, které Claude prostě nemá jako svou hlavní parketu, ale v tom, co dělám celý den, tedy v programování, jsem rozdíl proti Opusu 5 necítil natolik, aby to ospravedlnilo přeplácení a matoucí limity zpráv.
Zůstávám u Claude jako hlavního nástroje, ale Astru bych si klidně zapnul jako doplněk konkrétně na úlohy s ovládáním počítače nebo prohlížeče, kdybych je řešil pravidelně.
Poznámka k datům a zdrojům
Vlastní dojmy z testování doplňuju o oficiální benchmarky OpenAI a Anthropicu, o nezávislé srovnávací nástroje Artificial Analysis a ARC Prize a o diskuze na Hacker News a Redditu z prvních dní po startu Astry.
Protože jsou oba modely v době psaní staré řádově dny až týdny, čísla se ještě budou posouvat, jak si obě firmy doladí testovací nastavení i produkční limity. Než uděláte vlastní rozhodnutí, doporučuju si aktuální ceny a limity ověřit přímo na stránkách obou firem.
Oficiální stránky
- OpenAI, GPT-6 Astra (launch stránka a benchmarky): openai.com/index/gpt-6-astra
- Anthropic, Introducing Claude Opus 5: anthropic.com/news/claude-opus-5
- Anthropic, System Card: Claude Opus 5 (PDF): www-cdn.anthropic.com
- Anthropic, Introducing Claude Fable 5.1 and Mythos 5.1: anthropic.com/claude-fable-and-mythos-5-1
Nezávislé benchmarky
- Artificial Analysis, GPT-6 Astra (medium) vs Claude Opus 5: artificialanalysis.ai
- Artificial Analysis, GPT-6 Astra (high) vs Claude Opus 5 (medium effort): artificialanalysis.ai
- ARC Prize, vlákno k výsledkům Astry na ARC-AGI-3: x.com/arcprize
- OpenRouter, GPT-6 Astra (ceny a specifikace API): openrouter.ai/openai/gpt-6-astra
Diskuze a komunita
- Hacker News, Ask HN: Initial Thoughts on GPT-6 Astra: news.ycombinator.com
- Hacker News, vlákno k launchi GPT-6 Astra: news.ycombinator.com
Novinářské pokrytí a analýzy
- NBC News, OpenAI debuts GPT-6 Astra, says it triggered security measures: nbcnews.com
- Fox Business, OpenAI unveils GPT-6 Astra: foxbusiness.com
- Forbes, OpenAI Launches GPT-6 Astra After A Curious False Start: forbes.com
- The New Stack, GPT-6 Astra’s score of 98.6% looked like AGI: thenewstack.io
- The New Stack, „Sorry for the messy rollout“: thenewstack.io
- DataCamp, GPT-6 Astra: Features, Benchmarks, and Pricing: datacamp.com
- DataCamp, Claude Opus 5: datacamp.com
- Codersera, GPT-6 Astra vs Claude Opus 5: codersera.com
- Beam.ai, GPT-6 Astra for AI Agents: The 99.9% Footnote: beam.ai
Ceny a limity
- Eesel, Claude Opus 5 pricing in 2026: eesel.ai
- Kingy.ai, GPT-6 Astra Access: Plans, API, Pricing, Daybreak: kingy.ai

Vaše komentáře
Zatím nejsou žádné komentáře… Buďte první, kdo ho napíše.