Zcela otevřeně od začátku… ChatGPT jsem naposledy pořádně používal někdy před víc než rokem. Od té doby jedu na Claude, denně, přes Claude Code při programování, přes Claude Design na návrhy a prototypy, a v podstatě pro všechno ostatní taky. Takže když se kolem GPT-6 Astra strhl ten obrovský humbuk („éra AGI“, nejinteligentnější model na světě a tak dále), řekl jsem si, že si dnes konečně udělám čas, ChatGPT si znovu nainstaluju, zaplatím si vyšší tarif a pořádně to vyzkouším proti tomu, na co jsem zvyklý, tedy proti Claude Opus 5.

Beru to jako férové srovnání z mé strany a pocitů. Nepíšu článek za žádnou firmu, jen jako někdo, kdo jednu z těch dvou aplikací otevírá denně a druhou otevřel po dlouhé pauze. Snažil jsem se to nepsat jako slepý fanoušek jedné či druhé strany, takže kromě vlastního dojmu jsem si dohledal i veřejné benchmarky a samozřejmě diskuze ostatních, abych to nebylo jen „mně se to líbí, protože jsem na to zvyklý“.

Rychlé shrnutí: GPT-6 Astra vs Claude Opus 5 v kostce

  • Astra je dražší (10 dolarů za milion vstupních tokenů, 50 dolarů za výstupní, oproti Opusu 5 s 5 a 25 dolary) a marketingově mnohem hlasitější, ale v běžném programování je rozdíl proti Opusu 5 podle mě i podle benchmarků minimální.
  • Tam, kde Astra fakt exceluje, je ovládání počítače a prohlížeče, 3D a CAD práce a kybernetická bezpečnost. To jsou oblasti, kde jsem Claude nikdy moc nepoužíval, takže tohle byl pro mě upřímně nejzajímavější objev celého testování.
  • To nejcitovanější číslo z launche, 99,9 procenta na benchmarku ARC-AGI-3, je zavádějící. Vychází ze speciálního nastavení, které je nesrovnatelně dražší než běžné použití. V normálním režimu je to skóre kolem 62 procent.
  • Přechod z Claude na ChatGPT po roce mi přišel jako přechod z jednoho profesně vyladěného nástroje na jiný, taky profesně vyladěný nástroj, jen s jinými prioritami. Nikde jsem necítil generační skok, který by ospravedlnil ten mediální humbuk.
  • Zůstávám u Claude jako hlavního nástroje. Astru bych si asi zapnul konkrétně na úlohy s ovládáním počítače nebo prohlížeče, kdybych je řešil pravidelně.

Jak jsem se do srovnání obou AI pustil?

Než jsem začal cokoliv psát, dal jsem si tři cíle. Chtěl jsem si vyzkoušet běžné programování, protože to je to, co s Claude Opus 5 dělám celý den. Chtěl jsem si projít, co se v komunitě (Reddit, Hacker News) říká o zkušenostech jiných lidí, protože jeden týden testování mi na definitivní verdikt nestačí. A chtěl jsem dohledat oficiální benchmarky obou firem a nezávislých srovnávačů typu Artificial Analysis, abych svůj dojem podložil čísly, ne jen pocitem „tohle se mi líbí víc“.

Koukni...  Jak mít na ChatGPT Apps Booking, Expedia, Spotify i v ČR/SK

Jedna věc mě zarazila hned na začátku: Claude Opus 5 vlastně vůbec není momentálně nejsilnější model, jaký Anthropic nabízí. Nad ním je ještě takzvaná Mythos vrstva, konkrétně Claude Fable 5.1 a Claude Mythos 5.1, cílená na absolutní špičku výkonu, zatímco Opus 5 je spíš „nejlepší rozumná volba pro většinu lidí“ a výchozí model na placeném Claude Max.

Takže tohle srovnání ve skutečnosti není souboj dvou vlajkových lodí, je to spíš souboj OpenAI vlajkové lodi proti Anthropicově prostřednímu (ale pořád velmi solidnímu) modelu. Beru to na vědomí a v článku to zohledňuju.

Reklama Slevomat

Základní parametry: GPT-6 Astra a Claude Opus 5 vedle sebe

GPT-6 Astra (OpenAI)Claude Opus 5 (Anthropic)
Vydání3. září 202624. července 2026
Pozice v nabídceAktuální vlajková loď OpenAIProstřední flagship, nad ním stojí Fable 5.1 a Mythos 5.1
Kontextové oknozhruba 1,05 milionu tokenů1 milion tokenů
Maximální výstup128 000 tokenů128 000 tokenů
Cena API (vstup / výstup na milion tokenů)10 dolarů / 50 dolarů5 dolarů / 25 dolarů
Znalostní mezník30. duben 2026dřívější, oficiálně blíže neupřesněno

První, co mě praštilo do očí: dvojnásobná cena. Jako člověk, který platí Claude Max ze svého, tohle beru vážně, protože u agentních úloh se to nasčítá hodně rychle.

Programování: GPT-6 Astra vs Claude Opus 5 v praxi

Tohle je oblast, kterou znám nejlíp, protože je to moje každodenní chleba s Claude Code. Takže jsem si dal záležet a kromě vlastních zkušeností jsem prošel i publikované výsledky.

Benchmarky v kódování: GPT-6 Astra vs Claude Opus 5

BenchmarkGPT-6 AstraClaude Opus 5
Terminal-Bench 4.0zhruba 57,7 procentazhruba 52,3 procenta
DeepSWE v1.1zhruba 74,1 procentazhruba 73,7 procenta
FrontierCode 1.1 (hlavní skóre)zhruba 53,3 procentazhruba 53,4 procenta
SWE-bench VerifiedOpenAI toto číslo v přímém srovnání nepublikovala96,0 procenta (samostatně od Anthropicu)

Co to znamená v praxi. Na Terminal-Bench, tedy delší úlohy typu „nastav prostředí, projdi víc kroků v terminálu, dotáhni to do konce“, Astra jasně vede. Na čistém psaní a opravování kódu (DeepSWE, FrontierCode) je to skoro remíza, doslova v jednotkách procentních bodů.

Co jsem zjistil ve vlastním testu kódování

Tenhle dojem jsem cítil i sám na sobě. Zadal jsem oběma modelům pár typických úloh, refaktoring menší části kódu, opravu chyby s ne úplně zjevnou příčinou, návrh komponenty od nuly.

Astra si vedla solidně, ale nezažil jsem moment, kdy bych si řekl, že tohle Claude neumí nebo neumí stejně dobře. Kde jsem naopak cítil rozdíl, byla ochota Astry samostatně pokračovat přes víc kroků bez toho, aby se ptala, jestli má opravdu pokračovat. To je fajn vlastnost, pokud jí věříte, a trochu nepříjemná, pokud chcete mít nad procesem kontrolu.

Obecná inteligence: GPT-6 Astra vs Claude Opus 5

Benchmarky obecné inteligence a matematiky

BenchmarkGPT-6 AstraClaude Opus 5
FrontierMath Tier 4 (v2)97,6 procenta73,2 procenta
ARC-AGI-3 (standardní nastavení)zhruba 62 až 67 procent30,2 procenta
ARC-AGI-3 (speciální nastavení OpenAI)99,9 procentanení relevantní srovnání
Artificial Analysis Intelligence Index61 v jednom měření, jinde až 6760,7 až 63 podle zdroje a dne měření

ARC-AGI-3 a číslo 99,9 procenta: co je za tím

Tady musím být upřímný. Číslo 99,9 procenta na ARC-AGI-3 mě první den taky dostalo, přesně jak to bylo asi u všech ostatních. Pak jsem si ale dohledal komentář týmu, který ten benchmark provozuje (ARC Prize), a ukázalo se, že to číslo pochází ze speciálního, drahého testovacího nastavení, kde si model mezi kroky drží stav uvažování napříč celou konverzací.

V běžném, poskytovatelsky neutrálním nastavení, tedy v tom, co reálně použijete vy nebo já, je to skóre kolem 62 až 67 procent. Rozdíl mezi 62 a 99,9 procenty tak podle mě netvoří lepší model, ale výrazně dražší a propracovanější obal kolem něj.

Zajímavost na druhou stranu: Claude Opus 5 na tom samém benchmarku, standardním způsobem měření, dosáhl 30,2 procenta, což byl v době jeho vydání největší jednorázový skok, jaký kdy kdokoliv na tomhle žebříčku zaznamenal (předchozí maximum bylo kolem 7 až 8 procent). Obě čísla jsou tedy svým způsobem pravdivá, jen měří dost odlišné věci a nedají se prostě postavit vedle sebe jako „99,9 versus 30,2“.

Ovládání počítače: GPT-6 Astra vs Claude Opus 5

Tohle byla pro mě osobně nejzajímavější část celého testování, protože to je oblast, kterou jsem se Claude nikdy pořádně netestoval, používám ho hlavně na kód a text.

Koukni...  Jak nastavit, chránit soukromí na Instagramu: Krok za krokem

Ovládání prohlížeče a počítače v mém testu

BenchmarkGPT-6 AstraClaude Opus 5
OSWorld 2.0zhruba 70,6 až 72,6 procentazhruba 70,2 procenta
Agents‘ Last Exam59,3 procenta55,5 procenta
Benchmark ovládání prohlížeče (třetí strana)77,3 procenta50,5 procenta

Zkusil jsem Astře zadat pár úloh typu „otevři si prohlížeč a udělej mi rezervaci“ nebo „projdi mi tenhle formulář a vyplň ho podle zadaných údajů“, a musím uznat, že v tomhle si vedla líp, než jsem čekal.

Působí to sebejistěji a méně se zasekává na drobnostech v rozhraní. U Claude jsem podobnou zkušenost prostě nemám, protože jsem tuhle oblast dřív neřešil, takže tady beru svůj dojem s rezervou, je to spíš „poprvé jsem to zkusil a bylo to fajn“ než roky nabyté srovnání.

3D modelování a CAD práce

V komunitě se opakovaně objevují popisy 3D a CAD práce, kde má Astra navrhnout model podle pár naměřených hodnot nebo zrekonstruovat pohyb podle referenčního videa v Blenderu. To jsem sám netestoval, protože na to nemám vybavení ani potřebu, ale je to oblast, kterou i jinak skeptičtí uživatelé chválí nejčastěji.

Kybernetická bezpečnost u obou modelů

BenchmarkGPT-6 AstraClaude Opus 5
ExploitBench100 procent70 procent
ExploitGym42,4 procentaneuvedeno

Tohle je oblast, kterou jsem netestoval sám, ani bych se do toho nepouštěl, ale je vidět, že tady jde o reálný a měřitelný rozdíl. OpenAI dokonce tvrdí, že Astra při testování sama objevila dvě dosud neznámé bezpečnostní díry.

Kvůli tomu prý Astra jako první model překročila jejich interní takzvanou kritickou hranici v rámci bezpečnostního rámce, a proto je plný přístup k pokročilým útočným schopnostem omezený jen na prověřené organizace v programu s názvem Daybreak. Anthropic naopak u Opusu 5 popisuje spíš opatrnější přístup, omezili mu možnost skenovat zkompilované binárky na zranitelnosti.

Jak si při testování nových AI nástrojů hlídám vlastní soukromí

Tahle část mě mimochodem přiměla zamyslet se i nad vlastní online bezpečností. Když modely umí samy dohledávat zranitelnosti a firmy kvůli tomu aktivují nejvyšší úroveň interních bezpečnostních opatření, začal jsem víc řešit i to, jak chráním sám sebe, hlavně teď, když jsem si kvůli testování zakládal nový účet u OpenAI a procházel jsem si nastavení plateb a osobních údajů na další cizí platformě.

Osobně na tohle dlouhodobě používám VPNky, a protože se mě na doporučení lidi celkem často ptají, nechávám tu rovnou dvě služby, které sám soukromě i firemně používám nejen já ale i kolegové a máme s nimi ověřenou nejlepší zkušenost. Jde o affiliate odkazy, takže z nákupu přes ně mám malou provizi z čehož platím provoz tohoto webu, ale urpímně vždy doporučuju jen to, co si sám platím a reálně používám!

Vyzkoušet NordVPN, aktuálně 77% sleva a 3 měsíce zdarma

Vyzkoušet Surfshark, aktuálně 87% sleva a 3 měsíce zdarma

Cena a dostupnost: GPT-6 Astra vs Claude Opus 5

Tohle byla asi moje nejméně příjemná zkušenost s návratem k ChatGPT.

Claude Pro a Max: Moje zkušenost

Na Claude Pro (17 až 20 dolarů měsíčně) mám Opus 5 rovnou v hlavním chatu, žádné hledání, žádné podmínky. Na Claude Max, který používám, je Opus 5 dokonce výchozí model s pěti až dvacetinásobnou kapacitou oproti Pro.

Reklama Slevomat

ChatGPT Plus a Pro: Proč mě to zmátlo?

U ChatGPT jsem si musel Astru doslova hledat. Na plánu Plus (20 dolarů měsíčně) Astra vůbec není v běžném chatovacím okně, dostupná je jen omezeně přes nástroje nazvané Work a Codex, s odhadovaným rozsahem 5 až 45 zpráv za pět hodin.

Koukni...  OpenAI o1-preview: Nová éra v řešení složitých úloh 🧠

Teprve na dražším Pro plánu (100 nebo 200 dolarů měsíčně) se Astra objeví přímo v chatu, tam ale pod interním názvem „GPT-6 Pro“, s limitem 50 nebo 200 zpráv týdně, navíc sdíleným se starším modelem. Sám OpenAI navíc den po startu veřejně přiznal, že rollout byl neuklizený, a musel to dovysvětlovat.

Chápu, že jde o čerstvý a výpočetně náročný model, ale jako uživatel, který se po roce vrací, mi to přišlo zbytečně matoucí. U Claude jsem zvyklý na to, že za svoje peníze prostě dostanu nejlepší dostupný model bez skrývání za různé názvy a podmínky.

Co jsem si dohledal na interentu od ostatních uživatelů

Abych to nebylo jen o mém týdnu testování, prošel jsem si i diskuze na Redditu a Hacker News z prvních dní po launchi.

Opakovaně se chválí právě to, co jsem popsal výš, tedy ovládání počítače a prohlížeče, 3D a CAD práce a celková token efektivita na delších agentních úlohách.

Zároveň se ale často opakují stížnosti na extrémně rychlé vyčerpání limitu zpráv (někteří popisují, že jim celý pětihodinový limit spadl dřív, než model stihl odpovědět), na přehnanou opatrnost při odmítání i neškodných požadavků, a v rozsáhlejších projektech i na to, že model občas ignoruje pokyny uložené v projektových souborech a jede podle vlastního, méně kvalitního plánu.

K Opusu 5 (a nepřímo i k novějšímu Fable 5.1) jsou názory smíšenější. Část lidí ho popisuje jako spolehlivější na velké, byznys logikou obtížené kódové základny, jiná část dává přednost dražšímu modelu Fable právě na netriviální, dlouhodobé úlohy a Opus 5 vnímá jako rychlejší a levnější, ale ne nutně nejchytřejší volbu, což ostatně odpovídá tomu, jak ho pozicuje sám Anthropic.

Hodně komentářů taky poukazuje na to, že marketingová videa jsou pečlivě sestříhaná těsně před momentem, kdy by měla ukázat něco skutečně náročného, a že velká část nadšení pochází spíš z kreativních a vizuálních ukázek než z běžné vývojářské práce. S tímhle dojmem se po vlastním testování docela ztotožňuju.

Silné a slabé stránky: GPT-6 Astra vs Claude Opus 5

GPT-6 Astra: silné a slabé stránky

Co mě na Astře přesvědčilo

Ovládání počítače a prohlížeče, kybernetická bezpečnost, 3D a CAD práce, token efektivita na dlouhých úlohách.

Co mě na Astře štvalo

Dvojnásobná cena, matoucí a přísné limity zpráv, marketingové číslo na ARC-AGI-3, které bez kontextu zavádí, a chaotický start hned první dny.

Claude Opus 5: silné a slabé stránky

Co mě u Opusu 5 utvrdilo

Lepší poměr cena a výkon v běžném programování, jednoduchá a přímočará dostupnost rovnou v hlavním chatu, konzistentní dodržování pokynů, rekordní skok na ARC-AGI-3 měřený standardním způsobem.

Co bych Opusu 5 vytkl

V ovládání počítače a prohlížeče je znatelně slabší, a není to aktuálně nejsilnější model, jaký Anthropic nabízí, takže kdo chce absolutní špičku, měl by se podívat i na Fable 5.1.

Kdy bych sáhl po kterém modelu

Kdy bych zvolil Claude Opus 5

Pro běžné programování, opravy chyb a refaktoring bych zůstal u Claude Opus 5. Mám tam lepší poměr cena a výkon a v mých vlastních testech konzistentnější chování. Stejně tak pro práci s celým rozsáhlým repozitářem a delším kontextem, cena tam s rostoucím kontextem neroste tak, jak jsem četl, že roste u Astry. A pro hromadné zpracování textu a dat kvůli nižší sazbě za token.

Kdy bych zvolil GPT-6 Astra

Pro automatizaci prohlížeče, vyplňování formulářů a podobné úlohy s ovládáním počítače bych sáhl po Astře, tady byl rozdíl v můj prospěch i v mém vlastním testu nejcitelnější. Stejně tak pro 3D modelování a práci s CAD nástroji, i když jsem tuhle oblast sám netestoval do hloubky.

Kdy bych nezvolil ani jeden model

Pokud chcete absolutní špičku výkonu bez ohledu na cenu, ani jeden z těchhle dvou modelů podle mě není ta správná odpověď, spíš bych se podíval po Claude Fable 5.1, případně po Astřině nejvyšším režimu uvažování, pokud jde hlavně o matematiku nebo vědu.

Závěr: GPT-6 Astra vs Claude Opus 5

Po roce bez ChatGPTu jsem čekal buď zklamání, nebo naopak pocit, že jsem něco zásadního propásl. Nestalo se ani jedno. Astra je solidní, silná v konkrétních oblastech, které Claude prostě nemá jako svou hlavní parketu, ale v tom, co dělám celý den, tedy v programování, jsem rozdíl proti Opusu 5 necítil natolik, aby to ospravedlnilo přeplácení a matoucí limity zpráv.

Zůstávám u Claude jako hlavního nástroje, ale Astru bych si klidně zapnul jako doplněk konkrétně na úlohy s ovládáním počítače nebo prohlížeče, kdybych je řešil pravidelně.

Poznámka k datům a zdrojům

Vlastní dojmy z testování doplňuju o oficiální benchmarky OpenAI a Anthropicu, o nezávislé srovnávací nástroje Artificial Analysis a ARC Prize a o diskuze na Hacker News a Redditu z prvních dní po startu Astry.

Protože jsou oba modely v době psaní staré řádově dny až týdny, čísla se ještě budou posouvat, jak si obě firmy doladí testovací nastavení i produkční limity. Než uděláte vlastní rozhodnutí, doporučuju si aktuální ceny a limity ověřit přímo na stránkách obou firem.

Oficiální stránky

Nezávislé benchmarky

Diskuze a komunita

Novinářské pokrytí a analýzy

  • NBC News, OpenAI debuts GPT-6 Astra, says it triggered security measures: nbcnews.com
  • Fox Business, OpenAI unveils GPT-6 Astra: foxbusiness.com
  • Forbes, OpenAI Launches GPT-6 Astra After A Curious False Start: forbes.com
  • The New Stack, GPT-6 Astra’s score of 98.6% looked like AGI: thenewstack.io
  • The New Stack, „Sorry for the messy rollout“: thenewstack.io
  • DataCamp, GPT-6 Astra: Features, Benchmarks, and Pricing: datacamp.com
  • DataCamp, Claude Opus 5: datacamp.com
  • Codersera, GPT-6 Astra vs Claude Opus 5: codersera.com
  • Beam.ai, GPT-6 Astra for AI Agents: The 99.9% Footnote: beam.ai

Ceny a limity

  • Eesel, Claude Opus 5 pricing in 2026: eesel.ai
  • Kingy.ai, GPT-6 Astra Access: Plans, API, Pricing, Daybreak: kingy.ai
TipSport MS 2025 v hokeji
TipSport

Vaše komentáře

Zatím nejsou žádné komentáře… Buďte první, kdo ho napíše.


Přispějte svým komentářem