Späť na blog
AI modely a nástroje5. septembra 202617 min

GPT-6 Astra: benchmarky, cena a pre koho je dnes dostupný

OpenAI predstavil GPT-6 Astra 3. septembra 2026 a hovorí o ére AGI. Prechádzame kompletnú tabuľku benchmarkov zo systémovej karty, nezávislé meranie Artificial Analysis (61 bodov, rovnako ako predchodca), celý cenník vrátane dlhého kontextu a Fast mode, a rozoberáme, ktorý plán ChatGPT má model dnes k dispozícii a prečo ho free plán zatiaľ nedostane.

GPT-6 Astra: benchmarky, cena a pre koho je dnes dostupný

Rýchla odpoveď

  • OpenAI predstavil GPT-6 Astra 3. septembra 2026, širší rollout beží od 4. septembra.
  • API stojí 10 dolárov za milión vstupných a 50 dolárov za milión výstupných tokenov, teda 2,5-násobok ceny GPT-5.6 Sol.
  • Kontextové okno 1 milión tokenov, knowledge cutoff 30. apríl 2026.
  • Vlastné benchmarky OpenAI sú silné: 97,6 % na FrontierMath Tier 4, 100 % na ExploitBench, 72,6 % na OSWorld.
  • Nezávislý index Artificial Analysis dáva Astre 61 bodov, presne toľko čo predchodcovi, a o 5 menej než Claude Fable 5.1.
  • Dnes, 5. septembra 2026, je Astra v ChatGPT pre plány Plus, Pro, Business a Enterprise. Silnejší variant GPT-6 Pro Plus nedostal. Free plán prístup nemá a OpenAI ho zatiaľ ani nesľúbil.
  • Astra je prvý model OpenAI s hodnotením Critical pre kybernetické schopnosti.

Keď sme písali o Astre začiatkom augusta, existovalo o nej presne jedno tvrdenie: vyriešila desať otvorených matematických problémov. Žiadne benchmarky, žiadna cena, žiadny dátum. Text sa vtedy končil vetou, že bez benchmarkov sa model porovnať nedá.

Teraz benchmarky máme. A sú zaujímavejšie v tom, čo OpenAI zamlčal, než v tom, čo dal na titulnú stránku.

Čo je GPT-6 Astra a čím sa líši od GPT-5.6 Sol

GPT-6 Astra je nový vlajkový model OpenAI, ktorý nahrádza GPT-5.6 Sol. Firma ho predstavila 3. septembra 2026 ako „najinteligentnejší a najzarovnanejší model na svete". Prezident OpenAI Greg Brockman k tomu novinárom povedal, že „nie je nerozumné cítiť, že sme teraz v ére AGI".

Vecne je posun inde než v konverzácii. Astra je stavaná na delegovanie práce, nie na chat:

  • Ovládanie počítača. Model odbaví celý tok v desktopových aplikáciách: vyplní formulár, aktualizuje záznam v CRM, otestuje aplikáciu. Podľa rozboru DataCampu vie skladať dokumenty, prezentácie a tabuľky podľa vašej šablóny.
  • Pýta sa, ale len keď to má zmysel. Doplňujúcu otázku položí vtedy, keď odpoveď zmení výsledok, nie na začiatku každej úlohy.
  • Nová práca s kontextom v Codexe. Namiesto sumarizovania staršej histórie si model drží prehľadávateľné poznámky naprieč kontextovými oknami. Zatiaľ ide o experimentálnu funkciu, ktorá sa má v priebehu týždňov stať predvolenou.
  • Rýchlosť. Priemerný čas na úlohu v benchmarku OSWorld klesol zo 75 minút na 40.

Technické parametre

ParameterGPT-6 AstraGPT-5.6 Sol
Dátum vydania3. september 20269. júl 2026
Kontextové okno1 milión tokenov1,1 milióna tokenov
Maximálny výstup128-tisíc tokenov128-tisíc tokenov
Knowledge cutoff30. apríl 2026február 2026
Vstupytext, obrázkytext, obrázky
Cena vstup a výstup10 a 50 dolárov4 a 20 dolárov (promo)
Model ID v APIgpt-6-astragpt-5.6-sol

Parametre potvrdzuje databáza LLM Stats pre Astru aj pre Sol.

Všimnite si riadok s kontextom. Miliónové okno nie je novinka, Sol ho mal tiež. Zmenilo sa niečo iné a v praxi dôležitejšie: koľko z toho okna model reálne prečíta. K tomu sa dostaneme pri benchmarku MRCR nižšie.

Benchmarky GPT-6 Astra: kompletný prehľad

Nasledujúce čísla pochádzajú zo systémovej karty OpenAI, tak ako ich zosumarizoval Vellum. Ide teda o merania výrobcu, nie nezávislé. Nezávislým sa venujeme o dve kapitoly nižšie.

Ovládanie počítača a agenti

BenchmarkAstraGPT-5.6 Sol
ScreenSpot-Pro92,7 %76,9 %
OSWorld 2.072,6 %65,7 %
Agents' Last Exam59,353,6

ScreenSpot-Pro je najväčší jednotlivý skok celého vydania: nárast o takmer 16 percentuálnych bodov v schopnosti trafiť správny prvok na obrazovke. Práve to je tá nudná časť, na ktorej agenti v praxi padajú.

Profesionálna práca

BenchmarkAstraClaude Fable 5.1Claude Opus 5GPT-5.6 Sol
AutomationBench41,4 %31,4 %26,9 %18,1 %
BenchCAD95,9 %84,3 %neuvedené83,3 %
BrowseComp91,5 %neuvedenéneuvedené90,4 %

AutomationBench je tu ten dôležitý riadok. Astra na ňom zdvojnásobila skóre Solu a nechala Claude Fable 5.1 desať bodov za sebou.

Kódovanie

BenchmarkAstraFable 5.1Opus 5SolMuse Spark 1.3
Terminal-Bench 4.057,7 %55,8 %52,3 %37,3 %neuvedené
DeepSWE v1.174,1 %67,4 %cca 74 %72,7 %75,4 %
FrontierCode 1.1 Extended64,5 %neuvedenéneuvedenéneuvedenéneuvedené

Na DeepSWE, teda na tom benchmarku, ktorý OpenAI uvádza ako dôkaz agentického kódovania, vedie Meta Muse Spark 1.3 s 75,4 % pri maximálnom nastavení uvažovania. Astra je druhá. Na FrontierCode 1.1 Extended je Astra so 64,5 % tesne za starším Fable 5 so 64,9 %.

Matematika a akademické úlohy

BenchmarkAstraFable 5.1Opus 5Sol
FrontierMath Tier 4 (v2)97,6 %87,8 %73,2 %neuvedené
ARC-AGI-399,9 %neuvedené30,2 %7,8 %
GPQA Diamond96,0 %neuvedenéneuvedenéneuvedené
Terminal-Bench Science64,6 %52,6 %neuvedenéneuvedené
Humanity's Last Exam (s nástrojmi)57,2 %65,0 %63,6 %neuvedené

Dve veci si zaslúžia hviezdičku.

ARC-AGI-3 a tých 99,9 %. Skóre platí „pod adaptérom poskytovateľa od OpenAI". Keď sa ten istý model meria v bezstavovom režime, výsledky padajú do pásma 17 až 63 %. Číslo 99,9 % teda nehovorí, že model saturoval ARC-AGI-3, ale že ho saturoval v prostredí, ktoré si postavil sám dodávateľ.

Humanity's Last Exam. Astra tu má 57,2 %, čo je menej než 65,0 % u Claude Fable 5.1 aj menej než 63,6 % u Claude Opus 5. Tento benchmark v komunikácii OpenAI nenájdete, hoci pri predchádzajúcich vydaniach býval vpredu.

Veda, zdravotníctvo a dlhý kontext

BenchmarkAstraGPT-5.6 Sol
GeneBench Pro37,8 %28,7 %
LifeSciBench60,3 %59,9 %
HealthBench Professional63,4 %60,5 %
MedChemBench49,3 %47,4 %
MRCR v2, 8 ihiel, 256K až 512K100 %91,5 %
MRCR v2, 8 ihiel, 512K až 1M96,3 %73,8 %

MRCR je test vyhľadávania viacerých informácií v dlhom kontexte. Toto je ten sľúbený riadok o kontexte: obidva modely majú okno cez milión tokenov, ale v pásme nad pol milióna tokenov Sol našiel správne informácie v 73,8 % prípadov, kým Astra v 96,3 %. Milión tokenov teda prestáva byť číslom v datasheete a začína byť použiteľnou funkciou.

Zarovnanie a halucinácie

Test (nižšie je lepšie)AstraGPT-5.6 Sol
Halucinácie4,2 %12,2 %
Podvádzanie na honeypote v ExploitGyme0,0 %48,2 %
Obchádzanie Codex Auto-Review0,00 %0,29 %
Bezpečnosť pri ovládaní počítača2,4 %22,0 %

Pokles podvádzania zo 48,2 % na nulu je v kontexte agentov podstatnejší než ktorýkoľvek bod na FrontierMath. Model, ktorý pri neriešiteľnej úlohe siahne po podvode, je v produkcii nepoužiteľný bez ohľadu na to, aký je inak chytrý.

Nezávislé meranie: Artificial Analysis vidí iný obraz

Prvé nezávislé meranie urobila spoločnosť Artificial Analysis a jej výsledok je podstatne triezvejší než tlačová správa.

Intelligence Index, agregovaný index inteligencie:

Claude Fable 5.1
66
GPT-6 Astra
61
GPT-5.6 Sol
61

Coding Agent Index, index agentického kódovania:

Claude Fable 5.1
70
GPT-6 Astra
67
Claude Opus 5
cca 67

Zhrnutie servera Trending Topics je stručné: na oboch hlavných indexoch je Astra na úrovni vlastnej predchádzajúcej generácie a za vedúcimi modelmi Anthropicu aj za Metou.

Artificial Analysis pritom našla aj dve veci, ktoré OpenAI nezdôrazňuje, hoci sú v prospech modelu:

  • Tokenová efektivita. Pri kódovaní Astra spotrebuje zhruba tretinu tokenov oproti GPT-5.6 Sol a pätinu oproti Claude Opus 5.
  • Halucinácie pri maximálnom nastavení. Miera halucinácií klesla z 92 % na 51 %, pričom presnosť súčasne stúpla o štyri body.

A jednu, ktorá je proti nemu: pri maximálnom nastavení je jedna úloha o 75 % drahšia než pri Sole, aj keď model minie menej tokenov. Cenník totiž stúpol viac, než sa zlepšila efektivita.

Cena GPT-6 Astra: kompletný cenník

Ceny sú za milión tokenov v amerických dolároch, podľa rozpisu CloudZero.

RežimVstupCache čítanieCache zápisVýstup
Štandard (do 272K tokenov)10,001,0012,5050,00
Dlhý kontext (nad 272K)20,002,0025,0075,00
Batch a Flex5,000,506,2525,00
Fast mode20,002,0025,00100,00

Fast mode kupuje až 2,5-násobnú rýchlosť spracovania za presne dvojnásobok peňazí. Batch a Flex naopak zlacňujú o polovicu výmenou za oneskorenie.

Ako to vyzerá proti konkurencii

GPT-6 Astra
50 $
Claude Fable 5.1
50 $
GPT-5.6 Sol
20 $
Meta Muse Spark
4,25 $
Gemini 3.8 Flash
3,75 $

Cena za milión výstupných tokenov, štandardný režim.

Pripomeňme, že cena GPT-5.6 Sol na úrovni 4 a 20 dolárov je promo cena garantovaná do 21. novembra 2026. Kto v Sole postavil ekonomiku produktu, mal by si ten dátum poznačiť. Podrobnejšie porovnanie naprieč dodávateľmi nájdete v článku Koľko stojí milión tokenov v roku 2026.

Reálny prepočet

Zoberme typickú agentickú úlohu: 200-tisíc vstupných tokenov (repozitár, dokumentácia, história) a 40-tisíc výstupných.

Model a režimVstupVýstupSpolu
GPT-6 Astra, štandard2,00 $2,00 $4,00 $
GPT-6 Astra, 90 % z cache0,38 $2,00 $2,38 $
GPT-6 Astra, Batch1,00 $1,00 $2,00 $
GPT-5.6 Sol, štandard0,80 $0,80 $1,60 $

Pri tisícke takých úloh mesačne je rozdiel medzi Astrou a Solom 2 400 dolárov. To je celý spor o tom, či sa oplatí prejsť.

Dva protichodné nároky na cenu za úlohu

Tu je dobré si všimnúť rozpor, ktorý sa v recenziách stráca:

  • OpenAI tvrdí, že na DeepSWE je odhadovaná cena za dokončenú úlohu zhruba o 57 % nižšia než pri Sole, lebo model dokončí úlohu rýchlejšie a s menším počtom tokenov.
  • Artificial Analysis meria, že pri maximálnom nastavení uvažovania je úloha o 75 % drahšia.

Obe čísla môžu byť správne, lebo merajú iný scenár. OpenAI počíta dlhé agentické behy, kde sa efektivita prejaví. Artificial Analysis počíta beh na maximálnom uvažovaní, kde model minie viac. Praktický záver: ak Astru nasadíte na dlhé agentické úlohy, môže vyjsť lacnejšie. Ak ju nasadíte ako drahšie GPT namiesto Solu na bežné dopyty, zaplatíte 2,5-násobok za nič.

Pre koho je GPT-6 Astra dostupný dnes, 5. septembra 2026

Toto je najzmätenejšia časť celého vydania a stojí za to ju rozobrať poriadne, lebo rollout nie je plošný. Oznámenie o spustení negarantuje, že váš účet, krajina, workspace alebo API tier model dnes uvidia.

Pozor na dva rôzne názvy

V ChatGPT existujú dve veci s podobným menom a je to zdroj väčšiny nedorozumení:

  • GPT-6 Astra je základný model. OpenAI oznámil, že sa „v priebehu nasledujúcich dní" dostane ku všetkým používateľom Plus, Pro, Business a Enterprise, plus do API a na AWS.
  • GPT-6 Pro je silnejší variant s vyšším uvažovaním. Ten podľa prehľadu prístupov do plánu Plus nepatrí vôbec.

Presne v tejto medzere vznikol rozruch. Časť predplatiteľov Plus po oznámení nenašla v prepínači modelov nič, lebo prístup mali zatiaľ len cez ChatGPT Work a Codex, nie cez bežný výber modelu.

Tabuľka prístupu podľa plánu

PlánGPT-6 AstraGPT-6 ProLimit správ
Free a GoNieNiebez prístupu
Plus (20 dolárov)Áno, postupneNiecca 5 až 45 správ za 5 hodín
Pro (100 dolárov)ÁnoÁno50 správ týždenne, zdieľané so Sol Pro
Pro (200 dolárov)ÁnoÁno200 správ týždenne, denný strop 200
Business StandardÁnoÁno15 správ mesačne, zdieľané
Business PremiumÁnoÁno50 správ týždenne, zdieľané
EnterpriseÁnoÁnoadmin musí zapnúť, prvé 2 týždne vypnuté
Edu a Healthcareneuvedenéneuvedenébez zverejneného termínu

Dostane GPT-6 aj používateľ na free pláne?

Zatiaľ nie a OpenAI to ani nesľúbil. Oficiálna stránka modelu menuje pri nadchádzajúcom rolloute výslovne Plus, Pro, Business a Enterprise. Free plán v zozname nie je.

Historicky pritom vlajkové modely OpenAI na free plán dorazia, len s odstupom a s prísnym stropom správ. Rozdiel oproti minulosti je v tom, že Astra je prvý model s kybernetickým hodnotením Critical, čo dáva firme dôvod nechať širokú dostupnosť ešte odležať. Rozumné očakávanie je teda obmedzený prístup na free pláne v priebehu jesene, nie tento týždeň. Do tej doby zostáva pre free používateľa najsilnejšou dostupnou možnosťou generácia GPT-5.6.

API a cloudy

  • OpenAI API: model ID gpt-6-astra, vyžaduje projekt s nastavenou fakturáciou. Bezplatný API tier prístup nemá. Rate limity idú od 500 požiadaviek za minútu na Tier 1 po 15-tisíc na Tier 5.
  • Microsoft Foundry: katalóg už uvádza gpt-6-astra vo verzii 2026-09-03. Predplatné na úrovni Tier 5 a 6 dostáva kvótu automaticky, nižšie tiery si o ňu musia požiadať.
  • AWS Bedrock: ohlásené v tlačovej správe, oficiálna dokumentácia AWS to zatiaľ nepotvrdila.

Prvý model s hodnotením Critical pre kyberbezpečnosť

Toto je vecne najväčšia novinka celého vydania a v bežnom spravodajstve zapadla za citát o AGI.

OpenAI má interný Preparedness Framework, ktorý zaraďuje modely do štyroch stupňov rizika v oblastiach ako kyberbezpečnosť, biológia či rádiológia. Stupeň Critical v kyberbezpečnosti znamená schopnosť nájsť a zneužiť nové zraniteľnosti v zabezpečených systémoch bez toho, aby človek viedol model krok za krokom. Astra je prvý model, ktorý OpenAI takto klasifikoval.

Dôvod je konkrétny. Na internom teste dvadsiatich vysoko závažných zraniteľností enginu V8, zverejnených medzi júnom a augustom 2026, model objavil a využil dve dovtedy neznáme zraniteľnosti typu zero-day. OpenAI ich hlási správcom projektu.

Praktické dôsledky:

  • Verejná verzia modelu odmieta pokročilé útočné úlohy, napríklad tvorbu proof-of-concept exploitov. Obranné práce, ako revízia kódu a záplatovanie, fungujú.
  • Menej obmedzený prístup ide cez program OpenAI Daybreak, do ktorého sa organizácie prihlasujú. Vyžaduje overenie identity jednotlivcov a zapnuté rozšírené zabezpečenie účtu.
  • Rozdiel je veľký: v konfigurácii Daybreak Blue stúpa úspešnosť dokončenia proof-of-concept exploitu z 2,4 % na 92 %. Tú konfiguráciu nedostávajú všetci účastníci programu.

Päť vecí, ktoré sa v šume okolo AGI stratili

1. Astra sa trénovala v Stargate v Texase

Podľa súhrnu na Wikipédii išlo o najväčší tréningový beh v histórii OpenAI, na viac než 100-tisíc GPU.

2. Nová technika uvažovania robí model horšie kontrolovateľným

Astra používa techniku „recurrent depth", ktorá časť uvažovania modelu skrýva. OpenAI v tom istom materiáli priznáva regresiu: písané uvažovanie sa horšie monitoruje, hoci miera odmietnutí a odolnosť voči honeypotom sa zlepšili. Vlastná formulácia firmy znie, že pokrok v inteligencii nezaručuje pokrok v zarovnaní, a je spojená so záväzkom nepokračovať v škálovaní, kým sa monitorovateľnosť nezlepší. Práve toto vyvolalo obavy bezpečnostných výskumníkov.

3. Meno zapadá do rodiny, nie do poradia

Po Sol, Terra a Luna prichádza Astra, teda hviezda. OpenAI opustil číslovanie ako hlavný identifikátor a prešiel na astronomické mená. V ChatGPT sa pritom silnejší variant volá GPT-6 Pro, nie Astra, čo je ďalší dôvod, prečo je rollout mätúci.

4. Zdvojnásobenie rýchlosti predáva lepšie než zdvojnásobenie inteligencie

Skrátenie času na úlohu v OSWorld zo 75 na 40 minút je pokles o 47 %. Pre firmu, ktorá agenta púšťa na tisíce úloh, je to hmatateľnejšia zmena než tri body na benchmarku.

5. Nasadenie v kyberbezpečnosti prichádza s brzdami

OpenAI otvorene uvádza, že produkčné nasadenie kyberbezpečnostných funkcií zahŕňa „spomalenia, pauzy alebo bloky". Model teda nedostanete ako plne autonómneho pentestera, ani keď zaplatíte.

Čo GPT-6 Astra znamená pre viditeľnosť vášho webu v AI vyhľadávačoch

Pre bežný web sa priamo nemení nič, ale nepriamo dve veci.

Po prvé, ChatGPT bude vyhľadávať inak. Astra je stavaná na dlhé agentické behy a na prácu s miliónovým kontextom. Model, ktorý si vie udržať prehľadávateľné poznámky naprieč kontextom a spracovať pol milióna tokenov s 96 % presnosťou, si pri jednej otázke otvorí viac zdrojov a porovná ich medzi sebou. To zvýhodňuje weby, ktoré unesú podrobnejšie čítanie: konkrétne čísla, dátumy, zdroje, jednoznačné odpovede na podotázky. Naopak trestá texty, ktoré vyzerajú dobre v úryvku, ale pri hlbšom čítaní nemajú čo ponúknuť.

Po druhé, pokles halucinácií mení dôvod, prečo vás model cituje. Ak model v internom teste znížil halucinácie z 12,2 % na 4,2 %, znamená to, že častejšie povie „neviem" alebo siahne po zdroji, namiesto aby si odpoveď domyslel. Väčší podiel odpovedí sa teda bude opierať o skutočne nájdené stránky. Kto v danej téme nemá dohľadateľný a citovateľný obsah, zmizne z odpovede úplne, namiesto aby ho model vyhalucinoval.

Praktický krok je rovnaký ako pri každom novom vlajkovom modeli: zmerať si, či vás reálne cituje, a nie hádať. Ako sa to robí, rozoberáme v článku AI Share of Voice: ako zmerať, či vás AI vyhľadávače citujú.

Zistite, či vás ChatGPT spomína

Sledujeme citácie vašej domény v ChatGPT, Perplexity, Google AI Overviews, Gemini a Claude. Bezplatný audit za pár minút.

Spustiť bezplatný audit

Zhrnutie: oplatí sa prejsť na GPT-6 Astra?

Áno, ak staviate agentov, ktorí ovládajú počítač alebo prehliadač, robíte dlhé automatizované behy v Codexe, potrebujete pracovať s kontextom nad 500-tisíc tokenov, alebo riešite obrannú kyberbezpečnosť. V týchto scenároch je náskok Astry meraný a veľký.

Nie, ak model používate na písanie, sumarizáciu, klasifikáciu alebo bežné dopyty. Tam podľa nezávislého merania dostanete rovnakú inteligenciu ako od GPT-5.6 Sol za 2,5-násobok ceny, a lacnejšie modely od Mety či Googlu sú o rád nižšie.

Počkajte, ak vás zaujíma najlepší pomer ceny a výkonu na kódovanie. Podľa Artificial Analysis vedie na Coding Agent Indexe Claude Fable 5.1 so 70 bodmi za rovnakú cenu 10 a 50 dolárov. Pri takom rozdiele je rozumné otestovať oba modely na vlastných úlohách, nie na cudzích benchmarkoch.

Často kladené otázky

Kedy vyšiel GPT-6 Astra?

OpenAI predstavil GPT-6 Astra 3. septembra 2026. V ten deň dostala prístup obmedzená skupina organizácií, najmä účastníci kyberbezpečnostného programu Daybreak. Širší rollout pre používateľov ChatGPT a pre API začal 4. septembra 2026 a pokračuje postupne.

Koľko stojí GPT-6 Astra?

V API stojí 10 dolárov za milión vstupných tokenov a 50 dolárov za milión výstupných tokenov. Čítanie z cache stojí 1 dolár, zápis do cache 12,50 dolára. Nad 272-tisíc vstupných tokenov sa cena zdvojnásobuje na 20 dolárov za vstup a stúpa na 75 dolárov za výstup. Batch a Flex sú za polovicu, Fast mode za dvojnásobok. Oproti GPT-5.6 Sol ide o 2,5-násobok ceny.

Je GPT-6 Astra dostupný pre free používateľov ChatGPT?

Nie. Oficiálne oznámenie menuje len plány Plus, Pro, Business a Enterprise. Free plán ani plán Go prístup nemajú a OpenAI zatiaľ nezverejnil termín, kedy by ho mali dostať. Free používatelia zostávajú na modeloch generácie GPT-5.6.

Prečo mnohí používatelia ChatGPT Plus GPT-6 nevidia?

Sú dva dôvody. Prvý je, že rollout je postupný, takže oprávnený plán ešte neznamená okamžitý prístup. Druhý je, že v ChatGPT existujú dva rôzne názvy: základná Astra prichádza aj do plánu Plus, ale silnejší variant GPT-6 Pro je vyhradený pre plány Pro, Business a Enterprise. Predplatitelia Plus mali spočiatku prístup len cez ChatGPT Work a Codex, nie cez bežný prepínač modelov.

Aké má GPT-6 Astra kontextové okno a knowledge cutoff?

Kontextové okno je 1 milión tokenov, maximálny výstup 128-tisíc tokenov. Knowledge cutoff je 30. apríl 2026. Nad 272-tisíc vstupných tokenov sa účtuje vyššia sadzba za dlhý kontext.

Je GPT-6 Astra lepší než Claude Fable 5.1?

Závisí od úlohy. Na vlastných benchmarkoch OpenAI vedie Astra v ovládaní počítača, v automatizácii a v matematike. Na Humanity's Last Exam má Astra 57,2 % oproti 65,0 % u Fable 5.1. Nezávislý Intelligence Index od Artificial Analysis dáva Astre 61 bodov a Fable 5.1 66 bodov, na Coding Agent Indexe je to 67 oproti 70 v prospech Fable 5.1. Obidva modely stoja rovnako, teda 10 a 50 dolárov za milión tokenov.

Je GPT-6 Astra lepší než GPT-5.6 Sol?

Na benchmarkoch OpenAI výrazne áno, najmä pri ovládaní počítača, dlhom kontexte a kyberbezpečnosti. Podľa nezávislého merania Artificial Analysis však oba modely dosahujú rovnakých 61 bodov na Intelligence Indexe. Astra spotrebuje asi tretinu tokenov oproti Solu pri kódovaní, ale stojí 2,5-násobok, takže na bežných dopytoch je drahšia bez zisku.

Čo znamená hodnotenie Critical pre kyberbezpečnosť?

Je to najvyšší stupeň interného Preparedness Frameworku OpenAI pre kybernetické schopnosti. Znamená schopnosť samostatne nájsť a zneužiť nové zraniteľnosti v zabezpečených systémoch bez vedenia človekom krok za krokom. Astra je prvý model, ktorý OpenAI takto zaradil. Dôvodom bolo, že pri internom teste na dvadsiatich zraniteľnostiach enginu V8 objavila dve dovtedy neznáme zraniteľnosti typu zero-day.

Čo je program OpenAI Daybreak?

Daybreak je prístupový program pre obrancov v kyberbezpečnosti. Poskytuje skoršie a menej obmedzené použitie hraničných modelov na obranné účely. Verejná verzia Astry odmieta útočné úlohy ako tvorbu proof-of-concept exploitov, kým v konfigurácii Daybreak Blue stúpa úspešnosť dokončenia takého exploitu z 2,4 % na 92 %. Organizácie sa do programu prihlasujú a musia prejsť overením identity.

Je GPT-6 Astra dostupný na Slovensku?

Áno, s rovnakými podmienkami ako inde. Prístup sa neriadi krajinou, ale plánom a fázou rolloutu. Slovenský používateľ s plánom Plus alebo vyšším dostane Astru v rámci postupného spúšťania, vývojár potrebuje projekt OpenAI API s nastavenou fakturáciou. Model funguje aj v slovenčine, hoci žiadny zo zverejnených benchmarkov slovenčinu samostatne nemeria.

Ovplyvní GPT-6 Astra viditeľnosť môjho webu v AI vyhľadávačoch?

Nepriamo áno. Model s miliónovým kontextom a nižšou mierou halucinácií si pri odpovedi otvorí viac zdrojov a porovná ich, namiesto aby odpoveď domyslel. To zvýhodňuje weby s konkrétnymi číslami, dátumami a dohľadateľnými zdrojmi, a znevýhodňuje všeobecné texty. Odporúčame merať citácie vlastnej domény priebežne, nie odhadovať dopad z benchmarkov.

I

Tím Optimalizácia pre AI pomáha firmám zvyšovať viditeľnosť v AI vyhľadávačoch. Monitorujeme Perplexity, ChatGPT, Google AIO, Gemini a Claude pre desiatky domén.

Zdieľať článok

Sledujte, ako AI vyhľadávače citujú váš web

Vyskúšajte Optimalizáciu pre AI zadarmo