Späť na blog
AI modely a nástroje31. júla 202613 min

OpenAI zlacnil GPT-5.6 Luna o 80 %: nové ceny, Fast mode a čo z toho má váš web

OpenAI 30. júla 2026 znížil cenu GPT-5.6 Luna o 80 % a Terra o 20 %, premenoval Priority Processing na Fast mode a priznal, že produkčné kernely mu prepísal jeho vlastný model. Prechádzame nové cenníkové sadzby, porovnanie s Gemini a Claude, a to podstatné: čo pád ceny inteligencie znamená pre viditeľnosť bežného webu v AI vyhľadávaní.

OpenAI zlacnil GPT-5.6 Luna o 80 %: nové ceny, Fast mode a čo z toho má váš web

TL;DR OpenAI od 30. júla 2026 účtuje za GPT-5.6 Luna 0,20 $ za milión vstupných a 1,20 $ za milión výstupných tokenov, čo je o 80 % menej než predtým. GPT-5.6 Terra zlacnel o 20 % na 2,00 $ / 12,00 $. Cena vlajkového Sol sa nemenila, pribudol mu ale Fast mode: do 2,5-krát rýchlejšie odpovede za dvojnásobnú cenu. Pre firmy je hlavná správa mimo cenníka: keď hraničná cena jednej AI odpovede padne na centy, AI vyhľadávače a agenti si môžu dovoliť odpovedať na každý dopyt s vyhľadávaním a viacerými krokmi. Tým rastie hodnota toho, aby vás tie odpovede citovali.

Cenníky AI modelov sa zvyknú meniť po malých krokoch. 30. júla 2026 to bol krok veľký: OpenAI znížil cenu GPT-5.6 Luna o 80 % a GPT-5.6 Terra o 20 % a zároveň predstavil Fast mode pre vlajkový Sol. Zaujímavejšia ako samotné čísla je ale príčina, ktorú firma popísala: časť úspor vygeneroval jej vlastný model, keď prepisoval produkčný kód, na ktorom beží.

Tento článok rozoberá tri veci. Aké sú nové sadzby a ako obstoja voči konkurencii. Prečo si OpenAI mohol zlacnenie dovoliť. A čo z toho vyplýva pre každého, kto prevádzkuje web a chce, aby ho AI vyhľadávače spomínali.

Čo presne OpenAI oznámil

Oznámenie z 30. júla 2026 obsahuje štyri konkrétne zmeny:

  • GPT-5.6 Luna zlacnel o 80 %. Ide o najrýchlejší a najlacnejší model rodiny.
  • GPT-5.6 Terra zlacnel o 20 %. Vyvážený model na bežnú prácu.
  • Nižšie ceny sa premietli aj do predplatného. Používanie Luna a Terra v Codexe a ChatGPT Work teraz spotrebuje menej kreditov, pričom ceny predplatného ani rozpočty kvót sa nemenili.
  • Fast mode nahradil Priority Processing. Pre GPT-5.6 Sol prináša až 2,5-krát vyššiu rýchlosť za dvojnásobnú cenu, bez zmeny inteligencie.

Ak vám rodina Sol, Terra a Luna nič nehovorí, začnite prehľadom celej rodiny GPT-5.6. Detailne sme rozobrali aj samotný model Luna, Terra a Sol.

Nové ceny GPT-5.6 v číslach

Oficiálny cenník OpenAI API uvádza po znížení tieto sadzby za milión tokenov v štandardnom režime a krátkom kontexte:

GPT-5.6 LUNA
−80 %
0,20 $ vstup / 1,20 $ výstup
Zodpovedá pôvodným 1,00 $ / 6,00 $. Kešovaný vstup stojí 0,02 $, teda o 90 % menej.
GPT-5.6 TERRA
−20 %
2,00 $ vstup / 12,00 $ výstup
Zodpovedá pôvodným 2,50 $ / 15,00 $, čo je zhodou okolností presne cenník staršieho GPT-5.4.
GPT-5.6 SOL
bez zmeny
5,00 $ vstup / 30,00 $ výstup
Vo Fast mode 10,00 $ / 60,00 $, teda dvojnásobok za vyššiu priepustnosť.

Pozor na jeden detail, ktorý sa v článkoch o zlacnení stráca: pri dlhom kontexte platia iné, dvojnásobné sadzby. Luna vtedy stojí 0,40 $ / 1,80 $, Terra 4,00 $ / 18,00 $ a Sol 10,00 $ / 45,00 $. Ak posielate do modelu veľké dokumenty alebo dlhé konverzácie, reálna cena vašej aplikácie bude bližšie k tejto tabuľke než k tej marketingovej.

Ako to vyzerá voči Gemini a Claude

Porovnávať modely len cez cenu vstupu je zavádzajúce, lebo uvažujúce modely generujú veľa výstupných tokenov. Nasledujúci graf preto sčítava obe sadzby za milión tokenov. Je to hrubá aproximácia, ktorá predpokladá pomer vstupu a výstupu 1:1, no na zoradenie modelov podľa cenovej hladiny postačí.

Cena za milión tokenov, vstup plus výstup
Štandardný režim, krátky kontext, stav k 31. 7. 2026
GPT-5.6 Luna1,40 $
Gemini 3.5 Flash-Lite2,80 $
Claude Haiku 4.56,00 $
Gemini 3.6 Flash9,00 $
GPT-5.6 Terra14,00 $
Gemini 3.1 Pro Preview14,00 $
Claude Sonnet 518,00 $
Claude Opus 530,00 $
GPT-5.6 Sol35,00 $

Čísla pre Google pochádzajú z cenníka Gemini API, kde Gemini 3.6 Flash stojí 1,50 $ / 7,50 $, Gemini 3.5 Flash-Lite 0,30 $ / 2,50 $ a Gemini 3.1 Pro Preview 2,00 $ / 12,00 $ pri promptoch do 200-tisíc tokenov. Sadzby Anthropicu vychádzajú z oficiálneho cenníka Claude: Opus 5 za 5,00 $ / 25,00 $, Sonnet 5 za 3,00 $ / 15,00 $ a Haiku 4.5 za 1,00 $ / 5,00 $. Pri Sonnete 5 beží do 31. augusta 2026 zavádzacia cena 2,00 $ / 10,00 $, takže v grafe je uvedená vyššia, dlhodobá sadzba.

Podstatné je, že Luna sa dostala pod najlacnejší model Googlu. To je nová situácia: donedávna bola cenová spodná hranica doménou Gemini Flash a otvorených modelov. Ak vás zaujíma, ako si vedie špička Anthropicu, porovnávali sme ju v článku o benchmarkoch a cene Claude Opus 5.

Cena je len polovica rovnice, tou druhou je inteligencia

Lacný model, ktorý úlohu nezvládne, nie je úspora. Preto sa modely porovnávajú aj cez cenu za vyriešenú úlohu. Nezávislý index Artificial Analysis Intelligence Index dáva GPT-5.6 Sol 59 bodov pri cene 1,04 $ za úlohu, Terra 55 bodov pri 0,55 $ a Luna 51 bodov pri 0,21 $ za úlohu. Tie ceny za úlohu boli merané pred zlacnením, takže Luna sa po znížení sadzieb posunula na grafe výrazne doľava.

Práve tento posun ilustruje graf, ktorý OpenAI rozposlal spolu s oznámením: krivka Luny pri rôznej hĺbke uvažovania sa dotýka hodnôt, na ktoré ostatné modely potrebujú niekoľkonásobne vyšší rozpočet. Luna pritom nie je pomalá, Artificial Analysis jej nameral 184,4 tokenu za sekundu.

Samotný OpenAI to opisuje dvoma tvrdeniami. Luna podľa neho dosahuje výkon porovnateľný s modelmi, ktoré boli pred rokom na hranici možností, za približne 6 centov z dolára na úlohu a pri takmer deväťnásobnej rýchlosti. A v teste odbornej práce Agents' Last Exam prekonáva Claude Fable 5 pri odhadovanej cene za úlohu nižšej o takmer 99 %.

Berte to ako marketing výrobcu, nie ako nezávislé meranie. Ale aj po odpočítaní nadšenia zostáva jasný trend: hranica medzi „drahým rozumným modelom" a „lacným hlúpym modelom" sa rozpúšťa. Ak neviete, čo je token a prečo sa všetko počíta práve na ne, vysvetlili sme to v článku o tokenoch a embeddingoch.

Prečo si OpenAI mohol zlacnenie dovoliť

Toto je najzaujímavejšia časť oznámenia a v spravodajstve zvyčajne zapadne. Úspory nevznikli len z lepšieho hardvéru. OpenAI popisuje, že v procese vedenom ľuďmi model GPT-5.6 Sol autonómne prepísal a optimalizoval produkčné kernely, navrhol a spustil stovky experimentov na zlepšenie generovania tokenov a dozeral na tréning.

Výsledok podľa firmy: práca na kerneloch znížila celkové náklady na prevádzku modelu o 20 % a experimenty zvýšili efektivitu generovania tokenov o viac než 15 %. K tomu firma pridáva lepší routing, optimalizovaný softvér a inteligentnejšiu správu kontextu, vďaka ktorej agenti neopakujú prácu, ktorú už spravili.

Je to spätná väzba, ktorá sa točí sama do seba: lepší model vie efektívnejšie zlacniť sám seba, čo uvoľní kapacitu na tréning ešte lepšieho modelu. Nech už si o tempe odvetvia myslíte čokoľvek, pre plánovanie nákladov to znamená jednu vec. Cenu, ktorú dnes platíte za AI funkciu vo svojom produkte, treba brať ako horný odhad, nie ako fixný parameter.

Fast mode: čo sa mení v API

Priority Processing sa 30. júla 2026 premenovalo na Fast mode. Prakticky to znamená:

  • Nič nemusíte prepisovať. Požiadavky označené ako priority automaticky použijú Fast mode a v API funguje aj service_tier: "priority", aj service_tier: "fast".
  • Pre Sol platí do 2,5-krát vyššia rýchlosť za dvojnásobnú cenu. Inteligencia modelu sa nemení, kupujete si iba latenciu.
  • V Codexe tomu zodpovedá príkaz /fast.

Fast mode dáva zmysel tam, kde na odpoveď čaká človek alebo kde latencia priamo ovplyvňuje konverziu. Na dávkové spracovanie, nočné joby a agentov, ktorí bežia na pozadí, je to zbytočný náklad.

Čo pád ceny inteligencie znamená pre bežný web

Tu sa dostávame k dôvodu, prečo túto správu sledujeme na webe o AI viditeľnosti. Cena za milión tokenov je pre väčšinu firiem abstraktná. Jej dôsledky abstraktné nie sú.

1. AI vyhľadávanie prestáva byť drahé

Keď AI vyhľadávač odpovedá na dopyt, typicky nespraví jedno volanie modelu. Rozloží otázku na podotázky, vyhľadá zdroje, prečíta ich, porovná a až potom napíše odpoveď. Pri drahom modeli je taký postup ekonomicky únosný len pri časti dopytov. Pri modeli za 1,40 $ za milión tokenov prestáva byť cena limitom. Znamená to viac dopytov, na ktoré AI odpovie priamo, s citáciami, namiesto zoznamu odkazov.

2. Agentov bude viac a budú čítať váš web

OpenAI pri Lune výslovne uvádza, že vie používať nástroje a dokončovať viackrokové úlohy, čo robí širšiu škálu aplikácií prevádzkovateľnou vo veľkom. Preložené do praxe: viac softvéru, ktorý si samostatne otvára stránky, aby splnil zadanie používateľa. Váš web tak číta stále väčší podiel návštevníkov, ktorí nie sú ľudia a nikdy neuvidia váš dizajn. Tomu, ako sa na tento posun pripraviť technicky, sme sa venovali v článku o blokovaní AI crawlerov Cloudflarom.

3. Rozdiel medzi „byť na webe" a „byť citovaný" sa prehlbuje

Ak AI odpovedá častejšie a rovno, používateľ sa k vám dostane len vtedy, keď vás tá odpoveď spomenie. Klasická pozícia v Googli tým nestráca zmysel, dostáva ale konkurenta v podobe druhej, paralelnej výsledkovej plochy. Ako sa v nej meria prítomnosť značky, rozoberáme v článku o AI Share of Voice. Základy toho, prečo sa obsah pre AI pripravuje inak než pre klasické vyhľadávače, nájdete na stránke čo je AI optimalizácia.

Zistite, či vás AI vyhľadávače spomínajú

Sledujte, ako často ChatGPT, Perplexity, Gemini, Claude a Google AI Overviews citujú vašu doménu, a porovnajte sa s konkurenciou.

Vyskúšať zadarmo →

Praktické odporúčania, ak staviate na API

Ak vaša aplikácia volá modely OpenAI, zlacnenie je dobrá príležitosť prehodnotiť architektúru, nie len ušetriť.

  • Rozdeľte prácu medzi modely. OpenAI sám uvádza príklad z programovania: Sol vyrieši neistotu a navrhne plán, Luna potom implementuje dobre špecifikované zmeny, napíše a spustí testy a vyhodnotí výsledky. Rovnaká logika platí pre spracovanie dokumentov, klasifikáciu alebo podporu.
  • Rozhodujte podľa evaluácií, nie podľa pocitu. Definujte si kvalitatívny štandard, ktorý výstup musí splniť, a otestujte, kde vyššia inteligencia reálne zlepší výsledok a kde nie. Bez toho buď preplácate, alebo znižujete kvalitu naslepo.
  • Skontrolujte, či nepracujete v dlhom kontexte. Sadzby nad hranicou krátkeho kontextu sú dvojnásobné a dokážu vymazať celú úsporu.
  • Využite kešovanie vstupu. Pri Lune stojí kešovaný vstup 0,02 $ za milión tokenov. Pri opakovaných systémových promptoch je to najlacnejšia optimalizácia, akú viete spraviť.
  • Fast mode zapínajte cielene. Dvojnásobná cena za latenciu sa oplatí len tam, kde na odpoveď niekto čaká.

Často kladené otázky

Odkedy platia nové ceny GPT-5.6 Luna a Terra?

Nové ceny platia od 30. júla 2026. OpenAI zároveň uviedol, že na Amazon Web Services sa zmena zavádzala postupne v priebehu toho istého dňa.

Koľko stojí GPT-5.6 Luna po zlacnení?

GPT-5.6 Luna stojí 0,20 dolára za milión vstupných tokenov a 1,20 dolára za milión výstupných tokenov v štandardnom režime pri krátkom kontexte. Kešovaný vstup vyjde na 0,02 dolára za milión tokenov. Pri dlhom kontexte sú sadzby dvojnásobné, teda 0,40 a 1,80 dolára.

Zlacnel aj vlajkový GPT-5.6 Sol?

Nie. Cena GPT-5.6 Sol zostala na 5 dolároch za milión vstupných a 30 dolároch za milión výstupných tokenov. Sol namiesto zlacnenia dostal Fast mode, teda voliteľný rýchlejší režim za dvojnásobnú cenu.

Čo je Fast mode a čím sa líši od Priority Processing?

Fast mode je nový názov pre službu, ktorá sa predtým volala Priority Processing. Pre GPT-5.6 Sol prináša až dvaapolkrát vyššiu rýchlosť odpovedí za dvojnásobnú cenu, pričom inteligencia modelu zostáva rovnaká.

Musím niečo meniť v kóde, ak som používal Priority Processing?

Nie. Fast mode je spätne kompatibilný. Existujúce požiadavky označené ako priority budú automaticky používať Fast mode a v API naďalej fungujú obe hodnoty, priority aj fast.

Je GPT-5.6 Luna lacnejší ako Gemini 3.6 Flash?

Áno, a to výrazne. Luna stojí 0,20 dolára za vstup a 1,20 dolára za výstup, kým Gemini 3.6 Flash stojí 1,50 dolára za vstup a 7,50 dolára za výstup za milión tokenov. Luna je lacnejšia dokonca aj oproti najúspornejšiemu modelu Googlu, Gemini 3.5 Flash-Lite.

Ako sa zlacnenie AI modelov dotkne bežného webu?

Nepriamo, ale citeľne. Nižšia cena inteligencie robí ekonomicky únosným, aby AI vyhľadávače odpovedali priamo na väčší podiel dopytov a aby po webe chodilo viac automatických agentov. Rastie tým význam toho, či vás odpovede AI systémov citujú, a klesá podiel návštev, pri ktorých človek prejde na váš web z klasického odkazu.

Znamená to, že ceny AI modelov budú klesať ďalej?

Zaručiť sa to nedá, ale smerovanie je zreteľné. OpenAI popisuje, že jeho vlastné modely mu pomáhajú optimalizovať infraštruktúru, čím sa cyklus zlepšení skracuje. Pri plánovaní nákladov na AI funkcie je preto rozumnejšie brať dnešnú cenu ako horný odhad než ako fixnú položku.

Zhrnutie

Zlacnenie GPT-5.6 Luna o 80 % a Terra o 20 % posúva cenovú spodnú hranicu použiteľnej inteligencie nižšie, než kde doteraz ležala aj u Googlu. Vlajkový Sol zostal na svojej cene a dostal namiesto toho rýchlejší Fast mode. Za úsporami stojí podľa OpenAI aj práca, ktorú na optimalizácii infraštruktúry odviedol jeho vlastný model.

Pre firmy, ktoré stavajú na API, je to dôvod prehodnotiť rozdelenie práce medzi drahý a lacný model. Pre všetkých ostatných je to signál, že AI vyhľadávanie a automatickí agenti prestávajú byť experimentom obmedzeným cenou a stávajú sa štandardnou vrstvou medzi používateľom a webom. Viditeľnosť v tejto vrstve sa dá merať, a čím skôr s tým začnete, tým skôr uvidíte, či o vás AI systémy vôbec vedia.

Zdroje

Autor: Ing. Lukáš Szudár, zakladateľ platformy Optimalizácia pre AI. Ceny overené k 31. júlu 2026 v oficiálnych cenníkoch OpenAI, Google a Anthropic.

I

Tím Optimalizácia pre AI pomáha firmám zvyšovať viditeľnosť v AI vyhľadávačoch. Monitorujeme Perplexity, ChatGPT, Google AIO, Gemini a Claude pre desiatky domén.

Zdieľať článok

Sledujte, ako AI vyhľadávače citujú váš web

Vyskúšajte Optimalizáciu pre AI zadarmo