Čínske AI modely v auguste 2026: ceny, výkon a čo z nich reálne použiť
DeepSeek V4, Qwen3.8-Max, Kimi K3, GLM-5.2 a MiniMax M3 v jednej tabuľke. Overené ceny z oficiálnych cenníkov, nezávislé benchmarky a odporúčanie, ktorý model sa na čo hodí.

TL;DR Za šesť týždňov vydali čínske laboratóriá štyri modely frontier triedy. Kimi K3 stojí 3 $ za milión vstupných a 15 $ za milión výstupných tokenov a podľa Artificial Analysis skóroval 57 bodov v Intelligence Index, teda tretie miesto celkovo. Na opačnom konci je DeepSeek V4 Flash za 0,14 $ / 0,28 $, čo je približne 1 % ceny výstupu Claude Fable 5. Rozdiel vo výkone už nie je priepastný: na nezávislom indexe Artificial Analysis delia najlepší čínsky model od Claude Opus 5 tri body zo 63. Pre bežnú firmu je podstatný jeden záver: klasifikácia, extrakcia a sumarizácia sa dnes dajú robiť za zlomok minuloročných nákladov.
Leto 2026 bolo pre čínske AI laboratóriá nezvyčajne husté. Kimi K3 pristál koncom júla, DeepSeek V4 Flash vstúpil do verejnej beta verzie 31. júla a Qwen3.8-Max od Alibaby vyšiel 3. augusta. K tomu treba prirátať GLM-5.2 od Z.ai a MiniMax M3, ktorý vyšiel 31. mája.
Tento článok nie je prehľad tlačových správ. Ceny sú prepísané z oficiálnych cenníkov jednotlivých poskytovateľov, výkonnostné čísla pochádzajú z nezávislých meraní alebo z technických kariet modelov. Kde je zdroj slabší, je to napísané priamo pri čísle.
Ktoré modely treba poznať
Čínsky trh s jazykovými modelmi je fragmentovanejší než americký. Namiesto troch veľkých hráčov je tu šesť až desať laboratórií, ktoré vydávajú modely v porovnateľnej kvalite a často pod otvorenou licenciou.
| Model | Veľkosť | Kontext | Otvorené váhy |
|---|---|---|---|
| Kimi K3 Moonshot AI | 2,8 bilióna (MoE) | 1 048 576 tokenov | ohlásené, zatiaľ nevydané |
| Qwen3.8-Max Alibaba | 2,4 bilióna (MoE), 95 mld. aktívnych | 1 milión tokenov | prisľúbené |
| DeepSeek V4 Pro DeepSeek | nezverejnené | 1 milión tokenov | nie zatiaľ |
| DeepSeek V4 Flash DeepSeek | nezverejnené | 1 milión tokenov | nie zatiaľ |
| GLM-5.2 Z.ai (Zhipu) | 744 mld. (MoE), 40 mld. aktívnych | 1 milión tokenov | áno, licencia MIT |
| MiniMax M3 MiniMax | 428 mld. (MoE), 23 mld. aktívnych | 1 milión tokenov | áno |
Za pozornosť stojí architektúra. Všetkých šesť modelov používa Mixture of Experts, teda pri jednom dopyte sa aktivuje iba zlomok parametrov. Qwen3.8-Max má 2,4 bilióna parametrov, ale aktivuje z nich približne 95 miliárd. To je dôvod, prečo môžu byť tieto modely súčasne obrovské a lacné.
Tabuľka zámerne neobsahuje dvoch hráčov, ktorí patria k najpoužívanejším, ale nie k najschopnejším: Hy3 od Tencentu a MiMo-V2.5 od Xiaomi. Oba stavajú na extrémne nízkej cene a v rebríčku schopností sú hlboko za vyššie uvedenou šesticou. Ich objemom sa zaoberá samostatný článok o podiele na trhu.
Druhá vec je licencia. GLM-5.2 vyšiel pod licenciou MIT, čo znamená plné právo na komerčné použitie, doladenie aj vlastný hosting. Pri Kimi K3 a Qwen3.8-Max sú otvorené váhy zatiaľ len prísľubom, aj keď Alibaba pri auguste hovorila o vydaní do týždňa.
Cenová tabuľka augustových modelov
Nasledujúce ceny sú v amerických dolároch za milión tokenov. Sú prepísané z oficiálnych cenníkov, ktoré sú v tabuľke prelinkované. Stĺpec cache hit je cena za vstupné tokeny, ktoré model už videl v predchádzajúcom dopyte a má ich uložené.
| Model | Vstup | Cache hit | Výstup |
|---|---|---|---|
| DeepSeek V4 Flash | 0,14 $ | 0,0028 $ | 0,28 $ |
| MiniMax M3 | 0,30 $ | 0,06 $ | 1,20 $ |
| DeepSeek V4 Pro | 0,435 $ | 0,003625 $ | 0,87 $ |
| GLM-5 | 1,00 $ | 0,20 $ | 3,20 $ |
| GLM-5.2 | 1,40 $ | 0,26 $ | 4,40 $ |
| Qwen3.8-Max | 2,00 $ | 0,25 $ | 6,00 $ |
| Kimi K3 | 3,00 $ | 0,30 $ | 15,00 $ |
Rozpätie medzi najlacnejším a najdrahším čínskym modelom je viac než päťdesiatnásobné na výstupe. To nie je náhoda, ale zámerná segmentácia. DeepSeek V4 Flash je stavaný na objem, Kimi K3 na najnáročnejšie úlohy.
Pri MiniMax M3 treba jeden dôvetok. Uvedené ceny sú podľa vlastného označenia poskytovateľa trvalá zľava 50 %, základná sadzba je teda 0,60 $ a 2,40 $. Zároveň platí, že ak vstup prekročí 512-tisíc tokenov, celá požiadavka sa účtuje dvojnásobnou sadzbou.
Ako sa ceny líšia od západných modelov
Samotné čísla veľa nepovedia, kým ich nedáte vedľa toho, čo väčšina slovenských firiem reálne používa. Nasledujúci graf porovnáva cenu za milión výstupných tokenov, teda tú položku, ktorá v praxi tvorí väčšinu účtu.
Cena za milión výstupných tokenov. Fialová sú čínske modely, modrá západné. Posledný pruh je pre viditeľnosť zväčšený, reálne je 0,56 % dĺžky prvého. Zdroje: Anthropic, OpenAI, DeepSeek, Z.ai, Moonshot.
Dve veci sú z grafu čitateľné na prvý pohľad. Po prvé, čínske modely obsadili spodnú polovicu cenového spektra, ale nie sú tam sami. OpenAI po zlacnení z konca júla nasadil GPT-5.6 Luna na 1,20 $ za milión výstupných tokenov, čo je presne cena MiniMax M3.
Po druhé, Kimi K3 nie je lacný model. Za 15 $ na výstupe stojí viac než Claude Sonnet 5 a viac než GPT-5.6 Terra. Moonshot ho pozicionuje ako priamu konkurenciu najlepších modelov, nie ako úsporné riešenie.
Výkon podľa nezávislých meraní
Cena je ľahko overiteľná, výkon nie. Väčšina čísel v tlačových správach pochádza od výrobcu modelu. Preto sa oplatí pozerať sa najmä na nezávislé merania, ktoré prebiehajú rovnakou metodikou pre všetky modely.
Artificial Analysis Intelligence Index je agregát z deviatich hodnotení, ktoré prebiehajú rovnakou metodikou pre všetky modely. K 11. augustu 2026 vyzeral rebríček takto. Číslo v prvom stĺpci je celkové poradie medzi všetkými meranými modelmi, nielen medzi tými v tabuľke.
| Poradie | Model | Index | Priem. cena / 1M |
|---|---|---|---|
| 1. | Claude Opus 5 (max) | 63 | 2,34 $ |
| 3. | Claude Fable 5 | 62 | 3,14 $ |
| 5. | GPT-5.6 Sol (max) | 61 | 1,23 $ |
| 6. | Kimi K3 (max) | 60 | 0,84 $ |
| 9. | Qwen3.8-Max | 58 | 1,13 $ |
| 18. | GLM-5.2 (max) | 53 | 0,31 $ |
| 21. | DeepSeek V4 Flash 0731 (max) | 52 | 0,03 $ |
| 29. | DeepSeek V4 Pro (max) | 45 | 0,05 $ |
| 32. | MiniMax M3 | 45 | 0,14 $ |
| 40. | Hy3 (Tencent) | 42 | 0,04 $ |
| 53. | MiMo-V2.5 (Xiaomi) | 38 | 0,01 $ |
Rozdiel medzi prvým a šiestym miestom sú tri body zo 63. To je podstatne menej, než bol odstup pred rokom. Pri uvedení Kimi K3 Artificial Analysis uviedla skóre 57 a tretie miesto celkovo, porovnateľné s Opus 4.8 a GPT-5.5.
Tri veci, ktoré tabuľka prezrádza
Drahší neznamená lepší ani v rámci jedného laboratória. DeepSeek V4 Pro je trikrát drahší než V4 Flash, ale v indexe je nižšie, 45 oproti 52. Ak vyberáte model podľa názvu a ceny, môžete zaplatiť viac za horší výsledok. Toto je najsilnejší argument pre to, aby ste si každý model odmerali na vlastnej úlohe.
Najlacnejšie modely sú aj najslabšie, ale nie o toľko, koľko by cena naznačovala. MiMo-V2.5 od Xiaomi stojí v priemere jeden cent za milión tokenov a dosahuje 38 bodov. To je 60 % výkonu Opus 5 za necelé pol percenta jeho ceny. Pre jednoduché úlohy je to ekonomicky ťažko poraziteľné.
Stred rebríčka je preplnený. Medzi 42 a 53 bodmi sa tlačí päť čínskych modelov s cenami od 0,01 do 0,31 dolára. Rozdiely medzi nimi sú menšie než rozptyl na konkrétnej úlohe, takže výber by mal rozhodovať skôr licenčný model, dostupnosť a kvalita v danom jazyku než pár bodov v indexe.
Kde západné modely stále vedú
Agregovaný index zakrýva to, že rozdiely nie sú rovnomerné. Odstup je najmenší na krátkych, dobre definovaných úlohách a najväčší na dlhých agentických behoch, kde sa chyby kumulujú. Ilustruje to jedno z čiastkových meraní: na GDPval-AA v2 dosiahol Kimi K3 hodnotu 1668 Elo, čo je nad Claude Opus 4.8 s 1600, ale pod Claude Opus 5 s 1861 podľa systémovej karty Opus 5.
Inými slovami, najlepší čínsky model je dnes zhruba na úrovni predchádzajúcej generácie západnej špičky. To je odstup jednej generácie, teda niekoľkých mesiacov, nie rokov.
Čo sa z verejných dát zistiť nedá: kvalita v slovenčine. Žiadny z týchto benchmarkov ju nemeria a odhad z niekoľkých dopytov by nebol podklad, na ktorý sa dá spoľahnúť. Ak plánujete model nasadiť na slovenský obsah, otestujte ho na vlastnej vzorke.
Ktorý model sa na čo hodí
Praktické zhrnutie pre firmu, ktorá rieši, čo nasadiť. Predpokladom je, že spracúvané dáta nie sú citlivé alebo že model beží na vlastnej infraštruktúre.
| Úloha | Odporúčanie | Prečo |
|---|---|---|
| Klasifikácia, tagovanie, extrakcia z dokumentov | DeepSeek V4 Flash | 0,28 $ za milión výstupných tokenov pri skóre 52. Na štruktúrované úlohy postačuje. |
| Sumarizácia veľkých objemov textu | MiniMax M3 alebo GLM-5.2 | Milión tokenov kontextu a cena pod 5 $ na výstupe. |
| Zákaznícka podpora, chatbot | GLM-5.2 | Otvorené váhy pod MIT umožňujú vlastný hosting, teda kontrolu nad dátami. |
| Generovanie kódu, agenty | Kimi K3 alebo západný model | Na najťažších úlohách je odstup od Opus 5 stále citeľný. |
| Obsah pre slovenský trh | overiť na vzorke | Kvalita slovenčiny sa medzi modelmi líši viac než anglické benchmarky naznačujú. |
| Osobné údaje, zdravotné a finančné dáta | vlastný hosting alebo EÚ poskytovateľ | Prenos do Číny je pri týchto kategóriách právne komplikovaný. |
Posledný riadok si zaslúži rozvedenie. Používanie API prevádzkovaného v Číne znamená prenos dát do tretej krajiny bez rozhodnutia o primeranosti podľa GDPR. Pri anonymizovaných dátach to je riešiteľné, pri osobných údajoch to vyžaduje samostatné právne posúdenie. Otvorené váhy sú tu praktická cesta von: model si stiahnete a spustíte na vlastnom serveri, kde dáta nikam neodchádzajú.
Čo z toho plynie pre viditeľnosť v AI
Lacnejšie modely majú jeden druhotný efekt, ktorý sa v cenových porovnaniach nespomína. Keď cena za odpoveď klesne desaťnásobne, oplatí sa generovať desaťkrát viac odpovedí. To znamená viac AI asistentov, viac agentov a viac miest, kde sa o vašej značke rozhoduje bez toho, aby o tom kto z vašej firmy vedel.
Pre firmu, ktorá rieši svoju prítomnosť v AI odpovediach, sú relevantné tri dôsledky:
- Pribúda povrchov, kde sa značka spomína. Nie je to len ChatGPT a Perplexity. Interné firemné nástroje postavené na lacných modeloch odporúčajú dodávateľov rovnako ako verejné asistenty.
- Modely s otvorenými váhami nemajú vlastné vyhľadávanie. Keď GLM-5.2 beží na firemnom serveri bez pripojenia na web, odpovedá výhradne z toho, čo sa naučil počas tréningu. Tam sa dostane len obsah, ktorý bol v čase tréningu dostatočne rozšírený a citovaný.
- Merať treba naprieč enginmi. Viditeľnosť v jednom asistentovi nehovorí nič o ostatných. Rozdiely medzi modelmi v tom, koho citujú, sú väčšie než rozdiely medzi pozíciami v klasickom vyhľadávaní.
Ak vás zaujíma metodika, ako sa dá podiel značky v AI odpovediach kvantifikovať, rozoberá to článok o Share of Voice v AI vyhľadávačoch.
Zistite, či vás AI vyhľadávače spomínajú
Sledujte citácie svojej domény v ChatGPT, Perplexity, Gemini, Claude a Google AI Overviews. Prvý audit je súčasťou registrácie.
Vyskúšať zadarmo →Metodika a obmedzenia
Ceny v tomto článku sú prepísané z oficiálnych cenníkov k 11. augustu 2026 a v tabuľkách sú prelinkované na zdroj. Menia sa často a nie vždy smerom nadol: DeepSeek vo svojej cenníkovej dokumentácii priamo upozorňuje, že plánuje celkové ceny API v blízkej dobe zvýšiť, a to výrazne. Kto na dnešných sadzbách stavia rozpočet, mal by s tým rátať.
Výkonnostné čísla majú tri rôzne úrovne dôveryhodnosti. Najsilnejšie sú nezávislé merania Artificial Analysis, ktoré prebiehajú rovnakou metodikou naprieč modelmi. Stredné sú výsledky zo systémových kariet, kde metodiku poznáme, ale meranie robil výrobca. Najslabšie sú čísla z tlačových správ bez uvedenej metodiky, ktoré sú v texte označené.
Čo v článku zámerne nie je: kvalita slovenčiny. Neexistuje verejný benchmark, ktorý by ju pri týchto modeloch meral, a odhad z pár dopytov by nebol podklad, na ktorý sa dá spoľahnúť.
Často kladené otázky
Ktorý čínsky AI model je najlacnejší?
DeepSeek V4 Flash za 0,14 dolára za milión vstupných a 0,28 dolára za milión výstupných tokenov. Pri opakovaných dopytoch s rovnakým začiatkom klesá cena vstupu na 0,0028 dolára vďaka cache. Ide o verejnú beta verziu spustenú 31. júla 2026.
Sú čínske modely rovnako dobré ako Claude alebo GPT?
Na agregovanom indexe Artificial Analysis je odstup najlepšieho čínskeho modelu od najlepšieho modelu vôbec tri body zo 63. Na najťažších programátorských úlohách je rozdiel väčší: DeepSeek V4 Pro hlási 80,6 percenta na SWE-bench Verified oproti 96,0 percenta pre Claude Opus 5. Pre bežné firemné úlohy je rozdiel v praxi malý, pre náročné agentické scenáre stále citeľný.
Môžem čínsky model použiť na osobné údaje zákazníkov?
Cez API prevádzkované v Číne to znamená prenos osobných údajov do tretej krajiny bez rozhodnutia o primeranosti podľa GDPR, čo vyžaduje samostatné právne posúdenie a vhodné záruky. Bezpečnejšia cesta je model s otvorenými váhami, napríklad GLM-5.2 pod licenciou MIT, spustený na vlastnej infraštruktúre v EÚ.
Čo znamená, že model má otvorené váhy?
Znamená to, že si natrénovaný model môžete stiahnuť a spustiť na vlastnom hardvéri bez toho, aby dáta odchádzali k poskytovateľovi. Nie je to to isté ako otvorený zdrojový kód, pretože tréningové dáta ani postup obvykle zverejnené nie sú. GLM-5.2 a MiniMax M3 majú váhy vydané, pri Kimi K3 a Qwen3.8-Max boli k augustu 2026 zatiaľ len prisľúbené.
Ovplyvňujú čínske modely to, či ma AI odporučí zákazníkom?
Áno, ak ich niekto používa na hľadanie dodávateľov. Modely bez pripojenia na web odpovedajú výhradne z tréningových dát, takže sa do odpovedí dostane len obsah, ktorý bol v čase tréningu dostatočne rozšírený a citovaný inde. Preto sa oplatí sledovať zmienky o značke naprieč viacerými enginmi, nie len v jednom.
Ako často sa tieto ceny menia?
Veľmi často. Čínske laboratóriá znížili ceny v prvom polroku 2026 opakovane a časť znížení označili za trvalé. Zároveň DeepSeek vo svojej dokumentácii upozorňuje na možné zvýšenie. Pred rozpočtovaním projektu si ceny vždy overte priamo v cenníku poskytovateľa.
Odporúčame prečítať
Sledujte, ako AI vyhľadávače citujú váš web
Vyskúšajte Optimalizáciu pre AI zadarmo