Meranie z vlastnej výroby. Velocis
Neexistuje najlepší AI model. Existujú úlohy. Lacnejší vyhral častejšie
Tri úlohy, tri rôzne poradia. Namerané ceny a časy z augusta 2026 na plochom dizajne so slovenčinou, na držaní tej istej tváre a na videu z fotky. V troch zo štyroch cenových porovnaní lacnejšia možnosť buď vyhrala, alebo bola nerozoznateľná.
Odkiaľ sú dáta v tejto štúdii
Merania z vlastnej dielne medzi 19. a 24. augustom 2026. Ceny sú odpísané z verejných cenníkov alebo vypočítané zo skutočne naúčtovaných tokenov. Nie je to nezávislý benchmark. Väčšinou ide o jeden pokus na model. Autor Adam Fischer.
Čo je toto za dôkaz a čo to nie je
Toto nie je benchmark. Je to záznam z vlastnej dielne.
Spustili sme hŕstku modelov na našich úlohách, s našimi zadaniami, v konkrétnych dňoch augusta 2026. Každý výsledok treba čítať takto: tento model prehral túto úlohu v tento deň s týmto zadaním. Nie „tento model je horší“.
Rozdiel nie je slovíčkarenie. Robia ho zásadným tri veci.
- Väčšina porovnaní stojí na jednom pokuse na model. Generátory sú náhodné. To isté zadanie dvakrát vráti dva rôzne obrázky, takže jeden pokus je vzorka, nie meranie. Kde sme mali len jeden, je to napísané.
- Modely vydávajú nové verzie po týždňoch. Ten, ktorý tu prehral, mohol medzitým dostať novú verziu. Dátum pri každom čísle je súčasťou toho čísla.
- Ceny sa menia. Všetky sumy sú v amerických dolároch, odpísané z verejných cenníkov poskytovateľov v uvedený deň alebo, kde to API vracia, vypočítané zo skutočne naúčtovaných tokenov. Aj to je napísané pri každom čísle.
Užitočná časť tohto textu nie je poradie. Je to metóda: rovnaké zadanie, rovnaký deň, jeden menený parameter. A potom sa na to treba pozrieť.
Plochý dizajn, logá a slovenský text v obrázku
Merané 24. 8. 2026, deväť identických zadaní, tri modely, 27 obrázkov. Zadania boli tie, čo malá firma naozaj potrebuje, okrem iného: logo pre autoškolu, wordmark pre kozmetické štúdio, odznak s textom po oblúku, sada ikon, prezentačná doska so šiestimi variantmi značky, hero pozadie, editoriálna ilustrácia a celá webová stránka vysádzaná po slovensky aj s pätičkou.
Pre malú firmu je toto najužitočnejší z troch výsledkov. Ide o prácu, ktorú si dnes ľudia naozaj skúšajú vygenerovať sami.
| model | cena za obrázok | 9 obrázkov spolu | priemerný čas na obrázok | max. rozlíšenie |
|---|---|---|---|---|
| gpt-image-2, kvalita „medium“ | 0,041 – 0,053 $ | 0,44 $ | 40,0 s | 1536 × 1024 |
| gemini-3.1-flash-image | 0,067 $ (1K) · 0,101 $ (2K) | 0,91 $ | 15,0 s | 4096 × 4096 |
| ideogram v4, režim QUALITY | 0,10 $ (Turbo 0,03 $) | 0,90 $ | 18,5 s | 2048 × 2048 |
Ceny sú z cenníkov poskytovateľov k 24. 8. 2026. Suma pri OpenAI nie je z cenníka. Je vypočítaná z počtu tokenov, ktoré API po každom volaní skutočne vrátilo (30 $ za milión výstupných tokenov, 1756 tokenov za štvorec, 1372 za portrét). Časy sú priemery z deviatich volaní na model, prepočítané z manifestu behu.
Vyhral ten najlacnejší: gpt-image-2 pri nastavení kvality „medium“ bol prvý v piatich z ôsmich hodnotiteľných testov, vyhral ten rozhodujúci s náskokom a stojí zhruba polovicu oproti obom zvyšným.
| test | 1. | 2. | 3. |
|---|---|---|---|
| celá stránka po slovensky (rozhodujúci) | OpenAI | Gemini | Ideogram |
| logo — autoškola | Gemini | OpenAI | Ideogram |
| logo — serifový wordmark | Gemini | OpenAI | Ideogram |
| odznak, text po oblúku | OpenAI | Gemini | Ideogram |
| sada 8 ikon | OpenAI | Ideogram | Gemini (vrátil 16) |
| doska so 6 variantmi | Ideogram | OpenAI | Gemini |
| hero pozadie | OpenAI | Gemini | Ideogram |
| editoriálna ilustrácia | OpenAI | Gemini | Ideogram |
| „presne dve farby“ | nesplnil ani jeden |
Podklad je náš interný súbor videos/reference/design-images/montage/07-slovak-landing.png, tri stránky vedľa seba, zľava Ideogram, OpenAI, Gemini.
Slovenská diakritika je vyriešená. Toto zistenie vydrží najdlhšie
Všetky tri modely napísali správne AUTOŠKOLA ŠURABA, Štúdio Krása, ÚČTOVNÝ DOM, KOMÍN aj SKÚSENOSTÍ, a to vo všetkých testoch s logom. Pri predchádzajúcej generácii týchto modelov bola diakritika ešte dôvod, prečo slovenský text do generovaného obrázka nedávať. Ten dôvod padol.
Na celej strane súvislého slovenského textu sa však rozišli, a to podstatne.
| model | ako dopadol |
|---|---|
| gpt-image-2 | prakticky bezchybne — ďasná, včasná, Všetky práva vyhradené, reálne bratislavské PSČ 811 01, formát +421, doména .sk. Naše nemotorné „98 percent“ v zadaní si sám opravil na 98 %. |
| gemini-3.1-flash-image | všetko bezchybné až po pätičku, ktorá sa rozsypala: Slanna 1, Slovak ŕód 47, Otveriní, Soranv a e-mail na klinikafénix.cz — česká doména s dĺžňom vnútri. |
| ideogram v4 | asi 95 %. Chyby sa kopia v najmenšom písme: Naše tím (má byť Náš), šesí (šesť), dasná (ďasná), sviežojší (sviežejší). |
Vzorec je zreteľný a stojí za zapamätanie: chyby prichádzajú v najmenšom písme. Nadpis a hlavný text vyjdú takmer vždy. Pätička, kontakty a otváracie hodiny sú miesta, kde treba prečítať každý znak. Ak dáte klientovi obrázok s vygenerovanou pätičkou bez kontroly, dáte mu českú doménu s dĺžňom.
Čo nevie ani jeden z nich
- →Žiadny vektor a žiadna priehľadnosť. Všetkých 50 výstupov z oboch kôl prišlo ako RGB rastr s vyhladenými hranami, takže logo sa z toho nedá jednoducho vystrihnúť. Výstup je podklad na prekreslenie, nie hotová vec, čo je za 0,05 $ rozumná kúpa, ale nie náhrada za grafika.
- →„Presne dve farby“ nesplnil nikto. Po zredukovaní na 16 úrovní na kanál mala údajne dvojfarebná značka 78 / 72 / 79 rôznych odtieňov (Ideogram / OpenAI / Gemini). Čisto bielu 255, 255, 255 v rohu dal jediný Gemini. Ostatné dva majú mierne odlišný odtieň a pri teplých paletách prechádzajú do krémovej.
- →Gemini nevie počítať. Pri zadaní „presne 8 ikon v mriežke 4×2“ vrátil 16 v mriežke 4×4 a spodný riadok zopakoval trikrát. Na doske so šiestimi bunkami zas v jednej vypadol dĺžeň, KOMIN. Každé zadanie s pevným počtom prvkov treba po Gemini prepočítať.
- →Čokoľvek opíšete, môže sa to ocitnúť vysádzané v obrázku. Slovné spojenie „slovenská kominárska firma“ sa vrátilo ako tagline pod šiestimi logami vrátane vymysleného slova „SPIO“. Hexadecimálny kód #F1F3F5 v zadaní sa vykreslil ako text na tlačidle S1F3F5. Liek je vymenovať text, ktorý smie byť v obrázku, a zvyšok výslovne zakázať. V druhom kole už do obrázka neprenikol žiadny text navyše.
- →Text po oblúku treba vyhláskovať. V prvom kole zlomil Ideogram v3 slovo SKÚSENOSTÍ na SKÚSSENOSTÍ. Pomohlo napísať ho v zadaní ako S-K-U-S-E-N-O-S-T-I s dĺžňom nad U a nad posledným I. Potom to zvládli všetky tri. Lacný trik a funguje všade.
Tá istá tvár na dvadsiatich obrázkoch
Merané 22. 8. 2026. Šesť nastavení na tom istom origináli, z každého jeden hlavný záber a dva uhly: Gemini Flash, Gemini Pro, gpt-image-2 v troch úrovniach kvality a Ideogram. Každá bunka bola presne jeden krok od pôvodnej fotky. Nič nebolo generované z niečoho, čo už samo bolo generované.
Tu lacnejšia možnosť prehrala a rozhodnutie padlo na drahšiu, gemini-3-pro-image. Verdikt zadávateľa v pôvodnom znení: „ideogram is worst, then openai best on quality, gemini won, pro is better.“
Prečo práve tu: úloha nie je „nakresli peknú ženu“. Úloha je „vráť tú istú ženu ešte dvadsaťkrát“, a to je iná schopnosť. Rozhodli konkrétne rozdiely.
- →Až päť referenčných fotiek osoby v jednom volaní. OpenAI k tomu dátumu nemalo ekvivalent. Pri držaní identity je to podstatné.
- →Formát 9:16 natívne, takže výsledok netreba orezávať.
- →Zopakované 23. 8. 2026 na inom type zadania (päť obrázkov do kanála na Instagrame) s rovnakým výsledkom: Pro udržal identitu vo všetkých štyroch pokusoch. gemini-3.1-flash-image bol blízko na tvári, ale rozbil geometriu ruky na selfie. flux-2-pro sa podľa posudku vrátil ako iná žena.
Posledná veta je posudok, nie meranie. Je to úsudok o podobnosti s našou referenčnou sadou, nie tvrdenie o kvalite modelu. Merané čísla z toho istého behu (nástroj realism_check.py) hovoria o niečom inom a sú zaujímavejšie.
obrázok bokeh clip black grad sat flat sym cast
p2-gempro.png 0,25 7,49 0,01 0,81 0,173 4,89 0,550 0,057
p1-gempro.png 0,19 0,48 0,10 0,50 0,399 12,98 0,099 0,226
p1-gemflash.png 0,18 1,92 0,23 0,24 0,311 8,80 -0,093 0,174
p1-flux.png 0,29 0,81 0,66 0,44 0,454 13,94 0,204 0,211
Sledovať treba stĺpec clip, teda akú časť obrázka je prepálená na čistú bielu. Záber, ktorý pôsobí najviac ako skutočná fotka, má prepálených 7,5 % plochy. Telefón namierený proti nízkemu slnku tú svetlú časť fyzicky neudrží a ani by nemal. Obrázok s clip 0,48 má expozíciu vyriešenú za vás, čo žiadny telefón nerobí.
Podklad je náš interný priečinok videos/assets/faces/ela/ig/_bakeoff/, ten istý prompt cez tri modely vedľa seba.
V realizme nevyhral žiadny model. To je to hlavné
Toto je zistenie, ktoré prežije všetky ostatné čísla v tomto texte.
Existuje spôsob, ako zmerať, či snímka nesie fyzikálny podpis skutočného senzora. Volá sa to shot noise: dopad fotónov je počítací proces, takže šum reálnej kamery rastie s odmocninou jasu a svetlé plochy sú absolútne šumnejšie než tmavé. Namaľované zrno je ploché.
| shot noise | chroma | |
|---|---|---|
| snímky zo skutočných kamier | 0,099 – 0,372 | 0,009 – 0,032 |
| najlepší neupravený výstup, ktorýkoľvek poskytovateľ | 0,017 – 0,060 | 0,048 – 0,056 |
| po dokončovacom kroku (dogenerovanie detailu tváre + filmové zrno) | 0,197 | 0,015 |
Do pásma skutočnej kamery sa nedostal ani jeden poskytovateľ. Dostal sa tam až dokončovací krok, a ten je na modeli nezávislý. Pre malú firmu z toho plynie praktická vec: keď obrázok „vyzerá ako AI“, vo väčšine prípadov to nie je otázka výberu modelu. Príčina je architektonická. Difúzne modely sú trénované odstraňovať šum a jemná textúra pokožky je od šumu štatisticky takmer nerozoznateľná. Tréningový cieľ ju priamo trestá. Päť kôl formulácií typu „viditeľné póry, neretušované, reálna textúra pokožky“ tým pohlo minimálne, lebo žiadne slová v zadaní nesiahnu pod vlastný odšumovač modelu.
Drahší model to nerieši. Rieši to až úprava po generovaní.
Video z jednej fotky
Merané 24. 8. 2026. Jeden záber, jedna vstupná fotka, jedno zadanie, 8 sekúnd, formát na výšku. Menený jediný parameter, model. Štyri varianty.
| model | cena za 8 s | rozlíšenie | výsledok |
|---|---|---|---|
| Veo 3.1 Lite | 0,64 $ | 1080p | najpoužiteľnejší z celej štvorice |
| Gemini Omni Flash | 0,83 $ | 720p | jediný, čo preniesol fotografickú štatistiku predlohy |
| Veo 3.1 Fast | 0,96 $ | 1080p | to, čo sme dovtedy používali |
| Veo 3.1 Standard | 3,20 $ | 1080p | 3,3× cena Fast a v ničom lepší |
Najdrahšia úroveň neporazila strednú. Standard za 3,3-násobok ceny Fast nebol lepší v ničom, čo tento záber potreboval. Vyhral dve veci: najstabilnejšie pozadie a najmenší pohyb tváre. Ani jedna z nich nebola to, za čo sa platilo. Zároveň zo štvorice najviac ušiel od predlohy (tvár sa vyhladila, znamienka na líci zmizli) a vymyslel si chybu, ktorú nemal nikto iný: po skle telefónu mu putoval modrobiely odlesk, ktorý v predlohe nie je.
Najlacnejšia úroveň udržala identitu bez problémov. Lite bol navyše jediný, ktorý mal pohyb rozložený rovnomerne po celej dĺžke (0,36–0,99 na celej snímke, bez hluchého miesta). Fast aj Standard mali pohyb natlačený do druhej polovice. Pri strihu to rozhoduje o tom, odkiaľ sa dá vôbec vystrihnúť použiteľná sekunda.
Tri výhrady, bez ktorých sú tieto čísla nepoužiteľné.
- →Jeden pokus na model, a bez pevne zadaného parametra seed. Generátory sú náhodné. Druhý pokus môže poradie prehádzať. Parameter seed, ktorý by výsledok spravil zopakovateľným, existuje a nebol použitý. To je naša chyba, nie vlastnosť modelov.
- →Lite nemal rovnaké podmienky. Takzvané negatívne zadanie (zoznam vecí, ktoré v zábere byť nesmú) Lite odmieta úplne. API tú položku vôbec neprijme, takže bežal bez ochrany, ktorú Fast a Standard dostali. A predsa udržal ústa zavreté 2,42 s oproti 0,58 s pri úrovni Fast. To hovorí niečo nepríjemné o tej ochrane, nie o Lite.
- →Omni nebol porovnaním jedna k jednej. Má strop 720p, nemá negatívne zadanie vôbec a dostal opravenú verziu zadania. Jeho výsledok treba čítať s tým.
Zlé nastavenie parametra sa tvári ako vlastnosť modelu. Iné porovnanie, tá istá lekcia
Merané 23. 8. 2026. Iné porovnanie, traja rôzni poskytovatelia videa, deväť pokusov na tom istom zábere. Prvá verzia toho porovnania bola nesprávna a stojí za to povedať prečo.
Pohyb v zábere trval asi 1,5 sekundy. Od všetkých troch poskytovateľov sme si vypýtali 8 sekúnd „kvôli férovosti“. Generátor natiahne pohyb, ktorý dostal, na dĺžku, ktorú si vypýtate. Dvaja poskytovatelia ten jeden skok roztiahli na osem sekúnd, vyzeralo to ako spomalený film. Tretí ho zopakoval druhýkrát, čo bolo horšie. Potom sme ich podľa toho zoradili.
Pri opakovaní so správnou dĺžkou sa rozišli do troch strán. Číslo je priemerná zmena medzi susednými snímkami. Vyššie znamená viac pohybu za jednotku času.
| poskytovateľ | pri 8 s | pri správnej dĺžke | čo to znamená |
|---|---|---|---|
| Veo 3.1 Fast | 6,92 | 7,80 (4 s) | rýchly vždy; skrátenie mu pridalo |
| xAI grok-imagine-video-1.5 | 2,18 | 5,58 (4 s) | rýchlosť závisí od vyžiadanej dĺžky — 2,6× |
| BFL FLUX 3 Video | 3,62 | 1,94 (5 s) | pomalý vždy; kratšie zadanie ho spomalilo |
Rovnaká vstupná fotka, rovnaké zadanie. Jediný rozdiel je vo vyžiadanej dĺžke. Pravidlo, ktoré z toho ostalo: pýtajte si dĺžku, akú naozaj potrebujete v strihu, nie maximum. Každá sekunda navyše je sekunda, ktorú model musí niečím zaplniť. Buď natiahne to, čo dostal, alebo si vymyslí niečo, čo ste nechceli. Máme jednu aj druhú chybu, z toho istého záberu a popoludnia.
Štyri veci, ktoré stoja peniaze a v cenníku nie sú
Túto časť odporúčam prečítať aj tomu, koho zvyšok textu nezaujíma.
1. Paušál za obrázok bez ohľadu na rozlíšenie. Ideogram v režime QUALITY stojí 0,10 $ za obrázok 1024 × 1024 aj za 2048 × 2048 (merané 24. 8. 2026). Kto si vypýta menší obrázok, zahodí polovicu toho, čo zaplatil. Ak treba len lacný náhľad, tá páka nie je menšie plátno, ale lacnejší režim TURBO za 0,03 $.
2. Portrét lacnejší ako štvorec. Pri gpt-image-2 stojí 1024 × 1536 aj 1536 × 1024 zhodne 1372 výstupných tokenov, kým 1024 × 1024 stojí 1756 (opakovane merané 24. 8. 2026). Je to neintuitívne a nikde v dokumentácii sme to nenašli. Dá sa to prečítať len z toho, čo API vráti po volaní. Za štvorcové obrázky platíte asi o 28 % viac než za obdĺžnikové.
3. Vyššia úroveň kvality nemusí priniesť nič viditeľné. 19. 8. 2026 sme jednu celú osemsnímkovú sadu vygenerovali na úrovniach high, medium aj low s rovnakými zadaniami a jedinou menenou premennou. Pri prezeraní v pomere 1:1, pixel po pixeli, boli tvary písmen, hrany a diakritika nerozoznateľné medzi úrovňami. Medium mal dokonca o niečo väčšie súbory ako high, čo znamená, že sa nekódoval žiadny detail navyše. high pritom stojí zhruba trojnásobok. Dôležité obmedzenie, aby to nikto necitoval širšie, než to platí: meranie bolo na obrázkoch z veľkého písma a plochých plôch. Pri obrázku, ktorý je prevažne fotografia, môže mať vyššia úroveň zmysel. Tam to treba otestovať, nie predpokladať.
4. Zverejnená cena za sekundu môže byť sadzba za najnižšie rozlíšenie. Cenník xAI k 23. 8. 2026 uvádza pri modeli grok-imagine-video-1.5 0,080 $ za sekundu, bez rozlíšenia pri tom čísle. Nezávislý predajca toho istého modelu vtedy uvádzal 0,08 $/s pri 480p, 0,14 $/s pri 720p a 0,25 $/s pri 1080p. Naše dve skutočné volania to potvrdili: za štvorsekundový klip v 1080p nám naúčtovali 1,01 $ a za osemsekundový 2,01 $, teda približne 0,251 $ za sekundu, viac než trojnásobok zverejneného čísla.
Toto nie je obvinenie a nemá sa tak čítať. Je to opis toho, čo nám prišlo na účet v uvedený deň. Zverejnená sadzba zjavne platí pre najnižšie rozlíšenie a čítať ju ako paušál je omyl na strane čitateľa. Praktický záver je všeobecný: prvé platené volanie u nového poskytovateľa spravte naschvál malé a prečítajte si, koľko vám naozaj naúčtoval, lebo u mnohých to API vráti priamo v odpovedi.
Schopnosti, ktoré rozhodnú viac než kvalita
Pri výbere modelu ľudia porovnávajú, ako pekné sú ukážky. Podľa našej skúsenosti rozhodne skôr niektorá z nasledujúcich vecí. Ani jednu z nich nie je vidieť na ukážke.
Negatívne zadanie nemusí existovať. Zoznam „toto v zábere byť nesmie“ je bežná pomôcka, ale z troch poskytovateľov videa, ktorých sme skúšali (stav k 23.–24. 8. 2026), ho dvaja nemajú vôbec. Pole v ich rozhraní jednoducho nie je. U tretieho (Veo) je dvojito podmienené: najlacnejšia úroveň ho odmietne úplne a vyššie úrovne ho odmietnu vždy, keď je v požiadavke referenčný obrázok. Z obrazových modelov, ktoré tu používame, ho k rovnakému dátumu mal jediný Ideogram.
Dôsledok nie je „vyberte si toho s negatívnym zadaním“. Dôsledok je, že ochranu treba vedieť napísať kladne. Nie „bez rozmazaného pozadia“, ale „všetko od tváre po stenu je ostré“. Negatívny zoznam vie len zakázať, kladný opis vie určiť. A ako sa ukázalo, negatívne zadanie aj tam, kde existuje, nemusí fungovať: úroveň, ktorá ho dostala, porušila zákaz skôr než tá, ktorá ho nedostala.
Najvyššie rozlíšenie môže byť viazané na najdlhšiu stopáž. Veo prijme klip v dĺžke 4, 6 alebo 8 sekúnd. Rozlíšenie 1080p však odmietne pri 4 aj pri 6 sekundách, doslovne hláškou 1080p is not supported for a duration of N seconds (overené naživo 24. 8. 2026, na dvoch rôznych úrovniach, takže je to pravidlo rozlíšenia, nie úrovne). Kto potrebuje trojsekundový záber v plnom rozlíšení, zaplatí za osemsekundový klip a päť sekúnd zahodí, alebo vezme 720p.
Najvyšší pomer strán nemusí byť ten, ktorý potrebujete. gpt-image-2 má najvyšší portrét 1024 × 1536, čo je pomer 2:3. Formát pre mobilné video a príbehy je 9:16, ktorý je vyšší, takže z každého obrázka treba odrezať asi 8 % šírky z každej strany. Nie je to problém, ak sa s tým počíta pri komponovaní (objekt do stredu, skutočný okraj po bokoch, nič dôležité pri ľavom ani pravom kraji). Je to problém, keď sa na to príde až po vygenerovaní dvadsiatich obrázkov.
Odpoveď „200 OK“ neznamená, že vaša požiadavka bola splnená. Ideogram v4 k 24. 8. 2026 akceptoval parametre aspect_ratio, style_type aj transparent_background bez chyby a bez účinku. Vygeneroval a naúčtoval, iba tie parametre ignoroval. Overiť sa to dá jediným spôsobom: otvoriť výsledok a pozrieť sa naň.
Čo si z toho odniesť
- Otázka nie je „ktorý model je najlepší“, ale „ktorý model na túto úlohu“. Na tých istých úlohách nám vyšli tri rôzne poradia podľa toho, či išlo o logo, o tvár alebo o video.
- Skúste najlacnejšiu možnosť ako prvú. V troch zo štyroch cenových porovnaní (dizajn, úrovne videa, úrovne kvality obrázka) lacnejšia možnosť buď vyhrala, alebo bola nerozoznateľná. Jediná výnimka bola úloha „udrž tú istú tvár“, a to je zhodou okolností jediná z tých úloh, pri ktorej ide o konkrétnu schopnosť, ktorú lacnejší model naozaj nemal: päť referenčných fotiek osoby v jednom volaní.
- Keď je výsledok zlý, prepíšte zadanie skôr, než siahnete po drahšom modeli. Väčšina našich zlyhaní bola zlyhaním zadania. Drahší model ich neopravil.
- Prečítajte v obrázku každý znak a začnite od najmenšieho písma. Chyby sedia v pätičke.
- Nespoliehajte sa na zverejnenú cenu za jednotku. Prvé volanie spravte lacné a prečítajte si, koľko vám poskytovateľ naozaj naúčtoval.
- Jedno porovnanie na vlastnej úlohe stojí pár dolárov a odpovie na otázku, na ktorú vám cudzí test neodpovie. Podmienka je jediná: meniť naraz jeden parameter a ostatné ponechať nemenné. Nás stálo najviac práve porušenie tohto pravidla.
- Keď obrázok „vyzerá ako AI“, nie je to väčšinou o modeli. Je to o tom, že model bol trénovaný tak, aby odstraňoval práve to, čo robí fotku fotkou. To sa rieši až po generovaní.
Odkiaľ sú tie čísla a čo im chýba
Dátumy meraní: tvárová matica 22. 8. 2026, päťobrázkové porovnanie do kanála 23. 8. 2026, porovnanie troch poskytovateľov videa 23. 8. 2026, dizajnové porovnanie 24. 8. 2026 (50 generácií v dvoch kolách), štvorcestné porovnanie videa 24. 8. 2026 a porovnanie úrovní kvality 19. 8. 2026.
Čo tieto čísla nie sú. Nie sú to nezávislé benchmarky, nie sú to štandardizované testy a nie sú to opakované merania. Vo väčšine prípadov ide o jeden pokus na model. Modely sú náhodné, takže druhý beh môže poradie zmeniť. Pri porovnaní videí to hovoríme výslovne, lebo sme nepoužili parameter seed, hoci existuje.
Čo sú ceny. Väčšina súm je aritmetika: sadzba z verejného cenníka vynásobená množstvom, nie sú to faktúry. Výnimky, pri ktorých ide o skutočne naúčtované množstvo, sú tri a sú označené: tokeny z odpovede OpenAI, tokeny z odpovede Gemini Omni a dve volania xAI, kde sme si prečítali skutočný účet. Rozdiel medzi cenníkom a účtom bol v jednom z tých prípadov viac než trojnásobok. Ten rozdiel treba brať vážne.
Čo sa odvtedy mohlo zmeniť. Ceny, verzie modelov aj dostupné parametre. Text píšeme 25. 8. 2026 a niektoré z čísel sú staré tri dni. Ak toto čítate o pol roka, berte poradie ako ilustráciu metódy, nie ako odporúčanie.
Podklady, z ktorých text vychádza (interné súbory v našej dielni, uvedené kvôli dohľadateľnosti): videos/reference/design-images.md a design-images/COMPARE.html · videos/projects/40-skor-nez-upracete/BAKEOFF.html · videos/projects/03-caroline/PROVIDERS.html · videos/assets/faces/ela/ig/RECIPE.md a _bakeoff/ · videos/assets/faces/ela/BIBLE.md · videos/reference/why-it-looks-ai.md · videos/reference/veo-api.md a xai-video.md.
Ku generovaným osobám. Postava, na ktorej sme merali držanie identity, je vymyslená a v kanáli, ktorý ju používa, je verejne označená ako AI. Nevystupuje ako zákazník, nikoho neodporúča a neposkytuje žiadne svedectvo. To nie je detail: vymyslená osoba smie niesť pozornosť, overenie smie niesť len skutočný človek. Podobizeň skutočného človeka sa používa jedine v rozsahu, ktorý je dohodnutý vopred, písomne a odvolateľne.
Časté otázky
Ktorý AI model na obrázky je najlepší?
Záleží od úlohy. Na troch úlohách nám vyšli tri poradia. Na plochom dizajne so slovenským textom vyhral najlacnejší gpt-image-2 (0,44 $ za deväť obrázkov, prvý v piatich z ôsmich testov). Na držaní tej istej tváre vyhral drahší gemini-3-pro-image, lebo prijme päť referenčných fotiek v jednom volaní.
Zvláda AI slovenskú diakritiku v obrázkoch?
V logách áno. Všetky tri modely napísali správne AUTOŠKOLA ŠURABA, Štúdio Krása aj SKÚSENOSTÍ vo všetkých testoch. Na celej stránke súvislého textu sa rozišli a chyby sedia v najmenšom písme. Pätička jedného modelu vrátila Otveriní a e-mail na českej doméne s dĺžňom.
Aké skryté náklady majú AI nástroje na obrázky?
Zverejnená cena za sekundu môže platiť pre najnižšie rozlíšenie. xAI uvádzal 0,080 $/s a naše dve volania v 1080p vyšli na približne 0,251 $/s. Ideogram účtuje rovnako za 1024 × 1024 aj 2048 × 2048. gpt-image-2 účtuje štvorec asi o 28 % drahšie než portrét.