Potřeboval jsem pozvánku na besedu v knihovně. Nic složitého: obrázek na šířku, název přednášky, datum a čas. Když jsem totéž zkoušel před dvěma lety, dostal jsem grafiku, na které stálo cosi jako „PŘEDNÁŠIKA“. Písmena tam byla, slovo ne. Tentokrát jsem napsal jednu větu do běžné konverzace v ChatGPT a za necelou minutu měl obrázek, kde se nadpis dal skutečně přečíst. V tom je hlavní rozdíl proti samostatným generátorům. Obrázek si neobjednáváte v jiné aplikaci, ale uprostřed rozhovoru, který třeba právě vedete o něčem úplně jiném. Místo jednoho dokonalého zadání diktujete pokyny postupně, jako když grafikovi koukáte přes rameno.
Od DALL-E ke GPT Image
Do března 2025 kreslil obrázky v ChatGPT model DALL-E 3. Fungoval odděleně: aplikace mu předala vaše zadání a on poslal zpátky hotový obrázek. Pak ho OpenAI nahradila obrazovým modelem zabudovaným přímo do ChatGPT, který nese jméno GPT Image. Druhá generace dorazila 21. dubna 2026 pod názvem ChatGPT Images 2.0 a OpenAI ji pustila mezi uživatele hned ten den, ve vývojářském rozhraní se stejný model jmenuje gpt-image-2.
Pro čtenáře starších návodů z toho plyne jedna praktická věc. Když někde narazíte na pokyn „otevřete DALL-E“, míří na funkci, která už není. Oficiální DALL-E GPT ChatGPT zrušil k 30. srpnu 2026.
Novinka, kterou u obrazových modelů nikdo nečekal, se jmenuje přemýšlení. Když v ChatGPT vyberete přemýšlivý model, obrázek nevznikne rovnou. Model si zadání nejdřív rozebere, může si dohledat čerstvé informace na webu a hotový výstup si po sobě zkontroluje, trvá to déle. Tenhle režim ale OpenAI počítá k placeným tarifům Plus, Pro a Business.
Model toho taky ví víc o světě. Jeho znalosti sahají do prosince 2025, což se hodí u infografik a vysvětlujících grafik, kde má sedět i obsah, ne jenom vzhled.
Jak si o obrázek říct
Nejjednodušší cesta je napsat větu do běžného chatu: „vygeneruj obrázek prázdné knihovny za soumraku“. ChatGPT pozná, že chcete obrázek, a začne kreslit. Druhá cesta vede přes nabídku nástrojů u textového pole, kde je generování obrázku samostatná položka, obojí funguje ve webové verzi i v mobilní aplikaci. Počítejte s tím, že to chvíli trvá. OpenAI v nápovědě píše, že u složitějšího zadání může generování zabrat i několik minut, vedle rychlých textových odpovědí to působí jako věčnost. Mezitím ale můžete v ChatGPT normálně psát dál, obrázek se dopočítá na pozadí.
Hotový obrázek si stáhnete do zařízení, zkopírujete do schránky nebo pošlete rovnou do jiné aplikace. Všechno, co takhle vytvoříte, se ukládá do samostatné sekce Images, takže se k obrázku vrátíte klidně za dva dny a necháte si ho upravit, aniž byste generovali od začátku. Jedna drobnost překvapí: z galerie se obrázek smaže až tehdy, když smažete konverzaci, ve které vznikl. Samotné generování běží na všech tarifech včetně bezplatného, jen s přísnějšími limity. OpenAI je nezveřejňuje jako pevné denní číslo, takže dopředu nevíte, kolik obrázků vám ještě zbývá. Když aplikace oznámí, že je limit vyčerpaný, obvykle stačí počkat do dalšího dne. Obrázky jsou přitom jen jedna z funkcí schovaných vedle chatu, jejich přehled najdete v textu o tom, co všechno ChatGPT umí.
Konverzace místo dokonalého promptu
U Midjourney nebo Stable Diffusion se vyplatí sepsat dlouhé přesné zadání napoprvé, protože oprava znamená nové zadání od nuly, v ChatGPT můžete začít jednou větou a zbytek doříct.
„Ten strom vlevo pryč.“ „Obloha ať je večerní.“ Model si pamatuje předchozí zprávy, takže nemusíte opakovat celé zadání dokola. Ukázka, jak to vypadá v praxi.
Začal jsem větou „vygeneruj plakát na besedu o umělé inteligenci v knihovně, formát na výšku“ a dostal obecnou grafiku s vymyšleným datem. Druhá zpráva byla konkrétnější: nadpis nahoře, pod ním menším písmem termín a místo konání, tmavě modré pozadí, jednoduchý geometrický motiv, dole volná plocha na logo knihovny. Třetí zpráva řešila jedinou věc, totiž posunout nadpis kousek níž, aby nesplýval s okrajem. Tři minuty a plakát byl použitelný. Tahle paměť má odvrácenou stranu. Čím delší konverzace, tím větší šance, že se do obrázku připlete detail, který jste zmínili o deset zpráv dřív a dávno na něj zapomněli. Když výsledek začne ujíždět stranou, otevřete nový chat a zadání napište načisto.
Struktura dobrého obrazového zadání platí i tady, jen ji nemusíte vysypat najednou: co je na obrázku, kde se scéna odehrává, odkud svítí světlo a jaký má být styl. Podrobně to rozebírá návod na psaní promptů pro generování obrázku.
Když chcete přemalovat jen jeden roh
Hotový obrázek se dá upravit dvěma způsoby. První je popsat změnu v chatu. Druhý je nástroj výběru: myší nebo prstem označíte část obrázku a napíšete, co se s ní má stát.
Výběr ovšem není laso z Photoshopu. Upozorňuje na to i sama OpenAI: označení nemusí být přesné a úprava se může protáhnout za jeho okraj. U produktové fotky, kde musí odstín obalu zůstat přesně stejný, si proto výsledek srovnejte s originálem vedle sebe. Pravidlo, které mi funguje nejlíp: popisujte jednu změnu, ne čtyři najednou. Když v jedné zprávě požádáte o jiné světlo, jinou barvu bundy, posun postavy a k tomu ještě jiný nápis, obvykle vám vyjde jedna věc a zbytek se rozjede.
Fotka, kterou přinesete s sebou
Nahrát se dá i vlastní obrázek. Vyfotíte obývák a řeknete si o stejnou místnost ve skandinávském stylu, nebo pošlete produktovou fotku a necháte kolem ní dogenerovat prostředí, z tužkové skici uděláte barevnou ilustraci. Druhé použití je reference stylu. Nahrajete obrázek, jehož vzhled se vám líbí, a popíšete úplně jiný motiv, který má vypadat podobně. Ušetříte si tím hledání slov ve chvíli, kdy styl poznáte, ale neumíte ho pojmenovat.
U nahrávání ale platí hranice, na kterou se snadno zapomene. Fotky jiných lidí, firemní podklady a nezveřejněné návrhy posíláte do cizí služby. Než tam nahrajete fotku kolegyně nebo grafiku, která ještě není venku, ověřte si, jestli k tomu máte souhlas a jak máte v účtu nastavené používání konverzací pro trénování modelů.
Nápis, který jde přečíst
Text uvnitř obrázku býval slabina všech generátorů. Právě tady odvedla druhá generace GPT Image největší kus práce. Zvládne hustý text, popisky v infografice, snímek do prezentace i mapu s názvy míst.
OpenAI přiznává, že starší modely zvládaly nejspolehlivěji angličtinu a další jazyky psané latinkou. U druhé generace jmenuje výrazný posun v japonštině, korejštině, čínštině, hindštině a bengálštině. Čeština v tom výčtu není. Nadpis s háčky a čárkami si po vygenerování přečtěte znak po znaku, chybějící háček je přesně ta drobnost, které si čtenář všimne dřív než vy. Pomůže i maličkost v zadání. Text, který má stát v obrázku, napište do uvozovek a přesně v té podobě, jakou má mít na výsledku. Model pak míň improvizuje.
Když musí nápis sedět na písmenko, třeba u ceny nebo termínu akce, sáhněte po starém postupu. Nechte si vygenerovat obrázek s volnou plochou bez textu a nadpis do něj doplňte v grafickém editoru. Zabere to o dvě minuty víc a odpadne kontrola každého znaku.
Formát vyberte dřív, než začne kreslit
Poměr stran si zvolíte v přepínači u textového pole, nebo ho napíšete rovnou do zadání. Nejširší možný poměr je 3:1, nejvyšší 1:3, takže se tam pohodlně vejde banner na web i formát na mobilní obrazovku. V API model kreslí až do rozlišení 2K a vyšší výstupy tam OpenAI zatím vede jako beta. Na web a běžný leták to stačí, na velkoformátový tisk počítejte s dodatečným zvětšováním. Ořezávat čtvercový obrázek na banner až dodatečně je špatný nápad. Model komponuje scénu do formátu, který dostal. Když z ní pak useknete třetinu, obvykle přijdete přesně o to, kvůli čemu jste obrázek generovali. Když se s formátem netrefíte, je lepší nechat si obrázek v editoru přegenerovat do jiného poměru stran než sahat po nůžkách.
Kde GPT Image kulhá
Udržet stejnou postavu napříč víc obrázky bývala největší slabina. Tady se karta obrátila. S přemýšlivým modelem umí ChatGPT vygenerovat několik různých obrázků naráz a OpenAI u nich slibuje návaznost postav i předmětů, například u série stránek komiksu. Háček je v tarifu: bez placeného účtu tuhle nadstavbu nemáte a stejný maskot ve třech scénách zůstává loterií.
Svoje slabiny OpenAI vypisuje docela otevřeně. Model si neporadí s úkoly, které vyžadují poctivou představu o fyzickém světě, tedy s návodem na origami nebo se správně poskládanou Rubikovou kostkou. Zlobí ho detaily na odvrácených, natočených a zrcadlených plochách. Potíže dělají i hodně husté opakující se struktury, třeba zrnka písku. A popisky v diagramech si po něm zkontrolujte, hlavně tam, kde šipka míří na konkrétní součástku. Podobizny konkrétních lidí jsou citlivá oblast a ChatGPT si tu drží vlastní pravidla. Zadání se jménem známé osobnosti může skončit odmítnutím, i když jste nechtěli nic nekalého. Přít se s modelem nemá cenu, rychlejší je popsat postavu obecně.
Chybí jemné ovládání, na které jsou zvyklí lidé od Stable Diffusion. Samostatné pole na negativní prompt tu nenajdete a stejně tak seed, tedy číslo, kterým se dá zopakovat přesně stejný náhodný základ obrázku. Komunitní doladěné modely taky ne. Co v obrázku nechcete, musíte napsat do běžného zadání a doufat, že si toho model všimne.
A pak je tu rukopis. Výstupy z ChatGPT bývají čisté, srozumitelné a tak trochu bezpečné. Midjourney nebo některé komunitní modely mají výraznější výtvarný charakter, který oceníte, když sháníte atmosféru, ne ilustraci k článku.
Komu se to vyplatí a kdo sáhne jinam
Smysl to dává hlavně tehdy, když ChatGPT používáte i na jiné věci a obrázek potřebujete jako doplněk: ilustraci k textu, grafiku do prezentace, obrázek k příspěvku, rychlou vizualizaci nápadu na poradě. Ušetříte přepínání mezi službami a nemusíte se učit další rozhraní.
Nevyplatí se to, když potřebujete velké tiskové rozlišení nebo chcete model provozovat u sebe a sahat si na každý parametr. Tam pořád vede Stable Diffusion a nástroje kolem něj. Na sérii se stejnou postavou dnes ChatGPT stačí, ovšem jen s placeným účtem a přemýšlivým modelem.
ChatGPT ostatně mezi hlavními hráči nestojí sám. Google nabízí generování přímo v Gemini pod přezdívkou Nano Banana a v práci s obrázky si nevede špatně. Než se rozhodnete, projděte si přehled toho, jak generování obrázků funguje a čím se nástroje liší.
Postup, který zabere pár minut
- Ujasněte si, k čemu obrázek bude. Plakát, ilustrace k článku a příspěvek na sociální síť potřebují jiný formát i jinou míru detailu.
- Nastavte poměr stran ještě před prvním generováním.
- Napište zadání: hlavní motiv, prostředí, světlo, styl. Text, který má být v obrázku, dejte do uvozovek.
- Prohlédněte si výsledek a pojmenujte jednu konkrétní změnu. Pak druhou. U složitějšího zadání jsem hotový málokdy napoprvé, pár kol úprav je normální.
- Na drobnosti použijte výběr oblasti místo přepisování celého zadání.
- Před stažením zkontrolujte nápisy, popisky u šipek, okraje obrázku a drobné opakující se struktury.
Na co si dát pozor
Vygenerované obrázky si nesou stopu původu, a to hned dvojí. V souboru jsou skryté údaje podle standardu C2PA, kterým se říká Content Credentials, a ty prozradí, čím a kdy snímek vznikl. Vedle toho OpenAI vkládá přímo do obrazu neviditelný vodoznak SynthID. Rozdíl mezi nimi je praktický: metadata umí sociální síť při nahrávání a kompresi setřít, vodoznak přežije i některé úpravy. Ani jedno není důkaz. A obráceně to platí taky, chybějící stopa neznamená, že snímek vyfotil někdo aparátem.
Když obrázek publikujete v kontextu, kde by ho někdo mohl považovat za skutečnou fotografii, napište to k němu. Stačí jedna věta v popisku. U komerčního použití si projděte podmínky přímo u OpenAI, pravidla vlastnictví a užití výstupů se mezi službami liší a v čase mění, obecná odpověď z diskusního fóra tady neplatí.
Shrnutí
Generování obrázků v ChatGPT stojí na konverzaci. První zadání nemusí být dokonalé, protože výsledek doladíte dalšími větami a u drobností označíte přímo tu část, která se má změnit. Nejvíc se posunula práce s textem uvnitř obrázku. Slabinou zůstávají scény, které vyžadují poctivou znalost fyzického světa, a čeština, kterou OpenAI mezi jazyky se zlepšeným vykreslováním písma nejmenuje.
Kdo chce vidět rozdíl hned, ať zkusí jednu věc. Vygenerujte si obrázek s krátkým nápisem, pak požádejte o změnu jediného slova v něm a srovnejte oba výsledky vedle sebe. Za dvě minuty budete vědět, kde je hranice, o kterou při vlastní práci zakopnete.