792 315 084
OVĚŘIT DOSTUPNOST

AI obrazové generátory 2026 — Midjourney, DALL-E, Stable Diffusion

Publikováno: 3. 8. 20262319 slovČtení na 11.6 min.

Lead: Generativní obrazové modely za poslední dva roky překročily práh, za kterým laik při běžném pohledu nepozná, jestli si bilbord vyfotil profesionál, nebo ho přes noc vygeneroval kreativec z domácí kuchyně. Midjourney V7, OpenAI DALL-E 4 a komunitní rodina Stable Diffusion / Flux drží trojici, kterou v polovině roku 2026 řeší každý, kdo dělá marketing, blog, malý e-shop nebo jen rád experimentuje. Tento průvodce není o tom, jak napsat hezký prompt — je o tom, který model zvolit, kolik to v praxi stojí, co je legálně OK a co ne, a jakým chybám se vyhnout, když si AI generování chcete pustit do reálné práce.

Stav trhu v polovině 2026 — kdo dominuje a proč

Když v roce 2022 vznikl Midjourney a DALL-E 2, šlo o experiment, ne o pracovní nástroj. Dnes je situace jiná: agentury běžně dodávají AI vizuály klientům, e-shopy si generují produktové ilustrace, blogeři kreslí featured images za 30 sekund. Tento posun stojí na třech pilířích.

Prvním je kvalita obličejů a rukou. Až do roku 2023 platilo „AI nezvládne ruce“. Midjourney V6 v roce 2024 to vyřešil a verze V7 z přelomu 2025/2026 ruce zvládá lépe než leckterý ilustrátor. DALL-E 4 (integrovaný do ChatGPT od konce 2025) je v anatomii rovněž bezchybný, navíc s lepším renderem textu v obraze — to byla dříve achillova pata generativních modelů.

Druhým je rychlost a cena. Generace 1024×1024 obrazu trvá u Midjourney 20–40 sekund, u DALL-E přes ChatGPT podobně, u Stable Diffusion lokálně na slušné grafice (RTX 4070+) klidně 3 sekundy. Cenové pásmo se ustálilo kolem 300–600 Kč měsíčně za neomezené komerční použití u cloudových služeb a 0 Kč u lokálních open-source modelů (Stable Diffusion, Flux.1).

Třetím je přijatelnost u zákazníků. Ještě v roce 2024 vyvolávalo zveřejnění AI vizuálu vlnu kritiky v komentářích. V roce 2026 je tato vlna utlumená — značky se k AI obsahu otevřeně hlásí, soutěže o „lidský vs AI obraz“ mizí ze sociálních sítí, prostě se to stalo normou. Otázky etiky se přesunuly do specializovanějších oblastí — deepfake politiků, generování pornografie reálných osob — a běžnou tvorbu nezatěžují.

Midjourney V7 — král estetiky, slabý v ovladatelnosti

Midjourney začínal jako experiment dvojice vývojářů na Discordu a dodnes nese pečeť této historie — primární rozhraní bylo až do roku 2024 čistě Discord bot, web aplikace přišla později. V polovině 2026 už Midjourney funguje plnohodnotně přes web (midjourney.com), Discord zůstává jako alternativa.

Co Midjourney V7 odlišuje: stylová konzistence. Pokud chcete obraz, který „vypadá hezky bez práce“, Midjourney vyhrává. Default style je vyladěný směrem k filmové kompozici, měkkému světlu, profesionálnímu look-and-feel. Pro produktové fotky, mood boardy, blog featured images, instagramové vizuály — Midjourney prostě dodá pohlednější výsledek než konkurence při minimálním promptu.

Kde Midjourney selhává

Ovladatelnost. Když chcete přesně „žena s červenou taškou na pravém rameni stojící před modrým autem v 3/4 pohledu“, Midjourney vám 30 % případů otočí rameno, 20 % zamění barvy a v 10 % vám tašku omylem nasadí na hlavu. Modely OpenAI a kontrolovaný Stable Diffusion (s ControlNet) jsou v této přesnosti výrazně dál.

Druhá slabina: generování textu v obraze. Loga, nápisy na cedulích, text na produktech — Midjourney to dnes umí, ale s vyšší chybovostí než DALL-E 4.

Cena: 10 USD/měsíc za základní plán s ~200 generacemi, 30 USD/měsíc za standard (neomezené relaxed + 15 fast hodin), 60 USD/měsíc za pro plán s privátními generacemi. Komerční použití je zahrnuto v placených plánech.

DALL-E 4 — integrace s ChatGPT a textová přesnost

DALL-E 4 je úzce svázaný s ChatGPT — používáte ho buď přes ChatGPT Plus (200 Kč měsíčně) nebo přes API. Samostatné webové rozhraní DALL-E existuje, ale primární use case je dnes „v rozhovoru s ChatGPT řeknu, co chci, a obraz se vygeneruje v chatu“.

Tato integrace je obrovská výhoda pro lidi, kteří už ChatGPT používají. Místo toho, abyste otevřeli další službu a platili další předplatné, dostanete generování obrazu v nástroji, který stejně máte otevřený. ChatGPT navíc umí prompt zpřesnit, navrhnout alternativy, iterovat na výsledku v dialogu.

DALL-E 4 dnes vyniká ve dvou věcech:

  • Text v obraze. Logo, nápis na ceduli, text na knize — DALL-E to udělá s 90+ % přesností, zatímco Midjourney spadne pod 70 %.
  • Realistický photo-look. Pokud chcete obraz, který má vypadat jako skutečná fotografie (pro stock-photo náhrady, reklamní kampaně), DALL-E 4 default style cílí blíž k fotorealismu než Midjourney, který tíhne k filmovému / artistickému stylu.

Slabiny DALL-E 4

Estetika. Default Midjourney je pohlednější. DALL-E je přesnější, ale „učesanější“ v negativním smyslu — pohledy do kamery, středová kompozice, klasická studiová světla. Pro umělecké projekty Midjourney vyhrává, pro reklamní fotku DALL-E.

Druhý limit: safety filtering. OpenAI filtruje promty agresivně — generování postav v jakkoli sugestivnějších pozicích, scény s násilím i v komickém kontextu, parodie známých osobností narážejí na „I can’t help with that“. Midjourney je v tomto volnější, lokální Stable Diffusion je zcela bez filtrů.

Stable Diffusion + Flux — open-source revoluce

Třetí pilíř je komunitní. Stable Diffusion vznikl jako open-source projekt Stability AI v roce 2022 a stal se ekosystémem, ve kterém dnes nejen že nainstalujete model na vlastní GPU, ale stáhnete si stovky komunitních variací — fine-tunes pro anime styl, fotorealismus, konkrétní umělecké styly, LoRA modely pro konkrétní osoby a postavy.

V průběhu 2024 přibyl konkurent Flux.1 od Black Forest Labs (tým bývalých Stable Diffusion vývojářů), který v některých testech předbíhá i komerční Midjourney. Flux.1 dev je zdarma pro nekomerční použití, Flux.1 pro placená API.

Pro koho lokální generování dává smysl

  • Časté generování (100+ obrazů týdně). Cloudové služby vyjdou na 600–1500 Kč měsíčně, lokální Stable Diffusion na slušné GPU má marginální cenu energie.
  • Citlivá data. Nechcete posílat firemní materiály na cizí server.
  • Specifický styl/postava. Trénovaný LoRA model na vaše produkty, vaše modelky, váš vizuální styl.
  • Bez filtrů. Komerční služby filtrují, lokální model dělá, co řeknete.

Co je za to potřeba

Grafická karta s 8+ GB VRAM (RTX 3060 12 GB minimum pro slušnou rychlost, RTX 4070+ ideální). Setup přes ComfyUI nebo Forge UI (nástupce Automatic1111) trvá hodinu a vyžaduje technickou trpělivost. Pro někoho, kdo vidí „command line“ poprvé, je to bariéra. Pro někoho, kdo si pamatuje instalaci Linuxu v 90. letech, je to pohoda.

Cenové scénáře — co dává smysl pro koho

Bloger / OSVČ / drobný marketing (10–30 obrazů měsíčně): ChatGPT Plus 200 Kč/měsíc. Použijete DALL-E 4 pro články, GPT-4 pro psaní textů, je to all-in-one nástroj.

Marketingový profesionál / freelancer (50–200 obrazů měsíčně): Midjourney Standard 30 USD (~700 Kč) + ChatGPT Plus. Midjourney pro krásu, DALL-E pro text v obraze a dialogovou iteraci.

Agentura / produkční tým (500+ obrazů měsíčně, klientská data): Lokální Stable Diffusion / Flux na pracovní stanici + Midjourney Pro pro privátní generace. Investice 30–50 tisíc Kč do hardware se vrátí během půl roku.

E-shop s 1000+ produkty (variace produktových fotek): Lokální Stable Diffusion s vlastním fine-tune — jen toto dává smysl. Cloudové služby vás na takové škále zničí jak cenou, tak rychlostí.

Hobby / experimentátor: Free plány nebo Flux.1 dev lokálně. Bing Image Creator (DALL-E zdarma s denním limitem), Leonardo.ai free tier, ChatGPT free s denním limitem DALL-E — kombinací free služeb se dostanete daleko.

Autorské právo a komerční použití v 2026

Téma, které v rocích 2022–2024 mátlo všechny, je dnes jasnější. Shrnu situaci v ČR / EU:

  • AI obraz není sám o sobě chráněn autorským právem. Soud v USA i postoje českého ÚPV se shodují — generativní obraz bez podstatné lidské tvůrčí intervence nemá autora, kterému by ochrana náležela. Můžete ho ale komerčně používat. Konkurent ho ale taky může legálně překopírovat.
  • Komerční použití generací z placených služeb je OK. Midjourney, OpenAI i Stability AI v licenci povolují komerční použití pro platící zákazníky.
  • Tréninková data zůstávají šedou zónou. Probíhající soudní spory (Getty Images vs Stability AI, NYT vs OpenAI) ještě v polovině 2026 nemají finální výrok. To znamená, že generativní modely mohly být trénovány na materiálech bez svolení autorů. Pro vás jako uživatele to aktuálně riziko není, ale situace se může změnit.
  • Generování obrazu konkrétní žijící osoby bez jejího svolení je v ČR/EU velmi riziková zóna (GDPR, ochrana osobnosti). I když to model technicky umí, právně se tomu vyhněte mimo zjevnou parodii.

Praktické tipy pro každodenní práci

Zde je seznam, který šetří hodiny zbytečného experimentování:

  • Stejný prompt v různých modelech dává různě dobré výsledky. Naučte se „jazyk“ každého modelu. Midjourney miluje krátké, hutné prompty s důrazem na styl. DALL-E preferuje delší přirozený popis. Stable Diffusion má často „negative promty“ (co nechcete v obraze).
  • Iterujte na jednom obraze, nesnažte se „vystřelit jednu perfektní generaci“. Vyberte nejlepší ze 4 a generujte variace, znovu vyberte, znovu variace.
  • Upscaling je samostatný krok. Výstup z modelů má často 1024×1024 nebo 2048×2048. Pro tisk potřebujete 4K+ — použijte Topaz Gigapixel, ESRGAN nebo upscale funkci v daném modelu.
  • Postprocessing v Photoshopu / GIMPu / Affinity výsledku pomůže. AI udělá 90 % práce, posledních 10 % (oprava drobné chyby v ruce, doladění barev, ořez) udělejte ručně.
  • Ukládejte si prompty. Co vám fungovalo, znovu poslouží. Pro tým je dobrý prompt cennější než finální obraz.

FAQ — generativní obrazové AI v praxi

Jaký model je nejlepší pro začátečníka?

ChatGPT Plus s DALL-E 4. Investice 200 Kč měsíčně, žádný setup, dialogová iterace v češtině, integrace s textovou AI. Pro 80 % uživatelů je to jediný nástroj, který kdy budou potřebovat.

Můžu prodávat AI obrazy jako art / tisky?

Ano, pokud používáte placené plány komerčních služeb nebo open-source modely. Pamatujte ale, že obraz není autorsky chráněn — kdokoli může legálně přivlastnit / kopírovat. Ekonomicky to funguje pro reklamní a stock-photo trh, hůř pro fine-art trh, kde sběratele zajímá lidská ruka.

Jak velký počítač potřebuju pro lokální Stable Diffusion?

Minimum: GPU s 8 GB VRAM (RTX 3060 12 GB, RX 7600 XT, M2/M3 Mac s 16+ GB unified memory). Komfort: RTX 4070 / 4080. Generování trvá u minima 15–30 s na obraz, u komfortu 3–8 s.

Lze AI obraz použít na obal knihy / album / produkt?

Ano, pokud máte komerční licenci modelu (placené plány nebo lokální open-source). Riziko: pokud se v budoucnu prokáže, že model byl trénován neetickými daty, mohou nastat reklamace. Riziko je dnes nízké, ale není nulové.

Funguje AI generování v češtině?

Promtování ano (modely rozumí češtině), ale výrazně lépe pracují s angličtinou. Češtinu jen z poloviny „překládají“ do své interní reprezentace, anglický prompt je přímější. Pro vážnou práci promptujte anglicky a používejte ChatGPT na překlad nápadu z češtiny do anglického promtu.

Co když mi model generuje „deformované“ ruce nebo obličeje?

V 2026 jen výjimečně. Pokud ano: zvyšte počet variací, použijte výslovný negative prompt („deformed hands, extra fingers“), upscale s „face restoration“ filtrem (CodeFormer, GFPGAN). U Midjourney V7 a DALL-E 4 by tato chyba měla být řídká.

Můžu vygenerovat obraz s konkrétním člověkem (např. politik)?

Komerční služby to filtrují (OpenAI tvrdě, Midjourney méně). Lokální Stable Diffusion neomezuje. Právně: parodie známé osobnosti v rozumném rozsahu je v ČR/EU obvykle obhajitelná, deepfake bez kontextu parody = problém s ochranou osobnosti a (od 2025) i s EU AI Act.

Závěr — který model si zvolit dnes

Pokud teprve začínáte, jděte do ChatGPT Plus s DALL-E 4 — největší poměr „užitek za investovaný čas“. Pokud chcete krásnější výsledky a děláte vizuální marketing, přidejte Midjourney. Pokud generujete denně, máte citlivá data nebo specifický styl, naučte se lokální Stable Diffusion / Flux. Hardware se vám vrátí během měsíců, kontrola a nezávislost na cloudových službách nemá cenu.

A poslední praktická poznámka: AI generování je nástroj, ne cíl. Hezký vizuál bez kontextu, kompozice a smyslu pořád nefunguje. Naučte se základní pravidla výtvarné kompozice — pravidlo třetin, vyváženost, hierarchie. AI udělá technickou část; estetické rozhodnutí je pořád na vás.


Chcete sledovat tech trendy v Praze? Sledujte náš blog na internetpraha.com — pravidelně přinášíme přehledy AI nástrojů, recenze chytrých domácností, návody na kyberbezpečnost a tipy pro hybridní práci. Pokud máte tip na téma, ozvěte se.

Čtěte také

Přečtěte si i ostatní články z blogu.