V půlce října do ChatGPT dorazila DALL-E-3, tedy generativní AI. Ta co je už pár týdnů v Bing Create. Musíte mít placenou ChatGPT a v menu GPT-4 aktivovat, že chcete generovat obrázky.
Kompozice
- Po určité době asi zjistíte, že má velmi v oblibě vystředěnou kompozici a umístění významnějších věcí doprostřed. Nepomáhá jí říkat aby byla asymetrická, ale tohle je asi věc k dalšímu zkoumání (a byla o tom řeč i jiném dřívějším tipu). ChatGPT každopádně tvrdí, že umí následující kompozice
- Rule of Third
- Golden Ratio (or Phi Grid)
- Diagonal Lines
- Leading Lines
- Frame within a Frame
- Symmetry
- Asymmetry
- Central Composition
- Negative Space
- Foreground Interest
- Patterns and Repetition
- Juxtaposition
- Rule of Odds
- Fill the Frame
- Jenže, i když si řeknete o : Ok, make me wide picture od dog in park, each picture in different composition – use Diagonal Lines, Negative Space, Juxtaposition and Fill the Frame, tak to stále je všechno středěné, byť kompozice asi každá jiná.




- Pro lepší ilustraci tedy zkusme: OK, take number three and regenerate with those compositions: Diagonal Lines, Negative Space, Juxtaposition and Fill the Frame




- Úsměvné je, že když se ptáte jak se středění vyvarovat, tak nabídne využít Rule of Thirds. A u následujících obrázků suverénně tvrdí, že psiska jsou levé či pravé třetině. Ale neřekl bych že jsou.




- Takže otázku kompozice asi zatím můžeme uzavřít jako „nefunguje“ a doufat, že je to chyba, kterou někdy napraví. A jasně, zkoušel jsem toho mnohem více než pár výše uvedených.
Co DALL E 3 neumí
- Dall E 3 (ChatGPT) neumí upscaling, tady musíte mít vlastní řešení (Upscayl a další)
- Není ani možné nahrát obrázek, natož ho měnit/doplňovat ho
- Nelze určovat Inference Steps ani Guidance Scale
- Neumí “negative prompt” tak jako (například) Stable Diffusion
- V tipu o promptech/zadáních je i řeč o tom, že neumí hloubky ostrosti, volné poměry stran (protože umí pevně jen tři velikosti) ani zadat rozměry v bodech
- Neumí se zdržet zadání zasahování do zadání, takže občas zjistíte, že vaše zadání zásadně mění, zpravidla i tak, že jde o dodání “politické korektnosti”
TIP: Při psaní tohoto tipů jsem zkoušel řadu velmi různorodých věcí. Mrkněte do Hrátky s DALL E 3 v ChatGPT. Hodně různorodých promptů s ukázkou výsledků pro množství zadání (promptů) i výsledků.
- Jakkoliv chatGPT tvrdí, že když si řeknete o “PNG with transparent background” tak ho vytvoří, tak tomu tak není. Místo průhledného pozadí tam sází poněkud chaotické čtverečky
- Prozatím není možné sdílet konverzaci ve které jsou obrázky. Trochu škoda, ale asi to časem dorazí. [16.10.23]
Nejasnosti
- Halucinace? Ale samozřejmě. Následující prompt například vytváři leccos, jen ne ženu natož podobnou Leie. Problém je ale v češtině, protože když totéž poskytnete v angličtině, tak výsledek smysl dává (a dokonce i odmítá generovat, protože práva, což ostatně udělá běžně i v češtině).
Prosím o olejomalbu postavy vypadající jako princezna leia (princess leia, leia organa), na dřevě inspirovanou renesančním portrétem ve stylu sfumato. Obraz by měl zachytit tajemnou a klidnou náladu s jemným úsměvem a vzdáleným krajinářským pozadím. Na široko.




- K tomu předchozímu ještě poznámka. Ne nutně vám to musí udělat totéž jako mě. Může mezitím dojít k nápravě, mohlo jít o chybu či přetížení. Mohlo jít o vliv předchozích generování.
- Jak říct že něco ve výstup nemá být? Trochu komplikované, sama ChatGPT tvrdí, že máte napsat velkými písmeny co nechcete, tedy třeba „NO BANANAS“ nebo to uvést jako „absolutely no bananas“. Někdy to snad i zabare, ale zkušenost je že spíše ne
TIP: Nové Hrátky s DALL E 3 v ChatGPT: Vlevo ani vpravo prostě nedává a je potřeba to vědět, protože podle toho musíte pracovat s prompty (a mít nekonečnou trpělivost, ehm)
