← Slovníček pojmů

Difuzní model

anglicky: diffusion model

Difuzní model tvoří obrázek tak, že začne u čistého šumu a v desítkách kroků z něj postupně „odstraňuje“ všechno, co neodpovídá zadání. Takhle fungují Midjourney, FLUX i většina generátorů obrázků.

Vysvětluje to dvě věci, které uživatele překvapí: proč stejné zadání pokaždé dá jiný obrázek (start je náhodný šum) a proč se dá výsledek ovlivnit číslem kroků a nastavením, jak přísně se má model držet zadání.

Text v obrázcích byl dlouho slabina právě proto, že písmena vznikají stejným postupem jako mraky. Novější modely to zvládají, ale delší nápisy je pořád lepší dopsat v grafickém editoru.

Příklad

Stejný prompt spuštěný pětkrát dá pět různých obrázků. Když chcete tentýž, musíte si uložit seed neboli počáteční nastavení šumu.

Kde na to narazíte

Souvisí s tím