Evropská unie připravuje nové regulace s bohulibým záměrem ochránit nás před úskalími moderních technologií. Takže pokud si chcete vygenerovat svoje hambaté obrázky, máte poslední příležitost to zkusit.
V dohledné době budou modely uvedené v tomto článku prohlášeny za ilegální a už nebude možné je stahnout a legálně používat pro osobní potřebu.
Hardware
- GPU: RTX 2060, 6 GB VRAM (CUDA driver 610.57)
- Systémová RAM: 32 GB, 8jádrový CPU
- Úložiště: 150 GB+ SSD — modely rychle rostou
- OS: Linux (Debian/Ubuntu), NVIDIA driver
VRAM je limitem, ne výkon. 6 GB je zde prakticky ověřené minimum — SDXL checkpointy i model Anima se do něj vejdou, jeden po druhém, díky tomu, že InvokeAI modely automaticky přesouvá do/z cache. 8–12 GB tuto výměnu úplně odstraní a stojí za upgrade dřív než rychlejší CPU.
01 — Hardware a OS
Funguje jakákoliv moderní NVIDIA karta s 6 GB+ VRAM. AMD i Apple Silicon zvládnou InvokeAI také (pomaleji, přes vlastní backend) — seznam modelů níže předpokládá NVIDIA/CUDA, což používá tato sestava.
-
Instalace NVIDIA driveru — proprietární, ne
nouveau, CUDA ho potřebuje:sudo apt install nvidia-driver firmware-misc-nonfree nvidia-smi # ověření, že karta je rozpoznaná -
Instalace InvokeAI — má vlastní instalátor, vytvoří si
izolované Python prostředí, nepotřebuje systémový Python/PyTorch:
pip install invokeai invokeai-web # první běh vytvoří root adresář a zeptá se na GPU/CPURoot adresář (
INVOKEAI_ROOT) obsahujemodels/,outputs/,databases/ainvokeai.yaml— jediný soubor, který stojí za ruční úpravu (host/port, velikost VRAM cache). -
Stažení základních modelů — přes Model Manager →
Add Model → Install from URL/HF repo, nebo přímo soubory do
models/a nechat naskenovat při dalším startu. Katalog níže je přesná sada nainstalovaná na této sestavě, včetně URL, odkud byl každý model stažen. -
Instalace Ollama pro popisky — bot (níže) si píše vlastní
captions/hashtagy malým lokálním LLM, žádné cloudové API, žádné náklady
za obrázek:
curl -fsSL https://ollama.com/install.sh | sh ollama pull llama3.1:8b
02 — Katalog modelů
Co je na této sestavě reálně nahráno — jedna sada zaměřená na anime přes diffusion-transformer architekturu (Anima) a dva klasické SDXL checkpointy, doplněné LoRA vrstvami pro konkrétní styly.
| Role | Název | Základ | Zdroj |
|---|---|---|---|
| checkpoint | Anima Base 1.0 | anima | huggingface.co/circlestone-labs/Anima |
| text encoder | Anima Qwen3 0.6B | anima | huggingface.co/circlestone-labs/Anima |
| vae | Anima QwenImage VAE | anima | huggingface.co/circlestone-labs/Anima |
| controlnet | Anima LLLite (Inpainting / Sketch) | anima | huggingface.co/kohya-ss/Anima-LLLite |
| checkpoint | AutismMix SDXL | sdxl | civitai.com — hledat podle jména |
| checkpoint | RealVisXL V4.0 | sdxl | huggingface.co/SG161222/RealVisXL_V4.0 |
| lora | Stylové a charakterové LoRAs Cartoon_styles_anima, COMMIX, kobold IL … |
mixed | civitai.com — jeden soubor na styl |
| ip-adapter | Standard Reference (ViT-H) | sdxl | generování/přenos stylu podle referenčního obrázku |
| prompt LLM | Qwen2.5-3B-Instruct | any | vestavěné rozšiřování promptů v InvokeAI |
03 — Pomůcky pro prompty a další styly
- CivitAI (civitai.com) — hlavní knihovna komunitních checkpointů a LoRA. Každá stránka modelu ukazuje prompty a nastavení ostatních uživatelů — nejrychlejší způsob, jak zjistit, na co daný styl skutečně reaguje.
- Hugging Face (huggingface.co/models) — základní checkpointy, text encodery a VAE — odkud pochází Anima, RealVisXL a většina modelů mimo CivitAI.
- Rozšiřování promptů v InvokeAI — už nainstalováno výše (Qwen2.5-3B-Instruct) — z krátkého nápadu udělá plnohodnotný prompt přímo v InvokeAI, žádná další služba není potřeba.
- Ollama library (ollama.com/library) — výměna modelu pro popisky za větší nebo menší podle toho, kolik VRAM zbývá, když generování neběží.