Generování necenzurovaných obrázků na lokální grafické kartě

CS

Evropská unie připravuje nové regulace s bohulibým záměrem ochránit nás před úskalími moderních technologií. Takže pokud si chcete vygenerovat svoje hambaté obrázky, máte poslední příležitost to zkusit.
V dohledné době budou modely uvedené v tomto článku prohlášeny za ilegální a už nebude možné je stahnout a legálně používat pro osobní potřebu.

Hardware

  • GPU: RTX 2060, 6 GB VRAM (CUDA driver 610.57)
  • Systémová RAM: 32 GB, 8jádrový CPU
  • Úložiště: 150 GB+ SSD — modely rychle rostou
  • OS: Linux (Debian/Ubuntu), NVIDIA driver

VRAM je limitem, ne výkon. 6 GB je zde prakticky ověřené minimum — SDXL checkpointy i model Anima se do něj vejdou, jeden po druhém, díky tomu, že InvokeAI modely automaticky přesouvá do/z cache. 8–12 GB tuto výměnu úplně odstraní a stojí za upgrade dřív než rychlejší CPU.

01 — Hardware a OS

Funguje jakákoliv moderní NVIDIA karta s 6 GB+ VRAM. AMD i Apple Silicon zvládnou InvokeAI také (pomaleji, přes vlastní backend) — seznam modelů níže předpokládá NVIDIA/CUDA, což používá tato sestava.

  1. Instalace NVIDIA driveru — proprietární, ne nouveau, CUDA ho potřebuje:
    sudo apt install nvidia-driver firmware-misc-nonfree
    nvidia-smi   # ověření, že karta je rozpoznaná
  2. Instalace InvokeAI — má vlastní instalátor, vytvoří si izolované Python prostředí, nepotřebuje systémový Python/PyTorch:
    pip install invokeai
    invokeai-web   # první běh vytvoří root adresář a zeptá se na GPU/CPU

    Root adresář (INVOKEAI_ROOT) obsahuje models/, outputs/, databases/ a invokeai.yaml — jediný soubor, který stojí za ruční úpravu (host/port, velikost VRAM cache).

  3. Stažení základních modelů — přes Model Manager → Add Model → Install from URL/HF repo, nebo přímo soubory do models/ a nechat naskenovat při dalším startu. Katalog níže je přesná sada nainstalovaná na této sestavě, včetně URL, odkud byl každý model stažen.
  4. Instalace Ollama pro popisky — bot (níže) si píše vlastní captions/hashtagy malým lokálním LLM, žádné cloudové API, žádné náklady za obrázek:
    curl -fsSL https://ollama.com/install.sh | sh
    ollama pull llama3.1:8b

02 — Katalog modelů

Co je na této sestavě reálně nahráno — jedna sada zaměřená na anime přes diffusion-transformer architekturu (Anima) a dva klasické SDXL checkpointy, doplněné LoRA vrstvami pro konkrétní styly.

RoleNázevZákladZdroj
checkpoint Anima Base 1.0 anima huggingface.co/circlestone-labs/Anima
text encoder Anima Qwen3 0.6B anima huggingface.co/circlestone-labs/Anima
vae Anima QwenImage VAE anima huggingface.co/circlestone-labs/Anima
controlnet Anima LLLite (Inpainting / Sketch) anima huggingface.co/kohya-ss/Anima-LLLite
checkpoint AutismMix SDXL sdxl civitai.com — hledat podle jména
checkpoint RealVisXL V4.0 sdxl huggingface.co/SG161222/RealVisXL_V4.0
lora Stylové a charakterové LoRAs
Cartoon_styles_anima, COMMIX, kobold IL …
mixed civitai.com — jeden soubor na styl
ip-adapter Standard Reference (ViT-H) sdxl generování/přenos stylu podle referenčního obrázku
prompt LLM Qwen2.5-3B-Instruct any vestavěné rozšiřování promptů v InvokeAI

03 — Pomůcky pro prompty a další styly

  • CivitAI (civitai.com) — hlavní knihovna komunitních checkpointů a LoRA. Každá stránka modelu ukazuje prompty a nastavení ostatních uživatelů — nejrychlejší způsob, jak zjistit, na co daný styl skutečně reaguje.
  • Hugging Face (huggingface.co/models) — základní checkpointy, text encodery a VAE — odkud pochází Anima, RealVisXL a většina modelů mimo CivitAI.
  • Rozšiřování promptů v InvokeAI — už nainstalováno výše (Qwen2.5-3B-Instruct) — z krátkého nápadu udělá plnohodnotný prompt přímo v InvokeAI, žádná další služba není potřeba.
  • Ollama library (ollama.com/library) — výměna modelu pro popisky za větší nebo menší podle toho, kolik VRAM zbývá, když generování neběží.
Back to articles