Stable Diffusion: otwarty model i forki
Stable Diffusion to otwarty model dyfuzji latentnej wydany w 2022 r. Wyjaśniamy architekturę, wersje, licencje i dlaczego jego forki napędzają narzędzia undress.
Stable Diffusion co to — definicja i architektura
Stable Diffusion to rodzina otwartych modeli generujących obrazy z tekstu, oparta na architekturze dyfuzji latentnej z pracy Rombacha i in. (CompVis, LMU Monachium) i wydana publicznie w sierpniu 2022 r. przy wsparciu Stability AI. Otwarte wagi i kod sprawiły, że model stał się podstawą tysięcy forków — od edytorów SFW po wyspecjalizowane narzędzia nudify.
| Parametr | Wartość · źródło (data dostępu) |
|---|---|
| Rodzaj | otwarty model text-to-image (dyfuzja latentna, U-Net + autoenkoder + enkoder tekstu) · Rombach i in., 2022 |
| Zastosowanie | generowanie z tekstu, img2img, inpainting, baza dla adapterów LoRA i modeli specjalistycznych · repozytorium CompVis |
| Ryzyko | otwarte wagi umożliwiają usunięcie filtrów i dostrojenie do treści NSFW z wizerunkiem osób · AI Act art. 50, 53 |
| Standard / organizacja | CompVis (LMU), Stability AI, Runway; dane treningowe LAION-5B; licencje CreativeML OpenRAIL-M i Stability AI · stability.ai/license |
| Wersje | 1.x (2022), 2.x (2022), SDXL (2023), SD 3 (2024) · arXiv 2403.03206 |
| Rok | grudzień 2021 — publikacja LDM; 22.08.2022 — publiczne wydanie; 2023 — SDXL; 2024 — SD 3 · Stability AI, 2022 |
Stan na 08.09.2026. Wpis ma charakter informacyjny i nie zawiera instrukcji użycia narzędzi; to nie jest porada prawna.
Rodzaj
Model dyfuzji latentnej — odszumianie w skompresowanej przestrzeni, dekodowanie do pikseli; działa na kartach konsumenckich.
Zastosowanie
Fundament ekosystemu — interfejsy graficzne, adaptery, modele branżowe; także większość silników undress AI.
Ryzyko
Otwartość bez kontroli — filtr bezpieczeństwa i znak wodny można wyłączyć w forku; odpowiedzialność przenosi się na operatora.
Standard / organizacja
Licencje użycia — OpenRAIL-M i licencja Stability AI zakazują treści seksualnych bez zgody i z małoletnimi.
Rok
2022 — publiczne wydanie zmieniło rynek generatorów; 2024 — SD 3 na transformerze dyfuzyjnym.
Jak zbudowany jest Stable Diffusion
Model składa się z trzech części: autoenkodera (VAE), który kompresuje obraz do przestrzeni latentnej o kilkadziesiąt razy mniejszym wymiarze, sieci odszumiającej U-Net działającej w tej przestrzeni oraz enkodera tekstu, który zamienia opis na wektory sterujące przez mechanizm uwagi (Rombach i in., 2022). Zasadę dyfuzji opisuje osobne hasło.
Dzięki pracy w przestrzeni latentnej generowanie obrazu 512×512 px trwa sekundy na karcie graficznej klasy konsumenckiej. Repozytorium CompVis dokumentuje architekturę, skrypty text-to-image, img2img i inpaintingu oraz moduł safety checker (github.com/CompVis/stable-diffusion).
Model trenowano na podzbiorach LAION-5B — zbioru par obraz–opis zebranych z internetu, z filtrowaniem estetycznym i NSFW opisanym przez autorów (Schuhmann i in., 2022). Skład danych jest źródłem sporów o prawa autorskie i obecność treści niepożądanych.
Wersje: od 1.4 przez SDXL do SD 3
Publiczne wydanie wersji 1.4 nastąpiło 22 sierpnia 2022 r. (Stability AI). Wersje 2.x z końca 2022 r. zmieniły enkoder tekstu i zaostrzyły filtrowanie danych treningowych, co społeczność odebrała jako spadek jakości postaci — i przyczyniło się do popularności forków 1.5.
SDXL z lipca 2023 r. zwiększył rozdzielczość bazową do 1024 px i dodał drugi enkoder tekstu (Podell i in., 2023). Stable Diffusion 3 z 2024 r. zastąpił U-Net transformerem dyfuzyjnym i wprowadził flow matching (Esser i in., 2024) — podobnie jak konkurencyjny FLUX.
Wraz z SD 3 zmieniła się licencja: model wydano na licencji Stability AI Community, która ogranicza użycie komercyjne powyżej progu przychodów i zakazuje zastosowań naruszających prawo (stability.ai/license). Wersje 1.x/2.x pozostają na CreativeML OpenRAIL-M z listą zakazanych użyć.
Stable Diffusion NSFW — filtry, forki i licencje
Oficjalne dystrybucje zawierają safety checker — klasyfikator odrzucający wyniki NSFW — oraz niewidoczny znak wodny. W forku oba moduły da się wyłączyć, a model dostroić adapterem LoRA do treści dla dorosłych. Tak powstaje większość silników narzędzi nudify: niepubliczny fork na bazie wersji 1.5 lub SDXL.
Licencje OpenRAIL-M i Stability AI wprost zakazują generowania treści seksualnych bez zgody przedstawianych osób oraz jakichkolwiek treści z udziałem małoletnich (stability.ai). Naruszenie licencji jest sprawą cywilną między operatorem a licencjodawcą; odpowiedzialność karna za art. 191a KK spoczywa na osobie, która tworzy lub rozpowszechnia wizerunek (ISAP).
AI Act traktuje modele tej klasy jako modele ogólnego przeznaczenia (art. 53) z obowiązkami dokumentacji i przejrzystości, a operatorów usług — obowiązkiem oznaczania wyników z art. 50 od 2 sierpnia 2026 r. (EUR-Lex). Serwis nie linkuje do wag ani forków; hasło ma charakter informacyjny.
Stable Diffusion online w recenzowanych narzędziach
Większość usług w przeglądarce, które recenzujemy, nie ujawnia modelu, ale cechy wyników — rozdzielczość bazowa, typowe artefakty dłoni, styl oświetlenia — wskazują na forki SD 1.5 lub SDXL z wąskim dostrojeniem. Platformy wielomodelowe, jak WaveSpeed, wymieniają model w interfejsie.
W recenzjach oceniamy nie architekturę, lecz sposób jej użycia: czy operator zachował filtr wieku i moderację wejścia, jak długo przechowuje zdjęcia i czy oznacza wyniki. Testy prowadzimy na materiałach syntetycznych zgodnie z zasadami odpowiedzialnego użycia; kryteria opisuje Jak oceniamy.
Powiązane narzędzia, które recenzujemy
Forki Stable Diffusion stoją za większością recenzowanych narzędzi. Poniżej recenzje usług, w których omówiliśmy deklarowane modele i filtry bezpieczeństwa.
Źródła
Wpis opiera się na publikacjach naukowych, dokumentacji standardów i tekstach aktów prawnych; daty dostępu podano przy każdym źródle. Redakcja nie linkuje do wag modeli ani dystrybucji oprogramowania i nie udziela porad prawnych.
- Rombach i in., „High-Resolution Image Synthesis with Latent Diffusion Models”, arXiv 2112.10752 (2021/2022) — dostęp 08.09.2026.
- CompVis — repozytorium Stable Diffusion: opis architektury, skryptów i safety checkera (bez pobierania wag) — dostęp 08.09.2026.
- Stability AI — komunikat o publicznym wydaniu Stable Diffusion (22.08.2022) — dostęp 08.09.2026.
- Podell i in., „SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis”, arXiv 2307.01952 (2023) — dostęp 08.09.2026.
- Esser i in., „Scaling Rectified Flow Transformers for High-Resolution Image Synthesis” (Stable Diffusion 3), arXiv 2403.03206 (2024) — dostęp 08.09.2026.
- Schuhmann i in., „LAION-5B: An open large-scale dataset for training next generation image-text models”, arXiv 2210.08402 (2022) — dostęp 08.09.2026.
- Stability AI — licencje modeli i lista zakazanych użyć — dostęp 08.09.2026.
- Rozporządzenie (UE) 2024/1689 (AI Act) — art. 50 i art. 53 (modele ogólnego przeznaczenia), EUR-Lex — dostęp 08.09.2026.
Najczęstsze pytania
Krótkie odpowiedzi redakcji; szczegóły — w źródłach powyżej.
Co to jest Stable Diffusion?
To otwarty model generujący obrazy z tekstu, oparty na dyfuzji latentnej opisanej przez Rombacha i in. Publicznie wydany 22 sierpnia 2022 r. przy wsparciu Stability AI; jego otwarte wagi stały się podstawą tysięcy forków.
Czy Stable Diffusion generuje treści NSFW?
Oficjalne dystrybucje mają filtr bezpieczeństwa, ale w forku można go wyłączyć i dostroić model do treści dla dorosłych. Licencje zakazują takich użyć wobec osób bez zgody i małoletnich, a polskie prawo karze tworzenie intymnego wizerunku bez zgody.
Czy narzędzia undress to Stable Diffusion?
W większości tak — to niepubliczne forki wersji 1.5 lub SDXL z wąskim dostrojeniem. Usługi rzadko to ujawniają, ale cechy wyników na to wskazują. Odpowiedzialność za użycie spoczywa na operatorze i użytkowniku.
Czym różni się SDXL od Stable Diffusion 3?
SDXL (2023) zwiększył rozdzielczość bazową do 1024 px i dodał drugi enkoder tekstu, zachowując U-Net. SD 3 (2024) zastąpił U-Net transformerem dyfuzyjnym i wprowadził flow matching oraz nową licencję.
Czy można używać Stable Diffusion online?
Tak, wiele serwisów udostępnia model w przeglądarce. W recenzjach oceniamy nie sam model, lecz operatora: filtry wieku, moderację, retencję zdjęć i oznaczanie wyników. Serwis nie linkuje do wag ani forków.