Słownik · Techniki · Aktualizacja: 08.09.2026

Stable Diffusion: otwarty model i forki

Stable Diffusion to otwarty model dyfuzji latentnej wydany w 2022 r. Wyjaśniamy architekturę, wersje, licencje i dlaczego jego forki napędzają narzędzia undress.

TechnologiaHasło słownikaAktualizacja: 08.09.2026
Definicja

Stable Diffusion co to — definicja i architektura

Stable Diffusion to rodzina otwartych modeli generujących obrazy z tekstu, oparta na architekturze dyfuzji latentnej z pracy Rombacha i in. (CompVis, LMU Monachium) i wydana publicznie w sierpniu 2022 r. przy wsparciu Stability AI. Otwarte wagi i kod sprawiły, że model stał się podstawą tysięcy forków — od edytorów SFW po wyspecjalizowane narzędzia nudify.

ParametrWartość · źródło (data dostępu)
Rodzajotwarty model text-to-image (dyfuzja latentna, U-Net + autoenkoder + enkoder tekstu) · Rombach i in., 2022
Zastosowaniegenerowanie z tekstu, img2img, inpainting, baza dla adapterów LoRA i modeli specjalistycznych · repozytorium CompVis
Ryzykootwarte wagi umożliwiają usunięcie filtrów i dostrojenie do treści NSFW z wizerunkiem osób · AI Act art. 50, 53
Standard / organizacjaCompVis (LMU), Stability AI, Runway; dane treningowe LAION-5B; licencje CreativeML OpenRAIL-M i Stability AI · stability.ai/license
Wersje1.x (2022), 2.x (2022), SDXL (2023), SD 3 (2024) · arXiv 2403.03206
Rokgrudzień 2021 — publikacja LDM; 22.08.2022 — publiczne wydanie; 2023 — SDXL; 2024 — SD 3 · Stability AI, 2022

Stan na 08.09.2026. Wpis ma charakter informacyjny i nie zawiera instrukcji użycia narzędzi; to nie jest porada prawna.

Rodzaj

Model dyfuzji latentnej — odszumianie w skompresowanej przestrzeni, dekodowanie do pikseli; działa na kartach konsumenckich.

Zastosowanie

Fundament ekosystemu — interfejsy graficzne, adaptery, modele branżowe; także większość silników undress AI.

Ryzyko

Otwartość bez kontroli — filtr bezpieczeństwa i znak wodny można wyłączyć w forku; odpowiedzialność przenosi się na operatora.

Standard / organizacja

Licencje użycia — OpenRAIL-M i licencja Stability AI zakazują treści seksualnych bez zgody i z małoletnimi.

Rok

2022 — publiczne wydanie zmieniło rynek generatorów; 2024 — SD 3 na transformerze dyfuzyjnym.

Jak zbudowany jest Stable Diffusion

Model składa się z trzech części: autoenkodera (VAE), który kompresuje obraz do przestrzeni latentnej o kilkadziesiąt razy mniejszym wymiarze, sieci odszumiającej U-Net działającej w tej przestrzeni oraz enkodera tekstu, który zamienia opis na wektory sterujące przez mechanizm uwagi (Rombach i in., 2022). Zasadę dyfuzji opisuje osobne hasło.

Dzięki pracy w przestrzeni latentnej generowanie obrazu 512×512 px trwa sekundy na karcie graficznej klasy konsumenckiej. Repozytorium CompVis dokumentuje architekturę, skrypty text-to-image, img2img i inpaintingu oraz moduł safety checker (github.com/CompVis/stable-diffusion).

Model trenowano na podzbiorach LAION-5B — zbioru par obraz–opis zebranych z internetu, z filtrowaniem estetycznym i NSFW opisanym przez autorów (Schuhmann i in., 2022). Skład danych jest źródłem sporów o prawa autorskie i obecność treści niepożądanych.

Wersje: od 1.4 przez SDXL do SD 3

Publiczne wydanie wersji 1.4 nastąpiło 22 sierpnia 2022 r. (Stability AI). Wersje 2.x z końca 2022 r. zmieniły enkoder tekstu i zaostrzyły filtrowanie danych treningowych, co społeczność odebrała jako spadek jakości postaci — i przyczyniło się do popularności forków 1.5.

SDXL z lipca 2023 r. zwiększył rozdzielczość bazową do 1024 px i dodał drugi enkoder tekstu (Podell i in., 2023). Stable Diffusion 3 z 2024 r. zastąpił U-Net transformerem dyfuzyjnym i wprowadził flow matching (Esser i in., 2024) — podobnie jak konkurencyjny FLUX.

Wraz z SD 3 zmieniła się licencja: model wydano na licencji Stability AI Community, która ogranicza użycie komercyjne powyżej progu przychodów i zakazuje zastosowań naruszających prawo (stability.ai/license). Wersje 1.x/2.x pozostają na CreativeML OpenRAIL-M z listą zakazanych użyć.

Stable Diffusion NSFW — filtry, forki i licencje

Oficjalne dystrybucje zawierają safety checker — klasyfikator odrzucający wyniki NSFW — oraz niewidoczny znak wodny. W forku oba moduły da się wyłączyć, a model dostroić adapterem LoRA do treści dla dorosłych. Tak powstaje większość silników narzędzi nudify: niepubliczny fork na bazie wersji 1.5 lub SDXL.

Licencje OpenRAIL-M i Stability AI wprost zakazują generowania treści seksualnych bez zgody przedstawianych osób oraz jakichkolwiek treści z udziałem małoletnich (stability.ai). Naruszenie licencji jest sprawą cywilną między operatorem a licencjodawcą; odpowiedzialność karna za art. 191a KK spoczywa na osobie, która tworzy lub rozpowszechnia wizerunek (ISAP).

AI Act traktuje modele tej klasy jako modele ogólnego przeznaczenia (art. 53) z obowiązkami dokumentacji i przejrzystości, a operatorów usług — obowiązkiem oznaczania wyników z art. 50 od 2 sierpnia 2026 r. (EUR-Lex). Serwis nie linkuje do wag ani forków; hasło ma charakter informacyjny.

Stable Diffusion online w recenzowanych narzędziach

Większość usług w przeglądarce, które recenzujemy, nie ujawnia modelu, ale cechy wyników — rozdzielczość bazowa, typowe artefakty dłoni, styl oświetlenia — wskazują na forki SD 1.5 lub SDXL z wąskim dostrojeniem. Platformy wielomodelowe, jak WaveSpeed, wymieniają model w interfejsie.

W recenzjach oceniamy nie architekturę, lecz sposób jej użycia: czy operator zachował filtr wieku i moderację wejścia, jak długo przechowuje zdjęcia i czy oznacza wyniki. Testy prowadzimy na materiałach syntetycznych zgodnie z zasadami odpowiedzialnego użycia; kryteria opisuje Jak oceniamy.

Powiązane narzędzia, które recenzujemy

Forki Stable Diffusion stoją za większością recenzowanych narzędzi. Poniżej recenzje usług, w których omówiliśmy deklarowane modele i filtry bezpieczeństwa.

  • Ainudez — recenzja z obserwacjami dotyczącymi modelu i moderacji.
  • WaveSpeed — platforma wielomodelowa z wyborem silnika.
  • OpenArt — narzędzie SFW — zmiana ubrań, nie rozbieranie; edytor na modelach otwartych.
FAQ

Najczęstsze pytania

Krótkie odpowiedzi redakcji; szczegóły — w źródłach powyżej.

Co to jest Stable Diffusion?

To otwarty model generujący obrazy z tekstu, oparty na dyfuzji latentnej opisanej przez Rombacha i in. Publicznie wydany 22 sierpnia 2022 r. przy wsparciu Stability AI; jego otwarte wagi stały się podstawą tysięcy forków.

Czy Stable Diffusion generuje treści NSFW?

Oficjalne dystrybucje mają filtr bezpieczeństwa, ale w forku można go wyłączyć i dostroić model do treści dla dorosłych. Licencje zakazują takich użyć wobec osób bez zgody i małoletnich, a polskie prawo karze tworzenie intymnego wizerunku bez zgody.

Czy narzędzia undress to Stable Diffusion?

W większości tak — to niepubliczne forki wersji 1.5 lub SDXL z wąskim dostrojeniem. Usługi rzadko to ujawniają, ale cechy wyników na to wskazują. Odpowiedzialność za użycie spoczywa na operatorze i użytkowniku.

Czym różni się SDXL od Stable Diffusion 3?

SDXL (2023) zwiększył rozdzielczość bazową do 1024 px i dodał drugi enkoder tekstu, zachowując U-Net. SD 3 (2024) zastąpił U-Net transformerem dyfuzyjnym i wprowadził flow matching oraz nową licencję.

Czy można używać Stable Diffusion online?

Tak, wiele serwisów udostępnia model w przeglądarce. W recenzjach oceniamy nie sam model, lecz operatora: filtry wieku, moderację, retencję zdjęć i oznaczanie wyników. Serwis nie linkuje do wag ani forków.