Słownik · Pochodzenie i bezpieczeństwo · Aktualizacja: 08.09.2026

Klasyfikator NSFW: detekcja treści 18+

Klasyfikator NSFW to model oceniający, czy obraz zawiera treści dla dorosłych. Wyjaśniamy, jak działa filtr NSFW, gdzie jest stosowany i jakie ma ograniczenia.

BezpieczeństwoHasło słownikaAktualizacja: 08.09.2026
Definicja

Czym jest klasyfikator NSFW i jak działa detekcja nsfw

Klasyfikator NSFW to model uczenia maszynowego, który przypisuje obrazowi (rzadziej tekstowi lub wideo) prawdopodobieństwo należenia do kategorii treści nieodpowiednich — nagości, aktów seksualnych, przemocy. Stosują go wyszukiwarki, platformy społecznościowe, sklepy z aplikacjami i generatory obrazów, w tym safety checker w oficjalnych dystrybucjach Stable Diffusion.

ParametrWartość · źródło (data dostępu)
Rodzajmodel klasyfikacyjny (CNN lub klasyfikator na osadzeniach CLIP) · Radford i in., 2021
Zastosowaniemoderacja platform, SafeSearch, filtry wyjścia generatorów, ochrona małoletnich w systemach mobilnych · Google Cloud Vision
Ryzykofałszywe alarmy (sztuka, medycyna) i przepuszczenia; łatwe wyłączenie w forkach modeli otwartych · LAION-5B, 2022
Standard / organizacjaDSA art. 28 i 34 (ryzyka systemowe), AI Act; brak jednej normy technicznej · EUR-Lex
PrzykładyGoogle SafeSearch, Cloud Vision SafeSearch, Apple Sensitive Content Analysis (iOS 17, 2023) · developer.apple.com
Rok2016 — otwarte klasyfikatory CNN; 2021 — CLIP; 2022 — safety checker w Stable Diffusion; 2023 — filtr systemowy w iOS · CompVis

Stan na 08.09.2026. Wpis ma charakter informacyjny i nie zawiera instrukcji użycia narzędzi; to nie jest porada prawna.

Rodzaj

Klasyfikator binarny lub wieloklasowy — zwraca prawdopodobieństwo dla etykiet takich jak nagość, treści seksualne, przemoc.

Zastosowanie

Filtr wejścia i wyjścia — blokuje niepożądane zdjęcia przed przetworzeniem i wyniki po wygenerowaniu.

Ryzyko

Błędy w obie strony — blokuje sztukę i medycynę, przepuszcza treści w nietypowym kontekście; nie ocenia zgody ani wieku.

Standard / organizacja

DSA, AI Act, sklepy z aplikacjami — obowiązek ograniczania ryzyk i zakaz treści seksualnych w Google Play i App Store.

Rok

2021 — CLIP umożliwił tanie klasyfikatory na osadzeniach; 2022 — filtry w otwartych generatorach.

Jak działa filtr NSFW — od CNN do CLIP

Pierwsza generacja klasyfikatorów to sieci konwolucyjne trenowane na zbiorach oznaczonych ręcznie: obraz → prawdopodobieństwo „NSFW”. Działają szybko i lokalnie, ale słabo generalizują na nowe style, np. grafikę syntetyczną, i wymagają dużych, kontrowersyjnych zbiorów treningowych.

Druga generacja korzysta z modeli językowo-wizualnych. CLIP z 2021 r. mapuje obrazy i teksty do wspólnej przestrzeni osadzeń (Radford i in., 2021); klasyfikator NSFW to wtedy mały model na tych osadzeniach lub porównanie z opisami kategorii. Tak filtrowano zbiór LAION-5B (Schuhmann i in., 2022) i tak działa safety checker w Stable Diffusion (CompVis).

Wynik to liczba z zakresu 0–1 porównywana z progiem. Niski próg blokuje więcej (także sztukę i zdjęcia medyczne), wysoki przepuszcza treści graniczne. Operator dobiera próg do kontekstu — inaczej wyszukiwarka, inaczej generator obrazów. Definicję samej kategorii omawia hasło NSFW.

Gdzie stosuje się nsfw detector

Wyszukiwarki: Google SafeSearch filtruje treści jawnie seksualne w wynikach i domyślnie rozmywa obrazy (support.google.com); mechanizm i jego wpływ na widoczność opisuje hasło SafeSearch. Ten sam typ modelu udostępnia deweloperom Cloud Vision z kategoriami adult, racy, violence (Google Cloud).

Systemy mobilne: Apple udostępnia od iOS 17 (2023) framework Sensitive Content Analysis, który wykrywa nagość lokalnie na urządzeniu bez wysyłania zdjęć do chmury (developer.apple.com). Sklepy z aplikacjami: Google Play zakazuje aplikacji z treściami seksualnymi (polityka Google Play), więc narzędzia undress dystrybuowane są przez przeglądarkę lub pliki APK.

Generatory obrazów: filtr działa dwukrotnie — na zdjęciu wejściowym (odrzucenie treści niepożądanych i, w dobrych implementacjach, osób wyglądających na małoletnie) oraz na wyniku. W forkach modeli otwartych oba filtry można wyłączyć, co jest podstawą działania większości usług nudify.

Ograniczenia: czego klasyfikator NSFW nie widzi

Klasyfikator ocenia treść, nie kontekst: nie wie, czy osoba na zdjęciu wyraziła zgodę ani czy zdjęcie jest autentyczne. Nie zastępuje więc weryfikacji wieku użytkownika ani oceny wieku osoby na zdjęciu — do tego potrzebne są osobne modele estymacji wieku, również obciążone błędem.

Fałszywe alarmy dotykają sztuki, fotografii medycznej, karmienia piersią i strojów kąpielowych; przepuszczenia — treści w nietypowym stylu graficznym lub częściowo zasłoniętych. Modele trenowane głównie na fotografiach gorzej radzą sobie z obrazami syntetycznymi, których jest coraz więcej.

Art. 34 DSA wymaga od bardzo dużych platform oceny ryzyk systemowych, a art. 28 — ochrony małoletnich (EUR-Lex); klasyfikatory są głównym narzędziem realizacji tych obowiązków, ale regulator ocenia skuteczność procesu, nie sam model. AI Act dodaje obowiązki przejrzystości dla treści syntetycznych (EUR-Lex).

Filtr NSFW w recenzowanych narzędziach

W kryterium prywatności i bezpieczeństwa odnotowujemy, czy usługa deklaruje moderację wejścia, czy odrzuca zdjęcia z widocznymi cechami małoletności i czy filtruje twarze osób publicznych. Nie testujemy filtrów na zdjęciach osób trzecich — używamy materiałów syntetycznych zgodnie z zasadami odpowiedzialnego użycia.

Narzędzia SFW, takie jak OpenArt, stosują filtr wyjścia blokujący nagość — dlatego zmieniają ubrania, ale ich nie usuwają. Przegląd tej kategorii zawiera hasło SFW, a kryteria oceny — strona Jak oceniamy.

Powiązane narzędzia, które recenzujemy

Obecność i jakość filtrów wejścia to jedno z kluczowych kryteriów bezpieczeństwa. Poniżej recenzje, w których opisaliśmy moderację i filtry.

  • Ainudez — recenzja z opisem moderacji wejścia i filtrów wieku.
  • OpenArt — narzędzie SFW — zmiana ubrań, nie rozbieranie; filtr wyjścia blokujący nagość.
  • Yollo.ai — narzędzie SFW — zmiana ubrań, nie rozbieranie; edytor z filtrem treści.
FAQ

Najczęstsze pytania

Krótkie odpowiedzi redakcji; szczegóły — w źródłach powyżej.

Co to jest klasyfikator NSFW?

To model uczenia maszynowego, który ocenia, z jakim prawdopodobieństwem obraz zawiera nagość, treści seksualne lub przemoc. Wynik porównuje się z progiem; operator dobiera próg do kontekstu — wyszukiwarki, platformy lub generatora.

Jak działa filtr NSFW w generatorach obrazów?

Zwykle dwukrotnie: sprawdza zdjęcie wejściowe i wygenerowany wynik. W oficjalnych dystrybucjach Stable Diffusion robi to safety checker na osadzeniach CLIP. W forkach filtr można wyłączyć — tak działa większość usług nudify.

Czy klasyfikator NSFW rozpoznaje wiek osoby?

Nie. Ocenia treść, nie tożsamość ani wiek. Do oceny wieku potrzebne są osobne modele estymacji, również obciążone błędem. Dlatego pytamy narzędzia o odrębny filtr wieku, a nie tylko o filtr NSFW.

Dlaczego filtr NSFW blokuje sztukę lub zdjęcia medyczne?

Bo model widzi nagość, nie kontekst. Niski próg zwiększa fałszywe alarmy wobec aktów, fotografii medycznej czy strojów kąpielowych; wysoki próg przepuszcza treści graniczne. To kompromis, który ustala operator.

Czy SafeSearch to klasyfikator NSFW?

Tak — Google używa klasyfikatorów do wykrywania treści jawnie seksualnych i domyślnie je filtruje lub rozmywa. Ten sam typ modelu jest dostępny dla deweloperów w Cloud Vision z kategoriami adult, racy i violence.