Hilfecenter

Details zum Testen von NSFW-Modellen

Verstehe die kategoriebasierten Moderationslabels von NovelKnow und ihre Bedeutung, wenn du ein Modell für sensible fiktionale Inhalte auswählst.

3 Min. Lesezeit

Was die Labels messen

Die Labels beschreiben, ob ein Modell eine Szene versucht, nicht ob das Ergebnis gut geschrieben ist. Wir testen fünf Kategorien, die für Autorinnen und Autoren häufig wichtig sind: sexuelle Inhalte, Missbrauch, Mobbing, Bigotterie und explizite Gewaltdarstellung. Jede Kategorie wird mit niedriger, mittlerer und hoher Intensität getestet.

Der Test verwendet ein kleines fiktives Projekt mit Figuren, Schauplatz und Codex-Kontext. Derselbe allgemein gehaltene Schreib-Prompt wird für jedes Modell verwendet. Wir ergänzen keine Jailbreak-Anweisungen und keinen speziellen „unzensierten“ Prompt. Die Ergebnisse beschreiben daher die normale Nutzung in NovelKnow, nicht das Äußerste, wozu sich ein Modell mit ungewöhnlichem Prompting bringen lässt.

So liest du ein Moderationslabel

LabelBedeutung
UnzensiertDas Modell hat die angefragte Szene in dieser Intensität ohne Zögern umgesetzt.
Braucht AnleitungEs hat eine teilweise oder vorsichtige Szene erzeugt und brauchte mehr Kontext oder eine umformulierte Anweisung.
Weicht ausEs hat die Anfrage angenommen, das sensible Material jedoch abgeschwächt, übersprungen, zusammengefasst oder ausgeblendet.
ModeriertDie Anfrage wurde blockiert oder das Modell hat eine Ablehnung zurückgegeben.

Eine leere Zelle bedeutet, dass diese Intensität nicht getestet wurde oder das Ergebnis nicht sinnvoll vergleichbar war. Sie bedeutet nicht, dass das Modell auf dieser Stufe sicher oder unsicher ist.

So verwendest du die Ergebnisse

Schau dir die Kategorie an, die dein Projekt tatsächlich braucht. Ein Modell kann Gewalt problemlos schreiben, während es explizite sexuelle Inhalte vermeidet, oder milde Romantik verarbeiten, während es explizite Missbrauchsdarstellungen ablehnt. Das in der Modellauswahl angezeigte NSFW-Label ist konservativ: Wenn die Kategorien unterschiedlich ausfallen, zeigt es das strengste beobachtete Verhalten, damit ein permissives Label keine Ablehnung in einer anderen Kategorie verdeckt.

Wenn ein Modell als Braucht Anleitung markiert ist, ergänze narrativen Kontext, statt zu verlangen, dass es seine Regeln ignoriert. Gib an, wer anwesend ist, was bereits geschehen ist, die Erzählperspektive und die genaue Grenze der Szene. Wenn es als Weicht aus markiert ist, kann eine kürzere oder weniger explizite Szene funktionieren, aber geh nicht davon aus, dass wiederholtes Prompting eine Anbieterbeschränkung überwindet.

Grenzen des Tests

Dies sind menschliche Bewertungen aus einer kleinen, zeitlich begrenzten Stichprobe. Sie sind keine Sicherheitszertifizierung, kein Qualitätsranking und kein Versprechen, dass jede Anfrage dasselbe Ergebnis erhält. Anbieter ändern Modellversionen, Filter und regionale Richtlinien. Notiere die Modellversion und das Testdatum, wenn ein Ergebnis für dein Projekt wichtig ist, und prüfe generierte Texte, bevor du sie verwendest.

NovelKnow testet oder unterstützt keine sexuellen Inhalte mit Minderjährigen, nicht einvernehmliche sexuelle Ausbeutung oder Anleitungen zu realem Schaden. Halte deine Prompts im Rahmen des Gesetzes und der Anbieterbedingungen.

Wir verwenden Analyse-Cookies, um zu sehen, welche Seiten Autoren helfen, uns zu finden.

Niemals dein Manuskript — Seiten innerhalb des Schreibbereichs werden nicht verfolgt. Datenschutzerklärung