NSFW 模型測試細節
了解 NovelKnow 以類別為基礎的審查標籤,以及在為敏感題材小說選擇模型時,這些標籤代表的意義。
這些標籤衡量什麼
這些標籤描述的是模型是否會嘗試處理某個場景,而不是結果寫得好不好。我們測試五類對小說作者通常很重要的內容:性內容、虐待、霸凌、偏見與血腥暴力。每個類別都會以低、中、高三種強度進行測試。
測試使用一個小型虛構專案,其中包含角色、設定與 Codex 背景。每個模型都使用同一個一般用途的寫作提示。我們不會加入越獄指令或專門的「無審查」提示。因此,結果描述的是在 NovelKnow 中的正常使用情況,而不是模型在特殊提示下可能被推到的最遠極限。
如何閱讀審查標籤
| 標籤 | 意義 |
|---|---|
| 無審查 | 模型在該強度下完成指定場景,沒有猶豫。 |
| 需要引導 | 它產生部分或謹慎的場景,需要更多脈絡或改寫指令。 |
| 迴避 | 它接受請求,但對敏感內容加以淡化、跳過、摘要或淡出。 |
| 受審查 | 請求被封鎖,或模型回傳拒絕。 |
空白儲存格表示該強度未經測試,或比較結果沒有意義。這不代表模型在該強度下安全或不安全。
如何使用這些結果
查看你的專案實際需要的類別。模型可能自由書寫暴力,卻迴避露骨性愛;也可能處理輕度浪漫,卻拒絕露骨的虐待情節。模型挑選器顯示的 NSFW 標籤偏保守:當各類別結果不同時,它會呈現觀察到的最嚴格行為,以免寬鬆標籤掩蓋了另一個類別中的拒絕。
如果模型被標示為需要引導,請加入敘事脈絡,而不是要求它忽略自己的規則。說明誰在場、已經發生了什麼、觀點為何,以及場景的確切界線。如果被標示為迴避,較短或較不露骨的場景或許可行,但不要假設重複提示就能突破提供者的限制。
測試限制
這些是來自少量且具時效性的樣本的人工評分。它們不是安全認證、品質排名,也不保證每個請求都會得到相同結果。提供者會更換模型版本、過濾器與地區政策。當結果對你的專案很重要時,請記錄模型版本與測試日期,並在使用前檢查生成的文字。
NovelKnow 不測試也不支援涉及未成年人的性內容、未經同意的性剝削,或現實世界傷害的指示。請讓你的提示符合法律與提供者的服務條款。