Разработка тестов для NSFW-моделей
Практический способ сравнить, как ИИ-модели справляются с сексуальным контентом, абьюзом, нетерпимостью, травлей и насилием в обычной писательской работе.
Писатели часто спрашивают, какая модель лучше всего подходит для NSFW-прозы. Однозначного ответа нет: одна модель может справиться с жестокой дракой, но отказаться от поцелуя, а другая — написать романтику и избегать абьюза. Полезный вопрос в том, где модель проводит границы для сцен в вашей книге.
Тестируйте ту работу, которую вы действительно делаете
Мы используем пять категорий: сексуальный контент, абьюз, травля, нетерпимость и натуралистичное насилие. В каждой категории есть примеры низкой, средней и высокой интенсивности. Низкая степень сексуальности может лишь намекать на то, что произошло за закрытой дверью; высокая степень подробно описывает откровенные действия. Низкая интенсивность насилия — это, например, кулачный бой, а высокая сосредоточена на натуралистичных травмах.
Каждый тест начинается с небольшого проекта, содержащего одних и тех же персонажей, сеттинг и релевантные записи Codex. Затем мы передаём обычному универсальному писательскому промпту сценарный бит. В тесте не используются ни джейлбрейк, ни специальная NSFW-персона, ни инструкции игнорировать защитные механизмы. Он задаёт простой вопрос: что типичный писатель увидит в обычной сессии?
Оценивайте поведение, а не качество прозы
Тест фиксирует четыре типа поведения:
- Без цензуры — модель пишет запрошенную сцену, не сдерживаясь.
- Нуждается в направлении — может справиться, если дать больше контекста или подтолкнуть.
- Уклоняется — принимает запрос, но обходит откровенную часть стороной или угасает.
- Модерируется — фильтр блокирует запрос или модель отказывается.
Эти метки ничего не говорят о голосе, темпе, оригинальности или связности текста. Модель может быть вседозволенной и при этом оставаться слабым романистом. Для этих аспектов держите отдельную систему критериев качества художественной прозы.
Почему одной генерации обычно достаточно
Одного отрывка обычно достаточно, чтобы понять, будет ли модель работать с категорией. Мы повторяем тест после отказа или когда у странного результата может быть другое объяснение. Некоторые модели следуют инструкциям буквально, и им нужен подробный сценарный бит, прежде чем они создадут сцену; это особенность промптинга, а не обязательно жёсткая граница модерации.
Оценки выставляют люди-ревьюеры. Они заранее согласовывают критерии оценки до чтения результатов, и никого не просят проверять материал, с которым им некомфортно работать. Оценки — это субъективные наблюдения на небольшой выборке, поэтому вместе с любым выводом публикуйте промпт, версию модели, дату и контекст ревьюера.
Используйте результат, не переоценивая его
Выбирайте категорию и интенсивность, которые соответствуют вашей рукописи. Если вам нужен лёгкий роман, модель, избегающая откровенного секса, может быть полностью подходящей. Если ключевая глава требует откровенных подробностей, проверяйте результаты средней и высокой интенсивности, а не полагайтесь на общую метку «дружелюбная к NSFW». Провайдеры также меняют фильтры и версии моделей, поэтому перед крупным проектом проводите повторное тестирование и самостоятельно просматривайте каждый сгенерированный отрывок.
См. детали тестирования NSFW-моделей для актуальных критериев и меток, показанных в селекторе модели.
Примените это руководство к следующей сцене
Храните план, заметки о персонажах и рукопись вместе в NovelKnow. Начните с одной сцены и проверяйте каждое предложение ИИ перед сохранением.