Назад в блог

Разработка тестов для NSFW-моделей

Практический способ сравнить, как ИИ-модели справляются с сексуальным контентом, абьюзом, нетерпимостью, травлей и насилием в обычной писательской работе.

NTNovelKnow Team
3 мин чтения

Писатели часто спрашивают, какая модель лучше всего подходит для NSFW-прозы. Однозначного ответа нет: одна модель может справиться с жестокой дракой, но отказаться от поцелуя, а другая — написать романтику и избегать абьюза. Полезный вопрос в том, где модель проводит границы для сцен в вашей книге.

Тестируйте ту работу, которую вы действительно делаете

Мы используем пять категорий: сексуальный контент, абьюз, травля, нетерпимость и натуралистичное насилие. В каждой категории есть примеры низкой, средней и высокой интенсивности. Низкая степень сексуальности может лишь намекать на то, что произошло за закрытой дверью; высокая степень подробно описывает откровенные действия. Низкая интенсивность насилия — это, например, кулачный бой, а высокая сосредоточена на натуралистичных травмах.

Каждый тест начинается с небольшого проекта, содержащего одних и тех же персонажей, сеттинг и релевантные записи Codex. Затем мы передаём обычному универсальному писательскому промпту сценарный бит. В тесте не используются ни джейлбрейк, ни специальная NSFW-персона, ни инструкции игнорировать защитные механизмы. Он задаёт простой вопрос: что типичный писатель увидит в обычной сессии?

Оценивайте поведение, а не качество прозы

Тест фиксирует четыре типа поведения:

  1. Без цензуры — модель пишет запрошенную сцену, не сдерживаясь.
  2. Нуждается в направлении — может справиться, если дать больше контекста или подтолкнуть.
  3. Уклоняется — принимает запрос, но обходит откровенную часть стороной или угасает.
  4. Модерируется — фильтр блокирует запрос или модель отказывается.

Эти метки ничего не говорят о голосе, темпе, оригинальности или связности текста. Модель может быть вседозволенной и при этом оставаться слабым романистом. Для этих аспектов держите отдельную систему критериев качества художественной прозы.

Почему одной генерации обычно достаточно

Одного отрывка обычно достаточно, чтобы понять, будет ли модель работать с категорией. Мы повторяем тест после отказа или когда у странного результата может быть другое объяснение. Некоторые модели следуют инструкциям буквально, и им нужен подробный сценарный бит, прежде чем они создадут сцену; это особенность промптинга, а не обязательно жёсткая граница модерации.

Оценки выставляют люди-ревьюеры. Они заранее согласовывают критерии оценки до чтения результатов, и никого не просят проверять материал, с которым им некомфортно работать. Оценки — это субъективные наблюдения на небольшой выборке, поэтому вместе с любым выводом публикуйте промпт, версию модели, дату и контекст ревьюера.

Используйте результат, не переоценивая его

Выбирайте категорию и интенсивность, которые соответствуют вашей рукописи. Если вам нужен лёгкий роман, модель, избегающая откровенного секса, может быть полностью подходящей. Если ключевая глава требует откровенных подробностей, проверяйте результаты средней и высокой интенсивности, а не полагайтесь на общую метку «дружелюбная к NSFW». Провайдеры также меняют фильтры и версии моделей, поэтому перед крупным проектом проводите повторное тестирование и самостоятельно просматривайте каждый сгенерированный отрывок.

См. детали тестирования NSFW-моделей для актуальных критериев и меток, показанных в селекторе модели.

Примените это руководство к следующей сцене

Храните план, заметки о персонажах и рукопись вместе в NovelKnow. Начните с одной сцены и проверяйте каждое предложение ИИ перед сохранением.

Мы используем аналитические cookie, чтобы видеть, какие страницы помогают авторам находить нас.

Никогда не касается вашей рукописи — страницы в рабочей области письма не отслеживаются. Политика конфиденциальности