Почему свой собственный текст определяется как ИИ — привычки письма, вызывающие ложное срабатывание
Текст написан человеком, а вероятность ИИ высокая — у этого есть причины. Разбираем, какие привычки письма и какие жанры текста провоцируют ложное срабатывание и что стоит подготовить заранее, чтобы не оправдываться впустую.
«Я писал сам, а мне показало 90%».
Эту фразу приходится слышать очень часто. И в большинстве случаев это не враньё. Текст, написанный человеком, действительно регулярно попадает в категорию машинного, и у этого есть вполне понятные структурные причины.
Разберём по порядку: почему так выходит, какие тексты страдают особенно, и что делать, если вас уже заподозрили.
Что детектор на самом деле видит
Сначала одна оговорка. Детектор ИИ не знает происхождения текста. Он смотрит на статистические признаки стиля: насколько предсказуемо разворачивается фраза, насколько велик разброс длины предложений и выбора слов.
Отсюда сразу вытекает проблема. «Предсказуемый и ровный текст» пишет не только ИИ. Так пишет и человек с поставленной рукой. Более того, чем лучше он обучен, тем ровнее у него получается.
Жанры, где ложное срабатывание встречается чаще всего
По опыту, высокая оценка чаще выпадает следующим текстам.
1. Тексты со строгой формой
- отчёт по практике, служебная записка, текст, написанный тезисами
- официальные письма, бизнес-планы, коммерческие предложения
- аннотации к научным статьям по заданному шаблону
Форма диктует структуру предложений, и разброс схлопывается. Чем аккуратнее вы соблюдаете шаблон, тем сильнее эффект. Получается парадокс: текст, точно выдержанный по форме, читается механичнее.
2. Тексты, которые много раз переписывали
Что происходит при многократной правке? Уходят неловкие обороты, длина предложений выравнивается, исчезают опечатки. Это ровно те признаки, по которым узнают машинный стиль.
Так и выходит, что вылизанный текст получает оценку выше, чем написанный наспех. Это самый ироничный поворот во всей теме ложных срабатываний.
3. Тексты, прошедшие через проверку орфографии и грамматики
Современные сервисы правки не ограничиваются опечатками. Они меняют структуру фразы, подменяют неудачные выражения, иногда переписывают предложение целиком. По дороге стираются приметы личного стиля.
4. Переводные тексты
Особенно если вы писали на другом языке и переводили, или просто привыкли к переводным конструкциям. Перевод тянет за собой структуру оригинала, а слова подбирает нейтральные — в итоге текст становится ровным.
5. Короткие тексты
Самая частая причина. В тексте на пару абзацев просто нет статистики. Трёх-четырёх предложений не хватает, чтобы посчитать разброс, и результат сильно скачет. Возможно, вы уже замечали: вставляешь первую половину текста и вторую по отдельности — оценки получаются совершенно разные.
6. Тексты неносителей языка и просто простой стиль
Привычка рубить фразы коротко и держаться базовой лексики сама по себе даёт ровный текст. Это вопрос не способностей, а стиля, но инструмент этих двух вещей не различает.
Ложные срабатывания из-за личных привычек
Помимо жанра, влияют и личные привычки.
| Привычка | Почему провоцирует ложное срабатывание |
|---|---|
| Все предложения примерно одной длины | Разброс исчезает |
| Регулярные связки («кроме того», «таким образом» в начале абзаца) | Ход мысли становится предсказуемым |
| Въевшаяся привычка писать тезисами | Даже связный текст выходит ровным |
| Почти нет эмоций и личных историй | Слабеет сигнал «писал человек» |
| Каждый абзац начинается с вывода | Структура повторяется |
Последние два пункта важнее всего. Чем логичнее человек пишет, тем вероятнее у него эти привычки. Поэтому ложные срабатывания чаще достаются тем, кто пишет хорошо, а не плохо.
Что с этим делать
Пока вас не заподозрили: сохраняйте процесс
Это самое надёжное. По одному готовому файлу доказать ничего нельзя, а если сохранился процесс, вам есть что показать.
- откладывайте черновики отдельно (дату — в имя файла)
- пишите в облачном документе, чтобы осталась история версий
- складывайте ссылки на источники и заметки в один файл
- если набросок плана был от руки — сфотографируйте
История версий в облачном редакторе работает особенно хорошо. Следы того, как текст рос и сокращался в течение нескольких часов, подделать трудно.
Если вас уже заподозрили
- Не спорьте оценками. Прогнать текст через другой сервис и принести низкий балл почти бесполезно. Вы только подтвердите, что у разных инструментов результаты расходятся.
- Покажите процесс. Черновик, история правок, заметки.
- Объясните содержание. Если вы можете рассказать, почему этот фрагмент написан именно так, вопрос обычно снимается. На практике это и есть та проверка, которой доверяют больше всего.
- Не реагируйте на эмоциях. Обидно — понятно, но проверяющая сторона чаще всего просто следует процедуре.
Если хочется проверить себя до сдачи
Прогнать текст через детектор ИИ перед сдачей — это не попытка обойти проверку, а прогноз. Заранее зная, какие абзацы читаются машинно, вы понимаете, что придётся объяснять, если спросят.
Оговорка одна. Не гонитесь за снижением оценки. Если насильно уродовать отмеченные фразы, качество текста падает, и вы проиграете там, где оценка действительно важна. Достаточно открыть отмеченные фрагменты и спросить себя: «есть ли здесь моя мысль и конкретные факты?» Если пусто — дополните, если есть, а фрагмент всё равно отмечен, оставьте как есть.
Напоследок
Результат проверки — это не приговор, а ориентировочная вероятность ИИ. Ни один инструмент не докажет, что «этот текст написал ИИ», и принимать решения о человеке по одной цифре опасно. Считаю, что придерживаться этого должны и те, кто такие инструменты делает.
Частые вопросы на эту тему собраны в разделе FAQ.