ИИ-детектор vs Копирайтер: на чьей стороне правда
Из интересного: вбил в ГПТ два запроса: «700 символов про то, как важно отличать ИИ-контент от авторского» и «700 символов про то, почему детекторы ИИ определяют авторские тексты как сгенерированный контент». Результаты на скринах.
Для сравнения проверил введение, которое вы уже прочитали выше. Каков результат?

Какие тексты получают «черную метку»?


И создатели самих нейросетей, и разработчики сервисов по распознаванию AI-контента не слишком много рассказывают о том, почему детекторы определяют текст, написанный человеком, как сгенерированный искусственным интеллектом. Наиболее подробный ответ дает администрация Text.ru (см. скриншот ниже).
Похоже на правду. Вобьем на проверку текст явно невысокого качества. Результат — детектор уверенно маркирует его как ИИшницу.
Итак, если копирайтер льет воду, оперирует обобщенными формулировками, злоупотребляет устоявшимися выражениями и канцеляризмами, его творение, скорее всего, отнесут к AI-контенту. То же самое касается текстов, в которых смысл скачет, как бешеный заяц на минном поле, а метафоры заставляют читателя задуматься, под какими веществами это вообще было писано.
Видите? Я тоже грешу такими оборотами! Но у меня просто такая фантазия, я не робот, честно-честно.
Интересно, что выдать «черную метку» детектор может как сухому, скучному тексту, так и стилистическому шедевру. Последнее, конечно, зависит от конкретной программы, и чтобы не быть голословным, прикрепляю скрин проверки небольшого фрагмента по GPTzero.

Полагаю, шедевр Михаила Александровича в представлении не нуждается :)

И закон «О центре Сколково», где, напротив, официальщина в каждом символе, а канцеляризм на канцеляризме сидит и им же погоняет, тоже признан ИИшницей.

Законы пишут роботы!

И вполне приличные тексты могут быть заклеймены таким же образом. Более того: результат, выдаваемый детекторами, нестабилен. Просто сравните два скрина ниже: разница между их созданием — около 10 минут. Содержание идентично вплоть до запятой.

Все хорошо, писал человек, ИИ только рядом покуривал…

Ахтунг, алярм, я передумал! Это все написано роботом, а не кожаным мешком!111


Итак, программа может признать текст, созданный вручную, творением нейронки, если в нем:
  • много штампов, расхожих выражений, популярных оборотов;
  • отсутствует выраженная связь между абзацами;
  • есть «взаимоисключающие параграфы»;
  • встречаются ключевые фразы, особенно высокочастотные и среднечастотные;
  • нет конкретики (да, все вот эти «молодые, динамично развивающиеся компании» будут расценены как AI-мусор).
А также детектор с большой вероятностью зарубит статью, если в ней часто встречаются списки, ярко выраженные рекламные приемы, разговорные выражения и Бог знает что еще. А если программа англоязычная, русские тексты будут переведены на английский тем же онлайн-переводчиком, из-за чего шансы на некорректный результат тоже возрастают.

Что делать, если текст, написанный человеком, определяется как шедевр нейросети?

Копирайтеру
Выдохните и постарайтесь не нервничать: метка «80…100% сгенерировано ИИ» — еще не приговор. Сделайте перерыв хотя бы на 10-15 минут, а затем перечитайте свой текст. Скорее всего, вы увидите, от каких недочетов стоит его почистить — например, убрать слова-паразиты, исправить тавтологию, перефразировать сложные фразы.
Если после вычитки и корректировки статья все равно определяется как сгенерированная, попробуйте:
  • проверить ее не одним, а несколькими детекторами — например, когда один сервис выдает большой показатель, а другие показывают, что текст вполне себе человеческий, возможно, проблема не в нем, а в первой программе;
  • перестроить структуру — убрать лишние списки, чередовать длинные предложения с короткими, оптимизировать размер абзацев, добавить таблицы или другие формы контента;
  • добавить конкретики — например, если заказчик просит указать в тексте об услуге шиномонтажа, что мастера имеют большой опыт, уточните, какой именно стаж у сотрудников, и укажите в статье конкретную цифру.
В конце концов, если вы видите, что текст получился объективно качественным, полезным и эффективным, но детектор упорно маркирует его как AI-контент, свяжитесь с заказчиком и объясните ситуацию. В качестве доказательства, что вы реально писали все сами, а не пытаетесь схитрить, можно предоставить доступ к Гугл-документу. И да, работать со статьей, от сбора информации до редактирования, тоже нужно в этом же сервисе. Дело в том, что в нем есть функция просмотра версий, по которой видно, как менялся текст. Логично, что если строчки появлялись постепенно, в отдельные фрагменты вносились изменения, это значит, что автор работал честно. Едва ли кто-то станет генерировать статью, а затем переносить ее в Гугл-документ вручную — какой тогда вообще смысл от нейросети, если она даже не помогает экономить время? :)

SEO-специалисту
Если тексты, которые вам сдают ваши копирайтеры, объективно хороши, но ИИ-детектор маркирует их как сгенерированные, вы можете:
  1. Пересмотреть структуру и принципы формирования ТЗ. Обилие однотипных ключей, требования подгонять технические показатели по нескольким сервисам, завышенный объем на простые темы — все это может стать поводом для «черной метки». Предоставляйте копирайтеру максимум информации: это касается не только продвигаемых товаров и услуг, но и того, куда пойдет контент, требований к Tone of Voice и других моментов.
  2. Забить и публиковать контент как есть. Ну а что, если он выполняет свои задачи и не банится поисковиками, какая разница, что говорит программа, которую еще неизвестно кто создал? :)
P.S. А хотите теорию заговора? Некоторые детекторы точно созданы коварными копирайтерами. Схема вот какая:
  1. Создаем программу, которую распиариваем как самый строгий, самый современный детектор AI-контента, который невозможно обмануть.
  2. Прописываем в коде ПО, что все тексты, за исключением тех, что проверяются с конкретного аккаунта или IP-адреса, маркируются как сгенерированные нейросетью.
  3. Избавляемся от конкурентов: их статьи распознаются программой как ИИ на 90-100%, в то время как любой ваш текст — авторский шедевр с 0% генерации.
  4. Профит!

Подбиваем итоги

Ни один нейродетектор не гарантирует, что происхождение текста будет определено правильно. И это работает в обоих направлениях. Бывает, что нейросеть выдает неожиданно крепкий результат (правильно заданный промт — половина успеха), случается, что сам копирайтер или вебмастер подошел к задаче шаблонно или небрежно. В любом случае смотрите на содержание и качество контента: если в нем есть смысл и польза для целевой аудитории, а читать его увлекательно, то результат проверки по всевозможным программам отходит на второй план.
И кстати, вот вам результат проверки этой статьи по детектору text.ru. Я на целых 97,5% человек. Думаю, оставшиеся 2,5% — это из-за пары пломб :)
This site was made on Tilda — a website builder that helps to create a website without any code
Create a website