Как антиплагиат находит нейросетевой текст
Обычная проверка на плагиат сравнивает текст с базой источников: миллионы статей, книг и курсовых. Находит совпадения и выдаёт процент заимствований. Это работало пока студенты копировали куски из интернета. Нейросети всё усложнили.
Текст от ChatGPT или Claude уникален, прямых совпадений вы не найдёте. Но у такого текста есть другие признаки. Детекторы AI анализируют две ключевые метрики:
- Perplexity, насколько текст предсказуем. Человек пишет хаотично: перескакивает с мысли на мысль, использует неожиданные слова и обороты. Нейросеть идёт по наиболее вероятному пути, её текст слишком гладкий. Низкая perplexity = текст сгенерирован
- Burstiness, разброс длины предложений. Люди чередуют длинные и короткие предложения. У AI длина равномерна. Низкая burstiness в комбинации с низкой perplexity даёт уверенный вердикт: текст нечеловеческий
Я тестировал: взял свой текст про умный дом и сгенерированный ChatGPT на ту же тему. Свой показал perplexity в районе 45, сгенерированный упал до 18. Разница в два с половиной раза. Детектор GPTZero определил мой текст как «human», сгенерированный как «AI 92%».
Одной метрики недостаточно. Аккуратный автор с ровным стилем может получить низкую perplexity на своём тексте. Но две метрики одновременно низкие практически только у AI.
6 сервисов для проверки текста
Антиплагиат.ВУЗ
Стандарт для российских вузов. Проверяет по огромной базе: дипломы, диссертации, научные статьи, интернет. С недавних пор встроили модуль обнаружения AI-текста который анализирует те самые perplexity и burstiness.
Бесплатного доступа нет, но большинство вузов предоставляют студентам. Проверка занимает от пары минут до получаса. Результат: процент заимствований с разбивкой по источникам и отдельно подсвеченные AI-фрагменты. Комиссии смотрят на оба показателя, так что мало получить 80% оригинальности если из них 50% отмечены как AI.
Text.ru
Популярный онлайн-сервис, бесплатно проверяет до 10 000 знаков за раз. Показывает процент уникальности со ссылками на найденные совпадения. AI-детектор встроен как дополнительная опция, работает приемлемо для русского языка.
Для студенческой работы больше 10К знаков придётся проверять частями или брать платный тариф за 500 рублей в месяц. Интерфейс простой, результат за пару минут. Я проверял на нём свой старый диплом, нашёл три абзаца которые я честно забыл что перефразировал из учебника.
GPTZero
Самый известный западный детектор AI-текста. Заточен именно на выявление генерации: определяет ChatGPT, Claude, Gemini и большинство популярных моделей. Для каждого фрагмента показывает вероятность AI и подсвечивает предложения.
Бесплатно 5 000 слов в месяц. Интерфейс на английском но русский текст анализирует нормально. Полезная фишка: показывает какие именно предложения триггерят детектор, можно точечно переписать их а не весь текст.
Originality.ai
Профессиональный инструмент редакций и издательств. Проверяет плагиат и AI одновременно, заявляет точность 99% на ChatGPT и 94% на Claude. Работает через API, можно встроить в редакционный пайплайн.
Бесплатного тарифа нет, оплата за проверенные мегабайты текста. Для студента дороговато, для преподавателя который проверяет десятки работ в день нормально.
Content-watch.ru
Российский сервис, бесплатно до 3 000 знаков. Ищет плагиат в интернете, показывает уникальность и показывает заимствования. AI-детектирование базовое, не специализированное.
Интерфейс на русском, регистрация не нужна для разовой проверки. Подойдёт быстро проверить небольшой фрагмент перед отправкой, но для серьёзной проверки возьмите что-то помощнее.
Advego Плагиатус
Десктопная программа а не веб-сервис. Скачиваете, устанавливаете, проверяете текст локально на компьютере. Ищет совпадения в интернете через поисковые запросы, показывает шинглы (одинаковые фразы) и процент уникальности.
AI-детектора нет. Но для базовой проверки на классический плагиат годится, плюс текст не уходит на сторонний сервер. Бесплатно без ограничений по объёму. Хорош как первый прогон перед загрузкой в Антиплагиат.ВУЗ.
Сравнительная таблица сервисов
| Сервис | Плагиат | AI-детектор | Бесплатный лимит | Цена платной версии |
|---|---|---|---|---|
| Антиплагиат.ВУЗ | Через вуз | от 3 000 руб./год | ||
| Text.ru | 10 000 знаков | 500 руб./мес | ||
| GPTZero | 5 000 слов/мес | от $10/мес | ||
| Originality.ai | Нет | от $15/мес | ||
| Content-watch.ru | Базово | 3 000 знаков | бесплатно | |
| Advego | Безлимитно | бесплатно |
Можно ли обмануть детектор AI
Коротко: можно но муторно. Если взять сгенерированный текст и вручную переписать каждое второе предложение, перемешать структуру абзацев, добавить свои примеры, детектор скорее всего примет за человеческий. Но времени уйдёт столько же сколько на написание с нуля.
Автоматические «очеловечиватели» текста которые обещают обойти детекторы работают плохо. Они заменяют слова синонимами и переставляют фразы, но глубинная структура остаётся AI-шной. Perplexity не растёт потому что последовательность слов по-прежнему статистически предсказуема. Я пробовал три таких сервиса на сгенерированном тексте: GPTZero всё равно определил AI в 70-80% случаев.
Единственный реальный способ: писать самому. Или переработать AI-черновик так глубоко чтобы от исходной генерации остался только логический каркас.
Какой сервис выбрать под свою задачу
Студенту перед сдачей: сначала Advego для быстрой проверки на совпадения, потом GPTZero для проверки на AI-следы, потом Антиплагиат.ВУЗ через вуз для финального вердикта. Три прогона, три разных инструмента, минимум сюрпризов.
Преподавателю: Originality.ai для потоковой проверки работ. API позволяет загружать файлы пачками и получать отчёт по каждому с разбивкой на плагиат и AI.
Копирайтеру или редактору: Text.ru для русского текста. Бесплатного лимита хватит на ежедневную проверку, интерфейс на русском, скорость хорошая.
Как я тестировал детекторы на своём тексте
Ради интереса прогнал через GPTZero три варианта одного и того же текста: свой оригинал, версию полностью написанную ChatGPT, и гибрид где я взял ChatGPT-черновик и переписал каждое второе предложение.
Свой оригинал: GPTZero показал 98% human. ChatGPT-версия: 8% human, уверенно определил как AI. Гибридная версия: 67% human. Детектор колебался но склонялся к тому что текст смешанный.
Из этого я сделал вывод: даже поверхностная ручная переработка AI-текста сильно сбивает детекторы. А глубокая переработка где вы переписываете структуру и добавляете свой опыт делает текст неотличимым от человеческого. Главное не лениться.
Почему детекторы ошибаются
Ложные срабатывания случаются. Студент который пишет в академическом стиле с ровной структурой может получить подозрение на AI даже если писал всё сам. Особенно если его естественный стиль похож на нейросетевой: формальные обороты, одинаковая длина предложений, мало личных отступлений.
Ложные пропуски тоже бывают. Если вы возьмёте AI-текст и добавите пару опечаток, одно нелогичное предложение и личную историю, детектор может пропустить его как человеческий. Технология несовершенна с обеих сторон, и умные студенты это используют.
Что писать в сопроводительном письме к работе
Некоторые вузы уже требуют вместе с работой прикладывать краткое описание того как использовались нейросети. Это не запрет а прозрачность: если вы честно написали что использовали ChatGPT для проверки орфографии и Claude для структурирования глав, это нормально. Проблемы возникают когда пытаются скрыть использование AI.
Формулировка может быть такой: «При подготовке работы использовались инструменты на базе нейросетей (ChatGPT, Claude) для проверки орфографии, стилистической редактуры и помощи в структурировании материала. Все содержательные выводы, анализ данных и практическая часть выполнены автором самостоятельно». Честно, прозрачно, не к чему придраться.
Проверка на плагиат и AI-детекция это два разных процесса. Одна ищет совпадения, другая ищет слишком гладкую структуру. Для студента оптимальный набор: Advego для первого прогона, GPTZero для проверки на AI, и финально Антиплагиат.ВУЗ. И помните: ни один детектор не даёт 100% точности, но их комбинация отсекает почти все риски. А лучший способ пройти любую проверку по-прежнему один: писать текст самому.