Как Яндекс отличает текст нейросети от живого автора — и что за это бывает

Как Яндекс отличает текст нейросети от живого автора

Меня почти на каждой консультации спрашивают одно и то же: «Анатолий, а Яндекс поймёт, что статью писала нейросеть? Меня забанят?» За этим вопросом всегда стоит страх — человек уже нагенерировал сайт статей за вечер и теперь боится, что утром позиции обнулятся. Отвечаю честно, как есть: Яндекс действительно неплохо различает машинный текст. Но история не про то, «поймает или нет». История про то, что наказывают вообще не за факт использования нейросети. Не хотите вникать сами — я много лет занимаюсь продвижением сайта в Яндексе и подскажу точки роста вашего сайта.

За 20 лет в SEO я застал все волны: сначала боялись «переоптимизации», потом «неуникального рерайта», теперь — искусственного интеллекта. И каждый раз оказывалось, что поисковик наказывает не за инструмент, а за результат — за бесполезный, пустой, никому не нужный текст. Разберём по полочкам: что Яндекс реально умеет, по каким признакам вычисляет генерацию, за что прилетает штраф на самом деле и как использовать ИИ так, чтобы он вам помогал, а не топил сайт.

Умеет ли Яндекс вообще отличать нейросеть от живого автора

Короткий ответ — да, и намного лучше, чем думает большинство владельцев бизнеса. И это логично: Яндекс сам разработал YandexGPT. Компания, которая делает генеративную модель, по определению знает, как выглядит её выхлоп изнутри — какие статистические закономерности характерны для машинного текста, какие обороты повторяются, как распределяются слова. Ловить генерацию для них — почти домашняя задача.

Но важно понимать, чем именно «занимается» поисковик. У Яндекса нет отдельной кнопки «это написал ИИ — в бан». Есть алгоритмы оценки качества, которые смотрят на текст комплексно: насколько он оригинален, отвечает ли на запрос, приносит ли пользу человеку, задерживается ли на странице читатель. Машинный текст плох не потому, что машинный, а потому что в 9 случаях из 10 он получается водянистым, шаблонным и ни о чём. Именно эти свойства алгоритмы и ловят.

Проще говоря, детекция ИИ — не самоцель, а побочный сигнал. Яндекс не спрашивает «кто автор», он спрашивает «зачем этот текст существует и кому он помогает». Если ответа нет — неважно, кто его набирал, живой копирайтер или нейросеть.

По каким признакам машина узнаёт машину

Когда я аудирую чужой контент, сгенерированную статью видно почти сразу — и мне, и алгоритмам. Вот характерные маркеры, по которым и человек, и Яндекс опознают «пластиковый» текст:

  • Гладкая пустота. Текст читается ровно, грамматически безупречно — но после прочтения в голове ничего не остаётся. Нет ни одной цифры, ни одного факта, который нельзя было бы выкинуть.
  • Вводные обороты-паразиты. «Важно отметить», «стоит подчеркнуть», «в современном мире», «играет важную роль», «не стоит забывать» — модели обожают эти связки и лепят их через абзац.
  • Симметричные списки ни о чём. Три пункта, в каждом по два предложения, все одинаковой длины, все — общие слова. Живой человек так не пишет, у него мысли разной «тяжести».
  • Отсутствие конкретики и опыта. Никаких «на моём проекте в 2019 году», никаких названий инструментов, реальных сумм, ошибок, сомнений. Только обобщения.
  • Придуманные факты. Нейросеть уверенно выдаёт несуществующую статистику и ссылается на исследования, которых нет. Это называют «галлюцинациями», и для экспертной темы это приговор.
  • Одинаковый ритм. Предложения примерно одной длины, монотонная интонация, ни одной живой фразы, вопроса читателю, иронии.

Плюс к этому у Яндекса есть статистические методы, недоступные глазу: распределение вероятностей слов, «предсказуемость» следующего токена, характерные для генерации паттерны. Человек пишет чуть хаотичнее и непредсказуемее — и это, как ни странно, признак живого текста. Но подчеркну ещё раз: сами по себе эти признаки не караются. Они лишь коррелируют с главной бедой — бесполезностью.

Главное заблуждение: наказывают не за ИИ

Вот мысль, ради которой стоит прочитать всю статью. Яндекс официально не запрещает генеративный контент. В рекомендациях для вебмастеров прямо говорится: создавайте контент для людей, а каким инструментом вы это делаете — ваше дело. Санкции прилетают не за нейросеть, а за нарушение принципа полезности.

Я это проверял на практике. У меня есть проекты, где часть черновиков готовится с помощью ИИ — и они годами живут в топе, потому что доведены до ума. И есть кейсы клиентов, которые пришли ко мне уже с просевшим сайтом: 200 статей, нагенерированных пачкой, вылетели из индекса. Разница не в инструменте. Разница в том, что первые тексты обогащены фактами, опытом и вычиткой, а вторые — сырой выхлоп, залитый «как есть».

Проведу аналогию. Молоток — инструмент. Им можно построить дом, а можно разбить окно. Никто не запрещает молотки. Ровно так же поисковик относится к нейросети: проблема не в ней, а в том, что люди заливают полуфабрикат тоннами и называют это «контент-стратегией». Если вам интересно, как на самом деле изменился рынок текстов после появления ChatGPT, я подробно разбирал это в отдельном материале — почему ChatGPT не убил копирайтеров, а поднял планку.

Что для Яндекса значит «неоригинально и бесполезно»

У поисковика есть конкретные алгоритмы, которые бьют по плохому контенту. Их полезно знать в лицо, чтобы понимать, чего именно избегать.

Баден-Баден. Запущен ещё в 2017 году, но живёт и здравствует. Он понижает страницы с переоптимизированными, «сеошными» текстами — теми, что написаны ради поисковика, а не человека: с неестественным нагромождением ключевых слов, водой и штампами. Классический выхлоп нейросети, залитый без правок, попадает под него на ура.

Проксима и оценка качества. Яндекс давно оценивает не отдельную страницу, а общее качество сайта — насколько он полезен пользователям в целом. Если половина страниц — пустые сгенерированные простыни, страдает весь домен, даже хорошие разделы. Это как ложка дёгтя: портит всю бочку.

Поведенческие факторы. Самый честный судья. Человек зашёл на страницу, за 8 секунд понял, что тут вода, и вернулся в выдачу. Такой «отказ» Яндекс фиксирует — и делает вывод, что страница не решает задачу. Бесполезный ИИ-текст проваливает этот тест сам собой, без всякой детекции. Как поведение пользователей влияет на позиции, я разбирал в статье про поведенческие факторы ранжирования — это, пожалуй, важнее любого «антиплагиата».

Обратите внимание: ни один из этих механизмов не называется «детектор ИИ». Все они про пользу и оригинальность. Нейросеть просто чаще других способов производит контент, который под них попадает.

Что реально бывает за плохой сгенерированный контент

Давайте без пугалок, но и без иллюзий. Вот что я наблюдаю у клиентов, которые залили сайт сырой генерацией:

  • Страницы не индексируются или вылетают из индекса. Яндекс просто не берёт в поиск то, что считает малополезным дублем чужих мыслей. Формально страница есть, а в выдаче её нет.
  • Проседание позиций всего сайта. Не одной статьи, а домена целиком — потому что качество оценивается в среднем.
  • Фильтр Баден-Баден. Резкая просадка трафика, иногда в разы, с характерной формулировкой в Вебмастере о нарушении.
  • Потеря доверия к домену. Даже после чистки восстановление занимает месяцы. Репутацию сайта в глазах поисковика восстанавливать дольше, чем терять.

А теперь важное «но». За аккуратно доработанный текст, созданный с помощью ИИ, не бывает ничего плохого — он ранжируется наравне с ручным. Наказание — это всегда следствие лени, а не инструмента. Если вы сомневаетесь, всё ли в порядке с вашим контентом, начать стоит с технического аудита сайта и общей проверки качества — часто проблема видна сразу.

Как я использую нейросеть на проектах: помощник, а не автор

Я не противник ИИ — я активно им пользуюсь. Но у меня жёсткое правило: нейросеть — это стажёр, а не автор. Она делает черновую работу, а решения, факты и финальный текст остаются за мной. Вот как это выглядит на практике:

  • Структура и план. Прошу набросать скелет статьи, список подзаголовков, варианты формулировок. Это экономит время на «чистом листе».
  • Рыба для абзацев. Модель пишет черновую версию раздела, а я переписываю её под живой язык, добавляю конкретику и выбрасываю воду.
  • Идеи и ракурсы. «Дай 10 углов, под которыми можно раскрыть тему» — отличный способ не упустить важное.
  • Рутина. Мета-теги, варианты заголовков, краткие пересказы, вычитка на опечатки. Тут ИИ незаменим.

Чего я не делаю никогда: не публикую сгенерированный текст без правок, не доверяю модели факты и цифры, не отдаю ей экспертную позицию. Нейросеть не была на моих проектах, не теряла деньги на ошибках, не видела, как ведёт себя выдача в живой нише. Всё это приношу я. Если у вас нет времени доводить тексты до этого уровня — это как раз тот случай, когда имеет смысл заказать SEO-статьи у человека, который отвечает за результат головой, а не отдавать нишу генератору.

Факты, цифры и опыт — то, что ИИ придумать не может

Главное, чего катастрофически не хватает машинному тексту, — это реальности. Нейросеть обучена на миллионах чужих текстов и умеет их усреднять, но она не имеет собственного опыта. Она не знает, что на вашем производстве заказ собирают за 3 дня, а не за неделю, как пишут конкуренты. Она не была на объекте. Она не считала вашу конверсию.

Именно поэтому я строю контент вокруг того, что модель не сгенерирует в принципе:

  • Конкретные цифры из практики. Не «многие клиенты», а «из 300 с лишним проектов». Не «трафик вырос», а «с 400 до 2100 визитов за полгода».
  • Реальные кейсы и ошибки. История о том, как что-то пошло не так и чему это научило, стоит десяти гладких абзацев. Свои разбираю в портфолио с кейсами.
  • Детали ниши. Сезонность, типичные возражения клиентов, специфика региона — то, что знает только практик.
  • Проверяемые данные. Ссылки на реальные источники, актуальные цифры, а не выдуманная статистика.

Когда в тексте есть такая плотность фактов, вопрос «а не нейросеть ли это?» отпадает сам собой. И для читателя, и для Яндекса. Именно уникальный опыт и делает страницу той самой, которую поисковик хочет показать первой. Кстати, о том, как убедить алгоритм, что ваш материал экспертнее конкурентского, у меня есть отдельный разбор — как доказать Яндексу, что вы лучше конкурента.

Экспертность, авторитет и доверие — по-русски E-E-A-T

Есть набор принципов, которые поисковики применяют к контенту: опыт, экспертность, авторитетность, достоверность. Звучит абстрактно, но на деле всё просто — поисковик хочет понимать, кто и на каком основании вам это рассказывает. Сгенерированный обезличенный текст этого сигнала не даёт: у него нет автора, нет биографии, нет ответственности.

Что усиливает экспертность страницы в глазах Яндекса:

  • Явный автор с опытом. Имя, специализация, стаж, а не безликое «редакция сайта».
  • Первое лицо и позиция. «Я считаю», «на моей практике», «я бы так делать не советовал» — это то, чего нейросеть избегает, а живой эксперт использует постоянно.
  • Глубина, а не ширина. Лучше один материал, раскрывающий тему до дна, чем двадцать поверхностных.
  • Связность контента. Внутренние ссылки на смежные материалы показывают, что за сайтом стоит система знаний, а не набор случайных статей.

Именно поэтому статьи в этом блоге я пишу от первого лица и подписываю именем. Это не поза — это сигнал доверия, который машинный текст по определению дать не может. Если вы хотите разобраться, как вообще устроен продающий и экспертный текст, я собрал практику в материале про то, как написать продающий текст для сайта.

Вычитка: последний рубеж между вами и штрафом

Даже отличный черновик от нейросети нельзя публиковать «как есть». Вычитка — это не про запятые, это про то, чтобы текст стал вашим. Вот мой чек-лист, который я прогоняю по каждому материалу перед публикацией:

  • Проверяю каждый факт и цифру. Всё, что модель «уверенно» заявила, перепроверяю по источникам. Галлюцинации нейросети в экспертной статье недопустимы.
  • Выбрасываю воду. Все «важно отметить», «в современном мире» и абзацы, которые ничего не добавляют, — под нож.
  • Добавляю себя. Свой опыт, свои примеры, свою интонацию. После этого текст перестаёт быть машинным.
  • Читаю вслух. Живой текст звучит естественно. Если язык спотыкается — переписываю.
  • Проверяю пользу. Задаю вопрос: если бы я был клиентом, я получил бы ответ? Если нет — раздел переделываю.

Эта работа занимает больше времени, чем сама генерация, — и именно она отделяет контент, который растёт в поиске, от того, что вылетает из индекса. На вычитке экономить нельзя. Если хотите, чтобы я оценил ваши тексты и сайт целиком, приходите на SEO-консультацию — за час разберём, что работает, а что тянет вас вниз.

Коротко: что запомнить про нейросети и Яндекс

  • Яндекс умеет отличать машинный текст — он же создатель YandexGPT. Но детекция ИИ не самоцель.
  • Наказывают не за нейросеть, а за неоригинальность и бесполезность. Инструмент нейтрален.
  • Плохой ИИ-текст ловят Баден-Баден, оценка качества сайта и поведенческие факторы — все они про пользу.
  • Последствия сырой генерации: невключение в индекс, просадка позиций домена, фильтры, долгое восстановление.
  • ИИ — отличный помощник для структуры, черновиков и рутины. Но не автор: факты, опыт и решения — за вами.
  • Спасают текст три вещи: конкретные факты и цифры из практики, живая экспертная позиция и честная вычитка.
  • Обезличенный сгенерированный текст не даёт сигнала доверия. Автор, стаж и первое лицо — дают.

Так что не бойтесь нейросети — бойтесь лени. Используйте ИИ как способ ускориться, а не как замену своей голове и своему опыту. Тогда Яндекс будет видеть на вашем сайте именно то, что любит: живого эксперта, который решает задачу читателя. А чем он там пользовался на этапе черновика — поисковику, честно говоря, всё равно.

Анатолий Кузнецов — SEO-оптимизатор

Остались вопросы по продвижению?

Меня зовут Анатолий Кузнецов, я SEO-оптимизатор с 20-летним стажем. Разберу ваш сайт, отвечу на вопросы и подскажу, что улучшить для роста позиций в Яндексе и Google.

Связаться со мной →

Комментарии

Дмитрий

Вот прямо про меня. Нагенерировал 80 статей для интернет-магазина, залил разом — через месяц трафик просел вдвое. Теперь понимаю, что дело не в ИИ, а в том, что я даже не читал, что публикую.

Ольга

А правда, что если добавить в сгенерированный текст немного «своих слов», Яндекс уже не распознает? Или это не работает?

Анатолий Кузнецов автор

Косметическая правка не спасает — водянистая суть остаётся, и поведенческие факторы её выдадут. Работает другое: наполнить текст фактами, цифрами и реальным опытом, которых в исходной генерации не было. Это не «маскировка под человека», а превращение полуфабриката в полезный материал. Разница принципиальная.

Сергей Витальевич

Спорный момент про Баден-Баден — думал, он давно неактуален. Оказывается, до сих пор фильтрует. Спасибо, что напомнили, полез проверять свой сайт в Вебмастере.

Марина

У меня небольшая студия маникюра, сама веду блог. Времени в обрез, поэтому ChatGPT реально выручает. Но всегда переписываю под себя и добавляю случаи из практики. Получается, я всё делаю правильно?

Анатолий Кузнецов автор

Именно так и надо. Вы используете ИИ как черновик, а экспертизу и живые примеры приносите сами — это ровно та схема, о которой я пишу. Ваши случаи из практики нейросеть не сгенерирует никогда, и как раз они делают текст ценным для читателя и для Яндекса. Продолжайте в том же духе.

Артём

Больше всего бесят эти «важно отметить» и «в современном мире». Теперь читаю любой текст и сразу вижу генерацию по таким фразам. Раньше не замечал.

Наталья

А для Google это тоже работает так же? Или у него другие правила по ИИ-контенту?

Анатолий Кузнецов автор

Логика та же: Google тоже официально не запрещает генеративный контент, но бьёт по бесполезным страницам своими апдейтами качества. Требования к экспертности и пользе у него даже жёстче. Так что универсальный рецепт один — делать контент для людей, а не для робота. Инструмент создания вторичен.

Владимир

Проверил свой сайт после статьи. Половина текстов — та самая «гладкая пустота». Ни одной цифры, ни одного примера. Теперь понятно, почему не растём. Буду переделывать.

Екатерина

Вопрос как к практику: сколько примерно занимает нормально довести сгенерированный черновик до публикации? А то мне кажется, проще с нуля написать.

Анатолий Кузнецов автор

По-честному — вычитка и обогащение фактами занимают больше времени, чем сама генерация, иногда в разы. Но это всё равно быстрее письма с чистого листа: структура и рыба уже есть, остаётся вложить экспертизу. Если материал сложный и требует много собственных данных — да, бывает, что проще написать самому. Решается по каждой теме отдельно.

Роман

Хорошо, что развеяли миф про «бан за нейросеть». А то знакомый вообще боялся ИИ трогать, писал всё руками по три дня на статью. А проблема-то не в инструменте.

Ирина

Про автора и первое лицо — прямо в точку. Сравнила свои обезличенные тексты «от редакции» с вашими статьями, разница ощущается сразу. Доверия к живому человеку больше.

Павел

А как понять, что мой сайт уже под фильтром за плохие тексты? Есть какие-то явные признаки в Вебмастере или только по трафику видно?

Анатолий Кузнецов автор

Смотрите раздел «Диагностика» и уведомления в Яндекс.Вебмастере — при Баден-Бадене там обычно прямая формулировка про переоптимизацию. Плюс косвенно: резкая просадка трафика без видимых техпричин, массовое выпадение страниц из индекса. Если сомневаетесь — приходите, посмотрю ваш сайт на консультации и скажу точно, фильтр это или что-то другое.

Алексей

Забрал в закладки чек-лист по вычитке. Особенно про «читаю вслух» — реально помогает выловить корявые машинные фразы. Проверено уже на паре своих статей.

Увеличьте позиции и продажи вашего сайта

Профессиональное SEO-продвижение с гарантией результата. Выберите подходящую услугу:

Анатолий Кузнецов — SEO-оптимизатор

Остались вопросы по продвижению?

Меня зовут Анатолий Кузнецов, я SEO-оптимизатор с 20-летним стажем. Разберу ваш сайт, отвечу на вопросы и подскажу, что улучшить для роста позиций в Яндексе и Google.

Связаться со мной →
Прокрутить вверх