Уникальность текста: сколько процентов реально нужно

«Уникальность не ниже 95% по text.ru» — эта строчка кочует из одного технического задания копирайтеру в другое уже пятнадцать лет. За это время поиск научился понимать смысл, сравнивать документы по векторам, отличать пересказ от первоисточника и вычислять шаблонную генерацию — а требование в ТЗ не изменилось ни на процент. Проблема в том, что цифра из сервиса проверки и то, что поисковая система считает «новым контентом», — это две разные вещи, которые пересекаются лишь частично. Можно получить 100% и попасть под фильтр за малополезный контент. Можно опубликовать текст с 78% и годами держать ТОП. В этой статье разбираем, что на самом деле измеряют сервисы, какие пороги имеют смысл для разных типов страниц, чем опасен рерайт и как в эту картину встраиваются ИИ-тексты — на основе того, что мы видим на проектах SEO-продвижения с 2005 года.
Коротко
- Сервисы проверки измеряют техническую уникальность — совпадение цепочек слов (шинглов). Поисковик оценивает смысловую новизну документа, и это принципиально разные метрики.
- Рабочие ориентиры: информационная статья — от 90%, коммерческая посадочная — 85–95%, карточка товара — 70–85% достижимо и достаточно, юридические и технические тексты — 60–80% нормально.
- Гнаться за 100% вредно: текст с абсолютной уникальностью почти всегда получается вымученным, с искажёнными терминами и сломанной читаемостью.
- Рерайт даёт высокие проценты и нулевую ценность — Яндекс отличает переформулировку от нового смысла с 2017 года, со времён Баден-Баден.
- Внутренние дубли на сайте вредят чаще, чем внешний копипаст: одинаковые описания на сотнях карточек и шаблонные тексты по городам — типичная причина проблем.
- ИИ-текст даёт 95–100% технической уникальности автоматически, и это ровно ничего не говорит о его качестве — проверять нужно фактуру и полезность, а не проценты.
- Первоисточник в Яндексе определяется не по дате в тексте, а по совокупности сигналов: скорость индексации, траст домена, история публикаций.
Что на самом деле измеряют сервисы уникальности
Начнём с механики, потому что без неё все споры о процентах бессмысленны. Практически все популярные сервисы — text.ru, Advego Plagiatus, Content Watch, eTXT Антиплагиат — работают по одному принципу, который называется шингловым алгоритмом.
Текст разбивается на перекрывающиеся цепочки слов фиксированной длины. Цепочка из трёх слов — это шингл длины 3, из четырёх — длины 4 и так далее. Для фразы «уникальность текста для поисковых систем» при длине шингла 3 получаются цепочки: «уникальность текста для», «текста для поисковых», «для поисковых систем». Каждый шингл превращается в хеш — короткое число. Дальше сервис берёт часть этих хешей (не все, иначе проверка была бы неподъёмной по ресурсам) и ищет совпадения в своей базе и в поисковой выдаче.
Процент уникальности — это доля шинглов, которым не нашлось совпадения. Всё. Никакой оценки смысла, пользы, экспертности или новизны здесь нет и быть не может: алгоритм сравнивает последовательности слов.
Из этого следуют три практических вывода, которые сразу снимают половину вопросов:
- Длина шингла определяет строгость. Чем короче шингл, тем жёстче проверка. При длине 3 сервис поймает даже устойчивые словосочетания вроде «в соответствии с требованиями»; при длине 5–6 такие обороты пройдут мимо. Именно поэтому один и тот же текст даёт 82% в одном сервисе и 96% в другом — у них разные настройки по умолчанию.
- Перестановка слов ломает шингл. Замена одного слова в цепочке из трёх делает уникальными сразу три шингла. Отсюда фокус всех «синонимайзеров»: механически заменить каждое пятое слово — и получить 100% при полностью украденном смысле.
- База сравнения у всех разная. Сервис ищет по своему индексу и по выдаче через API. Он не видит закрытые разделы, PDF-файлы, документы во внутренних системах, часть контента за пейволлом. Отсюда ситуации, когда текст показывает 100%, а через месяц выясняется, что копирайтер переписал главу из книги.
КЛЮЧЕВОЕ РАЗЛИЧИЕ
Сервис проверки отвечает на вопрос «встречались ли эти последовательности слов раньше». Поисковая система отвечает на вопрос «содержит ли этот документ что-то, чего нет в других документах по той же теме». Первый вопрос решается сравнением хешей за миллисекунды. Второй — векторным представлением документа, анализом сущностей, оценкой полноты ответа на интент и поведением пользователей. Совпадать эти ответы не обязаны.
Техническая уникальность против смысловой
Разделение этих двух понятий — самая полезная вещь, которую стоит вынести из статьи. Разберём по признакам.
| Параметр | Техническая уникальность | Смысловая уникальность |
|---|---|---|
| Что измеряется | Доля несовпадающих цепочек слов | Наличие информации, которой нет в конкурирующих документах |
| Кто измеряет | text.ru, Advego, Content Watch, eTXT | Поисковые алгоритмы, асессоры, редактор, читатель |
| Как накрутить | Синонимайзер, перестановка слов, добавление вводных конструкций | Никак — нужна новая фактура, свои данные, свой опыт |
| Единица измерения | Проценты | Не измеряется в процентах в принципе |
| Что даёт в ранжировании | Порог допуска: ниже определённого уровня документ считается дублем | Основной вклад: полнота ответа, новизна, глубина раскрытия |
| Риск при погоне | Искажённая терминология, нечитаемый текст, потеря точных вхождений | Риска нет — это то, ради чего пишут текст |
| Когда критична | При приёмке работы копирайтера, при заимствовании чужих материалов | Всегда |
Простой мысленный эксперимент, который расставляет всё по местам. Возьмите статью конкурента из ТОП-3 и прогоните через качественный рерайт: смысл, структура, порядок аргументов, все примеры — те же, но каждое предложение переписано другими словами. Сервис покажет 98–100%. Для поиска же это документ, не добавляющий в выдачу ничего: тот же набор фактов в другой упаковке. Ранжироваться он будет по остаточному принципу — за счёт домена, ссылок, коммерческих факторов, но не за счёт текста.
Обратный пример: технический регламент, где половина текста — цитаты из ГОСТа. Уникальность 55%. Но если вокруг этих цитат построен разбор с расчётами, таблицами допусков и объяснением, как это применяется на практике, — документ уникален по смыслу и вполне способен занимать первые места. Именно поэтому в тематиках вроде юридической и медицинской пороговые требования принципиально ниже, чем в блогах общего профиля.
Уникальность текста — это не то, что показывает сервис. Это ответ на вопрос: если ваш документ удалить из интернета, потеряет ли пользователь что-нибудь, чего нет в других документах.
Сколько процентов реально нужно: рабочие пороги
Универсального числа нет — и любой, кто называет одну цифру для всех случаев, просто не работал с разными типами страниц. Пороги зависят от типа контента, от объёма неизбежных заимствований и от того, насколько тематика насыщена устойчивыми формулировками.
| Тип страницы | Рабочий порог (шингл 3–4) | Почему такой | Что важнее процентов |
|---|---|---|---|
| Информационная статья в блоге | 90–95% | Полностью авторский текст, заимствований почти нет | Глубина раскрытия темы, свои примеры, структура |
| Коммерческая посадочная (услуга) | 85–95% | Есть неизбежные клише отрасли и названия услуг | Конкретика по цене, срокам, процессу; коммерческие факторы |
| Категория интернет-магазина | 85–95% | Текст короткий, значительная часть — названия товаров | Полезность для выбора, а не объём ради объёма |
| Карточка товара | 70–85% | Характеристики, состав, комплектация совпадают у всех продавцов | Уникальность внутри сайта: карточки не должны дублировать друг друга |
| Юридический и нормативный текст | 60–80% | Цитаты законов, статей, регламентов менять нельзя | Авторский разбор и практическое применение вокруг цитат |
| Медицинский контент (YMYL) | 70–85% | Терминология, названия препаратов, протоколы фиксированы | Авторство врача, источники, соответствие E-E-A-T |
| Техническая документация, инструкции | 65–85% | Названия узлов, последовательности операций стандартны | Точность, полнота, наличие схем и таблиц |
| Новость, пресс-релиз | 80–90% | Фактура общая для всех изданий | Скорость публикации и авторский комментарий |
| Страницы по городам, филиалам | 75–90% | Шаблонная основа с региональными вставками | Реальные адреса, телефоны, кейсы и специфика региона |
Обратите внимание: во всех строках правая колонка важнее второй. Порог — это не цель, а фильтр отсева откровенного копипаста. Он нужен, чтобы отсечь ситуацию «копирайтер скачал текст у конкурента и слегка поправил», а не для того, чтобы стать целью оптимизации.
Почему требование 100% вредно
Абсолютная уникальность недостижима естественным путём, и попытка её выжать всегда деформирует текст. Вот что происходит на практике, когда в ТЗ стоит «не менее 100% по text.ru»:
- Ломаются термины. «Пластиковые окна» становятся «полимерными оконными конструкциями», «доставка по Москве» — «транспортировкой в пределах столицы». Точные вхождения из семантического ядра исчезают, и страница перестаёт отвечать на запрос, ради которого писалась.
- Появляются искусственные конструкции. Автор вставляет вводные слова и деепричастные обороты не потому, что они нужны, а чтобы разбить совпадающие шинглы. Растёт водность текста, падает читаемость.
- Исчезают цитаты и цифры. Чтобы не ловить совпадения, автор перестаёт цитировать источники и приводить точные формулировки — а именно они делают материал доказательным.
- Растёт стоимость без роста результата. Дотягивание с 93% до 100% занимает у копирайтера больше времени, чем написание половины текста, и не добавляет ни одной позиции.
ПРАКТИЧЕСКОЕ ПРАВИЛО
Если текст показывает 88–93% и при этом состоит из совпадений вида «в течение рабочего дня», «в зависимости от объёма», «при заказе от», — его не нужно трогать. Это устойчивые обороты русского языка, а не заимствования. Смотреть надо не на итоговый процент, а на подсвеченные фрагменты: если сервис выделяет целые абзацы с чужим смыслом — это проблема; если разрозненные словосочетания по 3–4 слова — это норма.
Как отличаются сервисы проверки
Разброс показаний между сервисами по одному тексту достигает 15–20 процентных пунктов, и это не баг, а следствие разных алгоритмов и разных баз. Понимание различий избавляет от бессмысленных споров с копирайтером.
| Сервис | Особенности алгоритма | Сильная сторона | Где ошибается |
|---|---|---|---|
| text.ru | Шингловый анализ + собственная база + проверка по выдаче; показывает заспамленность и водность | Отраслевой стандарт приёмки, подробный отчёт с подсветкой источников | Строгий к устойчивым оборотам; очередь при пиковой нагрузке |
| Advego Plagiatus | Настраиваемая длина шингла, глубина поиска, выбор поисковых систем | Гибкость: можно поднять шингл до 5–6 и увидеть реальную картину заимствований | Требует ручной настройки; результаты несопоставимы между разными профилями |
| Content Watch | Поиск по фрагментам с указанием совпавших URL | Удобно искать, кто и откуда скопировал ваш материал | Меньшая база по сравнению с лидерами |
| eTXT Антиплагиат | Десктопное приложение, пакетная проверка | Массовая проверка карточек и большого объёма страниц | Требует установки, зависит от лимитов поисковых систем |
| Проверка по выдаче вручную | Поиск точной фразы из текста в кавычках | Самый честный ответ на вопрос «знает ли поисковик такой текст» | Не даёт процента, работает только точечно |
Отдельно про ручную проверку — недооценённый метод. Возьмите из проверяемого текста 5–7 характерных предложений (не клише, а содержательные фразы) и вбейте каждое в поиск в кавычках. Если находятся другие сайты — вы видите первоисточник напрямую, без интерпретаций сервиса. Это единственный способ проверки, использующий базу самого поисковика, а не стороннюю.
Практический регламент, к которому имеет смысл прийти: один сервис — один порог — фиксированные настройки. Выбираете, например, text.ru, фиксируете его в ТЗ и приёмке, и все споры отпадают. Метаться между сервисами в поисках более приятной цифры — верный способ потерять управляемость процессом.
Рерайт: почему высокая уникальность не спасает
Рерайт — переписывание чужого материала своими словами — остаётся самым распространённым способом производства контента в русскоязычном сегменте. И самым бессмысленным с точки зрения SEO. Разберём, почему.
Что видит поисковик
Современные алгоритмы не сравнивают документы посимвольно. Текст преобразуется в векторное представление, где близкие по смыслу документы оказываются рядом в многомерном пространстве — независимо от конкретных слов. Синонимическая замена сдвигает вектор незначительно: «купить холодильник недорого» и «приобрести рефрижератор по низкой цене» окажутся практически в одной точке. Именно на этой технологии построены и нейропоиск Яндекса, и семантические факторы ранжирования.
Дальше подключается второй слой — оценка полезности. Если документ не добавляет фактов, не отвечает на дополнительные вопросы, не даёт нового угла зрения, он не поднимается выше тех, у кого этот смысл появился раньше и подкреплён поведенческими сигналами. Всё это описано в наборе факторов ранжирования Яндекса, где текстовые факторы давно перестали быть решающими сами по себе.
Градация переработки чужого материала
Прямой копипаст
Текст скопирован как есть. Техническая уникальность 0–20%. Страница почти гарантированно не попадёт в индекс как самостоятельный документ либо будет склеена с оригиналом.
Машинный синонимайз
Автозамена слов. Уникальность 90–100%, читаемость разрушена, термины искажены. Худший вариант из всех: и пользы нет, и текст нечитаем.
Ручной рерайт
Человек переписывает своими словами. Уникальность 95–100%, текст читается. Новой информации ноль. Работает только при слабых конкурентах и сильном домене.
Компиляция источников
Сведение 5–10 материалов в один. Уникальность высокая, ценность появляется за счёт полноты — уже приемлемо, если добавлена структура и навигация по теме.
Экспертный материал
Свои данные, свой опыт, свои расчёты, разбор ошибок. Уникальность может быть 88–93% из-за терминов — и это лучший контент из возможных.
Первичное исследование
Собственные замеры, опросы, эксперименты. Источник, на который ссылаются другие. Самый дорогой и самый устойчивый в ранжировании формат.
Практический вывод простой: рерайт уровня 2 стоит примерно как компиляция уровня 3, но даёт кратно меньше. Если бюджет на контент ограничен, лучше сделать в два раза меньше материалов, но уровня 4, чем закрыть весь план рерайтами. Как выстраивать такой процесс, разбирали в материале про контент-маркетинг и SEO.
Как Яндекс относится к копипасту
Здесь важно развести три разных механизма, которые постоянно путают между собой.
Механизм первый: склейка дублей
Когда поисковик находит несколько документов с идентичным или почти идентичным содержимым, он выбирает один как основной, а остальные исключает из выдачи. Это не санкция, а нормальная работа дедупликации: незачем показывать пользователю десять одинаковых страниц. Исключённая страница получает в Вебмастере статус вроде «дубль» или «неканоническая». Механика подробно разобрана в статье про canonical и дубли страниц.
Механизм второй: определение первоисточника
Если один и тот же текст есть на двух сайтах, поисковик решает, кто автор. И решает не по дате в теле статьи — эта дата ничем не подтверждена и легко подделывается. Учитывается совокупность сигналов:
- Дата первой индексации. Кого робот увидел первым — у того преимущество. Отсюда практический приём: ускорять индексацию новых материалов через переобход в Вебмастере и корректный sitemap.xml с актуальным lastmod.
- Траст и история домена. Сайт с многолетней историей публикаций по теме выигрывает у молодого агрегатора почти всегда. Подробнее — в материале про траст сайта и возраст домена.
- Ссылочные сигналы. Куда ведут ссылки при упоминании материала, тот и считается источником.
- Инструмент «Оригинальные тексты». В Яндекс.Вебмастере есть раздел, куда можно отправить текст до публикации. Это не гарантия, но дополнительный сигнал авторства — и стоит он ноль рублей.
Печальная реальность: если ваш текст скопировал крупный портал с высоким трастом, он вполне может ранжироваться выше оригинала. Юридически вы правы, алгоритмически — нет. Поэтому для ценных материалов имеет смысл заранее отправлять текст в «Оригинальные тексты» и добиваться быстрой индексации.
Механизм третий: санкции за малополезный контент
Копипаст сам по себе редко приводит к санкциям — он просто не индексируется как самостоятельный документ. А вот массовое производство малополезных текстов, переоптимизация и «текст ради текста» — это уже зона алгоритмов Яндекса и фильтра Баден-Баден. Здесь наказывается не заимствование, а бесполезность. Как выглядит попадание и выход — разбирали в материале про вывод сайта из-под фильтра.
ЧАСТОЕ ЗАБЛУЖДЕНИЕ
«За неуникальный текст Яндекс наложит фильтр на весь сайт» — это миф. За неуникальный текст страница просто не будет ранжироваться как самостоятельная: её склеят с оригиналом. Фильтр — это про другое: про переспам, про текст, написанный для робота, про массовую генерацию страниц без пользы. Сайт с честными, но частично заимствованными характеристиками товаров под фильтр не попадёт. Сайт с тысячей уникальных на 100% пустых текстов — вполне может.
Внутренние дубли: то, о чём забывают
Проверяя тексты на уникальность относительно интернета, большинство упускает более частую и более вредную проблему — дублирование внутри собственного сайта. На коммерческих проектах она встречается чаще внешнего копипаста и бьёт больнее.
| Проблема | Причина | Последствие | Решение |
|---|---|---|---|
| Одинаковый текст на карточках товара | Описание выгружено из прайса поставщика на всю линейку | Карточки не ранжируются по низкочастотным запросам, каннибализация внутри категории | Уникализировать 2–3 абзаца на карточку: отличия модели, применение, комплектация |
| Шаблонные страницы по городам | Один текст с автоподстановкой названия города | Из десятков страниц ранжируется одна-две, остальные считаются дублями | Локальная фактура: адреса, кейсы, сроки доставки, региональные особенности — см. региональное SEO |
| Одинаковые Title и Description | Шаблон без переменных или с одинаковой хвостовой частью | Плохой сниппет, низкий CTR, признаки дублирования | Формулы с переменными и ручная доработка топовых страниц — см. Title и Description |
| Категория и подкатегория с похожим текстом | Копирование текста родителя в потомков при запуске | Каннибализация запросов, нестабильность позиций | Развести по интенту: категория — обзор, подкатегория — конкретика |
| Страницы фильтров с одним текстом | Единый SEO-блок выводится на все комбинации фильтров | Тысячи почти одинаковых документов, расход краулингового бюджета | Уникальный текст только на приоритетных комбинациях, остальные закрыть — см. фасетную навигацию |
| Дубли по URL | Слеш/без слеша, index.php, UTM-метки, регистр | Один и тот же текст доступен по нескольким адресам | 301-редиректы к канонической форме, rel=canonical |
Проверять внутренние дубли сервисами уникальности бессмысленно — они смотрят наружу. Нужен краулер: Screaming Frog умеет считать сходство контента между страницами сайта, Топвизор и Serpstat дают отчёты по дублям метатегов. Порядок действий — сначала выгрузить все страницы с текстом, затем сравнить попарно и отсортировать по проценту совпадения. Всё, что выше 85% сходства между разными URL, — кандидат на переработку или склейку.
Карточки товаров: отдельная история
Самый болезненный сценарий: интернет-магазин с 20 000 позиций, описания взяты из прайса производителя, ровно те же описания стоят у сотни конкурентов. Требовать здесь 95% уникальности — значит остановить проект.
Рабочая стратегия строится на приоритизации, а не на тотальной уникализации.
Сегментировать ассортимент по спросу
Выгрузите частотность по товарным запросам через Вордстат, сопоставьте с маржинальностью и остатками. Обычно 10–15% позиций дают основную часть поискового спроса — с них и начинают.
Уникализировать топ-сегмент вручную
Для приоритетных карточек — полноценное описание: для кого товар, чем отличается от соседних моделей, что в комплекте, типичные ошибки при выборе. 1200–2500 знаков осмысленного текста.
Для среднего сегмента — блочная схема
Оставить характеристики поставщика как есть (их менять и не надо — это фактические данные), но добавить 2–3 уникальных блока: краткий вывод, сценарий применения, сравнение с ближайшей моделью.
Для хвоста — структурная уникальность
Отзывы, вопросы-ответы, блок «с этим товаром покупают», характеристики в разметке Schema.org. Уникальность возникает за счёт пользовательского контента и структуры, а не за счёт переписывания.
Убрать внутреннее дублирование
Проверить, чтобы описания не повторялись между карточками своего же сайта. Одинаковый текст на 40 модификациях одного товара вредит сильнее, чем совпадение с прайсом производителя.
Замерить эффект и расширять
Через 6–10 недель сравнить динамику индексации и трафика уникализированного сегмента с контрольной группой. Если эффект есть — двигаться дальше по списку приоритета.
Контрольная группа в шестом шаге — принципиальный момент. Без неё вы не отличите эффект уникализации от общего сезонного роста и не сможете обосновать бюджет на продолжение работ. Подробнее о выстраивании такого процесса — в гиде по SEO для интернет-магазина.
ИИ-тексты и уникальность
С массовым приходом генеративных моделей вопрос уникальности перевернулся. Раньше высокий процент был косвенным признаком того, что текст писали, а не копировали. Теперь любая нейросеть выдаёт 95–100% технической уникальности с первой попытки — потому что генерирует последовательности слов заново, а не копирует их.
Это означает, что процент уникальности перестал быть индикатором качества вообще. Проверка на уникальность ИИ-текста ничего не говорит ни о его полезности, ни о достоверности, ни о пригодности к публикации.
Что реально проверять в ИИ-тексте
- Фактические ошибки. Главный риск генерации — правдоподобные, но выдуманные факты: несуществующие нормативы, неверные цифры, ссылки на несуществующие исследования. Проверять нужно каждое утверждение с цифрой.
- Отсутствие конкретики. Модель по умолчанию пишет обтекаемо: «важно учитывать множество факторов», «зависит от специфики бизнеса». Такой текст технически уникален и содержательно пуст — это ровно то, что фильтруется как малополезный контент.
- Шаблонность структуры. Одинаковые вводные абзацы, одинаковые переходы, одинаковые заключения на сотне статей — это уже внутреннее дублирование на уровне структуры, даже если слова разные.
- Устаревшие данные. Модель обучена до определённой даты и не знает изменений в алгоритмах, законах, ценах.
- Отсутствие опыта. Нейросеть не может рассказать, что произошло на вашем проекте в прошлом квартале. А именно этого требуют критерии E-E-A-T.
Позиция поисковых систем по ИИ-контенту прагматична: сам факт использования модели не является нарушением, наказывается результат — массовая публикация текстов без пользы. Поэтому рабочая схема выглядит так: нейросеть используется как черновик и ускоритель, эксперт добавляет фактуру и опыт, редактор проверяет достоверность. Как встроить это в процесс без риска — подробно в статье про нейросети в SEO.
НОВЫЙ КРИТЕРИЙ ПРИЁМКИ
Старое ТЗ: «уникальность не ниже 95%, тошнота не выше 7%». Новое ТЗ: «уникальность не ниже 90%; в тексте не менее пяти конкретных фактов, которых нет у конкурентов из ТОП-10; каждая цифра подтверждена источником; есть минимум одна таблица и один разбор типичной ошибки». Первое проверяется сервисом за минуту и ничего не гарантирует. Второе проверяется редактором за пятнадцать минут и определяет, будет ли текст ранжироваться.
Пошаговая проверка текста перед публикацией
Порядок, который мы используем на проектах. Он занимает 15–20 минут на статью и снимает подавляющее большинство проблем.
Проверка на техническую уникальность
Один фиксированный сервис, фиксированные настройки. Смотреть не на итоговый процент, а на подсвеченные фрагменты и их источники. Целые совпавшие абзацы — стоп; разрозненные обороты по 3–4 слова — норма.
Ручная проверка ключевых фраз
Взять 5–7 содержательных предложений и найти каждое в поиске в кавычках. Это проверка по базе самого поисковика — она видит то, чего может не знать сервис.
Проверка на внутренние дубли
Сравнить текст с уже опубликованными материалами своего сайта по той же теме. Если совпадение по смыслу выше 60–70% — вместо новой страницы лучше дополнить существующую.
Тест на новизну относительно ТОПа
Открыть 5 конкурентов из выдачи и выписать, что есть в вашем тексте и чего нет у них. Если список пуст — это рерайт, каким бы ни был процент.
Проверка переспама и водности
Заспамленность в пределах нормы сервиса, отсутствие неестественных вхождений. Логика и пороги — в материале про SEO-тексты без переспама.
Фактчекинг
Каждая цифра, норматив, срок и цена — с подтверждением. Особенно критично для YMYL-тематик и для текстов, прошедших через генеративную модель.
Фиксация авторства
Отправить текст в «Оригинальные тексты» Яндекс.Вебмастера до публикации, затем опубликовать и сразу отправить URL на переобход.
Что делать, если текст украли
Ситуация рядовая: материал скопировали на несколько сайтов, а один из них ранжируется выше вас. Порядок действий по возрастанию усилий.
- Зафиксировать факт. Найти все копии через поиск по точной фразе в кавычках или через Content Watch. Сохранить скриншоты и URL с датами.
- Убедиться, что вы первоисточник в глазах поиска. Проверить, когда ваша страница попала в индекс. Если копия проиндексирована раньше вашего оригинала — это ваша проблема со скоростью индексации, и решать её надо системно.
- Написать владельцу сайта. В половине случаев вопрос решается письмом: копию удаляют или ставят ссылку на источник. Это самый быстрый и дешёвый путь.
- Жалоба хостеру и в поисковые системы. Через контакты из whois-данных хостинга, а также через формы обратной связи поисковиков.
- Юридический путь. Досудебная претензия с фиксацией авторства. Имеет смысл при систематическом воровстве или при копировании коммерчески значимых материалов.
- Усилить оригинал. Самая надёжная защита: дополнить свой материал так, чтобы он стал заметно полнее копии, и добавить внутренние ссылки на него с сильных страниц — механики в статье про внутреннюю перелинковку.
Профилактика работает лучше реакции: быстрая индексация новых материалов, отправка в «Оригинальные тексты», регулярное обновление ключевых статей. Украденный текст, который на вашем сайте обновляется раз в квартал, а на чужом лежит мёртвым грузом, со временем проигрывает оригиналу сам.
Регламент по уникальности для контент-команды
Чтобы всё вышесказанное превратилось в процесс, а не в разовые проверки, нужен короткий внутренний документ. Минимальный состав:
- Один сервис и один порог для каждого типа страниц — из таблицы выше. Настройки зафиксированы, скриншот проверки прикладывается к сдаче материала.
- Запрет на синонимайзеры в любом виде. Обнаружение — основание для отклонения работы без правок.
- Обязательный блок новизны: перед сдачей автор пишет 3–5 пунктов, чего нет в материалах конкурентов из ТОП-10. Это тридцатисекундное упражнение, которое отсекает рерайт на входе.
- Правила по цитатам: цитаты законов, ГОСТов и исследований не переписываются, оформляются как цитаты с указанием источника и выводятся из-под требования уникальности.
- Проверка на внутренние дубли раз в квартал краулером по всему сайту.
- Фиксация авторства для всех материалов с экспертной ценностью.
Такой регламент занимает одну страницу и экономит недели споров. Он же снимает главный конфликт между SEO-специалистом и копирайтером: спор идёт не о цифре в сервисе, а о том, что нового появилось в тексте. Как это встраивается в общий процесс — в чек-листе по внутренней оптимизации сайта, а примеры реализованных контент-стратегий есть в портфолио.
Частые вопросы
Зависит от типа страницы. Для информационной статьи в блоге — от 90%, для коммерческой посадочной — 85–95%, для карточки товара — 70–85%, для юридических и медицинских текстов с обязательными цитатами — 60–80%. При этом сам порог — только фильтр против копипаста, а не цель. Текст с 92% и пятью фактами, которых нет у конкурентов, всегда сильнее текста со 100% и нулевой новизной.
Из-за разной длины шингла и разных баз сравнения. При шингле длиной 3 сервис ловит даже устойчивые обороты вроде «в течение рабочего дня», при шингле 5–6 они проходят как уникальные. Плюс у каждого сервиса свой индекс: один знает документ, другой — нет. Разброс в 15–20 процентных пунктов между сервисами — обычное дело. Решение: зафиксировать один сервис с одними настройками в ТЗ и приёмке.
Санкций за это не будет. Карточка с описанием из прайса производителя просто не получит преимущества по текстовым факторам и с высокой вероятностью не будет ранжироваться по низкочастотным запросам как самостоятельный документ. Гораздо опаснее другое — когда одинаковое описание стоит на десятках карточек внутри вашего же сайта: это создаёт массив дублей, расходует краулинговый бюджет и ведёт к каннибализации внутри категории.
Сам факт использования модели нарушением не является — поисковики оценивают результат, а не инструмент. Проблема в том, что генерация даёт 95–100% технической уникальности при возможной нулевой пользе: обтекаемые формулировки, выдуманные факты, шаблонная структура. Рабочая схема — нейросеть как черновик, эксперт добавляет фактуру и опыт, редактор проверяет каждую цифру. Публикация сырой генерации массово — прямой путь под фильтры за малополезный контент.
Дата в теле статьи ничего не доказывает. Работают: раннее попадание в индекс (ускоряйте переобход в Вебмастере), отправка текста в раздел «Оригинальные тексты» Яндекс.Вебмастера до публикации, история публикаций домена по теме, ссылки на ваш материал. Если копию проиндексировали раньше оригинала, доказать авторство алгоритмически будет сложно — поэтому профилактика (быстрая индексация плюс фиксация текста) дешевле любой последующей борьбы.
Только те, что имеют потенциал трафика. Порядок такой: выгрузите страницы с показами из Вебмастера, отсортируйте по потенциалу, проверьте уникальность у верхних. Переписывать имеет смысл там, где страница получает показы, но не получает кликов, или ранжируется во второй-третьей десятке. Массовая переработка всего архива ради процентов — это трата бюджета: страница без спроса не начнёт приносить трафик от того, что её уникальность выросла с 60% до 95%.
Косвенно — да. Документ, признанный дублем существующего, может не попасть в основной индекс вовсе: он склеивается с оригиналом. Если сайт систематически публикует заимствованный контент, робот со временем снижает интерес к нему и обходит реже. Обратная сторона: регулярная публикация действительно новых материалов повышает частоту обхода. Так что уникальность влияет не на скорость индексации конкретной страницы, а на общее отношение робота к сайту.
Ни то, ни другое само по себе. Важна полнота ответа на запрос: раскрыты ли подтемы, на которые пользователь ждёт ответа, есть ли конкретика, структура, таблицы, ответы на смежные вопросы. Объём — производная от полноты, а не самостоятельная цель: если тема исчерпывается в 3000 знаков, растягивание до 12000 только ухудшит показатели вовлечённости. Уникальность — это порог допуска. Полнота и новизна — то, что определяет позицию.
Соберём контент-стратегию, где тексты работают на позиции, а не на проценты
Проверим существующие тексты на реальную ценность и внутренние дубли, соберём регламент для копирайтеров, уникализируем приоритетные карточки и посадочные, зафиксируем авторство ключевых материалов. Прозрачный договор, отчёты каждую неделю.
- Пакет «Старт» от 55 000 ₽/мес
- Пакет «Стандарт» 75 000 ₽/мес
- Пакет «Премиум» 95 000 ₽/мес
- Бесплатный аудит и прогноз
- Договор с гарантией результата
- Отчёты каждую неделю
Комментарии (14)
Евгений
Объяснение про шинглы стоило прочитать хотя бы ради того, чтобы перестать спорить с копирайтером. Пять лет писал в ТЗ «100% по text.ru» и ни разу не задумывался, что именно там считается.
Ирина_К
У нас интернет-магазин сантехники, около 12 тысяч позиций, описания из прайсов производителя. Полгода мучили копирайтеров требованием 95% на карточку, пока не поняли, что это физически невозможно. Таблица с порогами прямо про нашу боль: 70–85% и приоритизация вместо тотальной уникализации.
AdminSEO Мастер
Ирина, вы описали типичный сценарий. При таком ассортименте начинайте с сегментации по спросу — обычно 10–15% позиций дают основную часть трафика, их и уникализируют вручную. Остальным достаточно блочной схемы и структурной уникальности через отзывы и вопросы-ответы.
Станислав В.
Пункт про разную длину шингла закрыл вопрос, почему Advego и text.ru расходятся на 15 пунктов по одному и тому же тексту. Раньше грешил на глюки сервиса.
vladimir77
А как быть, если текст показывает 91%, но заказчик упёрся и требует 100%? Аргументы про устойчивые обороты он не слышит.
AdminSEO Мастер
Владимир, покажите заказчику не итоговый процент, а сам отчёт с подсветкой: если совпадения — это «в течение рабочего дня» и «при заказе от», разговор обычно заканчивается сам. Второй рабочий приём — прогнать через тот же сервис страницы конкурентов из ТОП-3, там цифры чаще всего ниже требуемых ста процентов.
Ольга Т.
Спасибо за раздел про внутренние дубли. Мы честно проверяли каждый текст на уникальность относительно интернета и совершенно упустили, что у нас 30 страниц по городам с одним и тем же текстом и подстановкой названия.
Никита_копирайтер
Как автор скажу: дотягивание с 93 до 100 действительно съедает больше времени, чем половина статьи. И текст после этого становится хуже, это видно невооружённым глазом.
Алла
Немного не соглашусь с градацией уровней. Компиляция из 5–10 источников на практике часто выглядит как каша: собрано много, а читать невозможно. Уровень 3 сильно зависит от редактора, без него он ничем не лучше рерайта.
AdminSEO Мастер
Алла, замечание справедливое. Ценность компиляции возникает именно за счёт структуры и навигации по теме, а не за счёт объёма собранного — без редактуры она действительно скатывается к уровню 2. Поэтому в статье и оговорка «уже приемлемо, если добавлена структура».
Глеб М.
Приём с проверкой фраз в кавычках через поиск — очевидная вещь, до которой почему-то не доходят руки. Прогнал вчера семь предложений из статьи подрядчика, три нашлись слово в слово на чужом сайте. Сервис при этом показывал 96%.
Тимур_бизнес
Вопрос по «Оригинальным текстам» в Вебмастере: есть ли смысл заливать туда вообще всё, что публикуем, или только ключевые материалы? У нас выходит по 15–20 статей в месяц.
AdminSEO Мастер
Тимур, гнать туда весь поток смысла мало — инструмент даёт дополнительный сигнал авторства, а не защиту. Заливайте то, что реально представляет ценность и что вероятнее всего скопируют: исследования, кейсы с цифрами, объёмные гайды. Остальное закрывается быстрым переобходом после публикации.
Полина
Формулировка нового ТЗ в блоке про приёмку — забрала себе целиком. «Не менее пяти фактов, которых нет у конкурентов из ТОП-10» звучит куда осмысленнее любой цифры уникальности.
kirill_seo
Про ИИ-тексты всё верно. Заказчик радуется 99% на выходе из нейросети, а внутри пять выдуманных нормативов и ни одной конкретной цифры. Фактчекинг теперь занимает больше времени, чем сам текст.
Раиса Н.
А что если тексты украли и копия висит на площадке, которая явно старше и трастовее нашего сайта? Письма владельцу без ответа. Есть ли вообще шанс отыграть или проще переписать материал заново?
AdminSEO Мастер
Раиса, если копия проиндексирована раньше и стоит на сильном домене, отыграть алгоритмически трудно — здесь чаще срабатывает связка «жалоба хостеру плюс досудебная претензия». Параллельно усиливайте оригинал: дополните материал так, чтобы он стал заметно полнее копии, и подведите к нему внутренние ссылки с сильных страниц. Если такие ситуации повторяются, приходите на бесплатный аудит — обычно корень проблемы в скорости индексации.
Артур
Пример с техрегламентом и уникальностью 55% отличный. У нас юридическая тематика, половина текста — цитаты законов, и каждый новый маркетолог первым делом требует их переписать.
Женя_редактор
Внедрили у себя пункт про блок новизны: автор перед сдачей пишет 3–5 тезисов, чего нет у конкурентов. Рерайт отсекается на входе, потому что написать эти пункты по чужой статье просто нечего.