Нет: текст с исчезнувшего сайта нельзя автоматически считать уникальным только потому, что исходный URL больше не работает. Но и обратное утверждение — что Google или Яндекс навсегда «помнят» старую публикацию и поэтому такой текст будет 100% неуникальным — официально не подтверждено.
Что происходит с точки зрения поисковика
У Google нет публичной метрики «уникальность текста в процентах». При индексировании Google определяет основной контент страниц, а найденные одинаковые или очень похожие страницы может объединять в кластер дублей и выбирать одну из них как каноническую. Это относится к обнаруженным поисковиком страницам, а не к публичному правилу «однажды опубликованный текст навсегда закрепляется за первым URL».
При этом исторические данные могут некоторое время влиять на состояние URL. В Google Search Central в 2023 году объясняли, что URL может отображаться как дубль потому, что страницы в какой-то момент были дублями или почти дублями. Там же указано, что индекс обновляется после повторного сканирования и обработки URL. Это подтверждает наличие исторического состояния, но не подтверждает существование вечного реестра текстов, из-за которого повторная публикация спустя годы автоматически считается неуникальной.
Если старый сайт давно исчез, его URL отдаёт 404/410 или домена уже нет, а других доступных копий текста поисковик не находит, у новой страницы может не быть текущей конкурирующей копии. Это не делает текст авторским или оригинальным: по происхождению он остаётся скопированным.
Веб-архив не превращает копию в оригинальный текст
Wayback Machine хранит архивные снимки старых страниц. Сам факт, что оригинал сейчас доступен только через архив, не означает, что текст стал новым. Справка Internet Archive отдельно говорит о получении архивных версий сайта, права на который принадлежат пользователю; наличие снимка само по себе нельзя трактовать как разрешение на чужую перепубликацию.
Для SEO важнее не формальный процент совпадения, а то, что вы публикуете. Google рекомендует не копировать чужой контент целиком или частично. В правилах о скрейпинге Google отдельно приводит публикацию чужих материалов без дополнительной ценности среди проблемных сценариев, когда копирование используется для манипулирования ранжированием. Массовое создание малоценных неоригинальных страниц ради поисковых позиций может также подпадать под правила о недопустимом масштабировании контента.
У Яндекса позиция ещё прямее: среди признаков малополезного контента он указывает полное или частичное копирование с других ресурсов и минимальное изменение исходного материала. То есть исчезновение первоисточника само по себе не превращает скопированный материал в хороший оригинальный контент.
Можно ли такой текст использовать
Если права на материал у вас есть, старый текст можно восстановить, но публиковать его точной копией только ради экономии на контенте — слабая стратегия. Лучше использовать архивную версию как исходник: проверить устаревшие факты, перестроить материал под текущий интент, добавить собственные примеры, данные, выводы и удалить то, что больше не актуально. Простая замена слов синонимами проблему не решает: Google и Яндекс отдельно приводят минимальные переделки скопированного текста как слабый сценарий.
Если права на материал вам не принадлежат, SEO-вопрос вторичен: наличие страницы в Wayback Machine не означает разрешения на её копирование.
Проверять ситуацию лучше не сервисом «уникальности 87%», а по фактическим копиям. Возьмите несколько длинных характерных фраз и найдите их в кавычках в Google и Яндексе, проверьте старый URL и зеркала, затем посмотрите, существуют ли сейчас индексируемые страницы с тем же материалом. Это покажет текущую конкуренцию дублей, но не докажет, что поисковик забыл всю историю текста.
Практический вердикт: исчезнувший оригинал не делает старый текст автоматически уникальным, однако доказательств правила «поисковики помнят его навсегда, поэтому он всегда будет 100% неуникальным» нет. Если материал нужен для SEO, безопаснее считать его восстановленным чужим или старым контентом и добавлять самостоятельную ценность, а не пытаться пройти формальную проверку уникальности.