Санкций только за сам факт размещения одной копии чужой статьи обычно ожидать не нужно, но в вашем случае полагаться на rel="canonical" не стоит: если страница нужна только для отправки клиентам и не должна участвовать в поиске, правильнее закрыть её через noindex.
Google прямо указывает, что наличие дублированного контента само по себе не является нарушением правил в отношении спама. Обычно поисковик группирует одинаковые или очень похожие документы и выбирает одну версию как каноническую.
Но canonical — не запрет на индексирование и не гарантированная директива. Это сигнал поисковой системе, который она может проигнорировать. Более того, для синдицированного, то есть повторно опубликованного на другом сайте, контента Google сейчас рекомендует не рассчитывать на canonical как основной способ устранения дубля. Если копия не должна попадать в поиск, надёжнее запретить её индексирование.
Для вашей задачи достаточно:
Страница при этом продолжит нормально открываться по прямой ссылке. Вы сможете отправлять её клиентам, но Google и Яндекс не должны показывать её в результатах поиска после обработки noindex.
Не закрывайте такую страницу одновременно через robots.txt, если рассчитываете на noindex. Поисковому роботу нужно получить HTML страницы и увидеть метатег. Если запретить обход через robots.txt, робот может не прочитать noindex.
С Яндексом есть ещё одна причина не строить решение на external canonical: в документации Яндекс Вебмастера для rel="canonical" прямо рекомендуется указывать канонический адрес в пределах одного домена. То есть canonical с вашего сайта на исходную статью другого домена нельзя считать рабочим способом исключения копии из Яндекса.
Если говорить именно о риске санкций, одна техническая страница для клиентов существенно отличается от массового копирования чужих материалов ради поискового трафика. Google относит к спамным практикам масштабное создание страниц из скопированного контента без дополнительной ценности, когда это делается для манипулирования поисковой выдачей. Из описанного вами сценария такой цели нет.
Оптимальная схема здесь:
- Размещаете копию статьи на отдельном URL.
- Ставите .
- Не запрещаете этот URL через robots.txt.
- Не добавляете страницу в основные разделы сайта и XML Sitemap, если она является исключительно служебным материалом для клиентов.
- При желании ставите обычную ссылку на оригинальный источник.
Canonical в такой схеме вообще не нужен.
Если материал должен быть доступен только конкретным клиентам и нет необходимости делать его публичным, ещё чище использовать страницу с авторизацией или паролем. Тогда поисковые системы вообще не получат содержимое статьи.
Отдельный вопрос — права на сам текст. Canonical сообщает поисковой системе о предпочитаемой версии страницы, но не является разрешением автора на копирование произведения. Поэтому отсутствие SEO-санкций и наличие права полностью перепубликовать чужую статью — две разные вещи.
Для задачи «дать клиенту удобную ссылку на хороший чужой материал, не пытаясь ранжировать его копию» я бы выбрал noindex, а не cross-domain canonical.