Ржанский Д.

Важно ли соотношение HTML-кода и текста и есть ли минимальный порог?

Разбор влияния соотношения текста и HTML-кода на сканирование, индексирование и ранжирование. Официальная позиция Google, актуальный лимит загрузки HTML и практические критерии проверки страницы.

Дмитрий Ржанский Дмитрий Ржанский 1 просмотров

Нет: Google не использует соотношение текста к HTML-коду как самостоятельный SEO-фактор, а официального минимального процента не существует. Показатели вроде 10%, 15% или 20%, которые показывают некоторые аудиторские инструменты, — их внутренние пороги, а не требования поисковых систем. Google Search Central прямо называет text-to-code ratio нерелевантным для Google Search показателем.

Что измеряет text-to-HTML ratio

Text-to-HTML ratio — доля извлечённого текста относительно объёма HTML-документа. Формула выглядит объективно, но результат зависит от методики расчёта:

  • учитываются ли навигация, футер и скрытые элементы;

  • входят ли в объём встроенные CSS, JavaScript и JSON-LD;

  • анализируется исходный ответ сервера или DOM после выполнения JavaScript;

  • учитываются ли пробелы, комментарии и служебная разметка.

Поэтому два SEO-краулера могут показать разные значения для одной страницы. Сам коэффициент не позволяет определить, хорошо ли робот понимает страницу и достаточно ли на ней полезной информации.

Когда большой объём кода действительно мешает

Низкий процент текста не является проблемой сам по себе. Значение имеют конкретные технические последствия.

HTML превышает лимит загрузки Googlebot

По актуальной документации Googlebot загружает первые 2 МБ поддерживаемого файла. Когда лимит достигнут, оставшаяся часть документа не загружается и не передаётся на индексирование. Ограничение применяется к несжатым данным; подключённые CSS и JavaScript загружаются отдельно и имеют собственные лимиты.

Раздутый HTML становится SEO-проблемой, если важный текст, canonical, структурированные данные или другие критические элементы оказываются после границы загрузки. Такое возможно при использовании крупных встроенных скриптов, CSS, Base64-изображений или многомегабайтных блоков шаблонной разметки.

Проблемой здесь является не плохое соотношение текста и кода, а недоступность части документа для робота.

Большой DOM ухудшает производительность

DOM — дерево элементов, которое браузер создаёт после разбора HTML и выполнения JavaScript. Большой или чрезмерно вложенный DOM может увеличить время пересчёта стилей и расположения элементов, нагрузку на память и задержку при взаимодействии со страницей. Chrome рекомендует оценивать фактическую стоимость операций style и layout, а не только число элементов.

Это проблема производительности, а не санкция за низкий text-to-HTML ratio. Возможное поисковое значение возникает через реальные характеристики страницы, включая Core Web Vitals, а не через процент текста в исходном коде.

Текста мало, но страница решает задачу

Карточка товара, калькулятор, форма, фотогалерея или страница контактов могут содержать мало текста и при этом полностью соответствовать интенту. Google не устанавливает минимальную или максимальную длину контента для ранжирования.

Добавлять абзацы только ради увеличения коэффициента не следует. Яндекс относит к нарушениям искусственно увеличенные SEO-тексты, которые не решают задачу читателя и не дают дополнительной ценности.

Что проверять вместо процента

Не устанавливайте KPI вида «текст должен занимать не менее 15% HTML». Используйте четыре проверки.

  1. Доступность основного контента. Через проверку URL в Google Search Console убедитесь, что текст, ссылки, title, canonical и структурированные данные присутствуют в исходном или отрендеренном HTML. Google рекомендует проверять, видит ли робот страницу так же, как пользователь.

  2. Размер HTML-ответа. Документ должен оставаться с существенным запасом ниже текущего лимита Googlebot в 2 МБ. При аномально большом размере вынесите CSS и JavaScript во внешние файлы, удалите встроенные Base64-ресурсы и сократите повторяющуюся шаблонную разметку.

  3. Производительность. Проверяйте LCP, INP, CLS, сетевой payload и затраты браузера на style и layout. Оптимизировать нужно подтверждённые узкие места, а не формальный коэффициент.

  4. Смысловая достаточность. Контент должен закрывать интент конкретного типа страницы. Количество текста определяется необходимостью объяснить товар, услугу, функцию или вопрос, а не требованиями инструмента к проценту.

Если аудит показывает «низкое соотношение текста к HTML», сначала проверьте, существует ли реальная проблема: чрезмерный размер документа, недоступный роботу контент, медленный рендеринг или недостаточное смысловое покрытие. Если этих симптомов нет, исправлять процент не требуется.

Разобрать проблему на вашем сайте

Опишите проблему — найду вероятную причину и предложу понятный план исправлений без лишних работ.

Связаться