У attik.ru в выборку попали две страницы одного шаблона. Посадочная под дачные окна стоит седьмой по запросу «тёплые окна для дачи», общая категория пластиковых окон — тридцать пятой по «пластиковые окна купить». Подключений поровну, по 22 скрипта и 54 файла стилей на обеих. Сервер один, отвечает за 335 и 327 мс. Документы различаются на 42 килобайта.

Расходятся эти страницы там, где заканчивается техничка. 1205 слов против 2015, картинок 50 против 79. Дальше идёт on-page, то есть объём, полнота раскрытия темы и соответствие странице своему запросу.

Это не единичный случай. По всем 111 сайтам, где в выборку попали и высокие, и низкие адреса, картина та же. Между разными сайтами техничка отделяет верх от низа уверенно. Внутри одного сайта перестаёт. Алгоритм ранжирования Яндекса опирается на сотни факторов, и техничка среди них тот слой, который задаёт условия участия, а не место в выдаче.

Паспорт замера Method
Выборка
2585 страниц после очистки
Запросы
160, шестнадцать ниш
Группы
топ-10 против позиций 31–49
Регион
Москва
Дата съёма
09.09.2026
Поисковик
Яндекс
Браузерный слой
179 URL, по три прогона
Исключения
заглушки бот-защиты с кодом 200

Что здесь не будет разбираться

On-page слой я уже измерял отдельно, на 1601 странице по 162 запросам. Там проверялись title, description, H1, подзаголовки, объём текста, изображения, микроразметка и полнота интента. Ни полнота интента, ни длина title, ни большинство привычных ручных правок порядок мест внутри выдачи не объясняли.

Второй раз я это разбирать не буду. Эта работа только про техничку. Что отдаёт сервер, сколько весит загрузка, как настроен обход, кого сайт пускает к себе. Поисковая система видит этот слой раньше остальных, до текста, ссылок и поведения, и именно поэтому его удобно мерить снаружи.

Две величины, которые нельзя путать

Дальше в статье всё время идут две цифры, и они про разное.

Размер HTML — это сам документ, который отдаёт сервер, без скриптов, стилей, картинок и шрифтов. Медиана топ-10 здесь 395 КБ. Объём загрузки — всё, что браузер реально скачал, чтобы показать страницу. Медиана топ-10 уже 3,2 МБ.

Разница между ними в сорок с лишним раз. На HTML приходится всего 2,2% от того, что качает браузер, и эта доля одинакова у топа и у хвоста выдачи.

Что означают цифры в скобках

В таблицах попадаются обозначения из статистики. Читать их нужно так.

p = 0,128
Такую разницу легко получить на пустом месте, случайным совпадением, и строить на ней вывод нельзя
p < 0,001
Чтобы это совпало случайно, нужно невероятное везение. На такой вывод опираться можно
95% интервал [−1060; 26 170]
Настоящая разница лежит где-то между этими двумя числами. Если между ними помещается ноль, разницы может не быть совсем
коэффициент −0,224
Насколько тесно связаны две величины. Ноль — связи нет, единица — жёсткая зависимость. 0,224 означает, что по размеру страницы её место в выдаче не угадаешь
медиана
Значение ровно посередине: половина страниц больше, половина меньше. Один гигантский сайт её не перекосит, в отличие от среднего арифметического

Шестнадцать признаков на одной шкале

А теперь число, которое ломает всю первую половину статьи. Прежде чем разбирать находки по одной, вот вся картина сразу. Метрика простая. Беру две страницы из одной выдачи и смотрю, у какой признак больше и какая стоит выше. Считаю по всем парам внутри каждого запроса, а их набралось 20 020. Пятьдесят из ста означает монетку, то есть признак не связан с местом вообще.

4050 — монетка60
Размер HTML
58,5 из 100
DOM-узлов
57,0 из 100
Ссылок на страницеon-page, для сравнения
55,5 из 100
Слов на страницеon-page, для сравнения
55,2 из 100
Подсказок preload
54,8 из 100
Картинок
53,7 из 100
Длина descriptionon-page, для сравнения
52,4 из 100
Блоков микроразметки
52,1 из 100
Семантических тегов
51,6 из 100
Длина titleon-page, для сравнения
51,3 из 100
Параметров в URL
51,3 из 100
Файлов JavaScript
50,4 из 100
Файлов CSS
49,8 из 100
Смешанного контента
48,5 из 100
Блокирующих скриптов
47,6 из 100
Время ответа сервераменьше — выше
45,1 из 100

2585 страниц, 160 выдач, 20 020 пар внутри запросов. Ничьи делятся пополам. Серым отмечены два on-page-признака и длина мета-тегов, взятые для сравнения. Их я мерил отдельно, на 1601 странице.

Лучший технический признак лишь немного лучше монетки. Ни один не уходит от пятидесяти дальше чем на девять пунктов.

Читается это так. Размер HTML оказался сильнейшим из шестнадцати, и даже он ошибается в 41 случае из 100. Время ответа сервера ушло влево. Страница с бо́льшим временем стоит выше только в 45 случаях из 100, так что быстрые хосты в этих данных чаще наверху. А число файлов JavaScript и CSS сидит на пятидесяти, то есть на чистой монетке.

Что это значит для SEO Ни один технический признак не работает как рычаг: даже лучший ошибается в четырёх случаях из десяти. Это не повод забить на техничку, а повод продавать её как условие участия, а не как причину роста.

Что обещают чеклисты и что в данных

Технический аудит продают под обещание роста позиций. Я сам продаю технический аудит и считаю, что он нужен, — но за другим. Вот пять утверждений, которые лежат в топе выдачи по запросам про техническую оптимизацию, и то, что показал замер топ-10 Яндекса.

Обещания чеклистов против данных замера
Что пишутЧто в данных
«Скорость — самостоятельный фактор качества, она напрямую влияет на позиции» Времена загрузки топ-10 и позиций 31–49 не различаются. Первая отрисовка 842 против 736 мс, событие load 2131 против 1786 мс. Оба интервала включают ноль
«Страница грузится дольше трёх секунд — посетители уходят, позиции падают» 34,5% страниц топ-10 грузятся дольше трёх секунд. Дольше пяти — каждая пятая. Порог реальный для конверсии, но выдача его не наказывает
«Начните оптимизацию с технических факторов — их больше сотни» Из шестнадцати замеренных признаков сильнейший даёт 58,5 из 100 при монетке в 50. Половина чеклиста не различает первую десятку и четвёртую вовсе
«Сократите вес страницы и число запросов» Наверху страницы тяжелее. Загрузка 3267 КБ против 2159, запросов 127 против 79. Лёгкость — не признак топа
«Уберите ошибки разметки и дубли — это поднимет сайт» У топ-10 ошибок в микроразметке почти вдвое больше, чем у хвоста (16,7% против 9,4%), дублей title — вдвое с лишним. Чинить надо, но роста это не обещает
Что это значит для SEO Технический аудит остаётся нужен, только продавать его честнее не как рычаг позиций, а как проверку допуска: доступен ли сайт роботу, попадает ли в индекс, не плодит ли дубли, не выпадает ли за границы того, что реально стоит в выдаче. Обещание «поднимем позиции за счёт скорости» этими данными не подкреплено — и клиент рано или поздно это проверит.

Правда ли топ тяжелее? можно опираться

Ожидание

Лёгкие страницы должны быть ближе к топу

В данных

Топ тяжелее на 51% по загрузке. Лёгкость не признак верхней выдачи

Сначала всё выглядело просто. Данные аудита по всем 2585 страницам показывают ровный градиент.

Размер HTML по полосам позиций Медиана размера HTML: 448 КБ в позициях 1–3, 375 КБ в 4–10, 260 КБ в 31–39, 228 КБ в 41–49. 448 КБ 1–3 375 КБ 4–10 260 КБ 31–39 228 КБ 41–49 Медиана размера HTML-документа, килобайты
Чем ниже выдача, тем легче HTML. 2585 страниц, Яндекс, Москва, 09.09.2026.
Медианы технических метрик по полосам позиций
Полоса позицийРазмер HTML, КБDOM-узлов
1–34481937
4–103751763
31–392601364
41–492281303

Связь размера HTML с позицией на диапазоне 1–49 равна −0,224 при 2585 наблюдениях. Минус читается как «больше HTML — выше место», но связь слабая. Отличить топ от хвоста по ней можно, а угадать место конкретной страницы по её весу нельзя.

Данные аудита показывают только документ. Чтобы увидеть, что реально уходит в браузер, я взял 192 адреса поровну из шестнадцати ниш и открыл каждый трижды так, будто пользователь пришёл впервые, с пустым кэшем и чистым профилем. Байты считал сам браузер. Привычный способ, performance.transferSize, здесь врёт. Он показывает ноль для всего, что грузится с чужих доменов, а это половина рекламы и все CDN.

Успешно измерились 179 адресов: 88 сверху и 91 снизу.

топ-10 позиции 31–49
Объём загрузки 3267 / 2159 КБ
JavaScript 1104 / 716 КБ
Запросов 127 / 79
DOM-узлов 2110 / 1311

Три показателя, где разницы не видно нельзя опираться

  • Картинки: +64%, но интервал [−33; 578] КБ включает ноль
  • CSS: +2%, интервал [−28; 29] КБ
  • Шрифты: +6%, интервал [−80; 94] КБ

179 адресов, 88 сверху и 91 снизу · на каждый по три прогона, берётся средний · байты считаны самим браузером

Разрыв держится на скриптах и числе запросов. Картинки, стили и шрифты проверку интервалом не проходят.

У трёх показателей выше между границами помещается ноль. Значит, разницы может не быть вовсе, и такой результат я считаю неподтверждённым, как бы внушительно ни выглядела средняя цифра.

Точные значения браузерного замера
Браузерный замер: топ-10 против позиций 31–49
МетрикаТоп-10Позиции 31–49Разница95% интервал
Объём загрузки3267 КБ2159 КБ+51%[45; 1729] КБ
JavaScript1104 КБ716 КБ+54%[68; 509] КБ
Запросов12779+61%[19; 69]
DOM-узлов21101311+61%[313; 1441]
Картинки779 КБ476 КБ+64%[−33; 578] КБ
CSS77 КБ76 КБ+2%[−28; 29] КБ
Шрифты189 КБ179 КБ+6%[−80; 94] КБ

Загрузку тяжелее трёх мегабайт имеют 53,4% страниц наверху против 36,3% внизу. Больше ста запросов делают 61,4% страниц топа против 33,0% внизу.

Почему счётчики скриптов ничего не решают

Чеклист говорит

Сократите число скриптов и стилей

Выдача показывает

14 против 12 и 5 против 5. Счётчики топ от хвоста не отличают

Технический аудит обычно считает штуки. Сколько скриптов, сколько файлов стилей, сколько картинок. По этим счётчикам верх выдачи от хвоста почти не отличается. Данные те же самые — 1215 страниц топ-10 против 1370 страниц с позиций 31–49, счётчики берутся из разбора HTML.

Количество подключений на странице
ПризнакТоп-10Позиции 31–4995% интервал разницы
Файлов JavaScript1412[0; 3]
Файлов CSS55[−1; 1]
Картинок4234[4; 13]
Блокирующих скриптов23[−1; 0]
Подсказок preload10[0; 1]

Стилей поровну, ровно по пять. Блокирующих скриптов наверху даже меньше, чем в хвосте. Число JS-файлов упирается интервалом в ноль. Уверенно расходятся только картинки, и то на восемь штук.

При этом по объёму те же самые страницы расходятся в полтора раза с лишним. 395 килобайт HTML против 242, 3267 килобайт загрузки против 2159, 1104 килобайта JavaScript против 716. Наверху не больше подключений, зато внутри того же их числа больше кода.

Что это значит для SEO Не тратьте день на сокращение 14 скриптов до 10, если страница нормально рендерится. Ровно столько же их у страниц с четвёртой страницы выдачи. Смотрите на килобайты кода, а не на счётчик.

Одна оговорка про этот замер. Байты я считал от момента открытия страницы до конца загрузки плюс ещё полторы секунды. Всё, что подгружается позже — картинки при прокрутке, поздняя аналитика, реклама по таймеру, — в цифру не вошло. Так что это объём первой загрузки, а не всё, что страница скачает за время визита.

Что проверяли
2585 страниц из выдачи Яндекса: топ-10 против позиций 31–49, 160 запросов, шестнадцать ниш. Плюс 179 адресов через настоящий браузер с холодным кэшем.
Что нашли
Наверху HTML крупнее на 63%, браузер качает на 51% больше данных, запросов на 61% больше, DOM на 61% крупнее. Времена загрузки при этом не различаются.
Что это значит
Тяжёлая страница и медленная страница совсем не одно и то же, и в отчёте их стоит разводить.
Что делать
Сравнивать свой сайт с топом по килобайтам и DOM, а не по числу подключений. И мерить времена, а не сумму байтов.

А если сравнить две страницы одного сайта? можно опираться

А потом я сравнил страницы внутри одного сайта, и картина сломалась.

Вернёмся к attik.ru и добавим к нему вторую пару, cem-cement.ru. Оба сайта отдали в выборку по одной странице сверху и по одной снизу.

Две пары страниц внутри одного домена
Страница и её запросПозицияJS / CSSОтвет, мсHTML, КБСлов
attik.ru — окна на дачу
«тёплые окна для дачи»
722 / 543353841205
attik.ru — пластиковые окна
«пластиковые окна купить»
3522 / 543274262015
cem-cement.ru — цемент
«цемент м500 купить мешок»
31 / 123544242461
cem-cement.ru — смеси для стяжки
«сухие смеси для стяжки пола»
351 / 123783501501

Техническая часть внутри каждого сайта совпадает. Тот же набор подключений, тот же шаблон, тот же сервер с разницей в десяток миллисекунд. А вот дальше начинается то, чем эти страницы действительно отличаются, и это контент. У attik.ru верхняя страница в полтора раза с лишним короче нижней, у cem-cement.ru наоборот, во столько же длиннее. Направления нет. Различие уходит в объём текста и полноту раскрытия темы, то есть в on-page, а не в техничку.

Оговорка, которую SEO-специалист задаст первой. Страницы стоят по разным запросам, а разные выдачи между собой не сравнивают. Так устроен весь этот тест. Он берёт сайты, у которых есть и высокие, и низкие адреса, и спрашивает, насколько техничка у первых отличается от технички у вторых. Ответ на 111 доменах — почти не отличается.

Сравнение внутри домена частично закрывает сайтовые свойства. Бренд, возраст домена, значительную часть его авторитета, CMS, инфраструктуру, CDN и защиту. Если у сайта одна страница стоит в топ-10, а другая — на 31–49, эти характеристики у них общие и объяснять разницу уже не могут.

Все неизвестные так не уберёшь. Внутри одного домена по-прежнему различаются ссылки на конкретный URL, его возраст, внутренний вес, глубина вложенности, тип страницы, содержание и пользовательские сигналы. Именно поэтому дальше идёт отдельная проверка на парах «тот же домен, тот же тип страницы».

Каждый из 111 доменов даёт один голос. Считается медиана его верхних страниц минус медиана нижних.

Что проверяли
Может, вся разница держится просто на том, что наверху стоят сайты покрупнее? Взял 111 доменов, у которых есть страницы и в топ-10, и на позициях 31–49, и сравнил их между собой.
Что нашли
Размер HTML: +11 463 байта вместо +157 075, если сравнивать топ с хвостом напрямую. DOM: −5 узлов. Обе цифры вполне могут оказаться случайными (p = 0,128 и p = 0,775).
Что это значит
Если бы техничка отдельной страницы решала, верхняя страница сайта была бы заметно тяжелее его же нижней. Она такая же. Тот же шаблон, тот же набор подключений, тот же сервер. Расходятся страницы по объёму и полноте контента, а это уже on-page.
Что делать
Закрыть технический слой один раз на уровне шаблона и перестать возвращаться к нему по каждой странице. Дальше работать тем, чем страницы одного сайта реально отличаются. Это соответствие запросу, полнота раскрытия темы, внутренние ссылки и глубина.

Ни одна строка в таблице ниже не проходит порог надёжности. По размеру HTML вышло 0,128, по DOM 0,775, а нужно меньше 0,05.

Парное сравнение внутри домена
МетрикаМедиана разницы95% интервалВерх большеp
Размер HTML+11 463 байт[−1060; 26 170]58%0,128
DOM-узлов−5[−87; 89]48%0,775
Ответ сервера−8 мс[−33; 8]45%0,343
Слов+108[−50; 418]56%0,215

Между группами целиком разрыв по HTML составлял +157 075 байт, по DOM +492 узла.

Строка со словами показывает +108 при интервале [−50; 418]. Объём текста внутри домена тоже не задаёт направления, потому что на одном сайте верхняя страница длиннее, на другом короче, и в сумме это ноль.

А если взять пары по одному и тому же запросу?

Самая честная версия проверки выглядела бы так. Один сайт, один запрос, две его страницы, одна в топ-10 и вторая на 31–49. Таких пар во всей выборке нашлось три. Статистику на трёх наблюдениях не строят, но посмотреть на них стоит.

Три пары страниц одного сайта по одному запросу
Сайт и запросПозицииHTML, КБСлов
practicum.yandex.ru
«как выбрать онлайн школу»
6 против 491128 / 867734 / 1247
selectel.ru
«как выбрать хостинг для сайта»
2 против 35282 / 2151602 / 1754
yandex.ru
«дизайн проект интерьера квартиры»
10 против 37578 / 93859 / 111

Во всех трёх случаях страница, которая стоит выше, короче своего же соседа снизу. 734 слова против 1247, 1602 против 1754, 59 против 111. По размеру документа направления нет, два раза верх крупнее и один раз мельче.

Что это значит для SEO Три наблюдения ничего не доказывают, но они ложатся туда же, куда и проверка на 111 сайтах. Наращивание объёма текста ради объёма в этой выборке с местом в выдаче не связано. Работает не длина, а то, насколько страница отвечает своему запросу. Это уже on-page слой, и мерил я его отдельно, на 1601 странице.

Первая мысль была простая: может, я просто выбрал странные 111 сайтов? Проверил, добавив промежуточный шаг.

Шаг 1 Вся выдача: верх против хвоста +157 КБ
Шаг 2 Только те же 111 сайтов, но всё ещё вперемешку +214 КБ
Шаг 3 Те же сайты, но сравниваем страницы внутри каждого +11 КБ осталось 7% исходного разрыва
DOM: +492
DOM: +404
DOM: −5

Разница по размеру HTML в килобайтах, шкала у всех трёх полос общая. На первом шаге сравнивались 1215 страниц против 1370, на втором 381 против 224, на третьем — 111 сайтов.

Дело не в выборе сайтов: на втором шаге разрыв даже вырос. Обваливается он только тогда, когда сравнение уходит внутрь домена.
Что это значит для SEO Гнать вес и DOM своей страницы к медиане топа бессмысленно: у сайтов, которые уже стоят наверху, их собственные нижние страницы технически выглядят так же. Техничка закрывается один раз на уровне шаблона. Разница между вашими страницами живёт в on-page: соответствие запросу, полнота темы, внутренние ссылки, глубина вложенности.
Три шага сравнения точными числами
Три ступени сравнения
СтупеньЧто сравниваетсяРазница по HTMLПо DOM
Шаг 1вся выборка, сайты вперемешку+157 075 байт+492
Шаг 2только эти 111 сайтов, вперемешку+213 875 байт+404
Шаг 3те же 111 сайтов, сравнение внутри каждого+11 463 байта−5

Внутри домена от исходной разницы остаётся 7% по HTML, и эта часть от нуля не отличима. По DOM не остаётся ничего.

Одно уточнение, чтобы не сказать лишнего. Схлопывается именно величина. Направление слабо держится: если перебрать все 1801 пару «верхняя страница против нижней» внутри тех же 111 сайтов, крупнее оказывается верхняя в 58 случаях из 100 — почти как между разными сайтами. Но 58 из 100 при монетке в 50 не двигают ничего, когда сама разница усохла со 157 килобайт до одиннадцати.

Если сравнивать ещё строже, тот же сайт и тот же тип страницы, таких пар 95, размер HTML даёт +15 021 байт с границами [2302; 28 831] и p = 0,04. Разница слабая и на грани, но уже не нулевая. DOM и время ответа по-прежнему на нуле.

Вывод проверки собственные данные

Основную часть различий по HTML дают сами сайты, а не страницы внутри одного сайта

7%столько от исходной разницы переживает контроль по домену
Источник: собственный замер, 09.09.2026Уверенность: средняяЧто проверяли: 111 доменов с адресами в обеих группахОграничение: выборка мала, интервалы широкие

Читается это так. Технический вес в этой выборке принадлежит сайту целиком, а не отдельной его странице. Раздуть свою страницу до трёх мегабайт и стать проектом, который стоит наверху, — это, увы, совсем разные задачи.

Есть и обратная проверка. Может, всю разницу между сайтами создала пара огромных маркетплейсов или одна ниша? 2585 страниц пришли всего из 160 выдач, так что я пересчитал всё заново, сравнивая внутри каждой выдачи отдельно.

В 119 запросах из 160 медианный размер HTML наверху оказался больше. По DOM тоже 119 из 160. Оба результата с p < 0,001. Разница повторяется в трёх четвертях выдач по отдельности, так что дело не в паре гигантов вроде Авито или Яндекс Услуг.

Быстрее ли отвечают серверы из топа? под вопросом

Ожидание

Быстрый сервер — быстрее в топ

В данных

Два замера «за», третий против. На такой разнице обещаний не строят

А со скоростью вышло поучительнее всего.

Сервер наверху отвечает за 553 мс против 634 мс внизу. Разрыв около 80 мс, и с размером документа он не связан вообще. Единственная скоростная метрика во всём замере, которая различает верх и низ, — я уже собирался ставить её в выводы.

Дальше три проверки. Внутри каждой выдачи разница повторяется. Внутри одного сайта её мерить бесполезно — сервер там общий. А браузер разницы не находит.

Весь срез
−80 мс

верх быстрее на всей выборке, 2585 страниц

Проверка по выдачам
−70 мс

эффект повторяется: верх быстрее в 100 запросах из 160

Независимый браузер
+15 мс

интервал [−118; +217] включает ноль с запасом

Вердикт: быстрые серверы у сайтов из топа встречаются чаще, но перепроверка этого не подтвердила. В отчёт клиенту такое не ставят. под вопросом

Сравнивать страницы внутри сайта здесь бесполезно: их обслуживает один и тот же сервер

Красивый вывод про скорость не пережил браузер. Два способа посчитать одни и те же данные видят разницу, третий её не находит.
Все четыре замера таблицей
Четыре замера времени ответа
ЗамерРазница по времени ответа
Сравнение групп, 2585 страниц−80 мс, верх быстрее
По запросам, 160 выдач−70 мс, верх быстрее в 100 запросах из 160
Внутри домена, 111 сайтов−8 мс, от нуля неотличимо
Браузерный замер, 179 URL+15 мс, интервал [−118; +217]

У Яндекса скорость сайта в официальной документации описана как комплекс из серверного кода, HTML, CSS, JS, изображений, CDN и кэша. Выделить из этого комплекса время ответа как то, что двигает позиции, мои данные не позволяют.

Что это значит для SEO Медленный сервер чинят, но не в графе «работы по росту позиций». Строка «снизим TTFB и поднимемся в топе» не подкреплена даже теми данными, где верх быстрее.

robots.txt: рабочий инструмент или след старой конфигурации? под вопросом

User-agent: Yandex Clean-param: ref&utm_source /catalog/ Disallow: /search/ Sitemap: https://example.ru/sitemap.xml Host: example.ru
Clean-paramУбирает дубли по GET-параметрам и передаёт их накопленный вес на основной адрес.58,5% в топе против 47,7% внизу
User-agent: YandexОтдельный блок под робота Яндекса. Признак, что файл писали руками, а не взяли шаблон.52,9% в топе против 46,1% внизу
SitemapСсылка на карту сайта прямо в файле.90,3% в топе против 84,2% внизу
HostМёртвая строка. Директиву отменили в 2018 году, и она ни на что не влияет.27,3% в топе против 36,0% внизу — тут чаще внизу

843 сайта из топ-10 против 1190 с позиций 31–49

robots.txt — это история обслуживания сайта, а не рычаг позиций. Живые директивы наверху, мёртвые внизу.
Все признаки robots.txt таблицей
Признаки robots.txt по доменам
ПризнакТоп-10Позиции 31–49
Clean-param58,5%47,7%
Отдельный блок User-agent: Yandex52,9%46,1%
Указан Sitemap90,3%84,2%
Директива Host, отменённая в 201827,3%36,0%
Медиана размера файла1850 байт1313 байт
Медиана числа Disallow4832

Clean-param совсем не декоративная строка. Яндекс пишет, что директива избавляет робота от повторной загрузки дублей, снижает нагрузку на сервер и, в отличие от Disallow, позволяет передать часть накопленных показателей на основной адрес. Рабочий инструмент управления обходом, а не галочка в аудите. С 2026 года GET-параметрами можно управлять и через соответствующий раздел Вебмастера, а Clean-param остаётся поддерживаемым способом сделать это в robots.txt.

Host работает наоборот. Директиву отменили восемь лет назад, она ни на что не влияет, и именно поэтому она хороший индикатор. Файл с ней не пересматривали много лет.

На этом месте я решил проверить ещё раз: может, Clean-param просто чаще стоит у крупных проектов, а наверх их тянет размер, а не настройка обхода?

Связь с размером есть. У сайтов с Clean-param страницы крупнее — 359 КБ против 281 в топе и 236 против 196 в хвосте. Сам файл у крупных тоже толще: 2032 байта против 1242.

Но если сравнивать сайты одной весовой категории, разница между топом и хвостом никуда не девается.

Clean-param у сайтов одного размера
Размер сайтаClean-param в ТОП-10На позициях 31–49Разница
мелкие50,0%44,2%+5,8
ниже среднего58,6%57,8%+0,9
выше среднего62,6%52,2%+10,4
крупные67,7%56,0%+11,7

В самой крупной четверти разрыв даже больше общего. Значит, списать всё на масштаб не выходит, и robots.txt остаётся похож именно на след того, как сайт обслуживают.

Причинности здесь всё равно нет. Настройка идёт вместе с попаданием в топ, а не приводит к нему, и утверждать, что Clean-param поднимает позиции, эти данные не позволяют. Плюс оговорка про сам замер: размером сайта я считал медианный вес его страниц в выборке, а это грубая замена числу страниц — точных данных о размере каталога у меня нет.

Какого размера robots.txt у сайтов из топа

Раз уж файл читается как след обслуживания, полезно знать его нормальные габариты. Вот распределение по 807 сайтам из топ-10 и 1129 с позиций 31–49 — тем, у которых robots.txt вообще отдался.

Размер robots.txt по группам
Показательлёгкий крайчетверть нижесерединачетверть вышетяжёлый край
Размер файла в ТОП-10, байт369795185044668871
Размер файла на 31–49, байт250522131328165813
Строк Disallow в ТОП-1071848106221
Строк Disallow на 31–493123278159

Пустой или почти пустой файл встречается редко в обеих группах: меньше ста байт у 13 сайтов топа и у 30 снизу. А вот совсем короткие файлы наверху заметно реже — до 500 байт укладываются 14,6% сайтов топа против 23,7% внизу, до килобайта 29,9% против 41,7%.

Что это значит для SEO robots.txt читается как история обслуживания сайта, и эта картина держится даже среди проектов одного размера. Проверьте свой файл на два признака: настроен ли Clean-param под реальные GET-параметры проекта и не висит ли в файле Host. Первое убирает дубли и передаёт их накопленный вес на основной адрес. Второе — мёртвая строка с 2018 года, и внизу выдачи она встречается чаще, чем наверху. Только не продавайте это клиенту как рычаг позиций: связь тут есть, а причинности нет.

Что из чеклиста не работает вообще

А вот здесь мой собственный чеклист перестал выглядеть убедительно. Речь не про title и H1 — про техническую часть аудита, ту самую, что я годами гоняю по клиентским сайтам.

Признаки, которые не различают группы
ПризнакТоп-10Позиции 31–49
HTTP/284,0%85,1%
Отдают Last-Modified24,7%29,2%
no-store в Cache-Control42,9%43,0%
Мягкие 4046,3%8,3%
CSS-файлов на странице55
Балл качества HTML8888

Ни одного разрыва, который стоило бы обсуждать. У Last-Modified и мягких 404 картина вообще обратная ожидаемой. Их больше у хвоста, а не у топа.

И главное. Не всё в этой таблице вообще является ошибкой. Технический аудит обязан различать четыре разные вещи, а именно поломку, риск, рекомендацию и просто особенность реализации.

Мягкий 404 — настоящая проблема, его чинят ради робота. Отсутствие Last-Modified — не ошибка, а контекстный сигнал. no-store на HTML часто выставлен намеренно. HTTP/2 — характеристика инфраструктуры, а не дефект проекта.

Балл качества HTML стоит разобрать отдельно, потому что его любят показывать клиенту. В моём движке он собирается так: пятьдесят баллов страница получает просто за то, что существует, до тридцати добавляется за семантические теги по 2,5 за штуку, до двадцати — за плотность текста в коде. Больше там ничего нет.

Отсюда и результат. Семантических тегов в обеих группах медианно по семь, в потолок упираются 31,5% страниц топа и 31,7% хвоста. Половина балла вообще константа. Такая оценка по своей конструкции не может различать группы. Она не меряет ни валидность кода, ни его чистоту.

Ни одно из перечисленного по этим данным не отличает первую десятку от четвёртой.

Что это значит для SEO Шесть строк, на которые в аудите уходит время, конкурентоспособность не описывают. Мягкие 404 чинить надо — но потому, что это поломка для робота, а не потому, что их меньше у топа: у топа их 6,3% против 8,3%, разница в пределах шума. А если аудит подаёт клиенту балл качества HTML как оценку шансов в выдаче — у топа и хвоста он одинаковый, 88 и 88.

Где топ выглядит хуже хвоста

Более зрелая инфраструктура

  • preload есть у 51,3% страниц топа против 40,2% внизу
  • CSP не отдают 75,7% страниц топа против 82,9% внизу
  • Смешанный контент у 19,1% страниц топа против 24,9% внизу
и одновременно

Больше технической грязи

  • Ошибки микроразметки у 16,7% страниц топа против 9,4% внизу
  • Параметры в URL у 8,1% страниц топа против 2,8% внизу
  • Риск по краулинговому бюджету у 40,8% страниц топа против 28,8% внизу
  • Дубли title внутри домена у 15,9% страниц топа против 6,9% внизу
Сильный production-сайт бывает технологичнее и грязнее одновременно. Чистота аудита и способность стоять в топе живут отдельно друг от друга.
Точные значения таблицей
Аккуратность и грязь одновременно
ПризнакТоп-10Позиции 31–49
Есть preload51,3%40,2%
Нет CSP75,7%82,9%
Смешанный контент19,1%24,9%
Ошибки в микроразметке16,7%9,4%
Параметры в URL8,1%2,8%
Риск краулингового бюджета выше низкого40,8%28,8%

Наверху одновременно и аккуратнее, и грязнее. Больше подсказок preload и заголовков безопасности, меньше смешанного контента — и при этом заметно хуже с разметкой, параметрами в адресах и риском по краулинговому бюджету.

Сюда же дубли заголовков. На сайтах, давших в выборку минимум две страницы, неуникальный title внутри домена встречается у 15,9% страниц наверху против 6,9% внизу.

Полезными дубли от этого не становятся, и чинить их надо. Вывод другой. Сильный production-сайт не выглядит как идеальный результат чеклистового аудита.

Сколько «грязи» несёт на себе средняя страница из топа

Чеклист говорит

Уберите технические ошибки — и обгоните конкурента

Выдача показывает

35,8% против 37,6%. Чистых страниц наверху даже чуть меньше

Вот здесь результат становится неприятным для любителей чеклистов. Я взял пять типовых претензий, которые выкатывает любой краулер, и посчитал, сколько их приходится на одну страницу.

Сколько типовых проблем на одной странице
Проблем на страницеСтраниц ТОП-10Страниц с 31–49
ни одной35,8%37,6%
одна44,5%45,2%
две17,1%15,1%
три2,6%2,1%

Считались ошибки микроразметки, параметры в URL, смешанный контент, картинки без alt и почти-дубли текста. 1215 страниц топ-10 против 1370 с позиций 31–49.

Две трети страниц топа несут на себе хотя бы одну из этих претензий. У каждой пятой их две и больше. И — главное — чистых страниц наверху меньше, чем внизу: 35,8% против 37,6%.

По отдельным пунктам разрыв ещё нагляднее. Ошибки в микроразметке есть у 16,7% страниц топа против 9,4% внизу, параметрические адреса у 8,1% против 2,8%, почти-дубли текста у 3,2% против 1,2%. По трём признакам из пяти верх выдачи проигрывает хвосту, и это не мешает ему стоять наверху.

Что это значит для SEO Вылизывать техничку до нуля замечаний незачем: чистых страниц наверху даже меньше, чем внизу, а две трети топа живут с претензиями от краулера и никуда не падают. Поэтому аудит конкурента с полусотней ошибок не означает, что он держится «вопреки» и вы обгоните его чистотой. Разбирайте не длину списка, а последствия. Мягкий 404 и закрытая от робота страница мешают попасть в индекс, их чинят. Картинка без alt и лишний параметр в URL не мешают ничему, пока не плодят дубли, и стоять впереди контента в очереди работ не должны.

Сходится ли это с чужими исследованиями?

Прямых аналогов по Яндексу я так и не нашёл. Русскоязычные разборы факторов ранжирования за 2026 год, которые я открывал, цифр, выборок и ссылок на данные не приводят вообще. Так что сравнивать приходится с работами по Google, помня, что это другой поисковик и другая методика.

Backlinko

Выборка
11,8 млн результатов Google
Что нашли
«Page HTML size has no relationship with rankings» — размер HTML позиции не различал
Как соотносится
Результат расходится с моим. Скорость они брали усреднённую по всему домену из сервиса Alexa, так что с замером отдельных страниц в браузере это не сравнить

Advanced Web Ranking

Выборка
3 млн URL из топ-20 Google, 2022 год
Что нашли
LCP лучше ближе к началу выдачи, FID связи не показал, CLS показал слабую. Проверку Core Web Vitals целиком проходили 39% страниц из выборки
Как соотносится
Работа историческая, FID был тогдашней метрикой Core Web Vitals, с марта 2024 его заменил INP
Три замера связи размера HTML с позицией
ЗамерГде и на чёмЧто получилось по размеру HTML
Backlinko, 2020Google, 11,8 млн результатовСвязи с позицией не нашли вовсе
Мой замер: разные сайтыЯндекс, 2585 страницСтраницы топа крупнее на 157 КБ
Мой замер: внутри одного сайтаЯндекс, 111 доменовРазница падает до 11 КБ и от нуля уже неотличима

По HTML результаты расходятся, и это стоит проговорить прямо. У Backlinko на 11,8 млн результатов Google связи нет, у меня на выборке по Яндексу — есть, и заметная. Объяснений может быть несколько. Другой рынок, другой поисковик, другая методика отбора, влияние чего-то третьего, что тянет за собой и размер HTML, и позиции. Отделить их этими данными нельзя. Само по себе расхождение — повод для повторного замера, а не готовый вывод.

Ещё одно место, где ожидание не сходится с замером. Наверху существенно больше ресурсов — загрузка на 51%, запросы на 61%, — а измеренные времена не различаются вовсе. Первая отрисовка выше на 106 мс с интервалом [−104; +310], событие load на 329 мс с интервалом [−165; +760], браузерное время ответа на 15 мс с интервалом [−118; +217]. Все три ноль не исключают.

Почему полуторакратный рост объёма не даёт видимого проигрыша по времени, этот эксперимент не показывает. Гипотез хватает — параллельная загрузка, async и defer, отложенные картинки, CDN, приоритизация ресурсов, — но выбирать одну без измерения я не буду.

Что это значит для SEO Тяжёлая страница и медленная страница — не синонимы, и в отчёте их стоит развести. Три мегабайта, разложенные по defer, отложенным картинкам и CDN, в этой выборке грузятся не медленнее девятисот килобайт, собранных плохо. В отчёт идёт измеренное время загрузки; сумма байтов о нём не говорит.

В какой нише разрыв больше?

Верх крупнее по HTML в каждой из шестнадцати ниш. А вот насколько крупнее — зависит от ниши, и это меняет смысл любых ориентиров. Сравнивать свою страницу нужно с её нишей, а не со средним по выдаче.

Финансы+481 КБ
Туризм+337 КБ
Образование+300 КБ
Недвижимость+276 КБ
Спорт+245 КБ
Автосервис+201 КБ
Красота+170 КБ
Общепит+148 КБ
Бытовая техника+140 КБ
Окна и остекление+115 КБ
Ремонт квартир+100 КБ
Юруслуги+75 КБ
IT-услуги+66 КБ
Медицина+41 КБ
Стройматериалы+37 КБ
Товары для дома+21 КБ

Насколько HTML в топ-10 крупнее, чем на позициях 31–49, по каждой нише. Тёмным — две ниши, которые выбиваются из общей картины.

В финансах разрыв 481 КБ, в товарах для дома — 21. Направление везде одно, а размах отличается больше чем в двадцать раз.
Точные значения по нишам, включая DOM
Разрыв между топ-10 и позициями 31–49 по нишам
НишаСтраниц верх / низΔ HTML, КБΔ DOM, узлов
Финансы52 / 63+481+952
Туризм72 / 85+337+1048
Образование92 / 89+300+780
Недвижимость66 / 88+276+281
Спорт77 / 91+245+644
Автосервис80 / 92+201+416
Красота81 / 86+170+427
Общепит86 / 91+148+274
Бытовая техника63 / 88+140+348
Окна и остекление73 / 85+115+327
Ремонт квартир81 / 82+100+164
Юруслуги78 / 86+75+158
IT-услуги83 / 85+66+203
Медицина88 / 92+41+355
Стройматериалы76 / 86+37+817
Товары для дома67 / 81+21+595

Наверху списка оказались финансы, туризм и образование — ниши, где в выборке часто встречались крупные платформы и сложные интерфейсы. Насколько именно этим объясняется разрыв, текущий замер не показывает.

Обратите внимание на стройматериалы и товары для дома. Разрыв по HTML там минимальный, а по DOM остаётся крупным — 817 и 595 узлов. Документ такого же объёма разворачивается в куда более сложное дерево. Килобайты HTML и сложность DOM здесь явно измеряют разные свойства страницы, и один показатель нельзя использовать как замену другому.

Что это значит для SEO Единый ориентир по весу для всех проектов не работает: в финансах разрыв между верхом и низом 481 килобайт, в товарах для дома — 21. Сравнивайте страницу с топом её собственного запроса, а не со средним по выдаче и не с чужим кейсом из другой ниши.

В каких нишах топ не отдаётся краулеру

От ниши к нише меняется не только вес страниц. Второй разрез стоит посмотреть до того, как вы сядете собирать конкурентов. Он о том, какую долю топа краулер просто не получит.

Финансы45,0%
Бытовая техника26,0%
Товары для дома26,0%
Недвижимость24,2%
Стройматериалы19,0%
Спорт18,0%
Туризм18,0%
Юруслуги16,3%
Автосервис16,0%
Окна и остекление14,1%
Красота14,0%
Ремонт квартир13,0%
IT-услуги13,0%
Медицина10,0%
Общепит7,0%
Образование5,0%

Доля адресов топ-10, не отдавших код 200 обычному HTTP-клиенту. 1589 адресов, снимок 09.09.2026. Тёмным — две ниши, где топ открывается почти полностью.

В финансах краулер не получает почти половину топа. В образовании закрыт один адрес из двадцати.

В среднем по выборке недоступными остаются 17,8% верхней выдачи против 8,5% хвоста, и топ закрывается сильнее хвоста в пятнадцати нишах из шестнадцати. Исключение одно — образование, там верх парсится даже легче низа, 5,0% против 7,1%.

Отсюда же оговорка к разрывам выше. Они посчитаны по страницам, которые ответили. В финансах это чуть больше половины топа, так что к цифрам именно этой ниши стоит относиться осторожнее.

Что это значит для SEO В финансах краулером вы соберёте чуть больше половины топа, в бытовой технике, товарах для дома и недвижимости — примерно три четверти. Выгрузка об этом молчит, недостающие строки просто не появляются. Прежде чем строить ТЗ на конкурентном анализе, посмотрите, сколько адресов в выгрузке не ответили, и доберите их браузерным рендером — он возвращает около половины закрытых.

Скорость ответа: почти везде верх быстрее

Третий разрез по нишам — время ответа сервера, та самая находка, которую не подтвердил браузер.

Все шестнадцать ниш по времени ответа
Разница времени ответа по нишам
НишаРазница медианКто быстрее
Окна и остекление−257 мсверх быстрее
IT-услуги−191 мсверх быстрее
Ремонт квартир−145 мсверх быстрее
Бытовая техника−134 мсверх быстрее
Спорт−131 мсверх быстрее
Недвижимость−121 мсверх быстрее
Общепит−107 мсверх быстрее
Юруслуги−82 мсверх быстрее
Финансы−76 мсверх быстрее
Стройматериалы−65 мсверх быстрее
Медицина−23 мсверх быстрее
Товары для дома−22 мсверх быстрее
Туризм−15 мсверх быстрее
Красота−7 мсверх быстрее
Автосервис+44 мсверх медленнее
Образование+56 мсверх медленнее

Верх отвечает быстрее в четырнадцати нишах из шестнадцати. Сильнее всего в окнах — на 257 мс, в IT-услугах на 191. Исключений два: автосервис и образование, там верх медленнее на 44 и 56 мс.

Ровная картина — причина, по которой находку я не выбросил. Но это тот же краулерный замер, разложенный по нишам, а не новая проверка: браузер разницы по-прежнему не видит. Обещать клиенту позиции за снижение TTFB на этом всё равно нельзя.

Коридор страницы, которая уже стоит в топ-10

Самая полезная цифра ниже — не медиана, а ширина разброса. 395 килобайт — середина топ-10, а 200 килобайт уже мало или ещё нормально? Поэтому ниже по каждому признаку показаны пять точек: где лежит самая лёгкая десятая часть топа, где половина, а где начинается самая тяжёлая десятая.

Признаки развёл на три группы, потому что для аудита они значат разное. Первую вы меняете на самой странице. Вторая показывает, что уходит в браузер при реальной загрузке. Третья описывает хост. У всех страниц одного сайта эти значения общие, и правкой шаблона не двигаются — это прямо следует из проверки внутри домена выше.

Что правится на самой странице
1215 страниц топ-10
медиана
Размер HTMLкилобайты
109 1 525
395коридор 198…779
DOM-узловштук
633 5 290
1 814коридор 1 064…3 118
Файлов JavaScriptштук
3 36
14коридор 6…24
Файлов CSSштук
1 20
5коридор 2…11
Картинокштук
8 174
42коридор 19…91
Блокирующих скриптовштук
0 22
2коридор 0…7
Подсказок preloadштук
0 12
1коридор 0…4
Блоков микроразметкиштук
0 4
1коридор 0…2
Что уходит в браузер
88 адресов, по три прогона
медиана
Объём загрузкикилобайты
1 007 14 567
3 267коридор 1 854…4 503
JavaScriptкилобайты
322 2 239
1 104коридор 592…1 617
Запросовштук
46 231
127коридор 86…178
Что задаёт хост
у всех страниц сайта эти значения общие
медиана
Ответ серверамиллисекунды
285 1 298
553коридор 367…860
Заголовки безопасностииз 100
0 60
20коридор 0…40
тут лежит половина страниц топасерединакрая: по десятой части топа с каждой стороны

Считано по 1215 страницам топ-10, снимок 09.09.2026, Москва. Браузерная группа считана на подвыборке из 88 адресов по три прогона.

Единого «правильного» веса у топа нет. От лёгкого края до тяжёлого размер HTML отличается в четырнадцать раз, объём загрузки — в четырнадцать с половиной.
Как этим пользоваться Попадание в коридор не поднимает позиции, выход за него не роняет. Польза в другом. Если ваша страница вылетела за левый или правый край шкалы, это повод спросить почему. Страница легче 109 килобайт — проверьте, весь ли контент в исходном коде. Тяжелее 1525 — ищите инлайновые данные и дубли шаблона. Сервер отвечает дольше 1298 мс — это уже инфраструктура, а не разметка.
Все значения таблицей

Свойства страницы

Разброс технических признаков страницы в топ-10
ПризнакЕд.лёгкий крайчетверть топа нижесерединачетверть топа вышетяжёлый край
Размер HTMLКБ1091983957791525
DOM-узловштук6331064181431185290
Файлов JavaScriptштук36142436
Файлов CSSштук1251120
Картинокштук8194291174
Блокирующих скриптовштук002722
Подсказок preloadштук001412

Браузерный слой

Разброс браузерной загрузки в топ-10
ПризнакЕд.лёгкий крайчетверть топа нижесерединачетверть топа вышетяжёлый край
Объём загрузкиКБ100718543267450314 567
JavaScriptКБ322592110416172239
Запросовштук4686127178231

Свойства хоста

Разброс технических признаков хоста в топ-10
ПризнакЕд.лёгкий крайчетверть топа нижесерединачетверть топа вышетяжёлый край
Ответ серверамс2853675538601298
Заголовки безопасностииз 10000204060

Объём текста, число изображений, блоки микроразметки и семантические теги сюда сознательно не вошли. Это on-page слой, и его коридоры я считал в отдельном исследовании на 1601 странице.

Два практических следствия. Размер HTML в топе идёт от 109 до 1525 килобайт, так что единого «правильного» веса документа в выдаче не существует. Любой аудит с порогом вроде «не больше 100 КБ» спорит не с Яндексом, а с реальностью его топа. И строка про заголовки безопасности: у четверти страниц топа их нет вообще.

Где начинается край

Отдельный вопрос, который задают чаще всего. А если сайт весит десять мегабайт и грузится девять секунд, это уже плохо? Ответ есть в том же замере, и он не «да» и не «нет». Это край. Так выглядит верхушка топа, куда крупные площадки заезжают на бренде и ссылках, а не его повседневная норма.

13,6%страниц ТОП-10
грузят больше 10 МБ за сессию загрузки. Такой вес в топе встречается, но это верхняя седьмая часть выборки. Медиана втрое меньше — 3,2 МБ
10,3%страниц ТОП-10
догружаются дольше 9 секунд. Девяносто процентов топа успевают быстрее, медиана — 2,1 секунды. Девять секунд не выбрасывают из выдачи, но ставят вас в один ряд с самыми медленными
13,6%страниц ТОП-10
отвечают сервером дольше секунды. Медиана TTFB в топе — 414 мс
18,2%страниц ТОП-10
рисуют первый экран дольше 1,8 секунды — порога, который Google считает хорошим для LCP. Медиана здесь 842 мс
2,3%страниц ТОП-10
рисуют первый экран дольше 5 секунд. Вот это уже действительно редкость: два случая из восьмидесяти восьми

Браузерный замер 88 адресов топ-10, по три прогона с холодным кэшем, снимок 09.09.2026.

Что это значит для SEO Пороги работают как сигнал, а не как приговор. Сайт на 10 МБ и 9 секунд формально попадает в диапазон топа — но в его верхние десять–пятнадцать процентов, куда крупные площадки заезжают за счёт бренда, ссылок и спроса. Если у проекта такого запаса нет, край распределения — плохое место: сначала вы платите за него конверсией, а потом объясняете клиенту, почему «по чеклисту всё зелёное».

Чеклист: сверить свой сайт с топом

С этой таблицы я бы начинал разговор с клиентом. Если под вами сотня проектов, от медианы толку мало. Нужны границы того, в каких пределах лежит реально стоящее в выдаче Яндекса. Ниже — сводка всех замеренных признаков в одном месте.

Шкала с распределением — в коридоре выше, здесь только границы и что с ними делать. Читается чеклист так. Попадание в коридор ничего не гарантирует, выход за него ничего не ломает. Это повод задать вопрос, а не поставить задачу в спринт. Дальше по каждой строке — что именно спрашивать.

Что меняется на самой странице

Коридор технических значений страницы в топ-10
ПризнакПоловина топа внутриКак читать свой результат
Размер HTML198–779 КБМеньше 109 КБ — проверьте, весь ли контент отдаётся в исходном коде, а не дорисовывается скриптом. Больше 1525 КБ — ищите инлайновые данные и дубли шаблона
DOM-узлов1064–3118За 5290 узлов обычно стоят вложенные обёртки вёрстки. Бьёт по отрисовке, а не по позициям
Файлов JavaScript6–24Число подключений верх от хвоста не отличает. Смотрите на килобайты кода, а не на счётчик
Файлов CSS2–11Одинаково в обеих группах. Как аргумент в отчёте не годится
Картинок19–91Единственный счётчик, где разрыв уверенный, — и то восемь штук. Свойство типа страницы, а не рычаг
Блокирующих скриптов0–7Наверху их меньше, чем внизу. Убирать стоит ради отрисовки
Подсказок preload0–4Есть у 51,3% топа против 40,2% хвоста. Маркер зрелой сборки

Что уходит в браузер

Считано по тем 88 адресам топ-10, которые открывались в браузере.

Коридор браузерной загрузки в топ-10
ПризнакПоловина топа внутриКак читать свой результат
Объём загрузки1854–4503 КБТри мегабайта — норма верхней выдачи, а не приговор. Тяжелее трёх мегабайт грузятся 53,4% страниц топа
JavaScript592–1617 КБГлавный источник разрыва с хвостом: 1104 КБ против 716
Запросов86–178Больше ста запросов делают 61,4% топа против 33,0% хвоста

Что задаёт хост

Коридор технических признаков хоста в топ-10
ПризнакПоловина топа внутриКак читать свой результат
Ответ сервера367–860 мсСекунда и выше — повод чинить инфраструктуру. Обещать за это позиции нельзя, браузерный замер разрыва не подтвердил
Заголовки безопасности0–40 из 100Четверть топа не отдаёт ни одного. Задача продуктовая, не поисковая
HTTP/284,0% топа против 85,1%Не различает группы вообще

Настройки обхода

Настройки robots.txt у топа и хвоста
НастройкаТоп-10Позиции 31–49Что делать
Указан Sitemap90,3%84,2%Базовая гигиена. Проверьте, что файл живой и совпадает с реальной структурой
Clean-param под GET-параметры58,5%47,7%Настроить, если у проекта есть параметрические дубли: директива снимает повторную загрузку и передаёт накопленные показатели на основной адрес
Отдельный блок User-agent: Yandex52,9%46,1%Нужен, когда правила для Яндекса и Google расходятся
Директива Host27,3%36,0%Удалить. Отменена в 2018 году, ни на что не влияет и выдаёт файл, который годами не пересматривали

Что чинить, хотя у топа с этим тоже плохо

Признаки, по которым топ хуже хвоста
ПризнакТоп-10Позиции 31–49Что делать
Ошибки в микроразметке16,7%9,4%Чинить у себя, но не считать признаком слабости конкурента
Параметры в URL8,1%2,8%Закрывать Clean-param, а не Disallow
Риск краулингового бюджета выше низкого40,8%28,8%Смотреть на больших сайтах, на маленьких это не проблема
Дубли title внутри домена15,9%6,9%Чинить, но не ждать от этого движения позиций
Смешанный контент19,1%24,9%Убирать: единственный пункт списка, где топ действительно чище
Как этим пользоваться Возьмите десять своих страниц, снимите по ним те же признаки и разложите по колонкам. Ценность не в попадании в медиану, а в вопросах, которые задаст выпадение: почему документ вчетверо легче конкурентов, почему сервер отвечает вдвое дольше, почему в robots.txt висит директива, отменённая восемь лет назад. Что из найденного чинить в первую очередь — в следующем разделе.

Разбор реальной страницы

Правило отбора я задал до того, как посмотрел на результат. Беру страницу с позиций 31–49, у которой все шесть технических признаков лежат внутри коридора топ-10. То есть техничка идеальна по любому чеклисту, а страница внизу. Под правило подошли 58 адресов из 1370, беру самый высокий по выдаче.

deloremonta.moscow, место 31 по запросу «ремонт квартиры под ключ», ниша ремонта квартир.

Разбор страницы по коридору топ-10
ПризнакСтраницаНорма топ-10Статус
Размер HTML, КБ602198–779в норме
DOM-узлов11401064–3118в норме
Файлов JavaScript106–24в норме
Файлов CSS42–11в норме
Картинок3919–91в норме
Ответ сервера, мс631367–860в норме
Слов на странице795on-page

Шесть из шести в коридоре. Любой технический аудит выдаст по ней зелёный отчёт, а страница болтается на тридцать первом месте. Такую страницу я бы раньше показал клиенту как образец.

Выбивается единственное — 795 слов, и это уже не техничка.

А теперь зайдём с другой стороны. Возьмём сами страницы топ-10 и посмотрим, многие ли укладываются во все шесть коридоров разом.

Страницы топ-10
2,4%

укладываются во все шесть коридоров одновременно. Четверть выпадает по трём признакам, каждая десятая — по пяти

Страницы с позиций 31–49
4,2%

укладываются во все шесть. Внизу выдачи технически безупречных страниц даже больше, чем наверху

Чистых страниц в топе даже меньше, чем в хвосте. 1215 страниц топ-10 против 1370 контрольных, коридоры взяты из самого топ-10.
Когда техничка закончена

Страница отдаётся роботу с кодом 200 и настоящим содержимым. В индекс попадает, canonical и мета-роботс не спорят друг с другом. Дубли по GET-параметрам закрыты. Сервер отвечает быстрее секунды. Значения лежат в коридоре или отклонение объясняется типом страницы.

Тогда останавливайтесь. Сжимать HTML с 600 до 400 килобайт, убирать четыре скрипта из десяти, догонять DOM до медианы, добиваться нулевых ошибок в разметке — эту работу мои данные не поддерживают. Идеальные по всем шести коридорам страницы составляют 2,4% топа и 4,2% хвоста, так что чистота чеклиста не отличает одних от других.

Четыре вопроса до правки. Страница вообще доступна роботу и попадает в индекс? Я реально вылетел за границы топа или просто не дотягиваю до середины? Отклонение объясняется типом страницы? И если техничка в норме, почему я всё ещё правлю техничку?

Что делать в четырёх ситуациях

Вот что я делаю в каждом из четырёх случаев.

Что делать в четырёх ситуациях
СитуацияЧто делать
Страница недоступна роботу или отдаёт не то, что видит человекЧинить в первую очередь. Это единственный слой замера, где поломка прямо мешает поисковой системе
Техничка выбивается из коридора в разыРазобраться почему. Документ легче 109 КБ — проверить, весь ли контент в исходном коде. Тяжелее 1525 КБ — искать инлайновые данные и дубли шаблона
Техничка в коридоре, страница не растётПерестать полировать вес, DOM и число файлов. Данные не показывают, что места различаются этим. Идти в on-page и релевантность
В коридоре и on-page в порядке, а роста нетИдти в следующий класс причин — ссылочный разрыв, коммерческие факторы, поведение, возраст и авторитет домена. Этот замер их не трогал

Что с этим делать в 2026

Никаких «сделай X — получишь позиции». Только три категории по назначению.

Может мешать поисковой системе

Чинить

  • Недоступность страницы и несоответствие кода содержимому
  • Бот-защита, случайно закрывающая поискового робота
  • Ошибки индексируемости в robots, canonical и мета-роботс
  • Технические дубли и неуправляемые GET-параметры — Clean-param здесь Яндекс рекомендует вместо Disallow
  • Системные проблемы с ответом сервера
Улучшает продукт

Оптимизировать, но не обещать позиции

  • Время ответа сервера и производительность целиком
  • Объём загрузки, JavaScript, картинки, кэш, CDN
  • Заголовки безопасности
  • Поддерживаемость фронтенда
Не использовать как ranking KPI

Не оптимизировать ради числа

  • Минимальный размер HTML и минимальный DOM
  • Идеальный балл качества HTML
  • Конкретное число скриптов и стилей
  • Наличие каждого семантического тега
  • Отсутствие любой технической «грязи» само по себе

Если сводить всё к одной мысли: техничка убирает препятствия. Робот доходит до страницы, забирает содержимое, кладёт в индекс, страница открывается у человека. Ни одной цифры, которую можно докрутить и получить за это место в выдаче, в этих данных нет.

Что сделать в понедельник

  • Открыть robots.txt и удалить директиву Host, если она там висит. Отменена в 2018 году, внизу выдачи встречается чаще, чем наверху.
  • Проверить, настроен ли Clean-param под реальные GET-параметры проекта. У топа он есть в 58,5% случаев против 47,7% у хвоста.
  • Снять по десяти своим страницам размер HTML, DOM, объём загрузки и время ответа — и разложить по коридорам из чеклиста выше.
  • Прогнать свои посадочные через браузерный рендер, а не только краулером. Код 200 не доказывает, что контент отдан.
  • Сверить свои технические выводы с Яндекс Вебмастером. Индексация, обход и статус страниц видны там, а не в стороннем аудите.
  • Свериться с топом своего запроса, а не со средним по выдаче. Между нишами разброс больше чем двадцатикратный.

Чего не делать

  • Не раздувать страницу до медианы топа. Внутри одного сайта вес и DOM позицию не двигают.
  • Не ставить в KPI число скриптов и стилей, у топа и хвоста их поровну.
  • Не обещать рост позиций за снижение TTFB. Разрыв по времени ответа не пережил проверку вторым инструментом.
  • Не писать в отчёт «у конкурента 50 ошибок, обгоним чистотой». У верхней группы ошибок в разметке почти вдвое больше, чем у хвоста.
  • Не считать балл качества HTML оценкой шансов в выдаче, у топа и хвоста он одинаковый — 88 и 88.

Как объяснить это клиенту

  • Эти работы отвечают за допуск. Робот должен дойти до страницы, забрать содержимое и не утонуть в дублях. Позиции такое условие не двигает, но без него их не будет вовсе.
  • Сайты в топе технически крупнее, но это пришло вместе с масштабом бизнеса, а не подняло их наверх.
  • Разница между «поправим техничку» и «вырастем в выдаче» проходит по ссылкам, поведению, коммерческим факторам и релевантности. Их этот замер не трогал.
  • Видимость сайта и трафик из поиска растут, когда снятое техническое ограничение открывает дорогу остальным факторам. Сама по себе техничка трафика не приносит.
  • Проверяемое обещание звучит так. После работ страница доступна роботу, попадает в индекс, отдаётся быстро и не плодит дубли. Позиции — отдельный разговор с отдельными данными.

Чего этот замер не знает

Я мерил техничку десктопной версии. Ссылочный профиль, поведенческие метрики, коммерческие факторы, возраст и траст домена, релевантность запросу, мобильная версия страницы — ничего этого в замере нет. Эти слои вполне могут объяснять часть разницы между сайтами, но определить их вклад мой замер не позволяет.

Ни один отдельный признак не показал сильной связи с позицией. Самый крупный коэффициент во всей работе — 0,224 при шкале от нуля до единицы. Это уровень «различает группы, но ничего не предсказывает для конкретной страницы».

На что можно опираться и насколько
Сайты из ТОП-10 крупнее по HTML и DOM
Это свойство сайта, а не отдельной страницы
Топ хуже парсится, чем хвост выдачи
Серверы сайтов из топа отвечают быстрее
robots.txt показывает зрелость сайта

Огромный технический разрыв, который виден в начале, живёт между сайтами. Стоит сравнить адреса внутри одного сайта — и большая часть различий по HTML и DOM пропадает. Что за этим стоит: бренд, ссылки, архитектура, масштаб бизнеса, поведение — замер не говорит.

Зато трактовку «сделайте страницу тяжелее, и она поднимется» он ломает всерьёз.

Частые вопросы

Нет, такого вывода данные не дают. Верно другое: наверху стоят сайты, чьи страницы в среднем крупнее — 395 КБ против 242. Стоит взять два адреса одного сайта, и это преимущество пропадает. Вес работает как признак площадки, которая уже пробилась наверх, а не как настройка, которую можно подкрутить на отдельной странице.

Серверы сайтов из топа отвечают быстрее — на 80,5 мс по всей выборке и на 69,8 мс, если считать внутри каждой выдачи отдельно. Но перепроверка браузером на 179 адресах этого не показала. В работе на такую разницу опираться нельзя, и обещать клиенту рост позиций за ускорение сервера эти данные не дают.

Примерно каждый шестой адрес: обычному краулеру не открылись 17,8% страниц топ-10 — вдвое чаще, чем в хвосте выдачи. Браузерный рендер возвращает около половины из них. Отдельная ловушка — код 200 с капчей внутри: такие страницы попадают в отчёт как живые, но пустые.

В этом замере длина тайтла дала коэффициент −0,038, длина описания −0,056 — связи, которые не объясняют почти ничего. Две трети страниц в топе имеют тайтл длиннее шестидесяти символов. Отдельное исследование on-page факторов на 1601 странице дало тот же результат.

Яндекс рекомендует её вместо Disallow для GET-дублей: она избавляет робота от повторной загрузки одинаковых страниц, снижает нагрузку на сервер и позволяет передать часть накопленных показателей основному адресу. В замере она стоит у 58,5% доменов топ-10 против 47,7% на позициях 31–49.

Нет, и по двум причинам сразу. Замер трогал только техничку — ссылок, поведения, коммерческих факторов и релевантности в нём нет. А внутри самой технички ни один признак не тянет на рычаг: сильнейший из шестнадцати даёт 58,5 из 100 при монетке в 50.

Методология и ограничения

Как это повторить
Выдача
Yandex Search API
Аудит страниц
Site Audit Pro, батч-режим
Браузер
Chromium, байты через протокол отладки, пустой кэш
Прогонов на URL
3, берётся медиана
Снимок выдачи
09.09.2026, Москва
Статистика
корреляция Спирмена, bootstrap, знаковый тест
Известные ограничения
7

Выборка. 160 запросов, 16 ниш по 10, регион Москва, 9 сентября 2026. Верхняя группа — топ-10, 1589 обработанных страниц; контрольная — позиции 31–49 через одну, 1582 страницы. После отсева заглушек бот-защиты осталось 1215 страниц с 833 доменов и 1370 страниц с 1161 домена. Пересечений по URL нет.

Направление внутри домена. Помимо парного теста по доменам я перебрал все пары «страница из топ-10 против страницы с 31–49» внутри одного сайта — 1801 пара на 111 доменах. Доля пар, где крупнее оказалась верхняя страница, — 58,0%. Метрика показывает направление, но не величину: медиана самой разницы там +11 463 байта против +157 075 между сайтами.

Проверка «дело в размере». Сайты разбиты на четыре равные группы по медианному размеру HTML их страниц в выборке, внутри каждой группы посчитана доля доменов с Clean-param отдельно для топ-10 и для позиций 31–49. В группах n = 108/285, 162/232, 187/207 и 201/193 сайта. Медианный вес страницы — грубая замена числу страниц сайта: точных данных о размере каталога в замере нет.

Как считался robots.txt. Замер идёт по сайтам: 843 в верхней группе против 1190 в нижней. 148 сайтов, попавших сразу в обе группы, из подсчёта исключены — иначе один и тот же файл голосовал бы за оба лагеря.

Как считалось. Корреляция Спирмена, n = 2585, стандартная ошибка около 0,020, порог отличимости от нуля принят как 0,06. Внутри домена: парные разницы по 111 доменам, bootstrap-интервалы на 5000 итераций, знаковый тест. Проверка по запросам: 160 разниц на уровне запроса, bootstrap по запросам. Браузерный замер: единица анализа — URL, по которому взята медиана трёх прогонов.

Доля исходного разрыва по ступеням
МетрикаШаг 1: вся выборкаШаг 2: 111 сайтов вперемешкуШаг 3: внутри каждого сайта
Размер HTML+157 075 байт+213 875 (136% от A)+11 463 (7% от A)
DOM-узлов+491,5+403,5 (82%)−5 (−1%)
Ответ сервера−80,5 мс−104,5 (130%)−8 (10%)

Пересчёт на уровне отдельных выдач. Размер HTML: медиана разницы +136 617 байт, интервал [99 757; 195 742], больше наверху в 119 запросах из 160, p < 0,001. DOM: +352,5, интервал [214; 524], 119 из 160, p < 0,001. Время ответа: −69,8 мс, интервал [−112; −27], верх быстрее в 100 запросах из 160, p = 0,002.

Почему перф-балл движка не отдельная находка. Перф-балл движка коррелирует с размером HTML на −0,847, потому что в коде штраф считается напрямую из размера документа. Это не отдельное измерение, и как отдельную находку я его не использую.

Поправка на число проверок. Шестнадцать коэффициентов проверены процедурой Бенджамини–Хохберга при уровне ложных открытий 5%. Порог проходят одиннадцать, включая длину описания с −0,056. Это ровно та ситуация, когда статистическая значимость не означает практической. К тому же p-значения посчитаны так, будто все страницы независимы друг от друга, а они сгруппированы внутри 160 выдач. Из-за этого надёжность выглядит выше, чем она есть, и ради этого сделаны отдельные проверки по запросам, по доменам и браузером.

Доступность выдачи для сбора данных. Парсинг верхней выдачи идёт тяжелее, чем парсинг хвоста, и это смещает любой конкурентный анализ на краулере. Обычному HTTP-клиенту не отдали код 200 17,8% адресов топ-10 против 8,5% на позициях 31–49. Stealth-браузер вернул около половины, недоступными остались 9,3% и 4,5%. Ещё 7,0% страниц топа против 5,4% в хвосте ответили кодом 200, а внутри отдали капчу или экран проверки браузера — формально доступны, фактически пусты. Это и есть заглушки, отсеянные из выборки. Под DDoS-Guard и Qrator наверху 21% доменов, внизу 14%.

Чего эти проценты не означают. «Недоступно стороннему краулеру» — не то же самое, что «недоступно YandexBot». Яндекс ходит с собственных адресов, которые сайты пропускают, и цифры выше говорят только о доступности для внешнего анализа. Часть блокировок относится к IP, а не к user-agent. Замер шёл с финского дата-центрового адреса, на выборке из 60 закрытых URL код ответа совпадал у браузерного и краулерного user-agent в 78% случаев, и лишь 18% открылись от одной смены user-agent. Поэтому 9,3% — верхняя оценка.

Что это значит для SEO Собирая топ конкурентов краулером, вы теряете верхнюю выдачу вдвое чаще, чем хвост, и получаете смещённую выборку — а капча с кодом 200 попадает в отчёт как живая страница с нулевым текстом. Доступность проверяется по содержимому: код 200 её не доказывает. Половину закрытых адресов возвращает браузерный рендер.

Что осталось непроверенным внутри домена. Попарно я сравнивал размер HTML и DOM, а браузерный замер парным не был. Верхняя группа тяжелее и по скриптам, +388 КБ с интервалом [68; 509], но относится ли этот разрыв тоже к различиям между сайтами, текущий тест не проверяет.

Насколько надёжен сам парный тест. 111 доменов — небольшая выборка, интервалы широкие, и верхняя граница по HTML допускает до +26 килобайт реального эффекта. Сравнение внутри домена заметно уменьшает влияние постоянных сайтовых различий, но подглядыванием за чужой выдачей остаётся. Это не эксперимент, где меняют одну переменную и смотрят результат.

Ограничения. Один регион, одна дата, один поисковик. Только технические факторы. Корреляция без причинности. 9,3% верхней группы не измерены вообще; пропуски распределены между группами неслучайно, поэтому характеристики этих страниц могут смещать оценки, но направление смещения неизвестно. Тест внутри домена слишком мал, 111 доменов дают широкие интервалы.

Что было бы правильным следующим шагом. Повторить на второй дате и во втором регионе. И поставить настоящий эксперимент — взять полсотни своих страниц, изменить в них что-то одно, замерить сдвиг. Наблюдение со стороны до этого уровня доказательности не дотягивает.

Я нашёл технический профиль сайтов, которые стоят наверху, а не техническую формулу попадания наверх.

Проверить это на своём сайте

Если нужен разбор технического слоя без чеклистовых ритуалов — это технический аудит сайта. Собрать выдачу и посмотреть, кто рядом с вами в топе, помогает бесплатный SEO-аудит.