51
из 100
так часто более полная страница стоит выше. Монетка даёт 50
55
из 100
то же для авторитета домена — сильнейший признак из измеренных
35%
страниц топ-20
имеют полный ключ в title. На первом месте ровно столько же
71 %
интента
медиана по 1454 страницам топ-20 с оценённым содержанием
18,5
лет домену
медиана возраста в топ-20. Моложе трёх лет — 5,2 % страниц
DR 0
и пять месяцев
с таким доменом занято первое место по «гидроизоляция под плитку»
Как применить это к своей странице
  1. Посмотрите саму выдачу. Что стоит наверху — статья, категория, калькулятор, сервис, официальный источник. Если формат другой, текстовый аудит вторичен.
  2. Сравните страницу с коридором двадцатки, а не с первым местом. Первое место в этих данных не образец: по большинству признаков оно от двадцатого почти не отличается.
  3. Ищите выпадения за P10 и P90. Туда попадает по десятой части выдачи с каждого края, и это места, куда стоит посмотреть глазами.
  4. Внутри P25–P75 ничего не полируйте. Там лежит половина двадцатки, и подтягивание к медиане с порядком мест не совпадает.
  5. Найдите составляющие интента, которые почти никто не закрыл. Их я нашёл в 15 темах из 20 и во всех пяти нишах.
  6. Если onpage уже в коридоре — переходите к другому классу причин. Формат ответа, ссылочный разрыв, техника, коммерческие свойства, поведение.

Дальше — данные, на которых это построено. Порядок разделов исследовательский: сначала замер, потом выводы.

Одно число вместо коэффициентов

Почти любой контент-бриф стоит на одном обещании: разбери интент запроса, закрой его на странице полнее конкурентов, и страница встанет выше. Я проверил это дважды. Первый корпус — 65 запросов и 544 страницы, второй — 97 запросов и 1057 страниц.

Оговорка, без которой дальше читать нельзя. Я меряю одну страницу против других страниц той же выдачи. Как сайт целиком набирает вес на теме десятками материалов и что это даёт, мой замер не проверяет. Речь здесь только о постраничном обещании из брифа.

Чтобы не бросаться коэффициентами корреляции, я перевёл всё в одну простую величину. Берём две страницы из одной выдачи. У одной признак больше, у другой меньше. Смотрим, та ли из них стоит выше, у которой признак больше. Считаем по всем парам всех выдач.

Пары с одинаковым значением признака в счёт не идут: они не говорят ни за, ни против. Поэтому у признаков вроде «есть ли ключ в title» пар меньше — их число я показываю в таблицах отдельной колонкой.

При 50 из 100 признак не отличает верх выдачи от низа, ровно как монетка.
При 65–70 признак уже заметно совпадает с порядком выдачи.
При 80 и выше совпадение очень сильное.
Само по себе это всё ещё не доказывает, что изменение признака поднимет страницу.

Полнота раскрытия интента дала 51 из 100. Разберём, что это значит, на живой выдаче.

Одна выдача построчно

Запрос «боль в пояснице отдает в ногу», ниша медицина. Карта интента для него содержит 14 составляющих: причины боли, отличие прострела от корешкового синдрома, что делать до врача, какие обследования назначают, конкретные препараты, когда идти в больницу срочно и так далее.

Поз.ДоменDRКлюч в titleДлина titleh2–h5Плотность, %СловРаскрыто интента
1gutaclinic.ru52да114195,931079
10/14
2newneuro.ru43да89175,012277
11/14
3institut-clinic.ru7да103264,653056
13/14
4doctordlin.ru31нет67187,811127
8/14
5cmrt.ru48нет93667,39717
7/14
6openclinics.ru43да61643,691625
5/14
7ldc-mrt.com3нет89253,532096
12/14
8probolezny.ru68нет108131,502736
12/14
9temed.ru43нет122163,371664
9/14
10krasotaimedicina.ru66нет56122,081539
14/14
11zelkinezis.ru2да102125,133238
9/14
12eastclinic.ru73нет123296,551268
4/14
13ocheretina.ru25да8167,83613
6/14
14citilab.clinic7нет8435,52979
11/14
15spinelife.ru23да57304,463207
11/14
16smartclinicspb.ru37да184126,621300
9/14
17zdravclinic.ru46да53175,82893
11/14
18dialrapid.ru3нет4675,431566
9/14
19dr-ost.ru42нет66286,971177
7/14
20dikul.ru23нет6962,941326
11/14

Я искал закономерность сверху вниз и не нашёл.

Отсортируйте эту двадцатку по полноте раскрытия — получите другой порядок. Отсортируйте по плотности ключа — получите третий. Ни один из них не совпадёт с тем, что показывает Яндекс.

Четырнадцать признаков на одной шкале

Теперь то же самое для всего, что я померил. Чем правее полоса, тем чаще страница с бо́льшим значением признака стоит выше. Вертикальная черта — монетка.

Domain Rating домена
55 из 100
Популярность домена по Tranco
55 из 100
Полный ключ в h1
54 из 100
Полный ключ в description
54 из 100
Длина title
53 из 100
Полный ключ в h2–h5
53 из 100
Точное вхождение в title
52 из 100
Объём основного текста
52 из 100
Полный ключ в title
52 из 100
Число подзаголовков
52 из 100
Зон страницы с полным ключом
52 из 100
Совпадение с ключом, BM25
52 из 100
Плотность ключа
52 из 100
Полнота раскрытия интента
51 из 100
4246505458
Доля пар страниц внутри одной выдачи, где страница с бо́льшим значением признака занимает более высокое место. Пары считались только внутри одного запроса: страницы разных выдач друг с другом не конкурируют.
ПризнакЧто это
Domain Ratingоценка ссылочной силы домена по шкале Ahrefs от 0 до 100. У домена с DR 70 ссылочный профиль на порядок мощнее, чем у DR 20
Популярность по Trancoоткрытый рейтинг миллиона самых посещаемых доменов. Исследователи собирают его усреднением нескольких списков посещаемости за тридцать дней, поэтому он устойчивее Alexa и не зависит от одного поставщика
BM25классическая мера совпадения текста с запросом. Считает, сколько раз слова ключа встречаются в документе, с поправкой на длину текста. На ней построено базовое ранжирование почти всех поисковых движков
Зон с полным ключомсколько из четырёх зон (title, h1, description, подзаголовки) содержат все значимые слова ключа
Водность и тошнотапоказатели текстовых анализаторов. Доля служебных слов и частота повторов самого частого слова. Обе величины вместе с BM25 считает разбор текста по двадцати метрикам

Разброс от 51 до 55 из 100. Признак, на который стоило бы работать, дал бы 65 и выше. Но ни один не дотянул даже до 56.

Водность оказалась ниже пятидесяти — 48 из 100. Это значит, что более водянистая страница чаще стоит ниже, но отклонение от монетки такое же крошечное, как у остальных.

Чем места 1–3 отличаются от 15–20

Полосы ТОП-1 и ТОП-20 накопительные, вторая включает первую, и разница между ними смазана. Поэтому вот два непересекающихся куска выдачи, начало и хвост. У части признаков разрыв здесь заметнее, у плотности ключа он вообще меняет знак — это само по себе говорит, насколько величины неустойчивы.

1–3
15–20
Ссылок на странице
162
136
+20 %
Подзаголовков h2–h5
14
12
+17 %
Изображений
26
23
+13 %
Domain Rating домена
68
61
+12 %
Слов основного текста
1385
1268
+9 %
Полнота раскрытия интента
0,750
0,692
+8 %
Длина title, знаков
72
68
+6 %
Предложений в пассиве, %
16,5
15,9
+4 %
Плотность ключа, %
3,97
3,84
+4 %
Возраст домена, лет
18,4
18,2
+1 %
Зон с полным ключом из четырёх
1,00
1,00
+0 %
Типов микроразметки
5
5
+0 %
Двоеточий-перечислений на 1000 слов
3,71
3,76
-2 %
Первого лица на 1000 слов
0,67
0,71
-6 %
Списков ul и ol
14
16
-9 %
Доля изображений с alt, %
53
64
-17 %
Читабельность по Флешу
5,0
6,6
-24 %
Слева медиана мест 1–3, справа медиана мест 15–20, полоса показывает разницу в процентах от хвоста. Вправо — признака больше наверху. Считано на 222 наблюдениях вверху и 471 внизу.

Верх выдачи крупнее. Ссылок на странице 162 против 136, подзаголовков и картинок примерно на седьмую часть больше, текста на девятую. Domain Rating 68 против 61. Полнота интента 0,750 против 0,692.

Но два признака идут в обратную сторону, и оба неожиданные. Alt у изображений заполнен у 53 % картинок наверху против 64 % в хвосте. А читабельность по Флешу 5,0 против 6,6: тексты на первых местах читаются тяжелее, чем на последних. Правда, в процентах эта строка выглядит крупнее, чем есть: 1,6 пункта на стобалльной шкале, у самого её дна, где формула почти не различает.

Что это значит

Разрывы есть, но все в пределах пятой части, и ни один из них не упорядочивает выдачу — по парам все признаки дают около пятидесяти. Верх двадцатки не «лучше сделан», он просто крупнее: больше ссылок, больше блоков, домен посолиднее. Догонять его правкой title бессмысленно, догонять объёмом — дорого и без гарантий.

Строго первое место против двадцатого

Полосы выше склеивают по три и по шесть позиций. Вот те же признаки на двух крайних позициях выдачи без всякой склейки: 72 наблюдения на первом месте и 82 на двадцатом.

Наблюдений мало, и медиана на таких числах прыгает. Поэтому рядом с ней стоит межквартильный размах — границы, между которыми лежит средняя половина страниц. Если размахи двух позиций перекрываются почти целиком, разница медиан ничего не значит, и такая строка приглушена.

ПризнакМесто 1Место 20Разница медианРазличимо
Подзаголовков h2–h5189…24127…20+50 %да
Длина title, знаков8266…976753…84+22 %да
Domain Rating домена7238…905930…78+21 %да
Ссылок на странице14873…22713072…230+14 %нет
Изображений2112…651910…36+10 %да
Полнота раскрытия интента0,7070,333…0,8570,6430,500…0,800+10 %да
Слов основного текста1261533…19751211809…1552+4 %да
Зон с полным ключом из четырёх1,000,00…3,001,000,00…3,00+0 %нет
Возраст домена, лет18,013,2…28,318,211,5…26,1-1 %нет
Плотность ключа, %3,562,73…5,493,922,81…5,58-9 %нет
Предложений в пассиве, %14,17,8…20,416,09,8…23,5-12 %да
Списков ul и ol124…28147…29-17 %нет
Доля изображений с alt, %4726…906332…92-25 %нет
Читабельность по Флешу4,7-3,2…13,410,1-3,8…15,2-53 %нет
Типов микроразметки21…751…9-60 %нет

Различимы 7 признака из 15. Первое место обходит двадцатое по числу подзаголовков (18.0 против 12.0), длине title (82.0 против 67.0 знаков) и авторитету домена (72.0 против 59.0). Полнота интента различима тоже, но разрыв вдвое меньше.

А самые крупные проценты в этой таблице как раз ничего не стоят. Типов микроразметки медиана даёт 2.0 наверху против 5.0 внизу, и это минус шестьдесят процентов — но размахи совпадают почти целиком, а распределения различаются на единицы страниц. Медиана переваливает через ступеньку кусковой целой величины, и процент показывает скачок, которого в данных нет. То же с читабельностью и с долей alt.

Что это значит

Даже на двух крайних позициях выдачи различаются только объёмные признаки: сколько блоков, сколько знаков, какой домен. Ни один текстовый признак, кроме полноты, крайние позиции не разделяет — а полнота разделяет их слабее, чем длина title. И это на разнице первого места с двадцатым, то есть на максимально возможном контрасте внутри выдачи.

Проверка самой мерки

Законный вопрос к разделу выше. Если всё лежит около пятидесяти, может, мерка просто слишком грубая для топ-20 и ничего не различает в принципе?

Проверяется это так. Берём пары признаков, связь между которыми заведомо есть — два измерения одного и того же, — и считаем ту же самую величину. Если мерка на них покажет пятьдесят, она бесполезна. Если восемьдесят и девяносто, значит она работает, а пятьдесят у полноты и ключа — настоящий ноль.

Полнота в двух режимах извлечения
92 из 100
Авторитет домена и его популярность
87 из 100
Объём текста и полнота раскрытия
73 из 100
BM25 и вхождение ключа в зоны
64 из 100
Полнота интента и позиция
51 из 100
528507295
Доля пар, где два признака указывают в одну сторону. Внизу для сравнения главная величина статьи.
Пара признаковПочему связь ожидаемаИз 100 парПар в счёте
Полнота в двух режимах извлеченияодна и та же величина, снятая с двух разных версий текста928460
Авторитет домена и его популярностьDomain Rating и ранг Tranco меряют разными способами одно — вес сайта879017
Объём текста и полнота раскрытиядлинная статья закрывает больше составляющих, связь ожидаема739667
BM25 и вхождение ключа в зоныобе величины считают присутствие слов запроса на странице646818

Полнота, снятая с двух разных версий текста одной и той же страницы, даёт 92 из 100. Авторитет домена и его популярность — 87. Мерка спокойно показывает девяносто там, где связь есть.

Значит 51 у полноты интента и 52 у ключа в title — это не тупость инструмента. Это отсутствие связи.

Что это значит

Ни один из четырнадцати признаков не дотянул до 56 из 100 при монетке в 50. Это значит, что порядок мест внутри двадцатки объясняется не тем, что видно в тексте и разметке. Искать рычаг стоит там, где я не мерил: в поведении пользователей, в коммерческих факторах, в том, попадёт ли страница в двадцатку вообще.

Почему в статье про onpage есть DR и возраст домена

Domain Rating, Tranco и возраст домена — признаки домена, а не страницы. Вёрсткой и текстом их не поправишь. Я взял их как линейку.

Без линейки число «51 из 100» повисает в воздухе. Может, полнота интента и правда не двигает позиции. А может, мерка в принципе не умеет показывать больше, и тогда все onpage-выводы статьи ничего не стоят. Поэтому DR, Tranco и возраст я померил тем же способом, на тех же страницах, в тех же парах: 55, 55 и 51 из 100. Внутри двадцатки ссылочная сила и возраст ведут себя примерно как ключ в title.

Но показывать больше мерка умеет — в разделе «Проверка самой мерки» связи с заранее известным ответом дают 92 и 87 из 100.

Рекомендаций по ссылкам и по выбору домена дальше не будет. Ни одну из трёх величин я не предлагаю оптимизировать: они стоят здесь как точка отсчёта для onpage-признаков и как проверка расхожего «он выше, потому что домен старше».

Ключ в title, h1, description и подзаголовках

Для каждой страницы я разобрал зоны и проверил вхождение ключа. Полным вхождением считается присутствие всех значимых слов ключа по леммам, точным — ключ подряд, слово в слово. Скажем, для запроса «сколько сохнет стяжка пола» title «Сколько сохнет стяжка пола, сроки по типам» даёт и полное, и точное вхождение, а «Время высыхания стяжки» не даёт ни того ни другого.

Доля страниц с полным вхождением ключа
Полный ключ в title
35%
39%
38%
36%
35%
Точное вхождение ключа в title
18%
23%
22%
21%
20%
Полный ключ в h1
35%
34%
31%
28%
27%
Полный ключ в description
36%
37%
36%
34%
33%
Полный ключ хотя бы в одном h2–h5
42%
42%
41%
39%
37%
ТОП-1ТОП-3ТОП-5ТОП-10ТОП-20
Столбцы слева направо: ТОП-1, ТОП-3, ТОП-5, ТОП-10, ТОП-20. Первая полоса выделена цветом.
ЗонаНа 1-м местеПо всему топ-20Из 100 парПар в счёте
Полный ключ в title35%35%523821
Точное вхождение ключа в title18%20%522647
Полный ключ в h135%27%543262
Полный ключ в description36%33%543896
Полный ключ хотя бы в одном h2–h542%37%534476

Две трети страниц в топ-20 обходятся без полного ключа в title, и на порядок мест это не влияет. Точное вхождение наверху встречается даже реже, чем внизу: 18% против 20%.

Практический смысл прямой. Если ваш title собран под ключ, а конкурент выше вас с title без ключа, вы смотрите на норму, а не на аномалию. В разобранной выше выдаче по «боль в пояснице отдает в ногу» ключ в title есть у страниц на 1, 2, 3, 6, 11, 13, 15, 16 и 17 местах — россыпью по всей двадцатке.

Плотность ключа, длина title и подзаголовки

Плотность считалась как доля вхождений слов ключа от всех слов основного текста; тексты короче двухсот слов исключены, потому что на них величина бессмысленна.

ПризнакТОП-1ТОП-3ТОП-5ТОП-10ТОП-20Из 100 пар
Длина title, знаков827273726953
Подзаголовков h2–h5181414141352
Плотность ключа, %3,563,974,024,003,9252
Слов основного текста1261138513861384130152
Зон с полным ключом из четырёх1,001,0011,001,0052
Водность, %25,926,727,026,727,048
Классическая тошнота4,584,694,694,694,5852
Академическая тошнота, %1,922,042,072,041,9650

Медианная плотность ключа на первом месте 3,56 %, по всему топ-20 3,92 %. Но если сравнить не одну позицию, а места 1–3 с местами 15–20, знак переворачивается: 3,970 против 3,840 %. Величина болтается около четырёх процентов и меняет направление от того, как нарезать полосы. По парам плотность даёт 52 из 100 — монетка.

Длина title наверху заметнее: медиана 82 знака против 69 внизу, 53 из 100 по парам. Это самый заметный из текстовых признаков, и всё равно он далёк от рычага. Подзаголовков наверху тоже больше, 18 против 13.

Водность, классическая и академическая тошнота, читабельность — все четыре лежат в пределах двух пунктов от монетки. Медиана водности 25,9 % на первом месте против 27,0 % по двадцатке, классическая тошнота держится около 4,58 во всех полосах.

Микроразметки и alt наверху меньше, чем внизу

До сих пор речь шла о тексте. Теперь то, что правят в самой странице: микроразметка, изображения с alt, списки и таблицы, ссылки, вид адреса. Всё снято с сохранённого HTML 1538 страниц.

Микроразметка стоит почти у всех, и наверху её меньше, чем внизу.

ПолосаСтраницС микроразметкойДоля
ТОП-1725779,2 %
ТОП-322219186,0 %
ТОП-536932487,8 %
ТОП-1074864986,8 %
ТОП-201538133286,6 %

Чаще всего размечают навигацию и карточку организации, а не содержание. Вот что встречается в корпусе: BreadcrumbList у 713, ListItem у 632, ImageObject у 609, Organization у 565, Article у 546.

ПризнакТОП-1ТОП-3ТОП-5ТОП-10ТОП-20Из 100 парПар в счёте
Типов микроразметки на странице2,05,05,05,05,05110506
Изображений21262626245311413
Доля изображений с alt, %47535660624910785
Списков ul и ol12141616165111315
Таблиц00000485732
Ссылок на странице1481621731661495311547
Доля внешних ссылок, %11109995110689
Тегов h111111461928
Длина адреса, знаков66666565674711430
Глубина вложенности адреса22222507715
Чисел на 100 слов2,32,32,12,22,25110877
Имён собственных на 100 слов0,80,80,60,70,84810435
Предложений в пассиве, %14,116,516,816,316,04911022
Читабельность по Флешу4,75,07,16,56,14911080
Доля длинных слов, %56,856,956,857,056,95111046
Рваность ритма0,520,520,520,520,525010670

Alt у изображений на первом месте заполнен у 47 % картинок, по всей двадцатке у 62 %. Наверху хуже, а не лучше. Изображений на первом месте 21 против 24, списков 12 против 16. Медиана таблиц по всем полосам ноль: таблицами в этих нишах почти не пользуются.

Адреса везде одинаковые. Медиана длины адреса на первом месте 66 знаков и 67 по двадцатке, глубина вложенности две папки. Кириллицы в пути адреса нет ни на одной из 1538 страниц. Кириллические домены при этом встречаются, просто записаны в punycode.

Тексты в топ-20 читаются тяжело. Медиана по Флешу 6,1 из ста, доля длинных слов 56,9 %, пассивных предложений 16,0 %. Первое место от двадцатого по этим величинам не отличается.

И ни один признак этого слоя не упорядочивает выдачу. Разброс по парам от 46 до 53 из 100 при монетке в 50.

Машинного текста наверху меньше, но разница крошечная

Все страницы корпуса я прогнал через два своих инструмента — SEO-анализ текста и детектор ИИ-текста. Второй смотрит на три слоя сразу. Шаблонные обороты, которые модели производят чаще людей. Предсказуемость слов, где у машинного текста разброс заметно у́же. И структуру письма — двоеточия-перечисления, тире-связки, первое лицо, начала фраз с союзов. Прогнал все 1538 страниц корпуса. Показания ниже по полосам выдачи, и в каждой таблице своя колонка со страницами: слои считаются не на всех, потому что часть страниц осталась без добытого текста.

Слой первый: шаблонные обороты

ПолосаСтраницС приметамиДоляСреднее по корпусу, %
ТОП-1632031,8 %0,50
ТОП-32076129,5 %0,55
ТОП-53499527,2 %0,49
ТОП-1072319827,4 %0,54
ТОП-20150642628,3 %0,57

Хотя бы одна примета нашлась у 31,8 % страниц первого места и у 28 % по всей двадцатке. Медиана везде ноль, максимум по корпусу 14,3 % предложений. По парам признак даёт 48 из 100, то есть чуть ниже монетки.

Чем выше место, тем меньше машинных оборотов

Доля страниц, где детектор нашёл хоть одну примету, по полосам почти ровная. А вот их количество на страницу растёт сверху вниз.

ПолосаСтраницС приметамиДоля страницСрабатываний на 100 страниц
места 1–32226127,5 %40
места 4–1052613726,1 %47
места 11–2079023029,1 %55

В местах 1–3 приходится 40 срабатываний на сотню страниц, в местах 11–20 — 55. В хвосте выдачи машинных оборотов на 38 % больше. При этом доля страниц, затронутых хоть одной приметой, различается всего на 1,6 пункта: дело не в том, что внизу больше «машинных» страниц, а в том, что на каждой их больше.

Разбор по отдельным оборотам показывает, какие именно тянут разницу.

ОборотРазСтраницМеста 1–3Места 4–10Места 11–20
«таким образом»2251578,6 %10,5 %10,5 %
«это не просто»88633,6 %2,9 %5,1 %
«стоит отметить»58541,4 %3,4 %4,2 %
«играет ключевую роль»54414,0 %3,0 %2,0 %
«широкий спектр»52453,6 %2,7 %2,9 %
«следует отметить»45391,8 %2,3 %2,9 %
«в заключение»39360,9 %2,9 %2,4 %
«индивидуальный подход»36281,4 %2,1 %1,8 %
«важно отметить»30270,4 %0,8 %2,8 %
«давайте рассмотрим»29272,7 %1,9 %1,4 %
«является одним из»27271,4 %2,5 %1,4 %
«на сегодняшний день»18161,4 %0,2 %1,5 %
«неотъемлемая часть»18121,4 %0,4 %0,9 %
«в связи с этим»13121,4 %0,9 %0,5 %

Тянет разницу мета-комментарий — обороты, которыми автор говорит о собственном тексте вместо того, чтобы говорить о предмете. «Важно отметить» встречается в хвосте выдачи в семь раз чаще, чем в первой тройке: 2,8 % страниц против 0,4 %. «Стоит отметить» — втрое чаще, «в заключение» — почти втрое.

Обратный перекос тоже есть, и он мельче. «Играет ключевую роль» и «давайте рассмотрим» встречаются наверху вдвое чаще, чем внизу. Самый частый оборот корпуса, «таким образом», распределён почти ровно: 8,6 % страниц наверху против 10,5 % внизу.

Что это значит

Направление есть, и оно в пользу чистого текста: чем выше место, тем меньше машинных оборотов на страницу. Но величина крошечная — 40 срабатываний на сотню страниц против 55, и по парам признак даёт всё те же 48 из 100. Как рычаг подъёма это не работает. Как стоп-лист редактору — работает: вычистить «важно отметить», «стоит отметить», «в заключение» и «таким образом» стоит десять минут, и хуже точно не станет.

Слой второй: предсказуемость слов

Что именно меряет этот слой и почему высокая предсказуемость сама по себе не улика, я разбирал отдельно — в работах про перплексию в русском SEO-тексте и про то, что на самом деле измеряют AI-детекторы.

ПолосаСтраницДетектор сработалДоляМедиана перекоса
ТОП-15411,8 %0,341
ТОП-319094,7 %0,291
ТОП-5321175,3 %0,297
ТОП-10659456,8 %0,286
ТОП-201366896,5 %0,286

На первом месте детектор сработал у 1,8 % страниц, по всей двадцатке у 6,5 %. Наверху машинного текста меньше, но на первом месте всего 54 страниц с этим замером, так что разницу стоит читать как наблюдение. По парам перекос даёт ровно 50 из 100.

Слой третий: структура письма

Структурные признаки по полосам выдачи
Двоеточий-перечислений на 1000 слов
82%
92%
100%
95%
94%
Тире-связок на 1000 слов
100%
99%
99%
90%
91%
Первого лица на 1000 слов
83%
94%
100%
86%
96%
Фраз с союза в начале, %
95%
95%
100%
95%
97%
Одинаковых начал абзацев, %
96%
96%
96%
96%
100%
ТОП-1ТОП-3ТОП-5ТОП-10ТОП-20
Столбцы слева направо: ТОП-1, ТОП-3, ТОП-5, ТОП-10, ТОП-20. Высота нормирована на максимум внутри признака, чтобы видеть форму, а не абсолютные величины.
ПризнакТоп-20Живой текстМашинный текстКуда ближеИз 100 пар
Двоеточий-перечислений на 1000 слов3,772,610,3к живому52
Тире-связок на 1000 слов10,529,920,6к живому52
Первого лица на 1000 слов0,689,80,0к машинному50
Фраз с союза в начале, %3,606,61,5посередине51
Одинаковых начал абзацев, %14,906,711,6к машинному48

Разброс между полосами виден на графике выше и везде мал. Поэтому в таблице оставлено то, ради чего она нужна: где значение топ-20 стоит между нормой живого текста и нормой машинного. Нормы сняты с размеченного корпуса — 231 человеческая статья против 353 машинных.

живой текстмашинный текст
Двоеточий-перечислений на 1000 слов
3,77
Тире-связок на 1000 слов
10,52
Первого лица на 1000 слов
0,68
Фраз с союза в начале, %
3,60
Одинаковых начал абзацев, %
14,90
Точка показывает, где медиана топ-20 стоит между нормой живого текста и нормой машинного. Чем правее, тем ближе выдача к машинному письму.

Топ-20 обезличен почти до машинной отметки. Первое лицо встречается 0,68 раза на тысячу слов при живой норме 9,8 и машинной 0,0. «Я», «мы», «нам» из SEO-текстов вымыты полностью, и на первом месте их не больше, чем на двадцатом.

Одинаковых начал абзацев в выдаче 14,9 %, что выше машинной нормы 11,6 и вдвое выше живой 6,7. По двоеточиям и тире выдача, наоборот, держится ближе к живому письму.

Направление у двух слоёв из трёх одно и то же: чем ниже место, тем машинного больше. Плотность оборотов растёт с 40 до 55 на сотню страниц, срабатывание по предсказуемости — с 1,8 % до 6,5 %. Структура письма при этом одинакова по всей двадцатке.

А вот упорядочить выдачу этим нельзя. Шаблонные приметы дают 48 из 100 пар, перекос предсказуемости 50, структурные признаки от 48 до 52 — на уровне монетки. Разница видна на средних по полосам и исчезает, когда сравниваешь страницы одной выдачи попарно. Так что «Яндекс топит нейротексты» из этих данных не следует, но и «ему всё равно» — тоже слишком сильно. Насколько по-разному пишут сами модели, я мерил в тесте восемнадцати ИИ-сервисов.

Страницы, где шаблонных примет больше всего:

МестоДоменЗапросДоля предложений с приметами
7zakonrf.infoсроки расчета при увольнении14,3 %
12troickopechorskij-r11.gosweb.gosuslugi.ruсроки расчета при увольнении10,0 %
8ceresit-market.ruобмазочная гидроизоляция7,7 %
7mediasphera.ruбессонница у женщин причины6,7 %
14potolki.groupнатяжные потолки6,7 %
15otvet.mail.ruпочему не работает вай фай на роутере6,7 %
Что это значит

Микроразметка стоит у 87 % страниц двадцатки, списки есть почти везде — по ним различать некого. А вот alt заполнен лишь у 62 % изображений, и наверху даже реже. То есть половина топа живёт с пустыми alt и не страдает. Всё это гигиена входа, а не рычаг подъёма.

Сколько интента раскрывают страницы топ-20

Раз полнота не двигает места внутри двадцатки, остаётся другой вопрос: какой уровень раскрытия там вообще встречается. Вот распределение по 1454 страницам с добытым содержанием.

8 %
13 %
33 %
46 %
меньше 25 %от 25 до 50 %от 50 до 75 %75 % и выше
Доля составляющих интента, раскрытых содержательно. Типичная страница топ-20 закрывает 71 % интента.

Половина страниц топ-20 раскрывает больше 71 % интента, пятая часть закрывает меньше половины, десятая — меньше 30 %.

Рабочая отсечка для брифа лежит не в медиане, а в нижнем краю. Десятый процентиль по полосам не опускается ниже 0,250 — ниже этого уровня лежит примерно десятая часть двадцатки. Это нижний край распределения, а не порог допуска: 7,5 % страниц закрывают меньше четверти карты и всё равно стоят в топ-20. Медиана 71 % — уровень типичной страницы, тоже не порог.

Но нижний край одинаков по всей выдаче. Десятый процентиль на первом месте 0,250, на местах 11–20 равен 0,286, разброс 0,083. Страницы со слабым раскрытием попадают и в самый верх.

Полоса, непересекающаясяСтраниц10-й процентильМедиана
1600,2500,786
2–31440,3330,774
4–104960,3330,714
11–207540,2860,700

Возраст домена: молодых в топе мало

Дату регистрации я собрал из WHOIS для 481 доменов из 562. Эти домены закрывают 89,4 % наблюдений корпуса. Международные зоны WHOIS в моём окружении не отдал, и я это не заглаживал. Возраст считается на дату съёма выдачи.

ПолосаНаблюденийМедиана, летМоложе 3 летСтарше 20 лет
ТОП-16818,02,9 %41,2 %
ТОП-321218,43,3 %45,8 %
ТОП-534718,14,0 %45,5 %
ТОП-1069018,15,4 %44,6 %
ТОП-20137518,55,2 %44,5 %

Медиана возраста одинакова во всех полосах: около 18,5 лет и на первом месте, и на двадцатом. По парам возраст даёт 51 из 100 — внутри двадцатки он не решает ничего.

Зато распределение говорит другое.

5 %
16 %
35 %
44 %
моложе 3 летот 3 до 10 летот 10 до 20 летстарше 20 лет
Возраст домена на дату съёма выдачи, все наблюдения топ-20.

Доменов моложе трёх лет в двадцатке 5,2 %, а старше двадцати — 44,5 %. Оговорка, которую снимать нельзя: WHOIS показывает дату регистрации домена, а не возраст проекта на нём. Купленный дроп 2007 года выглядит здесь восемнадцатилетним. И международные зоны выпали из сбора, а они моложе российских, так что медиана скорее завышена.

Что это значит

Внутри двадцатки возраст не двигает: 51 из 100. Но состав двадцатки перекошен — молодых там один из двадцати. Что это, барьер входа или просто след того, что старые сайты успели набрать всё остальное, мои данные не различают: страниц вне топ-20 я не собирал. Клиенту с трёхлетним доменом честно сказать так — пять процентов топа такие же, как он, и это немного, но не ноль.

ТОП-1, ТОП-3, ТОП-5, ТОП-10, ТОП-20

Средняя полнота раскрытия по позициям
место 1
0,577
место 2
0,658
место 3
0,667
место 4
0,657
место 5
0,569
место 6
0,675
место 7
0,655
место 8
0,620
место 9
0,669
место 10
0,646
место 11
0,593
место 12
0,604
место 13
0,684
место 14
0,672
место 15
0,641
место 16
0,609
место 17
0,614
место 18
0,649
место 19
0,675
место 20
0,611
Каждая позиция отдельно, по 77 наблюдений на каждой. Первая позиция выделена цветом.

Первая позиция даёт 0,577, десятая 0,646, тринадцатая 0,684. Ряд не выстраивается ни по возрастанию, ни по убыванию.

ПолосаПолнотаРаскрыто из картыНаблюденийСтраниц
ТОП-10,5775,7 из 10,17256
ТОП-30,6356,3 из 10,1222176
ТОП-50,6266,3 из 10,3369269
ТОП-100,6406,5 из 10,2748524
ТОП-200,6386,5 из 10,315381057

Полосы накопительные: ТОП-3 включает первые три места, ТОП-20 — все двадцать.

А так выглядит одна выдача целиком. Запрос «боль в пояснице отдает в ногу», 14 составляющих интента; высота столбца — сколько из них раскрыто содержательно на этой позиции.

10
11
13
8
7
5
12
12
9
14
9
4
6
11
11
9
11
9
7
11
1234567891011121314151617181920

На первом месте раскрыто 10 из 14, разброс по выдаче от 4 до 14, и максимум стоит не наверху.

В праве и финансах наверх выходит калькулятор, а не статья

НишаПолнота по нишеНа первом местеНа местах 11–20Наблюдений
медицина0,7600,8290,753339
право0,6750,3900,670302
финансы0,5980,3810,649307
техника0,5840,6840,550296
стройка0,5530,5480,550294

В медицине первое место полнее среднего по нише, 0,829 против 0,760. Но в праве и финансах наоборот, 0,390 против 0,675 и 0,381 против 0,598.

Причину я вижу в самих выдачах. По «сколько стоит осаго» на первом месте стоит калькулятор sravni.ru. Он считает, а текстом закрывает 1 составляющую из 11. По девяти запросам про временную регистрацию, европротокол, самозанятость и кредитную историю наверх выходит страница Госуслуг, где содержание собирается скриптом. В этих нишах верх выдачи занимают инструменты, а не статьи.

Что это значит

В медицине верх выдачи содержательнее среднего, в праве и финансах — беднее вдвое. Если ваш клиент в финансах и на первом месте стоит калькулятор, догонять его текстом бессмысленно: Яндекс отвечает на такой запрос действием. Стройте свой инструмент или бейтесь за места ниже первого.

Крайние случаи

Пары из одной выдачи по одному запросу. Слева первое место, справа страница ниже.

Нижняя страница раскрывает полнее

сколько стоит осаго11 составляющих интента · финансы
место 1sravni.ru1 из 11
место 4finuslugi.ru11 из 11
сколько можно жить без регистрации4 составляющих интента · право
место 1consultant.ru1 из 4
место 4brobank.ru4 из 4
гидроизоляция пола в ванной12 составляющих интента · стройка
место 1akterm.ru3 из 12
место 15plitonit.ru11 из 12
изжога после еды11 составляющих интента · медицина
место 1omez.ru5 из 11
место 7cmclinic.ru11 из 11

Первое место раскрывает полнее

монтаж натяжного потолка10 составляющих интента · стройка
место 1rosstroy-potolki.ru9 из 10
место 15potolok.net1 из 10
болит поясница причины9 составляющих интента · медицина
место 1ramsaydiagnostics.ru9 из 9
место 16eomed-clinic.ru2 из 9
как перезагрузить роутер7 составляющих интента · техника
место 1hi-tech.mail.ru6 из 7
место 15digitalsquare.ru1 из 7
телефон греется и разряжается10 составляющих интента · техника
место 1master-mobile.ru8 из 10
место 19yandex.ru1 из 10

И тот и другой список я получил одной процедурой из одного корпуса. Когда связи нет, крайние случаи находятся в обе стороны, это и видно.

В каждой нише есть составляющие, которые не закрыл почти никто

У каждой составляющей интента можно посчитать долю страниц выдачи, раскрывших её содержательно. Вот как эти доли разложились по 266 составляющим двадцати тем.

5 %
6 %
18 %
71 %
почти никемменьше четвертиот четверти до половиныбольше половины
Доля страниц выдачи, раскрывших составляющую содержательно.

Семь составляющих из десяти закрывает больше половины выдачи — по таким конкурировать нечем, там уже все. Интерес в другом хвосте. Меньше чем четвертью страниц закрыты 28 составляющих, а 12 из них не закрыл почти никто.

Важно, что это не экзотика одной темы. Слабо закрытые составляющие нашлись в 15 темах из 20 и во всех пяти нишах.

Сколько составляющих закрыто меньше чем четвертью выдачи
стройка56 составляющих
10 · 17,9 %
медиана закрытия0,504
техника51 составляющая
8 · 15,7 %
медиана закрытия0,524
право51 составляющая
5 · 9,8 %
медиана закрытия0,708
медицина55 составляющих
3 · 5,5 %
медиана закрытия0,787
финансы53 составляющие
2 · 3,8 %
медиана закрытия0,731
Полоса длиннее — свободного места больше. Справа медиана: доля выдачи, закрывающая типичную составляющую этой ниши.

Плотнее всего закрыты медицина и финансы: там слабых составляющих по три и по две, а типичная составляющая раскрыта у трёх четвертей выдачи. Свободнее всего стройка и техника — каждая шестая составляющая закрыта меньше чем четвертью страниц, и медиана закрытия там едва за половину.

На тему приходится в среднем по одной такой составляющей, в отдельных темах до 4. Немного — но это места, где догонять некого.

Главная рекомендация по контенту из этого замера

Ищите не максимальную полноту, а дефицит покрытия. По большинству составляющих полнее уже некуда, их закрывают все. Смысл есть в тех, где спрос есть, а ответа в выдаче нет. Постройте карту интента, прогоните её по своей двадцатке, отметьте составляющие с низким закрытием и проверьте под ними частотность. В стройке и технике такие места находятся чаще, чем в медицине и финансах.

Это конструктивнее, чем вывод «полнота не работает». Полнота как рычаг позиции внутри двадцатки не работает — 51 из 100. А как способ найти незанятое место она работает, и вот на что делится карта.

Закрыто выдачейСоставляющихДоля картыЧто это значит для ТЗ
меньше 10 %124,5 %свободное место. Проверьте спрос — и если он есть, это единственный тип правки, где догонять некого
10–25 %166,0 %слабо закрытая потребность. Ответ в выдаче есть, но у единиц
25–50 %4818,1 %обычная часть темы. Закрывать стоит, преимущества это не даёт
50 % и выше19071,4 %базовое ожидание. Без неё страница выглядит неполной, с ней — как все

Границы взяты из моего же разбиения 266 составляющих. Это рабочая эвристика для карты интента, а не доказанные пороги ранжирования: замер не показывает, что перенос составляющей из одной строки в другую двигает позиции.

Иногда причина пустоты видна прямо в тексте. Страница клиники по запросу «боль в пояснице» перечисляет группы препаратов, и в абзаце про нестероидные противовоспалительные стоит скобка: «(не надо указывать название препаратов)». Редакторская инструкция автору ушла в публикацию и висит в топ-20.

Одна оговорка, которую снимать нельзя. Фраза-свидетельство попадает в Wordstat и от одного показа, а порог в 300 показов я применял к запросам, а не к свидетельствам. Так что спрос под незакрытой составляющей надо проверять отдельно, прежде чем писать под неё текст.

Как это считалось

Две работы на разных наборах запросов. Первая — 65 запросов и 544 страницы. Вторая охватила 97 запросов пяти ниш (медицина, право, финансы, стройка, техника), и там карты интента, шкала оценки и вся процедура счёта заморожены до первого обращения к выдаче. Съём делался по Яндексу, топ-20, регион Россия.

Карту интента я строю от спроса. За каждой составляющей стоит хотя бы одна фраза, будь то сам запрос, верхняя фраза Wordstat или ассоциация из его же выдачи. Из 266 составляющих двадцати тем ни одна не появилась из общих соображений.

Дальше страница загружается, из неё извлекается основной текст, и оценщик читает текст, не видя ни позиции, ни домена, ни соседей по выдаче.

Чтобы числа ниже складывались в голове, вот весь корпус одной таблицей.

ЧтоСколькоПояснение
Мест в выдаче собрано194097 запросов по 20 позиций
Наблюдений в счёте1538место в выдаче, у которого есть и текст, и оценка
Уникальных страниц1057одна страница попадает в несколько выдач
Уникальных доменов562на 1057 страниц
Запросов97из ста задуманных
Тем20по пять запросов, карта интента строится на тему
Составляющих интента266в среднем 10,25 применимы к запросу

В разных разделах знаменатель меньше 1538, и всегда по одной из трёх причин. Страница не отдала текста ни одному извлекателю. Текст оказался короче порога содержания в 120 слов. Или внешний источник промолчал — так вышло с WHOIS по международным зонам. Каждый раз я называю фактическое число рядом с величиной.

ОценкаЧто означаетПример по составляющей «сколько сохнет стяжка»
0материала нетпро сроки высыхания не сказано ничего
1аспект назван, ответа нет«срок высыхания зависит от толщины и условий»
2есть самостоятельный ответ«цементная — сутки на каждый сантиметр, до 28 дней на полный набор прочности»

Оценщик здесь — языковая модель по замороженной инструкции, а не человек. Десятая часть документов прошла второй независимый проход, чтобы проверить воспроизводимость шкалы.

Полнота страницы — это доля составляющих, раскрытых на двойку, от числа применимых к запросу. Объём текста на оценку не влияет. Короткий конкретный ответ получает двойку, длинная пустая формулировка единицу.

Обе работы выложены целиком. В пакете лежат 2655 оценённых наблюдений таблицей, замороженные карты интента, предрегистрация второй работы вместе с журналом отклонений и скрипт, который пересчитывает числа этой статьи от исходного CSV — включая те решения, которые сыграли против моего же вывода.

Устойчивость результата

Одно и то же число я посчитал пятью способами. Если бы результат зависел от того, где провести границу, это было бы видно здесь.

Связь полноты и позиции при разных решениях о счёте
консервативный режим
−0,047
покрывающий режим
−0,029
без страниц без текста
−0,066
без смешанных запросов
−0,052
с текстом второго извлекателя
−0,029
Все пять величин лежат внутри полосы практического нуля, объявленной до сбора данных.

Прибор по рангу не косит, доля загруженных страниц по полосам 1–3 — 89,7 %, 4–10 — 90,2 %, 11–20 — 89,4 %. И шкала воспроизводима. Второй независимый проход по десятой части документов упорядочил их так же, связь +0,950 при совпадении отдельных решений 0,930.

Для тех, кто считает в коэффициентах. Ниже — ранговая связь каждого признака с местом, развёрнутая так, чтобы вправо означало «признак помогает подняться». Полоса вокруг нуля шириной ±0,10 — то, что я объявил практическим нулём до сбора данных. Признак работает рычагом, только если его отрезок вышел за её пределы.

Полнота раскрытия интента
+0,047
Domain Rating домена
+0,128
Популярность домена по Tranco
+0,111
Сила совпадения с ключом, BM25
+0,025
Зон страницы с полным ключом
−0,010
Объём основного текста
+0,069
−0,2−0,10,0+0,1+0,2+0,3
вторая работа: точка и интервал по кластерам первая работа полоса, объявленная практическим нулём вправо — признак помогает подняться, влево — мешает

Что об этом говорят другие замеры

Мой корпус свежий, но маленький: 162 запроса и 1601 страница в двух замерах, съём — август 2026 года. Проверить вывод стоит по чужим данным — собранным другим методом, на другой выборке и без моего участия.

Самый близкий по смыслу источник — Лаборатория поисковой аналитики «Ашманов и партнёры». Она снимает выдачу Яндекса и Google с 2015 года и считает связь позиции с шестью сотнями параметров. В сентябре 2024-го вышла вторая часть их исследования по информационным запросам — то есть по такому же типу выдачи, что и мой корпус.

Их главный вывод сформулирован так: «в Яндексе текстовые факторы участвуют в предварительном отборе сайтов… Поэтому текстовые факторы намного сильнее отражаются на выходе в топ Яндекса, чем на положении внутри него». Это ровно то, что у меня получилось на парах, только сказано с другой стороны.

Что пишет Лаборатория про ЯндексЧто вышло у меня
Текстовые факторы работают на входе в топ, а не на месте внутри негоПолнота даёт 51 из 100, классические текстовые признаки 52–54 при монетке в 50
У основного текста страницы «корреляция с позицией отсутствует»Объём основного текста 52 из 100, полнота раскрытия интента 51
«Концентрация слов запроса в тексте не показывает значимую корреляцию с позицией»Плотность ключа 52 из 100, BM25 52
Заголовки h2–h4 дают слабую корреляцию с позициейЧисло подзаголовков 52 из 100
Ссылочные параметры коррелируют с позицией сильноDomain Rating 55 из 100 — сильнейший из измеренных, но до рычага не дотягивает

Есть и общая мерка. В отчёте Лаборатории за 2019 год порог назван прямо: «Мы считаем корреляцию с позицией сильной, если коэффициент корреляции — 0,10 и больше (или −0,10 и меньше)». Медианная ранговая связь полноты интента с местом у меня −0,047 во второй работе и 0,033 в первой. По их собственной линейке это не слабая связь, а её отсутствие.

Где мы расходимся

Два пункта не сходятся, и я не буду их сглаживать.

Размер текста. Лаборатория пишет: «размер текста в целом как раз сильный параметр для ранжирования». У меня объём даёт 52 из 100. Расхождение объяснимо, и объяснение важнее самого расхождения. Они меряют текст страницы целиком — вместе с меню, анонсами соседних материалов и блоками перелинковки. Я меряю только основной текст, который извлекаю двумя режимами. Про него они говорят то же, что и я: корреляции с позицией нет. И вторая половина: «сильный» у них означает в том числе контраст с фоном — со страницами за пределами топ-30. Моя выборка фона не содержит вовсе.

Title. На информационных выборках они видят «сильную корреляцию с позициями» для вхождений запроса в title. У меня длина title даёт 53 из 100, полное вхождение ключа — 52. Тут мы меряем разное: они считают долю слов запроса в title с весами и получают 0,6–0,75 запроса, я считаю бинарно, есть полное вхождение по леммам или нет. Возможно, разница именно в этом. Но объявлять расхождение решённым я не могу — это открытый вопрос, и на моих данных title рычагом не выглядит.

Чего мой замер не видит вообще

Главное ограничение, которое видно только на чужом фоне

Я снимал топ-20 и меряю порядок внутри него. Попадание в двадцатку мой корпус измерить не может: страниц за её пределами в нём нет. Лаборатория меряет как раз это — контраст между топом и фоном, — и там текстовые факторы у неё сильные.

Две работы складываются в совместимую картину: текстовые факторы могут быть важнее для отбора страницы в конкурентный пул, чем для распределения мест уже внутри него. Мой корпус проверяет только вторую половину этой картины — первую я не мерил и утверждать её не могу.

Практический вывод от этого не меняется. Коридор двадцатки нужен, чтобы понять, дотягиваете ли вы до её обычных значений, а не чтобы подтягивать показатели к медиане ради позиции.

Третий замер, по другому признаку

В декабре 2024-го Сергей Юрков из SEO&ROI опубликовал разбор связи ИКС со средней позицией: 250 запросов, топ-20 Яндекса, около 3500 адресов. Спирмен вышел −0,023 при p-value 0,2325 — связи нет. Признак другой, метод похожий, вывод тот же: доменная метрика, которую принято сравнивать с конкурентами, порядок мест не объясняет.

Оговорка к этой работе есть: там позиция усреднена по запросам, а не сравнивается внутри одной выдачи. Мощность теста авторы сами оценили в 5,2 % и честно об этом написали. Так что это не третье доказательство, а третье наблюдение в ту же сторону.

Коридор страницы, которая уже стоит в топ-20

Медиана сама по себе ориентира не задаёт: непонятно, что считать отклонением. Тысяча триста слов — медиана двадцатки, а восемьсот это уже мало или ещё нормально? Поэтому вот пять процентилей по 1454 наблюдениям.

Признаки я развёл на две группы, потому что для аудита они значат разное. Первую вы правите на самой странице. Вторая — ссылочная сила и возраст домена — описывает среду, в которой страница конкурирует, и правкой текста не меняется.

Что можно исправить на странице
Полнота раскрытия интентадоля карты
0,30 1,00
0,71коридор 0,50…0,88
Слов основного текстаслов
563 2781
1372коридор 897…1976
Подзаголовков h2–h5штук
4 29
13коридор 8…21
Длина titleзнаков
46 103
69коридор 57…85
Плотность ключа%
1,43 7,69
3,92коридор 2,50…5,75
Зон с полным ключомиз четырёх
0 4
1коридор 0…3
Ссылок на страницештук
55 392
154коридор 90…262
Изображенийштук
6 110
25коридор 13…48
Доля изображений с alt%
10 97
63коридор 31…90
Списков ul и olштук
4 52
17коридор 9…30
Типов микроразметкиштук
0 12
5коридор 1…8
Водность%
20,1 33,0
27,1коридор 24,0…30,3
Классическая тошнота
3,00 7,07
4,58коридор 3,74…5,48
Предложений в пассиве%
7,3 27,8
16,1коридор 11,1…21,7
Читабельность по Флешу0–100
-17,0 22,5
6,5коридор -4,1…15,0
Предложений с приметами ИИ%
0,00 2,20
0,00коридор 0,00…0,80
Двоеточий-перечисленийна 1000 слов
0,00 12,26
3,82коридор 1,16…7,64
Первого лицана 1000 слов
0,00 5,87
0,67коридор 0,00…2,43
от P25 до P75, половина топ-20медианаот P10 до P90, встречается нормально
Тёмная часть полосы — от P25 до P75, там лежит половина страниц топ-20. Светлая — от P10 до P90, крайние значения подписаны по краям. Справа медиана, под ней границы коридора. 1454 наблюдений.
Контекст конкуренции
Domain Rating домена0–100
9 90
63коридор 36…78
Возраст доменалет
6,2 28,9
18,2коридор 11,5…26,6
от P25 до P75, половина топ-20медианаот P10 до P90, встречается нормально
Эти два признака читаются иначе. DR 9 при P25 36 означает «вы конкурируете со средой сильнее себя», а не «доведите DR до 63».

Читается это тремя зонами. От P25 до P75 — обычный коридор, там половина двадцатки. От P10 до P90 — встречается нормально. За краями — аномалия, которую стоит посмотреть глазами.

Сначала своя выдача, потом общий коридор

Эти процентили сняты с 162 выдач сразу, и разброс между ними огромный. Полнота первого места в медицине 0,829, в финансах 0,381, в праве 0,390 — потому что там наверх выходит инструмент, а не статья. Правильный порядок такой: сначала конкретная выдача по вашему запросу, потом норма ниши и формата страницы, и только потом общий коридор как грубая проверка. Не наоборот.

Иначе через полгода кто-нибудь напишет «исследование доказало: для Яндекса нужно 897–1976 слов». Оно доказывает обратное: страницы с 400 словами в двадцатке живут, и порядок мест объёмом не объясняется.

Почему медиана топ-20 — не ТЗ

Медиана — центр распределения, а не требование. «Сделать 13 подзаголовков», «написать 1372 слова», «выставить плотность 3,92 %» — это ровно тот подход, который замер не подтверждает: внутри двадцатки такие признаки с порядком мест почти не совпадают. Страница на 400 слов там, где коридор 897–1976, — повод разобраться, почему ответ вышел настолько короче конкурентных. Страница на 1200 слов при медиане 1372 — повод оставить её в покое.

С чем всё-таки попадают в тройку

Коридор показывает, где лежит большинство. Он не отвечает на вопрос человека с молодым доменом и нулевым ссылочным: а вообще бывает, чтобы такие попадали наверх.

Вот минимумы по 204 страницам, занявшим места с первого по третье, с живым примером на каждом. Рядом пятый процентиль — один рекорд может быть случайностью, а P5 показывает, где проходит граница у двадцатой части таких страниц.

ПризнакМинимум в тройкеУ когоP5Медиана тройки
Domain Rating домена0stroylan.ru, место 1, «гидроизоляция под плитку»664
Возраст доменалет0,4stroylan.ru, место 1, «гидроизоляция под плитку»4,519,2
Полнота раскрытия интентадоля карты0,00avito.ru, место 2, «замена электропроводки в квартире»0,180,78
Слов основного текстаслов239base.garant.ru, место 3, «сроки расчета при увольнении»4371550
Подзаголовков h2–h5штук0consultant.ru, место 1, «возврат товара надлежащего качества»116
Длина titleзнаков13market.yandex.ru, место 1, «как почистить ноутбук от пыли»3572
Ссылок на страницештук19help.ufanet.ru, место 3, «не горит индикатор интернета на роутере»63177
Изображенийштук0its.1c.ru, место 2, «сроки расчета при увольнении»329
Типов микроразметкиштук0semeynaya.ru, место 2, «боль в пояснице у женщин»05
Зон с полным ключомиз четырёх0hi-tech.mail.ru, место 2, «wifi подключен но интернета нет»01

Самый показательный случай — stroylan.ru на первом месте по запросу «гидроизоляция под плитку». Домен зарегистрирован 23 марта 2026 года, то есть за пять месяцев до съёма выдачи. Domain Rating ноль. В миллион самых популярных доменов по Tranco не входит. На странице 334 слова и раскрыто 4 составляющих интента из 12.

По каждому признаку, который принято считать входным билетом, в тройке нашлась страница у самого дна. Ноль подзаголовков. Ноль изображений. Ноль типов микроразметки. Ни одной зоны с полным ключом. Title в тринадцать знаков. Двести тридцать девять слов текста.

Как это читать

Это не рецепт и не обещание. Пятый процентиль показывает, что таких страниц двадцатая часть, а девятнадцать из двадцати выглядят как коридор из раздела выше. Но жёсткого порога, ниже которого наверх не пускают, в данных нет ни по одному признаку. Домен возрастом пять месяцев с нулевым DR первое место занять может — значит, объяснение чужого первого места «у них домен старше» проверяется, а не принимается на веру.

Диагностика страницы по данным топ-20

Порядок важен: первым идёт не текст.

Посмотрите, чем Яндекс отвечает на запрос
Если в первой тройке калькуляторы, сервисы, формы и базы, сравнивать свой текст с медианой бессмысленно — он отвечает не на тот вопрос. В финансах полнота первого места 0,381 против 0,598 по нише, в праве 0,390 против 0,675. Там наверху стоит инструмент. Не лечите неправильный формат тремя тысячами слов.
Сравните полноту раскрытия с зонами
Меньше четверти карты интента — 7,5 % двадцатки, для информационной страницы это красный флаг. От четверти до половины — ещё 12,7 %, проверьте, не пропущены ли основные подзадачи. Выше половины — обычный конкурентный диапазон, и 47,0 % страниц закрывают больше трёх четвертей. Сто процентов целью не являются.
Проверьте объём и структуру на выпадение из коридора
Слов от 897 до 1976, подзаголовков от 8 до 21, title от 57 до 85 знаков. Широкая статья из заголовка и двух абзацев — повод посмотреть структуру ответа. Не создавайте тринадцать подзаголовков механически.
Ключевые вхождения — только как проверка аномалии
Полный ключ в title есть у 35% страниц двадцатки, точное вхождение у 20%, полный ключ в h1 у 27 %, в подзаголовках у 37 %. Плотность коридора 2,50–5,75 %. Отсутствие ключа в title само по себе не проблема, и доводить плотность до медианы незачем.
Найдите то, чего нет ни у кого
Постройте карту интента, прогоните по своей выдаче, найдите составляющие с нулём у всех и проверьте под ними спрос. Не копируйте максимальную полноту конкурентов — ищите незанятое.

Норма, отклонение и что делать

Три статуса вместо одного эталона. Всё, что ниже, — способ решить, куда смотреть, а не список целевых значений.

Норма
P25 – P75
Половина двадцатки. Не трогать ради самого показателя.
Зона внимания
P10 – P25 и P75 – P90
Проверить, объясняется ли отличие типом страницы и форматом выдачи.
Аномалия
ниже P10 и выше P90
Кандидат на ручную проверку. Аномалия не равна ошибке — это место, куда надо посмотреть.
ПризнакКоридор топ-20Когда смотретьЧто делать
Что можно исправить на странице
Полнота раскрытия интента0,50 – 0,88доля картызаметно ниже P25, особенно меньше четверти картыпостроить карту интента по своей выдаче и найти пропущенные подзадачи. Сто процентов целью не являются
Слов основного текста897 – 1976словниже P10 для страниц того же типавыяснить, почему ответ вышел короче конкурентных, а не дописывать до медианы
Подзаголовков h2–h58 – 21штукбольшая тема раскрыта двумя-тремя блокамипроверить декомпозицию ответа. Механически плодить подзаголовки незачем
Длина title57 – 85знаковвыпадает из коридора или не описывает ответпереписать под задачу пользователя и сниппет
Плотность ключа2,50 – 5,75%только крайние отклоненияискать спам или отсутствие терминологии. К медиане не подгонять
Зон с полным ключом0 – 3из четырёхотсутствие ключа само по себе не проблемане вставлять механически: полный ключ в title есть у трети двадцатки
Типов микроразметки1 – 8штукразметки нет там, где она применимавнедрить как техническую гигиену, не как рычаг позиции
Доля изображений с alt31 – 90%изображение несёт смысл, а подписи нетзаполнить по назначению. Наверху alt заполнены реже, чем внизу
Контекст конкуренции: ориентир, а не задача
Domain Rating домена36 – 780–100сайт заметно слабее конкурентной средыпонимать как ограничение конкуренции, а не как задачу на onpage
Возраст домена11,5 – 26,6летдомен моложе большинства в выдачеучесть при оценке сроков. Первое место занимал домен пяти месяцев от роду

Отклонения неравноценны, и разбирать их по одному в случайном порядке — потеря времени. Порядок такой.

Сначала
Формат страницы не совпадает с форматом выдачи. Основной ответ не дан. Пропущена важная часть задачи пользователя. Страница пустая, нерелевантная или технически битая.
Потом
Структура: два подзаголовка на большую тему. Пустой или невнятный title. Объём, выпавший за коридор. Явный спам ключом.
Гигиена
alt, микроразметка, плотность, число списков, водность, тошнота. Не потому, что бесполезно вообще, а потому что мой корпус не показывает их как объяснение позиции внутри двадцатки.

Разбор реальной страницы

Возьмём страницу из корпуса. Правило отбора я задал до того, как посмотрел на результат: содержательная тройка — полнота, объём, структура — ушла ниже P25, а остальное лежит в норме. Под это правило подошли 28 страниц, беру самую нижнюю по выдаче.

shishonin.ru, место 20 по запросу «как быстро снизить давление», ниша медицина.

ПризнакСтраницаКоридор P25–P75Статус
Полнота раскрытия интента0,430,50 – 0,88ниже P25
Слов основного текста810897 – 1976ниже P25
Подзаголовков h2–h568 – 21ниже P25
Длина title5757 – 85в норме
Плотность ключа2,472,50 – 5,75ниже P25
Типов микроразметки11 – 8в норме
Доля изображений с alt9031 – 90в норме
Domain Rating домена2136 – 78ниже P25
Возраст домена15,111,5 – 26,6в норме

Title, микроразметку и alt я бы здесь не трогал: они в норме, и правка не даст ничего, кроме отчёта о проделанной работе. Плотность 2,47 при нижней границе 2,50 формально ниже коридора, но на три сотых — это шум, а не аномалия.

Разбирать надо другое. Полнота, объём и структура просели одновременно, и это три показателя об одной вероятной причине: документ содержательно недособран. Раскрыто 3 из 7 составляющих интента. Правильный следующий шаг — построить карту интента по этой выдаче и посмотреть, каких подзадач нет, а не дописывать 562 слова до медианы.

DR 21 при коридоре 36–78 — отдельная строка. Она не ставит задачу «нарастить ссылки до 63». Она говорит, что страница конкурирует со средой сильнее себя, и это стоит держать в голове, оценивая, сколько вообще даст правка текста.

Когда текст пора оставить в покое

Обратный алгоритм в SEO-статьях встречается редко, а нужен он не меньше прямого.

Признаки, что onpage закончен

Страница отвечает в том формате, который стоит в выдаче. Объём в обычном диапазоне. Основные составляющие интента закрыты. Структура читается. Из title, h1 и первых абзацев понятно, на какой запрос это ответ. Технических дефектов нет.

Тогда останавливайтесь. Поднимать плотность с 3,5 до 3,92 %, добавлять ключ ещё в два подзаголовка, растягивать 1372 слова до двух тысяч, вставлять FAQ потому что он есть у конкурента, доводить полноту с трёх четвертей до сотни — всё это работа, которую мои данные не поддерживают. Внутри двадцатки полнота даёт 51 из 100, а основные классические текстовые признаки — вхождения ключа, объём и структура — примерно 52–54 из 100 при монетке в 50.

Пять вопросов, которые стоит задать до правки страницы. Я конкурирую правильным типом страницы? Какие задачи пользователя закрывает двадцатка, а я нет? Я действительно выбиваюсь из распределения или просто ниже медианы? Могу ли я объяснить отклонение форматом страницы? И если onpage уже нормальный — почему я всё ещё правлю текст?

Шайа Лабаф на зелёном фоне кричит «JUST DO IT»

Дочитать было самой лёгкой частью. Коридор, процентили и разбор начинают работать в ту минуту, когда вы открываете свою страницу и сверяете её с числами. Не открыли — ничего не произошло.

Шайа Лабаф, «#INTRODUCTIONS», 2015

Что делать в четырёх случаях

Дерево решений, которое из этих данных следует.

СитуацияЧто делать
Страница не в топ-20Сравнить её с коридором двадцатки, а не с первым местом. Сильно выпадает — править формат, покрытие, структуру
Страница похожа на обычную страницу топ-20Перестать полировать плотность, число подзаголовков и объём. Данные не показывают, что места внутри двадцатки различаются этим
Страница в топ-20, но не растётДоводить 3,92 до 4,00 или 1200 слов до 1500 смысла нет: такая правка не совпадает с порядком выдачи
Страница в коридоре и всё равно проигрываетСмотреть следующий класс причин: формат ответа, ссылочный разрыв, коммерческие и сайтовые факторы, поведение, техника

Причём даже доменный авторитет здесь не волшебный фактор, а просто самый заметный из измеренных: 55 из 100 против 51–54 у большинства onpage-признаков.

И чего делать не стоит. Обещать клиенту рост позиций за счёт более полного раскрытия интента или за счёт вхождений ключа в зоны. У этих обещаний нет опоры в данных, а проверить их теперь можно — как и остальные обещания в коммерческом предложении подрядчика.

Частые вопросы

В этой выборке страниц топ-20 — практически нет: более полная страница стояла выше в 51 случае из 100 при случайной базе 50. Полнота полезна как диагностический коридор, но данные не подтверждают её как самостоятельный рычаг роста внутри двадцатки.

Нет. Полный ключ в title был у 35% страниц топ-20 и ровно у 35% первых мест. В этой выборке наличие полного вхождения не объясняло порядок позиций.

Это диапазон P25–P75, в котором лежит половина страниц топ-20 по измеренному признаку. Он помогает заметить сильное отклонение страницы, но не является целевым рецептом и не требует подгонять каждое значение к медиане.

Нет. В корпусе нет страниц за пределами топ-20, поэтому исследование описывает различия внутри уже ранжируемой двадцатки и не измеряет барьер входа в неё.

Нет. Некоторые шаблонные признаки машинного письма встречались наверху чуть реже, но попарное различение осталось около случайного уровня. Из этих данных нельзя вывести ни санкцию за AI-текст, ни безразличие поисковой системы к его качеству.

Коридор топ-20 показывает, где искать onpage-проблему. Он не показывает, чем поднять страницу внутри двадцатки, — там более полная стоит выше в 51 случаях из 100 при монетке в 50.