- Посмотрите саму выдачу. Что стоит наверху — статья, категория, калькулятор, сервис, официальный источник. Если формат другой, текстовый аудит вторичен.
- Сравните страницу с коридором двадцатки, а не с первым местом. Первое место в этих данных не образец: по большинству признаков оно от двадцатого почти не отличается.
- Ищите выпадения за P10 и P90. Туда попадает по десятой части выдачи с каждого края, и это места, куда стоит посмотреть глазами.
- Внутри P25–P75 ничего не полируйте. Там лежит половина двадцатки, и подтягивание к медиане с порядком мест не совпадает.
- Найдите составляющие интента, которые почти никто не закрыл. Их я нашёл в 15 темах из 20 и во всех пяти нишах.
- Если onpage уже в коридоре — переходите к другому классу причин. Формат ответа, ссылочный разрыв, техника, коммерческие свойства, поведение.
Дальше — данные, на которых это построено. Порядок разделов исследовательский: сначала замер, потом выводы.
Одно число вместо коэффициентов
Почти любой контент-бриф стоит на одном обещании: разбери интент запроса, закрой его на странице полнее конкурентов, и страница встанет выше. Я проверил это дважды. Первый корпус — 65 запросов и 544 страницы, второй — 97 запросов и 1057 страниц.
Оговорка, без которой дальше читать нельзя. Я меряю одну страницу против других страниц той же выдачи. Как сайт целиком набирает вес на теме десятками материалов и что это даёт, мой замер не проверяет. Речь здесь только о постраничном обещании из брифа.
Чтобы не бросаться коэффициентами корреляции, я перевёл всё в одну простую величину. Берём две страницы из одной выдачи. У одной признак больше, у другой меньше. Смотрим, та ли из них стоит выше, у которой признак больше. Считаем по всем парам всех выдач.
Пары с одинаковым значением признака в счёт не идут: они не говорят ни за, ни против. Поэтому у признаков вроде «есть ли ключ в title» пар меньше — их число я показываю в таблицах отдельной колонкой.
При 50 из 100 признак не отличает верх выдачи от низа, ровно как монетка.
При 65–70 признак уже заметно совпадает с порядком выдачи.
При 80 и выше совпадение очень сильное.
Само по себе это всё ещё не доказывает, что изменение признака поднимет страницу.
Полнота раскрытия интента дала 51 из 100. Разберём, что это значит, на живой выдаче.
Одна выдача построчно
Запрос «боль в пояснице отдает в ногу», ниша медицина. Карта интента для него содержит 14 составляющих: причины боли, отличие прострела от корешкового синдрома, что делать до врача, какие обследования назначают, конкретные препараты, когда идти в больницу срочно и так далее.
| Поз. | Домен | DR | Ключ в title | Длина title | h2–h5 | Плотность, % | Слов | Раскрыто интента |
|---|---|---|---|---|---|---|---|---|
| 1 | gutaclinic.ru | 52 | да | 114 | 19 | 5,93 | 1079 | 10/14 |
| 2 | newneuro.ru | 43 | да | 89 | 17 | 5,01 | 2277 | 11/14 |
| 3 | institut-clinic.ru | 7 | да | 103 | 26 | 4,65 | 3056 | 13/14 |
| 4 | doctordlin.ru | 31 | нет | 67 | 18 | 7,81 | 1127 | 8/14 |
| 5 | cmrt.ru | 48 | нет | 93 | 66 | 7,39 | 717 | 7/14 |
| 6 | openclinics.ru | 43 | да | 61 | 64 | 3,69 | 1625 | 5/14 |
| 7 | ldc-mrt.com | 3 | нет | 89 | 25 | 3,53 | 2096 | 12/14 |
| 8 | probolezny.ru | 68 | нет | 108 | 13 | 1,50 | 2736 | 12/14 |
| 9 | temed.ru | 43 | нет | 122 | 16 | 3,37 | 1664 | 9/14 |
| 10 | krasotaimedicina.ru | 66 | нет | 56 | 12 | 2,08 | 1539 | 14/14 |
| 11 | zelkinezis.ru | 2 | да | 102 | 12 | 5,13 | 3238 | 9/14 |
| 12 | eastclinic.ru | 73 | нет | 123 | 29 | 6,55 | 1268 | 4/14 |
| 13 | ocheretina.ru | 25 | да | 81 | 6 | 7,83 | 613 | 6/14 |
| 14 | citilab.clinic | 7 | нет | 84 | 3 | 5,52 | 979 | 11/14 |
| 15 | spinelife.ru | 23 | да | 57 | 30 | 4,46 | 3207 | 11/14 |
| 16 | smartclinicspb.ru | 37 | да | 184 | 12 | 6,62 | 1300 | 9/14 |
| 17 | zdravclinic.ru | 46 | да | 53 | 17 | 5,82 | 893 | 11/14 |
| 18 | dialrapid.ru | 3 | нет | 46 | 7 | 5,43 | 1566 | 9/14 |
| 19 | dr-ost.ru | 42 | нет | 66 | 28 | 6,97 | 1177 | 7/14 |
| 20 | dikul.ru | 23 | нет | 69 | 6 | 2,94 | 1326 | 11/14 |
Я искал закономерность сверху вниз и не нашёл.
- На первом месте — DR 52, полный ключ в title, плотность 5,93 %. Раскрыто 10 составляющих из 14.
- На третьем месте — DR 7. Почти нулевой авторитет, и при этом 13 из 14 — вторая по полноте страница выдачи.
- Все 14 составляющих закрыла страница на 10 месте. У неё ключа в title нет вовсе, плотность 2,08 % — одна из самых низких в выдаче, а DR 66.
Отсортируйте эту двадцатку по полноте раскрытия — получите другой порядок. Отсортируйте по плотности ключа — получите третий. Ни один из них не совпадёт с тем, что показывает Яндекс.
Четырнадцать признаков на одной шкале
Теперь то же самое для всего, что я померил. Чем правее полоса, тем чаще страница с бо́льшим значением признака стоит выше. Вертикальная черта — монетка.
| Признак | Что это |
|---|---|
| Domain Rating | оценка ссылочной силы домена по шкале Ahrefs от 0 до 100. У домена с DR 70 ссылочный профиль на порядок мощнее, чем у DR 20 |
| Популярность по Tranco | открытый рейтинг миллиона самых посещаемых доменов. Исследователи собирают его усреднением нескольких списков посещаемости за тридцать дней, поэтому он устойчивее Alexa и не зависит от одного поставщика |
| BM25 | классическая мера совпадения текста с запросом. Считает, сколько раз слова ключа встречаются в документе, с поправкой на длину текста. На ней построено базовое ранжирование почти всех поисковых движков |
| Зон с полным ключом | сколько из четырёх зон (title, h1, description, подзаголовки) содержат все значимые слова ключа |
| Водность и тошнота | показатели текстовых анализаторов. Доля служебных слов и частота повторов самого частого слова. Обе величины вместе с BM25 считает разбор текста по двадцати метрикам |
Разброс от 51 до 55 из 100. Признак, на который стоило бы работать, дал бы 65 и выше. Но ни один не дотянул даже до 56.
Водность оказалась ниже пятидесяти — 48 из 100. Это значит, что более водянистая страница чаще стоит ниже, но отклонение от монетки такое же крошечное, как у остальных.
Чем места 1–3 отличаются от 15–20
Полосы ТОП-1 и ТОП-20 накопительные, вторая включает первую, и разница между ними смазана. Поэтому вот два непересекающихся куска выдачи, начало и хвост. У части признаков разрыв здесь заметнее, у плотности ключа он вообще меняет знак — это само по себе говорит, насколько величины неустойчивы.
Верх выдачи крупнее. Ссылок на странице 162 против 136, подзаголовков и картинок примерно на седьмую часть больше, текста на девятую. Domain Rating 68 против 61. Полнота интента 0,750 против 0,692.
Но два признака идут в обратную сторону, и оба неожиданные. Alt у изображений заполнен у 53 % картинок наверху против 64 % в хвосте. А читабельность по Флешу 5,0 против 6,6: тексты на первых местах читаются тяжелее, чем на последних. Правда, в процентах эта строка выглядит крупнее, чем есть: 1,6 пункта на стобалльной шкале, у самого её дна, где формула почти не различает.
Разрывы есть, но все в пределах пятой части, и ни один из них не упорядочивает выдачу — по парам все признаки дают около пятидесяти. Верх двадцатки не «лучше сделан», он просто крупнее: больше ссылок, больше блоков, домен посолиднее. Догонять его правкой title бессмысленно, догонять объёмом — дорого и без гарантий.
Строго первое место против двадцатого
Полосы выше склеивают по три и по шесть позиций. Вот те же признаки на двух крайних позициях выдачи без всякой склейки: 72 наблюдения на первом месте и 82 на двадцатом.
Наблюдений мало, и медиана на таких числах прыгает. Поэтому рядом с ней стоит межквартильный размах — границы, между которыми лежит средняя половина страниц. Если размахи двух позиций перекрываются почти целиком, разница медиан ничего не значит, и такая строка приглушена.
| Признак | Место 1 | Место 20 | Разница медиан | Различимо |
|---|---|---|---|---|
| Подзаголовков h2–h5 | 189…24 | 127…20 | +50 % | да |
| Длина title, знаков | 8266…97 | 6753…84 | +22 % | да |
| Domain Rating домена | 7238…90 | 5930…78 | +21 % | да |
| Ссылок на странице | 14873…227 | 13072…230 | +14 % | нет |
| Изображений | 2112…65 | 1910…36 | +10 % | да |
| Полнота раскрытия интента | 0,7070,333…0,857 | 0,6430,500…0,800 | +10 % | да |
| Слов основного текста | 1261533…1975 | 1211809…1552 | +4 % | да |
| Зон с полным ключом из четырёх | 1,000,00…3,00 | 1,000,00…3,00 | +0 % | нет |
| Возраст домена, лет | 18,013,2…28,3 | 18,211,5…26,1 | -1 % | нет |
| Плотность ключа, % | 3,562,73…5,49 | 3,922,81…5,58 | -9 % | нет |
| Предложений в пассиве, % | 14,17,8…20,4 | 16,09,8…23,5 | -12 % | да |
| Списков ul и ol | 124…28 | 147…29 | -17 % | нет |
| Доля изображений с alt, % | 4726…90 | 6332…92 | -25 % | нет |
| Читабельность по Флешу | 4,7-3,2…13,4 | 10,1-3,8…15,2 | -53 % | нет |
| Типов микроразметки | 21…7 | 51…9 | -60 % | нет |
Различимы 7 признака из 15. Первое место обходит двадцатое по числу подзаголовков (18.0 против 12.0), длине title (82.0 против 67.0 знаков) и авторитету домена (72.0 против 59.0). Полнота интента различима тоже, но разрыв вдвое меньше.
А самые крупные проценты в этой таблице как раз ничего не стоят. Типов микроразметки медиана даёт 2.0 наверху против 5.0 внизу, и это минус шестьдесят процентов — но размахи совпадают почти целиком, а распределения различаются на единицы страниц. Медиана переваливает через ступеньку кусковой целой величины, и процент показывает скачок, которого в данных нет. То же с читабельностью и с долей alt.
Даже на двух крайних позициях выдачи различаются только объёмные признаки: сколько блоков, сколько знаков, какой домен. Ни один текстовый признак, кроме полноты, крайние позиции не разделяет — а полнота разделяет их слабее, чем длина title. И это на разнице первого места с двадцатым, то есть на максимально возможном контрасте внутри выдачи.
Проверка самой мерки
Законный вопрос к разделу выше. Если всё лежит около пятидесяти, может, мерка просто слишком грубая для топ-20 и ничего не различает в принципе?
Проверяется это так. Берём пары признаков, связь между которыми заведомо есть — два измерения одного и того же, — и считаем ту же самую величину. Если мерка на них покажет пятьдесят, она бесполезна. Если восемьдесят и девяносто, значит она работает, а пятьдесят у полноты и ключа — настоящий ноль.
| Пара признаков | Почему связь ожидаема | Из 100 пар | Пар в счёте |
|---|---|---|---|
| Полнота в двух режимах извлечения | одна и та же величина, снятая с двух разных версий текста | 92 | 8460 |
| Авторитет домена и его популярность | Domain Rating и ранг Tranco меряют разными способами одно — вес сайта | 87 | 9017 |
| Объём текста и полнота раскрытия | длинная статья закрывает больше составляющих, связь ожидаема | 73 | 9667 |
| BM25 и вхождение ключа в зоны | обе величины считают присутствие слов запроса на странице | 64 | 6818 |
Полнота, снятая с двух разных версий текста одной и той же страницы, даёт 92 из 100. Авторитет домена и его популярность — 87. Мерка спокойно показывает девяносто там, где связь есть.
Значит 51 у полноты интента и 52 у ключа в title — это не тупость инструмента. Это отсутствие связи.
Ни один из четырнадцати признаков не дотянул до 56 из 100 при монетке в 50. Это значит, что порядок мест внутри двадцатки объясняется не тем, что видно в тексте и разметке. Искать рычаг стоит там, где я не мерил: в поведении пользователей, в коммерческих факторах, в том, попадёт ли страница в двадцатку вообще.
Domain Rating, Tranco и возраст домена — признаки домена, а не страницы. Вёрсткой и текстом их не поправишь. Я взял их как линейку.
Без линейки число «51 из 100» повисает в воздухе. Может, полнота интента и правда не двигает позиции. А может, мерка в принципе не умеет показывать больше, и тогда все onpage-выводы статьи ничего не стоят. Поэтому DR, Tranco и возраст я померил тем же способом, на тех же страницах, в тех же парах: 55, 55 и 51 из 100. Внутри двадцатки ссылочная сила и возраст ведут себя примерно как ключ в title.
Но показывать больше мерка умеет — в разделе «Проверка самой мерки» связи с заранее известным ответом дают 92 и 87 из 100.
Рекомендаций по ссылкам и по выбору домена дальше не будет. Ни одну из трёх величин я не предлагаю оптимизировать: они стоят здесь как точка отсчёта для onpage-признаков и как проверка расхожего «он выше, потому что домен старше».
Ключ в title, h1, description и подзаголовках
Для каждой страницы я разобрал зоны и проверил вхождение ключа. Полным вхождением считается присутствие всех значимых слов ключа по леммам, точным — ключ подряд, слово в слово. Скажем, для запроса «сколько сохнет стяжка пола» title «Сколько сохнет стяжка пола, сроки по типам» даёт и полное, и точное вхождение, а «Время высыхания стяжки» не даёт ни того ни другого.
| Зона | На 1-м месте | По всему топ-20 | Из 100 пар | Пар в счёте |
|---|---|---|---|---|
| Полный ключ в title | 35% | 35% | 52 | 3821 |
| Точное вхождение ключа в title | 18% | 20% | 52 | 2647 |
| Полный ключ в h1 | 35% | 27% | 54 | 3262 |
| Полный ключ в description | 36% | 33% | 54 | 3896 |
| Полный ключ хотя бы в одном h2–h5 | 42% | 37% | 53 | 4476 |
Две трети страниц в топ-20 обходятся без полного ключа в title, и на порядок мест это не влияет. Точное вхождение наверху встречается даже реже, чем внизу: 18% против 20%.
Практический смысл прямой. Если ваш title собран под ключ, а конкурент выше вас с title без ключа, вы смотрите на норму, а не на аномалию. В разобранной выше выдаче по «боль в пояснице отдает в ногу» ключ в title есть у страниц на 1, 2, 3, 6, 11, 13, 15, 16 и 17 местах — россыпью по всей двадцатке.
Плотность ключа, длина title и подзаголовки
Плотность считалась как доля вхождений слов ключа от всех слов основного текста; тексты короче двухсот слов исключены, потому что на них величина бессмысленна.
| Признак | ТОП-1 | ТОП-3 | ТОП-5 | ТОП-10 | ТОП-20 | Из 100 пар |
|---|---|---|---|---|---|---|
| Длина title, знаков | 82 | 72 | 73 | 72 | 69 | 53 |
| Подзаголовков h2–h5 | 18 | 14 | 14 | 14 | 13 | 52 |
| Плотность ключа, % | 3,56 | 3,97 | 4,02 | 4,00 | 3,92 | 52 |
| Слов основного текста | 1261 | 1385 | 1386 | 1384 | 1301 | 52 |
| Зон с полным ключом из четырёх | 1,00 | 1,00 | 1 | 1,00 | 1,00 | 52 |
| Водность, % | 25,9 | 26,7 | 27,0 | 26,7 | 27,0 | 48 |
| Классическая тошнота | 4,58 | 4,69 | 4,69 | 4,69 | 4,58 | 52 |
| Академическая тошнота, % | 1,92 | 2,04 | 2,07 | 2,04 | 1,96 | 50 |
Медианная плотность ключа на первом месте 3,56 %, по всему топ-20 3,92 %. Но если сравнить не одну позицию, а места 1–3 с местами 15–20, знак переворачивается: 3,970 против 3,840 %. Величина болтается около четырёх процентов и меняет направление от того, как нарезать полосы. По парам плотность даёт 52 из 100 — монетка.
Длина title наверху заметнее: медиана 82 знака против 69 внизу, 53 из 100 по парам. Это самый заметный из текстовых признаков, и всё равно он далёк от рычага. Подзаголовков наверху тоже больше, 18 против 13.
Водность, классическая и академическая тошнота, читабельность — все четыре лежат в пределах двух пунктов от монетки. Медиана водности 25,9 % на первом месте против 27,0 % по двадцатке, классическая тошнота держится около 4,58 во всех полосах.
Микроразметки и alt наверху меньше, чем внизу
До сих пор речь шла о тексте. Теперь то, что правят в самой странице: микроразметка, изображения с alt, списки и таблицы, ссылки, вид адреса. Всё снято с сохранённого HTML 1538 страниц.
Микроразметка стоит почти у всех, и наверху её меньше, чем внизу.
| Полоса | Страниц | С микроразметкой | Доля |
|---|---|---|---|
| ТОП-1 | 72 | 57 | 79,2 % |
| ТОП-3 | 222 | 191 | 86,0 % |
| ТОП-5 | 369 | 324 | 87,8 % |
| ТОП-10 | 748 | 649 | 86,8 % |
| ТОП-20 | 1538 | 1332 | 86,6 % |
Чаще всего размечают навигацию и карточку организации, а не содержание. Вот что встречается в корпусе: BreadcrumbList у 713, ListItem у 632, ImageObject у 609, Organization у 565, Article у 546.
| Признак | ТОП-1 | ТОП-3 | ТОП-5 | ТОП-10 | ТОП-20 | Из 100 пар | Пар в счёте |
|---|---|---|---|---|---|---|---|
| Типов микроразметки на странице | 2,0 | 5,0 | 5,0 | 5,0 | 5,0 | 51 | 10506 |
| Изображений | 21 | 26 | 26 | 26 | 24 | 53 | 11413 |
| Доля изображений с alt, % | 47 | 53 | 56 | 60 | 62 | 49 | 10785 |
| Списков ul и ol | 12 | 14 | 16 | 16 | 16 | 51 | 11315 |
| Таблиц | 0 | 0 | 0 | 0 | 0 | 48 | 5732 |
| Ссылок на странице | 148 | 162 | 173 | 166 | 149 | 53 | 11547 |
| Доля внешних ссылок, % | 11 | 10 | 9 | 9 | 9 | 51 | 10689 |
| Тегов h1 | 1 | 1 | 1 | 1 | 1 | 46 | 1928 |
| Длина адреса, знаков | 66 | 66 | 65 | 65 | 67 | 47 | 11430 |
| Глубина вложенности адреса | 2 | 2 | 2 | 2 | 2 | 50 | 7715 |
| Чисел на 100 слов | 2,3 | 2,3 | 2,1 | 2,2 | 2,2 | 51 | 10877 |
| Имён собственных на 100 слов | 0,8 | 0,8 | 0,6 | 0,7 | 0,8 | 48 | 10435 |
| Предложений в пассиве, % | 14,1 | 16,5 | 16,8 | 16,3 | 16,0 | 49 | 11022 |
| Читабельность по Флешу | 4,7 | 5,0 | 7,1 | 6,5 | 6,1 | 49 | 11080 |
| Доля длинных слов, % | 56,8 | 56,9 | 56,8 | 57,0 | 56,9 | 51 | 11046 |
| Рваность ритма | 0,52 | 0,52 | 0,52 | 0,52 | 0,52 | 50 | 10670 |
Alt у изображений на первом месте заполнен у 47 % картинок, по всей двадцатке у 62 %. Наверху хуже, а не лучше. Изображений на первом месте 21 против 24, списков 12 против 16. Медиана таблиц по всем полосам ноль: таблицами в этих нишах почти не пользуются.
Адреса везде одинаковые. Медиана длины адреса на первом месте 66 знаков и 67 по двадцатке, глубина вложенности две папки. Кириллицы в пути адреса нет ни на одной из 1538 страниц. Кириллические домены при этом встречаются, просто записаны в punycode.
Тексты в топ-20 читаются тяжело. Медиана по Флешу 6,1 из ста, доля длинных слов 56,9 %, пассивных предложений 16,0 %. Первое место от двадцатого по этим величинам не отличается.
И ни один признак этого слоя не упорядочивает выдачу. Разброс по парам от 46 до 53 из 100 при монетке в 50.
Машинного текста наверху меньше, но разница крошечная
Все страницы корпуса я прогнал через два своих инструмента — SEO-анализ текста и детектор ИИ-текста. Второй смотрит на три слоя сразу. Шаблонные обороты, которые модели производят чаще людей. Предсказуемость слов, где у машинного текста разброс заметно у́же. И структуру письма — двоеточия-перечисления, тире-связки, первое лицо, начала фраз с союзов. Прогнал все 1538 страниц корпуса. Показания ниже по полосам выдачи, и в каждой таблице своя колонка со страницами: слои считаются не на всех, потому что часть страниц осталась без добытого текста.
Слой первый: шаблонные обороты
| Полоса | Страниц | С приметами | Доля | Среднее по корпусу, % |
|---|---|---|---|---|
| ТОП-1 | 63 | 20 | 31,8 % | 0,50 |
| ТОП-3 | 207 | 61 | 29,5 % | 0,55 |
| ТОП-5 | 349 | 95 | 27,2 % | 0,49 |
| ТОП-10 | 723 | 198 | 27,4 % | 0,54 |
| ТОП-20 | 1506 | 426 | 28,3 % | 0,57 |
Хотя бы одна примета нашлась у 31,8 % страниц первого места и у 28 % по всей двадцатке. Медиана везде ноль, максимум по корпусу 14,3 % предложений. По парам признак даёт 48 из 100, то есть чуть ниже монетки.
Чем выше место, тем меньше машинных оборотов
Доля страниц, где детектор нашёл хоть одну примету, по полосам почти ровная. А вот их количество на страницу растёт сверху вниз.
| Полоса | Страниц | С приметами | Доля страниц | Срабатываний на 100 страниц |
|---|---|---|---|---|
| места 1–3 | 222 | 61 | 27,5 % | 40 |
| места 4–10 | 526 | 137 | 26,1 % | 47 |
| места 11–20 | 790 | 230 | 29,1 % | 55 |
В местах 1–3 приходится 40 срабатываний на сотню страниц, в местах 11–20 — 55. В хвосте выдачи машинных оборотов на 38 % больше. При этом доля страниц, затронутых хоть одной приметой, различается всего на 1,6 пункта: дело не в том, что внизу больше «машинных» страниц, а в том, что на каждой их больше.
Разбор по отдельным оборотам показывает, какие именно тянут разницу.
| Оборот | Раз | Страниц | Места 1–3 | Места 4–10 | Места 11–20 |
|---|---|---|---|---|---|
| «таким образом» | 225 | 157 | 8,6 % | 10,5 % | 10,5 % |
| «это не просто» | 88 | 63 | 3,6 % | 2,9 % | 5,1 % |
| «стоит отметить» | 58 | 54 | 1,4 % | 3,4 % | 4,2 % |
| «играет ключевую роль» | 54 | 41 | 4,0 % | 3,0 % | 2,0 % |
| «широкий спектр» | 52 | 45 | 3,6 % | 2,7 % | 2,9 % |
| «следует отметить» | 45 | 39 | 1,8 % | 2,3 % | 2,9 % |
| «в заключение» | 39 | 36 | 0,9 % | 2,9 % | 2,4 % |
| «индивидуальный подход» | 36 | 28 | 1,4 % | 2,1 % | 1,8 % |
| «важно отметить» | 30 | 27 | 0,4 % | 0,8 % | 2,8 % |
| «давайте рассмотрим» | 29 | 27 | 2,7 % | 1,9 % | 1,4 % |
| «является одним из» | 27 | 27 | 1,4 % | 2,5 % | 1,4 % |
| «на сегодняшний день» | 18 | 16 | 1,4 % | 0,2 % | 1,5 % |
| «неотъемлемая часть» | 18 | 12 | 1,4 % | 0,4 % | 0,9 % |
| «в связи с этим» | 13 | 12 | 1,4 % | 0,9 % | 0,5 % |
Тянет разницу мета-комментарий — обороты, которыми автор говорит о собственном тексте вместо того, чтобы говорить о предмете. «Важно отметить» встречается в хвосте выдачи в семь раз чаще, чем в первой тройке: 2,8 % страниц против 0,4 %. «Стоит отметить» — втрое чаще, «в заключение» — почти втрое.
Обратный перекос тоже есть, и он мельче. «Играет ключевую роль» и «давайте рассмотрим» встречаются наверху вдвое чаще, чем внизу. Самый частый оборот корпуса, «таким образом», распределён почти ровно: 8,6 % страниц наверху против 10,5 % внизу.
Направление есть, и оно в пользу чистого текста: чем выше место, тем меньше машинных оборотов на страницу. Но величина крошечная — 40 срабатываний на сотню страниц против 55, и по парам признак даёт всё те же 48 из 100. Как рычаг подъёма это не работает. Как стоп-лист редактору — работает: вычистить «важно отметить», «стоит отметить», «в заключение» и «таким образом» стоит десять минут, и хуже точно не станет.
Слой второй: предсказуемость слов
Что именно меряет этот слой и почему высокая предсказуемость сама по себе не улика, я разбирал отдельно — в работах про перплексию в русском SEO-тексте и про то, что на самом деле измеряют AI-детекторы.
| Полоса | Страниц | Детектор сработал | Доля | Медиана перекоса |
|---|---|---|---|---|
| ТОП-1 | 54 | 1 | 1,8 % | 0,341 |
| ТОП-3 | 190 | 9 | 4,7 % | 0,291 |
| ТОП-5 | 321 | 17 | 5,3 % | 0,297 |
| ТОП-10 | 659 | 45 | 6,8 % | 0,286 |
| ТОП-20 | 1366 | 89 | 6,5 % | 0,286 |
На первом месте детектор сработал у 1,8 % страниц, по всей двадцатке у 6,5 %. Наверху машинного текста меньше, но на первом месте всего 54 страниц с этим замером, так что разницу стоит читать как наблюдение. По парам перекос даёт ровно 50 из 100.
Слой третий: структура письма
| Признак | Топ-20 | Живой текст | Машинный текст | Куда ближе | Из 100 пар |
|---|---|---|---|---|---|
| Двоеточий-перечислений на 1000 слов | 3,77 | 2,6 | 10,3 | к живому | 52 |
| Тире-связок на 1000 слов | 10,52 | 9,9 | 20,6 | к живому | 52 |
| Первого лица на 1000 слов | 0,68 | 9,8 | 0,0 | к машинному | 50 |
| Фраз с союза в начале, % | 3,60 | 6,6 | 1,5 | посередине | 51 |
| Одинаковых начал абзацев, % | 14,90 | 6,7 | 11,6 | к машинному | 48 |
Разброс между полосами виден на графике выше и везде мал. Поэтому в таблице оставлено то, ради чего она нужна: где значение топ-20 стоит между нормой живого текста и нормой машинного. Нормы сняты с размеченного корпуса — 231 человеческая статья против 353 машинных.
Топ-20 обезличен почти до машинной отметки. Первое лицо встречается 0,68 раза на тысячу слов при живой норме 9,8 и машинной 0,0. «Я», «мы», «нам» из SEO-текстов вымыты полностью, и на первом месте их не больше, чем на двадцатом.
Одинаковых начал абзацев в выдаче 14,9 %, что выше машинной нормы 11,6 и вдвое выше живой 6,7. По двоеточиям и тире выдача, наоборот, держится ближе к живому письму.
Направление у двух слоёв из трёх одно и то же: чем ниже место, тем машинного больше. Плотность оборотов растёт с 40 до 55 на сотню страниц, срабатывание по предсказуемости — с 1,8 % до 6,5 %. Структура письма при этом одинакова по всей двадцатке.
А вот упорядочить выдачу этим нельзя. Шаблонные приметы дают 48 из 100 пар, перекос предсказуемости 50, структурные признаки от 48 до 52 — на уровне монетки. Разница видна на средних по полосам и исчезает, когда сравниваешь страницы одной выдачи попарно. Так что «Яндекс топит нейротексты» из этих данных не следует, но и «ему всё равно» — тоже слишком сильно. Насколько по-разному пишут сами модели, я мерил в тесте восемнадцати ИИ-сервисов.
Страницы, где шаблонных примет больше всего:
| Место | Домен | Запрос | Доля предложений с приметами |
|---|---|---|---|
| 7 | zakonrf.info | сроки расчета при увольнении | 14,3 % |
| 12 | troickopechorskij-r11.gosweb.gosuslugi.ru | сроки расчета при увольнении | 10,0 % |
| 8 | ceresit-market.ru | обмазочная гидроизоляция | 7,7 % |
| 7 | mediasphera.ru | бессонница у женщин причины | 6,7 % |
| 14 | potolki.group | натяжные потолки | 6,7 % |
| 15 | otvet.mail.ru | почему не работает вай фай на роутере | 6,7 % |
Микроразметка стоит у 87 % страниц двадцатки, списки есть почти везде — по ним различать некого. А вот alt заполнен лишь у 62 % изображений, и наверху даже реже. То есть половина топа живёт с пустыми alt и не страдает. Всё это гигиена входа, а не рычаг подъёма.
Сколько интента раскрывают страницы топ-20
Раз полнота не двигает места внутри двадцатки, остаётся другой вопрос: какой уровень раскрытия там вообще встречается. Вот распределение по 1454 страницам с добытым содержанием.
Половина страниц топ-20 раскрывает больше 71 % интента, пятая часть закрывает меньше половины, десятая — меньше 30 %.
Рабочая отсечка для брифа лежит не в медиане, а в нижнем краю. Десятый процентиль по полосам не опускается ниже 0,250 — ниже этого уровня лежит примерно десятая часть двадцатки. Это нижний край распределения, а не порог допуска: 7,5 % страниц закрывают меньше четверти карты и всё равно стоят в топ-20. Медиана 71 % — уровень типичной страницы, тоже не порог.
Но нижний край одинаков по всей выдаче. Десятый процентиль на первом месте 0,250, на местах 11–20 равен 0,286, разброс 0,083. Страницы со слабым раскрытием попадают и в самый верх.
| Полоса, непересекающаяся | Страниц | 10-й процентиль | Медиана |
|---|---|---|---|
| 1 | 60 | 0,250 | 0,786 |
| 2–3 | 144 | 0,333 | 0,774 |
| 4–10 | 496 | 0,333 | 0,714 |
| 11–20 | 754 | 0,286 | 0,700 |
Возраст домена: молодых в топе мало
Дату регистрации я собрал из WHOIS для 481 доменов из 562. Эти домены закрывают 89,4 % наблюдений корпуса. Международные зоны WHOIS в моём окружении не отдал, и я это не заглаживал. Возраст считается на дату съёма выдачи.
| Полоса | Наблюдений | Медиана, лет | Моложе 3 лет | Старше 20 лет |
|---|---|---|---|---|
| ТОП-1 | 68 | 18,0 | 2,9 % | 41,2 % |
| ТОП-3 | 212 | 18,4 | 3,3 % | 45,8 % |
| ТОП-5 | 347 | 18,1 | 4,0 % | 45,5 % |
| ТОП-10 | 690 | 18,1 | 5,4 % | 44,6 % |
| ТОП-20 | 1375 | 18,5 | 5,2 % | 44,5 % |
Медиана возраста одинакова во всех полосах: около 18,5 лет и на первом месте, и на двадцатом. По парам возраст даёт 51 из 100 — внутри двадцатки он не решает ничего.
Зато распределение говорит другое.
Доменов моложе трёх лет в двадцатке 5,2 %, а старше двадцати — 44,5 %. Оговорка, которую снимать нельзя: WHOIS показывает дату регистрации домена, а не возраст проекта на нём. Купленный дроп 2007 года выглядит здесь восемнадцатилетним. И международные зоны выпали из сбора, а они моложе российских, так что медиана скорее завышена.
Внутри двадцатки возраст не двигает: 51 из 100. Но состав двадцатки перекошен — молодых там один из двадцати. Что это, барьер входа или просто след того, что старые сайты успели набрать всё остальное, мои данные не различают: страниц вне топ-20 я не собирал. Клиенту с трёхлетним доменом честно сказать так — пять процентов топа такие же, как он, и это немного, но не ноль.
ТОП-1, ТОП-3, ТОП-5, ТОП-10, ТОП-20
Первая позиция даёт 0,577, десятая 0,646, тринадцатая 0,684. Ряд не выстраивается ни по возрастанию, ни по убыванию.
| Полоса | Полнота | Раскрыто из карты | Наблюдений | Страниц |
|---|---|---|---|---|
| ТОП-1 | 0,577 | 5,7 из 10,1 | 72 | 56 |
| ТОП-3 | 0,635 | 6,3 из 10,1 | 222 | 176 |
| ТОП-5 | 0,626 | 6,3 из 10,3 | 369 | 269 |
| ТОП-10 | 0,640 | 6,5 из 10,2 | 748 | 524 |
| ТОП-20 | 0,638 | 6,5 из 10,3 | 1538 | 1057 |
Полосы накопительные: ТОП-3 включает первые три места, ТОП-20 — все двадцать.
А так выглядит одна выдача целиком. Запрос «боль в пояснице отдает в ногу», 14 составляющих интента; высота столбца — сколько из них раскрыто содержательно на этой позиции.
На первом месте раскрыто 10 из 14, разброс по выдаче от 4 до 14, и максимум стоит не наверху.
В праве и финансах наверх выходит калькулятор, а не статья
| Ниша | Полнота по нише | На первом месте | На местах 11–20 | Наблюдений |
|---|---|---|---|---|
| медицина | 0,760 | 0,829 | 0,753 | 339 |
| право | 0,675 | 0,390 | 0,670 | 302 |
| финансы | 0,598 | 0,381 | 0,649 | 307 |
| техника | 0,584 | 0,684 | 0,550 | 296 |
| стройка | 0,553 | 0,548 | 0,550 | 294 |
В медицине первое место полнее среднего по нише, 0,829 против 0,760. Но в праве и финансах наоборот, 0,390 против 0,675 и 0,381 против 0,598.
Причину я вижу в самих выдачах. По «сколько стоит осаго» на первом месте стоит калькулятор sravni.ru. Он считает, а текстом закрывает 1 составляющую из 11. По девяти запросам про временную регистрацию, европротокол, самозанятость и кредитную историю наверх выходит страница Госуслуг, где содержание собирается скриптом. В этих нишах верх выдачи занимают инструменты, а не статьи.
В медицине верх выдачи содержательнее среднего, в праве и финансах — беднее вдвое. Если ваш клиент в финансах и на первом месте стоит калькулятор, догонять его текстом бессмысленно: Яндекс отвечает на такой запрос действием. Стройте свой инструмент или бейтесь за места ниже первого.
Крайние случаи
Пары из одной выдачи по одному запросу. Слева первое место, справа страница ниже.
Нижняя страница раскрывает полнее
Первое место раскрывает полнее
И тот и другой список я получил одной процедурой из одного корпуса. Когда связи нет, крайние случаи находятся в обе стороны, это и видно.
В каждой нише есть составляющие, которые не закрыл почти никто
У каждой составляющей интента можно посчитать долю страниц выдачи, раскрывших её содержательно. Вот как эти доли разложились по 266 составляющим двадцати тем.
Семь составляющих из десяти закрывает больше половины выдачи — по таким конкурировать нечем, там уже все. Интерес в другом хвосте. Меньше чем четвертью страниц закрыты 28 составляющих, а 12 из них не закрыл почти никто.
Важно, что это не экзотика одной темы. Слабо закрытые составляющие нашлись в 15 темах из 20 и во всех пяти нишах.
Плотнее всего закрыты медицина и финансы: там слабых составляющих по три и по две, а типичная составляющая раскрыта у трёх четвертей выдачи. Свободнее всего стройка и техника — каждая шестая составляющая закрыта меньше чем четвертью страниц, и медиана закрытия там едва за половину.
На тему приходится в среднем по одной такой составляющей, в отдельных темах до 4. Немного — но это места, где догонять некого.
Ищите не максимальную полноту, а дефицит покрытия. По большинству составляющих полнее уже некуда, их закрывают все. Смысл есть в тех, где спрос есть, а ответа в выдаче нет. Постройте карту интента, прогоните её по своей двадцатке, отметьте составляющие с низким закрытием и проверьте под ними частотность. В стройке и технике такие места находятся чаще, чем в медицине и финансах.
Это конструктивнее, чем вывод «полнота не работает». Полнота как рычаг позиции внутри двадцатки не работает — 51 из 100. А как способ найти незанятое место она работает, и вот на что делится карта.
| Закрыто выдачей | Составляющих | Доля карты | Что это значит для ТЗ |
|---|---|---|---|
| меньше 10 % | 12 | 4,5 % | свободное место. Проверьте спрос — и если он есть, это единственный тип правки, где догонять некого |
| 10–25 % | 16 | 6,0 % | слабо закрытая потребность. Ответ в выдаче есть, но у единиц |
| 25–50 % | 48 | 18,1 % | обычная часть темы. Закрывать стоит, преимущества это не даёт |
| 50 % и выше | 190 | 71,4 % | базовое ожидание. Без неё страница выглядит неполной, с ней — как все |
Границы взяты из моего же разбиения 266 составляющих. Это рабочая эвристика для карты интента, а не доказанные пороги ранжирования: замер не показывает, что перенос составляющей из одной строки в другую двигает позиции.
Иногда причина пустоты видна прямо в тексте. Страница клиники по запросу «боль в пояснице» перечисляет группы препаратов, и в абзаце про нестероидные противовоспалительные стоит скобка: «(не надо указывать название препаратов)». Редакторская инструкция автору ушла в публикацию и висит в топ-20.
Одна оговорка, которую снимать нельзя. Фраза-свидетельство попадает в Wordstat и от одного показа, а порог в 300 показов я применял к запросам, а не к свидетельствам. Так что спрос под незакрытой составляющей надо проверять отдельно, прежде чем писать под неё текст.
Как это считалось
Две работы на разных наборах запросов. Первая — 65 запросов и 544 страницы. Вторая охватила 97 запросов пяти ниш (медицина, право, финансы, стройка, техника), и там карты интента, шкала оценки и вся процедура счёта заморожены до первого обращения к выдаче. Съём делался по Яндексу, топ-20, регион Россия.
Карту интента я строю от спроса. За каждой составляющей стоит хотя бы одна фраза, будь то сам запрос, верхняя фраза Wordstat или ассоциация из его же выдачи. Из 266 составляющих двадцати тем ни одна не появилась из общих соображений.
Дальше страница загружается, из неё извлекается основной текст, и оценщик читает текст, не видя ни позиции, ни домена, ни соседей по выдаче.
Чтобы числа ниже складывались в голове, вот весь корпус одной таблицей.
| Что | Сколько | Пояснение |
|---|---|---|
| Мест в выдаче собрано | 1940 | 97 запросов по 20 позиций |
| Наблюдений в счёте | 1538 | место в выдаче, у которого есть и текст, и оценка |
| Уникальных страниц | 1057 | одна страница попадает в несколько выдач |
| Уникальных доменов | 562 | на 1057 страниц |
| Запросов | 97 | из ста задуманных |
| Тем | 20 | по пять запросов, карта интента строится на тему |
| Составляющих интента | 266 | в среднем 10,25 применимы к запросу |
В разных разделах знаменатель меньше 1538, и всегда по одной из трёх причин. Страница не отдала текста ни одному извлекателю. Текст оказался короче порога содержания в 120 слов. Или внешний источник промолчал — так вышло с WHOIS по международным зонам. Каждый раз я называю фактическое число рядом с величиной.
| Оценка | Что означает | Пример по составляющей «сколько сохнет стяжка» |
|---|---|---|
| 0 | материала нет | про сроки высыхания не сказано ничего |
| 1 | аспект назван, ответа нет | «срок высыхания зависит от толщины и условий» |
| 2 | есть самостоятельный ответ | «цементная — сутки на каждый сантиметр, до 28 дней на полный набор прочности» |
Оценщик здесь — языковая модель по замороженной инструкции, а не человек. Десятая часть документов прошла второй независимый проход, чтобы проверить воспроизводимость шкалы.
Полнота страницы — это доля составляющих, раскрытых на двойку, от числа применимых к запросу. Объём текста на оценку не влияет. Короткий конкретный ответ получает двойку, длинная пустая формулировка единицу.
Обе работы выложены целиком. В пакете лежат 2655 оценённых наблюдений таблицей, замороженные карты интента, предрегистрация второй работы вместе с журналом отклонений и скрипт, который пересчитывает числа этой статьи от исходного CSV — включая те решения, которые сыграли против моего же вывода.
Устойчивость результата
Одно и то же число я посчитал пятью способами. Если бы результат зависел от того, где провести границу, это было бы видно здесь.
Прибор по рангу не косит, доля загруженных страниц по полосам 1–3 — 89,7 %, 4–10 — 90,2 %, 11–20 — 89,4 %. И шкала воспроизводима. Второй независимый проход по десятой части документов упорядочил их так же, связь +0,950 при совпадении отдельных решений 0,930.
Для тех, кто считает в коэффициентах. Ниже — ранговая связь каждого признака с местом, развёрнутая так, чтобы вправо означало «признак помогает подняться». Полоса вокруг нуля шириной ±0,10 — то, что я объявил практическим нулём до сбора данных. Признак работает рычагом, только если его отрезок вышел за её пределы.
Что об этом говорят другие замеры
Мой корпус свежий, но маленький: 162 запроса и 1601 страница в двух замерах, съём — август 2026 года. Проверить вывод стоит по чужим данным — собранным другим методом, на другой выборке и без моего участия.
Самый близкий по смыслу источник — Лаборатория поисковой аналитики «Ашманов и партнёры». Она снимает выдачу Яндекса и Google с 2015 года и считает связь позиции с шестью сотнями параметров. В сентябре 2024-го вышла вторая часть их исследования по информационным запросам — то есть по такому же типу выдачи, что и мой корпус.
Их главный вывод сформулирован так: «в Яндексе текстовые факторы участвуют в предварительном отборе сайтов… Поэтому текстовые факторы намного сильнее отражаются на выходе в топ Яндекса, чем на положении внутри него». Это ровно то, что у меня получилось на парах, только сказано с другой стороны.
| Что пишет Лаборатория про Яндекс | Что вышло у меня |
|---|---|
| Текстовые факторы работают на входе в топ, а не на месте внутри него | Полнота даёт 51 из 100, классические текстовые признаки 52–54 при монетке в 50 |
| У основного текста страницы «корреляция с позицией отсутствует» | Объём основного текста 52 из 100, полнота раскрытия интента 51 |
| «Концентрация слов запроса в тексте не показывает значимую корреляцию с позицией» | Плотность ключа 52 из 100, BM25 52 |
| Заголовки h2–h4 дают слабую корреляцию с позицией | Число подзаголовков 52 из 100 |
| Ссылочные параметры коррелируют с позицией сильно | Domain Rating 55 из 100 — сильнейший из измеренных, но до рычага не дотягивает |
Есть и общая мерка. В отчёте Лаборатории за 2019 год порог назван прямо: «Мы считаем корреляцию с позицией сильной, если коэффициент корреляции — 0,10 и больше (или −0,10 и меньше)». Медианная ранговая связь полноты интента с местом у меня −0,047 во второй работе и 0,033 в первой. По их собственной линейке это не слабая связь, а её отсутствие.
Где мы расходимся
Два пункта не сходятся, и я не буду их сглаживать.
Размер текста. Лаборатория пишет: «размер текста в целом как раз сильный параметр для ранжирования». У меня объём даёт 52 из 100. Расхождение объяснимо, и объяснение важнее самого расхождения. Они меряют текст страницы целиком — вместе с меню, анонсами соседних материалов и блоками перелинковки. Я меряю только основной текст, который извлекаю двумя режимами. Про него они говорят то же, что и я: корреляции с позицией нет. И вторая половина: «сильный» у них означает в том числе контраст с фоном — со страницами за пределами топ-30. Моя выборка фона не содержит вовсе.
Title. На информационных выборках они видят «сильную корреляцию с позициями» для вхождений запроса в title. У меня длина title даёт 53 из 100, полное вхождение ключа — 52. Тут мы меряем разное: они считают долю слов запроса в title с весами и получают 0,6–0,75 запроса, я считаю бинарно, есть полное вхождение по леммам или нет. Возможно, разница именно в этом. Но объявлять расхождение решённым я не могу — это открытый вопрос, и на моих данных title рычагом не выглядит.
Чего мой замер не видит вообще
Я снимал топ-20 и меряю порядок внутри него. Попадание в двадцатку мой корпус измерить не может: страниц за её пределами в нём нет. Лаборатория меряет как раз это — контраст между топом и фоном, — и там текстовые факторы у неё сильные.
Две работы складываются в совместимую картину: текстовые факторы могут быть важнее для отбора страницы в конкурентный пул, чем для распределения мест уже внутри него. Мой корпус проверяет только вторую половину этой картины — первую я не мерил и утверждать её не могу.
Практический вывод от этого не меняется. Коридор двадцатки нужен, чтобы понять, дотягиваете ли вы до её обычных значений, а не чтобы подтягивать показатели к медиане ради позиции.
Третий замер, по другому признаку
В декабре 2024-го Сергей Юрков из SEO&ROI опубликовал разбор связи ИКС со средней позицией: 250 запросов, топ-20 Яндекса, около 3500 адресов. Спирмен вышел −0,023 при p-value 0,2325 — связи нет. Признак другой, метод похожий, вывод тот же: доменная метрика, которую принято сравнивать с конкурентами, порядок мест не объясняет.
Оговорка к этой работе есть: там позиция усреднена по запросам, а не сравнивается внутри одной выдачи. Мощность теста авторы сами оценили в 5,2 % и честно об этом написали. Так что это не третье доказательство, а третье наблюдение в ту же сторону.
Коридор страницы, которая уже стоит в топ-20
Медиана сама по себе ориентира не задаёт: непонятно, что считать отклонением. Тысяча триста слов — медиана двадцатки, а восемьсот это уже мало или ещё нормально? Поэтому вот пять процентилей по 1454 наблюдениям.
Признаки я развёл на две группы, потому что для аудита они значат разное. Первую вы правите на самой странице. Вторая — ссылочная сила и возраст домена — описывает среду, в которой страница конкурирует, и правкой текста не меняется.
Читается это тремя зонами. От P25 до P75 — обычный коридор, там половина двадцатки. От P10 до P90 — встречается нормально. За краями — аномалия, которую стоит посмотреть глазами.
Эти процентили сняты с 162 выдач сразу, и разброс между ними огромный. Полнота первого места в медицине 0,829, в финансах 0,381, в праве 0,390 — потому что там наверх выходит инструмент, а не статья. Правильный порядок такой: сначала конкретная выдача по вашему запросу, потом норма ниши и формата страницы, и только потом общий коридор как грубая проверка. Не наоборот.
Иначе через полгода кто-нибудь напишет «исследование доказало: для Яндекса нужно 897–1976 слов». Оно доказывает обратное: страницы с 400 словами в двадцатке живут, и порядок мест объёмом не объясняется.
Медиана — центр распределения, а не требование. «Сделать 13 подзаголовков», «написать 1372 слова», «выставить плотность 3,92 %» — это ровно тот подход, который замер не подтверждает: внутри двадцатки такие признаки с порядком мест почти не совпадают. Страница на 400 слов там, где коридор 897–1976, — повод разобраться, почему ответ вышел настолько короче конкурентных. Страница на 1200 слов при медиане 1372 — повод оставить её в покое.
С чем всё-таки попадают в тройку
Коридор показывает, где лежит большинство. Он не отвечает на вопрос человека с молодым доменом и нулевым ссылочным: а вообще бывает, чтобы такие попадали наверх.
Вот минимумы по 204 страницам, занявшим места с первого по третье, с живым примером на каждом. Рядом пятый процентиль — один рекорд может быть случайностью, а P5 показывает, где проходит граница у двадцатой части таких страниц.
| Признак | Минимум в тройке | У кого | P5 | Медиана тройки |
|---|---|---|---|---|
| Domain Rating домена | 0 | stroylan.ru, место 1, «гидроизоляция под плитку» | 6 | 64 |
| Возраст доменалет | 0,4 | stroylan.ru, место 1, «гидроизоляция под плитку» | 4,5 | 19,2 |
| Полнота раскрытия интентадоля карты | 0,00 | avito.ru, место 2, «замена электропроводки в квартире» | 0,18 | 0,78 |
| Слов основного текстаслов | 239 | base.garant.ru, место 3, «сроки расчета при увольнении» | 437 | 1550 |
| Подзаголовков h2–h5штук | 0 | consultant.ru, место 1, «возврат товара надлежащего качества» | 1 | 16 |
| Длина titleзнаков | 13 | market.yandex.ru, место 1, «как почистить ноутбук от пыли» | 35 | 72 |
| Ссылок на страницештук | 19 | help.ufanet.ru, место 3, «не горит индикатор интернета на роутере» | 63 | 177 |
| Изображенийштук | 0 | its.1c.ru, место 2, «сроки расчета при увольнении» | 3 | 29 |
| Типов микроразметкиштук | 0 | semeynaya.ru, место 2, «боль в пояснице у женщин» | 0 | 5 |
| Зон с полным ключомиз четырёх | 0 | hi-tech.mail.ru, место 2, «wifi подключен но интернета нет» | 0 | 1 |
Самый показательный случай — stroylan.ru на первом месте по запросу «гидроизоляция под плитку». Домен зарегистрирован 23 марта 2026 года, то есть за пять месяцев до съёма выдачи. Domain Rating ноль. В миллион самых популярных доменов по Tranco не входит. На странице 334 слова и раскрыто 4 составляющих интента из 12.
По каждому признаку, который принято считать входным билетом, в тройке нашлась страница у самого дна. Ноль подзаголовков. Ноль изображений. Ноль типов микроразметки. Ни одной зоны с полным ключом. Title в тринадцать знаков. Двести тридцать девять слов текста.
Это не рецепт и не обещание. Пятый процентиль показывает, что таких страниц двадцатая часть, а девятнадцать из двадцати выглядят как коридор из раздела выше. Но жёсткого порога, ниже которого наверх не пускают, в данных нет ни по одному признаку. Домен возрастом пять месяцев с нулевым DR первое место занять может — значит, объяснение чужого первого места «у них домен старше» проверяется, а не принимается на веру.
Диагностика страницы по данным топ-20
Порядок важен: первым идёт не текст.
Норма, отклонение и что делать
Три статуса вместо одного эталона. Всё, что ниже, — способ решить, куда смотреть, а не список целевых значений.
| Признак | Коридор топ-20 | Когда смотреть | Что делать |
|---|---|---|---|
| Что можно исправить на странице | |||
| Полнота раскрытия интента | 0,50 – 0,88доля карты | заметно ниже P25, особенно меньше четверти карты | построить карту интента по своей выдаче и найти пропущенные подзадачи. Сто процентов целью не являются |
| Слов основного текста | 897 – 1976слов | ниже P10 для страниц того же типа | выяснить, почему ответ вышел короче конкурентных, а не дописывать до медианы |
| Подзаголовков h2–h5 | 8 – 21штук | большая тема раскрыта двумя-тремя блоками | проверить декомпозицию ответа. Механически плодить подзаголовки незачем |
| Длина title | 57 – 85знаков | выпадает из коридора или не описывает ответ | переписать под задачу пользователя и сниппет |
| Плотность ключа | 2,50 – 5,75% | только крайние отклонения | искать спам или отсутствие терминологии. К медиане не подгонять |
| Зон с полным ключом | 0 – 3из четырёх | отсутствие ключа само по себе не проблема | не вставлять механически: полный ключ в title есть у трети двадцатки |
| Типов микроразметки | 1 – 8штук | разметки нет там, где она применима | внедрить как техническую гигиену, не как рычаг позиции |
| Доля изображений с alt | 31 – 90% | изображение несёт смысл, а подписи нет | заполнить по назначению. Наверху alt заполнены реже, чем внизу |
| Контекст конкуренции: ориентир, а не задача | |||
| Domain Rating домена | 36 – 780–100 | сайт заметно слабее конкурентной среды | понимать как ограничение конкуренции, а не как задачу на onpage |
| Возраст домена | 11,5 – 26,6лет | домен моложе большинства в выдаче | учесть при оценке сроков. Первое место занимал домен пяти месяцев от роду |
Отклонения неравноценны, и разбирать их по одному в случайном порядке — потеря времени. Порядок такой.
Разбор реальной страницы
Возьмём страницу из корпуса. Правило отбора я задал до того, как посмотрел на результат: содержательная тройка — полнота, объём, структура — ушла ниже P25, а остальное лежит в норме. Под это правило подошли 28 страниц, беру самую нижнюю по выдаче.
shishonin.ru, место 20 по запросу «как быстро снизить давление», ниша медицина.
| Признак | Страница | Коридор P25–P75 | Статус |
|---|---|---|---|
| Полнота раскрытия интента | 0,43 | 0,50 – 0,88 | ниже P25 |
| Слов основного текста | 810 | 897 – 1976 | ниже P25 |
| Подзаголовков h2–h5 | 6 | 8 – 21 | ниже P25 |
| Длина title | 57 | 57 – 85 | в норме |
| Плотность ключа | 2,47 | 2,50 – 5,75 | ниже P25 |
| Типов микроразметки | 1 | 1 – 8 | в норме |
| Доля изображений с alt | 90 | 31 – 90 | в норме |
| Domain Rating домена | 21 | 36 – 78 | ниже P25 |
| Возраст домена | 15,1 | 11,5 – 26,6 | в норме |
Title, микроразметку и alt я бы здесь не трогал: они в норме, и правка не даст ничего, кроме отчёта о проделанной работе. Плотность 2,47 при нижней границе 2,50 формально ниже коридора, но на три сотых — это шум, а не аномалия.
Разбирать надо другое. Полнота, объём и структура просели одновременно, и это три показателя об одной вероятной причине: документ содержательно недособран. Раскрыто 3 из 7 составляющих интента. Правильный следующий шаг — построить карту интента по этой выдаче и посмотреть, каких подзадач нет, а не дописывать 562 слова до медианы.
DR 21 при коридоре 36–78 — отдельная строка. Она не ставит задачу «нарастить ссылки до 63». Она говорит, что страница конкурирует со средой сильнее себя, и это стоит держать в голове, оценивая, сколько вообще даст правка текста.
Когда текст пора оставить в покое
Обратный алгоритм в SEO-статьях встречается редко, а нужен он не меньше прямого.
Страница отвечает в том формате, который стоит в выдаче. Объём в обычном диапазоне. Основные составляющие интента закрыты. Структура читается. Из title, h1 и первых абзацев понятно, на какой запрос это ответ. Технических дефектов нет.
Тогда останавливайтесь. Поднимать плотность с 3,5 до 3,92 %, добавлять ключ ещё в два подзаголовка, растягивать 1372 слова до двух тысяч, вставлять FAQ потому что он есть у конкурента, доводить полноту с трёх четвертей до сотни — всё это работа, которую мои данные не поддерживают. Внутри двадцатки полнота даёт 51 из 100, а основные классические текстовые признаки — вхождения ключа, объём и структура — примерно 52–54 из 100 при монетке в 50.
Пять вопросов, которые стоит задать до правки страницы. Я конкурирую правильным типом страницы? Какие задачи пользователя закрывает двадцатка, а я нет? Я действительно выбиваюсь из распределения или просто ниже медианы? Могу ли я объяснить отклонение форматом страницы? И если onpage уже нормальный — почему я всё ещё правлю текст?
Дочитать было самой лёгкой частью. Коридор, процентили и разбор начинают работать в ту минуту, когда вы открываете свою страницу и сверяете её с числами. Не открыли — ничего не произошло.
Шайа Лабаф, «#INTRODUCTIONS», 2015
Что делать в четырёх случаях
Дерево решений, которое из этих данных следует.
| Ситуация | Что делать |
|---|---|
| Страница не в топ-20 | Сравнить её с коридором двадцатки, а не с первым местом. Сильно выпадает — править формат, покрытие, структуру |
| Страница похожа на обычную страницу топ-20 | Перестать полировать плотность, число подзаголовков и объём. Данные не показывают, что места внутри двадцатки различаются этим |
| Страница в топ-20, но не растёт | Доводить 3,92 до 4,00 или 1200 слов до 1500 смысла нет: такая правка не совпадает с порядком выдачи |
| Страница в коридоре и всё равно проигрывает | Смотреть следующий класс причин: формат ответа, ссылочный разрыв, коммерческие и сайтовые факторы, поведение, техника |
Причём даже доменный авторитет здесь не волшебный фактор, а просто самый заметный из измеренных: 55 из 100 против 51–54 у большинства onpage-признаков.
И чего делать не стоит. Обещать клиенту рост позиций за счёт более полного раскрытия интента или за счёт вхождений ключа в зоны. У этих обещаний нет опоры в данных, а проверить их теперь можно — как и остальные обещания в коммерческом предложении подрядчика.
Частые вопросы
В этой выборке страниц топ-20 — практически нет: более полная страница стояла выше в 51 случае из 100 при случайной базе 50. Полнота полезна как диагностический коридор, но данные не подтверждают её как самостоятельный рычаг роста внутри двадцатки.
Нет. Полный ключ в title был у 35% страниц топ-20 и ровно у 35% первых мест. В этой выборке наличие полного вхождения не объясняло порядок позиций.
Это диапазон P25–P75, в котором лежит половина страниц топ-20 по измеренному признаку. Он помогает заметить сильное отклонение страницы, но не является целевым рецептом и не требует подгонять каждое значение к медиане.
Нет. В корпусе нет страниц за пределами топ-20, поэтому исследование описывает различия внутри уже ранжируемой двадцатки и не измеряет барьер входа в неё.
Нет. Некоторые шаблонные признаки машинного письма встречались наверху чуть реже, но попарное различение осталось около случайного уровня. Из этих данных нельзя вывести ни санкцию за AI-текст, ни безразличие поисковой системы к его качеству.