По запросу «туры в турцию все включено» на 26-м месте Google стоит страница tours-spb.ru. Из одиннадцати вещей, которые люди ищут по этому запросу, она полностью раскрывает все одиннадцать: города вылета, курорты, сезон, звёздность отелей, цены, недорогие варианты, горящие туры, перелёт, туры с детьми и на двоих, продолжительность. Весит 118 килобайт.
На пятом месте стоит tours.tutu.ru. Основной текст этой страницы, по сути список отелей, полностью раскрывает две вещи из одиннадцати, а HTML весит 2,3 мегабайта. На восьмом — Tripadvisor с одной.
вопросов раскрыто полностью
tours-spb.ru · 118 КБ
вопроса раскрыто полностью
tours.tutu.ru · 2,3 МБ
Я смотрел на эти две строки и не мог понять, как такое вообще возможно. По любому SEO-чеклисту должно быть наоборот: в пятёрке страница, которая ответила на все вопросы и весит почти в двадцать раз меньше, а список отелей на третьей странице выдачи.
Такую картину легко выдать за доказательство, что полнота ответа в Google ничего не значит. Но одна выдача ничего не доказывает.
Составлять ещё один список факторов я не собирался. Хотел обратного: взять привычный SEO-чеклист, от ключа в title и объёма текста до лёгкого HTML и чистого технического аудита, и посмотреть, сколько его пунктов переживут встречу с реальной выдачей. Поэтому я проверил то же самое на 160 запросах и 7370 адресах: отдельно полноту ответа, охват темы, ключи, объём текста и техничку.
- Выборка
- 7370 адресов выдачи, 4432 домена
- Запросы
- 160, шестнадцать ниш по десять
- Группы
- топ-20 против позиций 21–50
- Регион
- Москва, google.ru, десктоп
- Дата съёма
- 14.09.2026
- Интент
- 1228 документов Google и 634 Яндекса, слепая оценка
- Сравнение
- Яндекс, те же запросы, 09.09.2026
- Исключения
- заглушки ботозащиты, окна согласия, битая кодировка
Одна выдача целиком
Вот та самая выдача. Из каждой из 160 выдач я случайно взял по четыре страницы из топ-20 и по четыре с позиций 21–50.
Эти страницы читал слепой оценщик, языковая модель. Он видел запрос, текст страницы и список составляющих интента, то есть вопросов, которые стоят за запросом. Позиции, домена и поисковика он не видел. За каждый вопрос страница получала 2, если отвечает на него полностью, 1, если только упоминает, и 0, если ответа нет.
| Место | Сайт | 11 составляющих интента | Раскрыто полностью | LSI | Слов | HTML, КБ |
|---|---|---|---|---|---|---|
| 2 | 1001tur.ru | 6 | 0,49 | 912 | 506 | |
| 5 | tours.tutu.ru | 2 | 0,12 | 417 | 2287 | |
| 8 | tripadvisor.ru | 1 | 0,26 | 854 | — | |
| 14 | coral.ru | 7 | 0,62 | 633 | 1216 | |
| 26 | tours-spb.ru | 11 | 0,77 | 1348 | 118 | |
| 31 | ru.trip.com | 9 | 0,77 | 2007 | 838 | |
| 33 | travelata.ru | 4 | 0,25 | 536 | — | |
| 44 | light-tur.ru | 9 | 0,65 | 1073 | 40 |
Составляющие слева направо: города вылета, лучшие месяцы, курорты, звёздность отеля, цена тура, недорогие варианты, горящие туры, перелёт в стоимости, тур на двоих или компанией, тур с детьми, продолжительность. Google, Москва, 14.09.2026.
Четыре страницы из топ-20 полностью ответили на 16 вопросов на всех. Четыре страницы с позиций 21–50 — на 33, вдвое больше.
Тему нижняя четвёрка тоже охватывает шире. В колонке LSI стоит доля тематических слов запроса, которые нашлись на странице: 0,77 — это примерно три слова из четырёх, 0,12 — одно из восьми. Внизу три страницы из четырёх охватывают тему шире любой страницы верхней четвёрки.
Что это за выдача, видно по первым строкам. Наверху в основном агрегаторы туров и Tripadvisor с узнаваемыми брендами. Внизу турагентства и агрегаторы поменьше, зато они отвечают на большую часть вопросов.
Остановись я на этой таблице, статья вышла бы короткой и неправильной: «полнота не нужна». Из одной выдачи следует немного: полнота ответа сама по себе силу площадки не перебивает. Обратного она не доказывает. Может, в среднем полнота всё-таки работает, а туризм просто исключение. Дальше — то же самое на всех 160 запросах.
Что мерил и чем это отличается от замеров Яндекса
Прежде чем идти по всем запросам, пара слов о том, откуда взялся этот замер. Он третий в серии и отвечает на вопросы, которые оставили два первых.
Первый, по on-page в Яндексе, смотрел только внутрь топ-20 и не нашёл там ни одного признака, который объяснял бы порядок мест. Но страниц за пределами двадцатки в той выборке не было. Вопрос «помогает ли полнота вообще попасть в двадцатку» остался открытым.
Второй, по техничке Яндекса, сравнивал топ-10 с позициями 31–49. Он показал, что технический вес страницы — в основном свойство сайта.
Здесь оба пробела закрыты сразу, но на Google. Граница проходит по двадцатому месту: топ-20 против позиций 21–50, то есть первые две страницы выдачи против третьей, четвёртой и пятой. On-page, полнота ответа, охват темы и техничка сняты с одних и тех же адресов.
В конце статьи Google сравнивается с Яндексом на границе из технического замера Яндекса, 1–10 против 31–49. Так числа двух поисковиков можно сравнивать напрямую.
Шесть гипотез и способ счёта я записал до того, как посмотрел на результаты. Список с исходом каждой есть в методологии.
Проверки, которые я придумал уже после данных, помечены в тексте словом «разведка», и им я доверяю меньше. Если после данных перебрать десятки разрезов, какой-нибудь из них покажет разницу чисто случайно.
Три величины и как читать цифры
Дальше почти в каждом разделе встречаются три величины. Без них цифры легко прочитать неверно, поэтому коротко о каждой.
Полнота интента. За каждым запросом стоит несколько вопросов. Человек, который ищет «туры в турцию все включено», хочет знать цену, курорт, город вылета, входит ли перелёт в стоимость, можно ли ехать с детьми, и так далее. Для каждого запроса я составил такой список, а потом проверил, на сколько вопросов из него страница отвечает полностью, на двойку. Доля таких ответов и есть полнота интента. В тексте я чаще говорю проще: насколько страница отвечает на вопросы пользователя.
Список строился по спросу: частые фразы и ассоциации Вордстата, подсказки Яндекса, блоки «Похожие вопросы» и «Похожие запросы» Google. Страницы из выдачи в него не попадали, иначе список подгонялся бы под тех, кто уже стоит наверху. На запрос выходит от трёх до шестнадцати составляющих, у типичного — десять.
Покрытие LSI. Это рабочее название охвата темы. К старому «LSI-копирайтингу» и к латентно-семантическому анализу оно отношения не имеет. Речь просто о доле тематических слов и понятий, которые постоянно встречаются на страницах по запросу. Для «туров в Турцию» это «путёвка», «перелёт», «курорт», «трансфер», «питание», «туроператор» и ещё десятки слов. Я считаю, какая доля такого списка есть на конкретной странице. Чем выше доля, тем шире страница охватывает тему. Дальше в тексте это чаще называется охватом темы или тематическим покрытием.
Технически список очищен от случайных и слишком общих слов, а слова самого запроса из него убраны, чтобы покрытие не повторяло вхождение ключа. Подробная формула есть в методологии.
Из 100 пар. Это самая простая шкала статьи. Беру две страницы одного запроса и смотрю, выше ли стоит та, у которой признак больше. Так по всем парам всех выдач.
Если признак с местом никак не связан, выйдет около 50 из 100, обычная монетка. 55 из 100 — небольшой перевес: признак угадывает, какая страница выше, в 55 парах из ста и ошибается в 45. Там, где связь заведомо есть, эта же шкала показывает 90 и выше. Когда у обеих страниц признак одинаковый, например у обеих нет полного ключа в title, пара считается ничьей и делится пополам.
Что означают цифры в скобках
В таблицах и на графиках встречаются обозначения из статистики. Для основного текста они не нужны. Если захотите заглянуть в точные данные, читайте их так.
- 53,8 из 100
- Небольшой перевес над монеткой: в 53,8 паре из ста выше стоит страница, у которой признак больше. 50 — монетка
- AUC 55,3
- То же самое, только в каждой паре страница из топ-20 и страница с позиций 21–50. Так эта шкала подписана в таблицах
- 95% интервал [53,6; 56,9]
- Насколько может гулять эта цифра. Если в интервал попадает 50, уверенного перевеса нет
- p = 0,0002
- Насколько легко получить такую разницу случайно. Меньше 0,05 — разница выглядит устойчивой, больше — вывод на ней не построишь
- медиана
- Типичная страница: у половины страниц значение больше, у половины меньше. Один гигантский сайт её не перекосит
Двадцать признаков на одной шкале
Что сильнее отличает топ: ключ в title, длина текста или охват темы? Прежде чем разбирать пункты по одному, я сложил на эту шкалу сразу двадцать признаков. Техничка страницы взята из аудита, on-page из основного текста, полнота интента из слепой оценки. Все двадцать посчитаны одинаково: пары страниц внутри одной выдачи Google, позиции с первой по пятидесятую.
Google, Москва, 14.09.2026, позиции 1–50, пары внутри запроса, ничьи пополам. Техничка: 5753 страницы, 102 968 пар. Текст: 6516 страниц, 130 712 пар. Полнота интента: 1228 документов слепой оценки, 4151 пара. Серым — технические признаки, цветом — две главные величины статьи.
Дальше всех от 50 уходят объёмы: сколько на странице слов, DOM-узлов (элементов разметки, из которых браузер строит страницу), килобайт и картинок. Из того, что правится в тексте, впереди тематическое покрытие. Почти вровень с ним идут подзаголовки и объём основного текста.
Полнота ответа на вопросы пользователя отстаёт от покрытия темы на полтора пункта. А все вхождения ключа, от title до плотности, лежат на пятидесяти, на уровне случайного выбора.
Глядя на такой график, легко решить, что шкала «из 100» просто не умеет показывать больше. Я проверил её на признаках, которые заведомо связаны между собой. Покрытие темы и число найденных тематических слов меняются в одну сторону в 99,4 паре из 100. Строгая и мягкая версии полноты интента — в 90,0. Полнота и покрытие темы — в 73,1.
Где связь есть, шкала спокойно показывает девяносто. Значит, 53,8 у тематического покрытия говорит о слабой связи, а 50,6 у ключа в title — о том, что связи нет. Шкала тут ни при чём.
Как это читать на практике. Даже при 53,8 из 100 в 46 парах из ста страница с большим охватом темы стоит ниже соседки. Рычага, который сам переставляет страницы, среди двадцати признаков нет. Вопрос в том, какие из этих слабых различий переживают дополнительные проверки, а какие рассыпаются.
Раскрывает ли топ интент полнее?
неясно
Страница, которая полнее отвечает на запрос, стоит выше
Чуть полнее, но у страниц одной длины разницы не видно. Больше вопросов закрывают просто более длинные тексты
Первой я проверял главную гипотезу замера: чем полнее страница отвечает на запрос, тем выше она стоит. После выдачи с турами я надеялся, что туризм окажется исключением, а на 160 запросах полнота своё возьмёт. Данные оказались куда неприятнее.
Типичная страница топ-20 полностью раскрывает половину частей запроса, типичная страница с позиций 21–50 — 45,5%. В штуках это 5 закрытых вопросов пользователя против 4. В расчёт вошли 1228 документов Google из 1272 отобранных, по четыре сверху и по четыре снизу на запрос.
из 100: перевес такой маленький, что его мог дать случай
у страниц одной длины и типа преимущество полноты почти исчезает, а длина держится
позиции 1–10 против 31–49: здесь полнота уже отличает верх. Полнота 0,5 против 0,4
Точные значения. Страницы одной длины и типа: p = 0,66 у полноты и 0,0095 у длины. Позиции 1–10 против 31–49: 56,3 из 100, интервал [51,5; 61,1], на случайность такой перевес уже не спишешь.
Первое впечатление: топ отвечает на вопросы полнее. Но разница такая маленькая, что её вполне мог дать случай. Если раздать страницам места «топ» и «ниже» наугад внутри каждого запроса, такая же или бо́льшая разница выпадает примерно в шести попытках из ста. На такой разнице вывод строить нельзя, и то, что она лежит близко к условному порогу, ничего «почти» не доказывает.
Дальше я проверил, не объясняется ли всё длиной текста. На этой проверке моя главная гипотеза и сломалась: эффект почти исчез.
Возьмите две страницы одинаковой длины и одного типа: преимущество более полной почти пропадает, и то, что от него осталось, вполне может быть случайностью. Длина текста в том же сравнении держится. Проверял сразу на всех 1228 документах, точные значения стоят на графике выше.
Получается простая вещь. Длинная статья за счёт объёма закрывает больше вопросов пользователя, а с местом в топ-20 в этом сравнении связана именно длина.
Остальные проверки полноту не спасли.
По запросам: полнее верх в 85 выдачах из 159, низ — в 60, в 14 поровну. Перевес есть, но далеко не везде.
Внутри одного сайта разница почти нулевая. У 63 доменов есть страницы и в топ-20, и ниже. Верхняя страница полнее у 32 из них, слабее у 27. Типичная разница +0,027: при десяти частях запроса это меньше трети одного вопроса.
По полосам позиций типичная полнота стоит на месте: половина частей запроса на местах 1–3 и на 41–50, чуть меньше на 11–20 и 31–40 (0,455 и 0,444).
Все варианты счёта полноты
| Величина | Топ-20 | 21–50 | AUC [95% ДИ] | p |
|---|---|---|---|---|
| Доля составляющих на 2 — основная | 0,500 | 0,455 | 52,7 [49,5; 55,6] | 0,063 |
| Доля на 1 или 2 — мягкая | 0,667 | 0,667 | 52,5 [49,4; 55,4] | 0,081 |
| Доля на 2, взвешенная спросом | 0,597 | 0,562 | 52,9 [50,1; 55,8] | 0,045 |
| Только составляющие из Вордстата | 0,500 | 0,500 | 49,2 [45,5; 52,7] | — |
623 документа топ-20 и 605 документов с позиций 21–50, 159 запросов. p — перестановка меток внутри запроса, 5000 повторов. Взвешенная величина проходит порог 0,05 на грани, основная и мягкая — нет. Взвешенная спросом доля даёт больший вес составляющим, которые чаще ищут. Когда одно и то же посчитано четырьмя способами, то, что один из них едва перешёл порог, мало что добавляет.
Одна деталь мешает списать всё на шум. Сила эффекта зависит от типа запроса. Сильнее всего верх полнее низа в смешанных запросах, где человеку нужно сразу несколько разных вещей, как в «перепланировка квартиры согласование»: 59,2 из 100 на 138 документах. У транзакционных 54,6, у коммерческих 51,5, у информационных 51,3.
Это разведка: разбивку я придумал уже после данных, и выборки внутри классов маленькие. Но направление понятное: чем больше в запросе разных потребностей, тем важнее закрыть их все.
Можно ли верить самой оценке? Десятую часть документов я отдал второму, независимому прогону оценщика. На 1877 решениях оценки совпали в 88 случаях из 100. Если сделать поправку на совпадения, которые дали бы оценки наугад, согласие остаётся почти таким же высоким.
Значит, шкала воспроизводима: независимый прогон ставит почти те же оценки, и слабый результат полноты разбросом оценок не объясняется. С человеческой разметкой шкалу не сверяли. Эта проверка показывает устойчивость оценок, а правы ли они, она не показывает.
- Что проверяли
- 1228 документов Google, по четыре из топ-20 и четыре с позиций 21–50 на запрос. Список вопросов к запросу собран из спроса, оценщик не видел позицию и домен.
- Что нашли
- Топ-20 отвечает на вопросы пользователя чуть полнее: на 4,5 пункта, 52,7 из 100. На такой разнице вывод строить нельзя. У страниц одной длины и типа разницы по полноте не видно. Самый верх против глубины выдачи — 56,3 из 100.
- Что это значит
- Полнота ответа отличает первую страницу выдачи от пятой. На границе двадцатки почти не отличает. Длинный текст закрывает больше вопросов, и в данных полнота идёт вместе с объёмом.
- Что делать
- Закрыть то, что закрывают соседи по выдаче. Прибавку от дописанного сверх этого данные не показывают.
Охват темы: текстовый признак, который выдержал все проверки
выдержал проверки
Тематические слова — пережиток старого SEO, Google понимает смысл и без них
Из двух главных величин все проверки выдержало только покрытие темы: на длину текста, внутри одного сайта и по нишам
Сама полнота оказалась слабее, чем я ждал. А что, если считать ширину темы вместо закрытых вопросов? Здесь результат уже другой.
Из всех текстовых признаков лучше всего держится охват темы. Он обходит и ключ в title, и длину текста. В таблицах и на графиках эта метрика называется покрытием LSI. Тематические слова многие считают пережитком старого SEO, а из текстовых рекомендаций удержалась именно эта.
Если по запросу «туры в Турцию» конкуренты раз за разом пишут про перелёт, питание, трансфер и курорты, страницы топ-20 чаще тоже закрывают эти темы. Разница остаётся, даже когда сравниваешь две страницы одного сайта.
В цифрах она скромная. Типичная страница топ-20 содержит около 56% тематических слов своего запроса, типичная страница с позиций 21–50 — около 51%. Это примерно пять слов из каждой сотни в списке. Для «туров в Турцию» со списком из 61 слова это три слова, например «трансфер», «питание» и «туроператор».
Форма кривой важнее самих чисел. Внутри первых двух страниц выдачи покрытие к первому месту не растёт: у мест 1–3 оно даже чуть ниже, чем у 4–10. А после двадцатки идёт ровная лестница вниз.
В замере Яндекса текстовые признаки порядок мест внутри двадцатки тоже не объясняли. Попадание в двадцатку тот замер не видел. Здесь видно, что ступенька по охвату темы приходится на её границу.
Эту гипотезу я записал до данных и проверял строже остальных. Возьмём пару: одна страница из топ-20, другая с позиций 21–50 того же запроса. Более широкий охват темы оказывается у верхней в 55,3 случая из 100.
Перевес небольшой, но устойчивый: даже по самой осторожной оценке он на 3,6 пункта выше 50, а когда я 5000 раз раздавал страницам места «верх» и «низ» наугад, такой разницы не выпало ни разу.
Только пять с небольшим пунктов над монеткой не та цифра, ради которой открывают шампанское. Кроме случая, у такого перевеса хватает скучных объяснений, и поверить ему сразу я не смог. Поэтому попробовал его убить.
Может, это просто длинные тексты? Нет.
Может, наверху просто сайты посильнее? Нет.
Может, среднее тянут несколько огромных выдач? Нет.
Одна удачная ниша? Тоже нет.
Маркетплейсы и агрегаторы? Выкинул их, результат остался.
| Проверка | Что получилось | Держится |
|---|---|---|
| Может, это просто длина текста? | Если сравнивать страницы одной длины, LSI всё равно отличает топ, p = 0,0004. А длина при одинаковом LSI уже может оказаться случайностью, p = 0,058 | да |
| Может, наверху просто другие сайты? | 529 доменов со страницами в обеих группах. Верхняя страница сайта богаче нижней на 0,026 [0,011; 0,042]: у 295 доменов больше, у 223 меньше, p = 0,002 | да |
| Может, это пара огромных выдач? | В 111 запросах из 160 медиана LSI в топ-20 выше, чем на 21–50. Ниже — в 48 | да |
| Может, это одна ниша? | Верх богаче в 15 нишах из 16. Исключение — юридические услуги, 48,9 из 100 | да |
| Может, это маркетплейсы и агрегаторы? | Без Ozon, Маркета, Avito, Wildberries, 2ГИС, YouTube, Дзена, отзовиков и других агрегаторов результат тот же: 55,3 из 100 [53,7; 56,9] | да |
Не сломался.
Первая строка таблицы самая важная. В длинном тексте просто больше слов, в том числе тематических. Можно было ожидать, что охват темы окажется всего лишь другим способом посчитать длину.
Вышло наоборот. Если сравнить страницы одинаковой длины, покрытие темы всё равно отличает топ. А если сравнить страницы с одинаковым покрытием, преимущество длины может оказаться случайностью. Если мерить оба признака одной линейкой, обычным разбросом между страницами, охват темы связан с попаданием в топ-20 вдвое сильнее, чем длина текста.
Вторая строка отличает Google от Яндекса. В Google даже у одного и того же сайта верхняя страница чаще охватывает больше тем, чем его же страница ниже. От разницы между разными сайтами внутри одного сайта остаётся половина. Поэтому покрытие темы здесь больше похоже на свойство конкретной страницы.
В Яндексе на той же проверке разницы внутри сайта не видно: у типичного сайта она нулевая. Но сайтов для такого сравнения всего 119, и оценка размытая: разница может оказаться и в плюс, и в минус (от −0,033 до +0,045).
Доля страниц, перешагнувших уровень покрытия
| Покрытие LSI не ниже | Топ-20 | Позиции 21–50 | Разница, п. п. |
|---|---|---|---|
| 0,3 | 85,4% | 81,8% | +3,6 |
| 0,4 | 74,4% | 68,9% | +5,5 |
| 0,5 | 59,3% | 51,8% | +7,5 |
| 0,6 | 41,9% | 34,4% | +7,5 |
| 0,7 | 25,1% | 18,6% | +6,5 |
2622 страницы топ-20 и 3342 страницы с позиций 21–50, у которых посчитано покрытие LSI.
Здесь легко сделать опасный вывод, поэтому одна оговорка. Это связь, эксперимента за ней нет. Совет «вставьте LSI-слова» из данных не следует. Скорее наоборот: страница, где автор разобрался в теме, сама собой содержит «трансфер» и «питание». Если нужные слова естественно появились в тексте, значит, тема действительно раскрыта.
Список полезен как проверка того, о чём соседи по выдаче говорят, а вы нет.
Ключ в title, H1 и description
не выдержал
Ключ в title и H1 — первое, что поднимает страницу
Почти случайный выбор. Полный ключ в title у 43,0% топа и у 40,8% соседних страниц, в H1 разницы нет
Если содержание что-то различает, что тогда с самым старым SEO-ритуалом, ключом в title?
Здесь обиднее всего за SEO-ТЗ, которые открываются этим пунктом. Ключ в title нужен для релевантности и клика. Но внутри первых 50 результатов его наличие почти ничего не говорит о том, кто окажется выше.
Полный ключ в title есть у 43% страниц топ-20 и у 41% страниц ниже. В H1 разницы практически нет вообще.
Полным вхождением я считаю все значимые слова ключа в любых формах. Для запроса «остекление балкона под ключ» title «Остекление балконов и лоджий под ключ в Москве недорого» даёт полное вхождение, «Отделка балконов и лоджий под ключ - Цены в Москве - Быстро и недорого!» — нет.
| Зона | 1–3 | 4–10 | 11–20 | 21–30 | 31–40 | 41–50 | Из 100 пар |
|---|---|---|---|---|---|---|---|
| Полный ключ в title | 46,4% | 42,6% | 42,4% | 41,8% | 39,5% | 41,4% | 50,6 |
| Полный ключ в description | 40,1% | 34,4% | 35,3% | 32,0% | 33,2% | 34,5% | 50,7 |
| Полный ключ в H1 | 23,3% | 21,8% | 22,5% | 21,4% | 22,8% | 21,9% | 50,0 |
6516 страниц с текстом, Google, позиции 1–50. Последняя колонка — доля пар внутри запроса, 130 712 пар.
из 100: так ключ в H1 угадывает, какая из двух страниц одной выдачи стоит выше. Подброшенная монетка даёт ровно столько же.
Первые три места чуть чаще несут ключ в title и description, на четыре-шесть пунктов. Дальше полосы ровные до пятидесятого места.
На границе двадцатки разница по title 2,2 пункта (51,1 из 100), и на такой разнице вывод строить нельзя. По H1 разницы нет совсем: 22,4% против 22,0%. Четыре страницы топ-20 из пяти обходятся без полного ключа в H1. Старый пункт ТЗ про ключ в заголовке эту проверку не пережил.
С остальными ключевыми признаками та же история. Точное вхождение в title — 10,6% в топ-20 против 9,7% ниже. Длина title — 71 знак против 70.
Плотность ради плотности тоже ничего не дала: у типичной страницы 5,2% в топ-20 и 5,3% ниже. По парам это 49,2 из 100: страница с большей плотностью стоит ниже даже чуть чаще, чем выше.
Объём текста и подзаголовки
неясно
Ключ почти ничего не дал. Может, Google просто любит больше текста?
В топе текста действительно больше. На секунду показалось, что старое доброе «сделаем на 20% больше текста, чем у конкурента» вернулось в строй.
Ненадолго.
У типичной страницы топ-20 около 840 слов основного текста, у страниц ниже около 700. Подзаголовков H2 шесть против пяти. Блок частых вопросов есть у 27,0% страниц топ-20 и у 20,8% страниц ниже. В 110 запросах из 160 типичный текст в топ-20 длиннее.
По шкале пар объём и подзаголовки отделяют топ-20 заметнее ключей: 54,3 из 100 у объёма текста и 54,9 у подзаголовков. Перевес небольшой, но достаточно устойчивый, чтобы не списывать его на случайность (интервалы [53,0; 55,7] и [53,6; 56,1]).
| Признак | 1–3 | 4–10 | 11–20 | 21–30 | 31–40 | 41–50 |
|---|---|---|---|---|---|---|
| Слов основного текста, медиана | 844 | 861 | 817 | 738 | 704 | 662 |
| Подзаголовков H2, медиана | 6 | 6 | 6 | 5 | 4 | 4 |
| Есть блок FAQ | 26,3% | 26,6% | 27,5% | 21,6% | 19,6% | 21,6% |
Картина та же, что у тематического покрытия: внутри двадцатки ровно, после неё ступенька. Блок FAQ держится на 26–27% три полосы подряд и падает до 20–22% ровно на третьей странице выдачи.
Почему тогда «неясно»? Всё решила проверка на длину из раздела про охват темы. Если сравнить страницы с одинаковым покрытием темы, преимущество длины практически исчезает. Похоже, длинные тексты чаще стоят в топ-20 из-за числа закрытых тем: в длинный текст их просто помещается больше.
Это совпадает с тем, что пишет сам Google в руководстве для начинающих: длина контента сама по себе на ранжирование не влияет, волшебного числа слов нет.
Объём сам по себе топ не объясняет. Остаётся убеждение посвежее: Google будто бы наказывает текст, написанный нейросетью. Если это правда, машинного текста в топе должно быть заметно меньше, чем ниже.
Бонусный прогон 1 из 2 · детектор ИИ-текста
Машинный текст: что показал наш детектор
не выдержал
Google понижает тексты, похожие на сгенерированные, и в топе их меньше
В Google топ-20 и позиции 21–50 по детектору не отличаются. Выше порога примерно одна страница из десяти и там, и там
Проверить это убеждение, «Google наказывает ИИ-текст», мне было чем. У сайта есть свой детектор ИИ-текста, и я заодно прогнал через него все страницы выдачи из этого замера.
Результат вышел скучным, и этим он полезен.
Детектор верх выдачи Google от соседей снизу не отличает. Выше порога 2,0, с которого инструмент считает текст похожим на машинный, стоят 10,5% страниц топ-20 и 10,9% страниц с позиций 21–50. Возьмите две страницы одного запроса, и сигнал окажется выше у верхней в 49,7 случая из 100. Внутри одного сайта то же самое: верхняя страница «машиннее» нижней у 134 сайтов и «человечнее» у 136.
Движок тот же, что работает в инструменте. Запускал я его на своём компьютере по HTML, сохранённым при съёме выдачи: 6491 адрес Google и 2849 адресов Яндекса. Общий сигнал детектор считает только по связному тексту от 500 слов, и такой текст нашёлся примерно у половины страниц: 48% в Google и 50% в Яндексе. Остальное — каталоги, карточки и короткие страницы услуг (36% в Google) или перечни, где тире и двоеточия стоят вместо фраз (13%). Поэтому всё ниже касается страниц со статьями и длинными описаниями.
| Показатель | Google, топ-20 | Google, 21–50 | Яндекс, топ-10 | Яндекс, 31–49 |
|---|---|---|---|---|
| Сигнал считается, % страниц | 51,6% | 45,4% | 50,3% | 49,4% |
| Страниц с сигналом | 1468 | 1666 | 703 | 717 |
| Сигнал типичной страницы | −1,24 | −1,13 | −0,92 | −1,29 |
| Средняя половина страниц | −2,95…0,48 | −2,89…0,63 | −2,82…0,85 | −3,47…0,33 |
| Выше порога 2,0 | 10,5% | 10,9% | 12,8% | 9,6% |
Порог 2,0 тот же, что в инструменте: выше него текст по восьми признакам похож на машинный. Отрицательный сигнал лежит ниже порога с запасом. Google — 14.09.2026, позиции 1–50. Яндекс — 09.09.2026, позиции 1–10 и нечётные 31–49.
В Яндексе верх по детектору даже чуть «машиннее» низа: выше порога 12,8% страниц первой десятки и 9,6% на позициях 31–49. Держится этот перевес плохо. Разница в 3,2 пункта может оказаться и нулевой, а по отдельным запросам сигнал верха выше в 78 выдачах и ниже в 70, почти поровну. У Google на тех же позициях разницы нет: 9,2% против 10,0%.
В прошлом замере Яндекса машинных примет наверху было чуть меньше. Числа напрямую не сравниваются: там я смотрел слои детектора по отдельности и места внутри топ-20, здесь общий сигнал на границе 1–10 против 31–49. Главное сходится: рычагом позиций сигнал детектора не работает ни там, ни здесь.
По отдельным признакам в Google разница тоже мелкая. После поправки на число проверок держатся две, и обе далеко от порогов: у страниц топ-20 чуть больше тире-связок, 10,7 на тысячу слов против 9,0, и чуть сильнее разброс длины абзацев, 0,64 против 0,61. Первое по шкале детектора ближе к машинному письму, второе к человеческому.
Эталон: типичные значения детектора на страницах выдачи
Это справка для тех, кто хочет сверить свой текст. В раскрывающемся блоке ниже типичные значения всех признаков детектора на страницах, которые уже стоят в первых пятидесяти результатах. Проверьте текст в детекторе и сравните его показатели со строками таблицы.
Все признаки детектора: типичные значения выдачи
| Признак в детекторе | Порог в инструменте | Google, типичная страница | Google, средняя половина | Яндекс, типичная страница | Яндекс, средняя половина |
|---|---|---|---|---|---|
| Общий сигнал | от 2,0 | −1,19 | −2,91…0,55 | −1,13 | −3,14…0,56 |
| Двоеточие-перечисление, на 1000 слов | от 10,1 | 3,8 | 1,6…7,3 | 3,9 | 1,6…7,5 |
| Параллельные начала, % | от 21,8 | 13,0 | 5,0…22,2 | 12,5 | 4,5…21,3 |
| Тире-коннектор, на 1000 слов | от 26,9 | 9,9 | 4,4…16,8 | 10,6 | 4,6…17,6 |
| Ритм (burstiness) | до 0,46 | 0,58 | 0,47…0,82 | 0,58 | 0,47…0,85 |
| Повтор триграмм, % | на нуле | 1,9 | 0,9…4,6 | 2,0 | 0,9…5,1 |
| Метод Ильдара | до 0,045 | 0,25 | 0,14…0,35 | 0,25 | 0,15…0,35 |
| Первое лицо, на 1000 слов | на нуле | 2,4 | 0,5…7,8 | 2,2 | 0,3…8,6 |
| Начала с союза, % | до 0,9 | 3,1 | 1,1…5,9 | 2,9 | 0,9…5,7 |
| Ровные абзацы, % | от 52,9 | 28,1 | 14,7…42,4 | 28,9 | 13,9…43,4 |
| Разброс абзацев | до 0,41 | 0,62 | 0,50…0,83 | 0,61 | 0,49…0,79 |
| Шаблонные обороты, % предложений | справочно | 0 | 0…1,5 | 0 | 0…1,2 |
| Слов связного текста | от 500 | 961 | 702…1427 | 992 | 717…1480 |
Страницы, где детектор считает общий сигнал: Google — 3134 из 6516, позиции 1–50; Яндекс — 1420 из 2849. Порог — значение, с которого признак срабатывает в инструменте. Ровные абзацы и разброс абзацев в общий сигнал не входят, шаблонные обороты показываются справочно, так же как в самом детекторе.
Если коротко, типичная страница выдачи от машинного профиля далеко. Общий сигнал около −1,2 при пороге 2,0, и ни один признак у неё порога не берёт. Заметнее всего в этом портрете безличность: первого лица 2,4 слова на тысячу, а у живых текстов, на которых калибровали детектор, около 12.
Эти же данные теперь встроены в детектор: рядом с общим сигналом и каждым признаком он показывает, где текст стоит среди 4542 страниц выдачи, а на графике — полосу, в которой лежит половина этих страниц. Веса и порог 2,0 я не менял. Страницы выдачи не размечены, и какие из них написаны моделью, неизвестно, поэтому переучить на них детектор нельзя.
Бонусный прогон 2 из 2 · SEO-анализ текста
Вода, тошнота и читабельность: что показал SEO-анализ текста
не выдержал
Текст в топе «чище»: меньше воды и тошноты, читается легче
Вода, тошнота и читабельность у топа и соседей одинаковые. Остальные различия почти целиком объясняются длиной текста
Детектор ищет машинную манеру. Чистка воды и тошноты — ритуал постарше, и для него у сайта есть второй инструмент, SEO-анализ текста. Те же страницы я прогнал через него, тоже локально и тем же движком, что работает на сайте. Целевым запросом для каждой страницы ставил тот, по которому она стоит в выдаче: так инструмент считает, насколько текст набирает вес по словам запроса. В счёт шли тексты от 100 слов: 6336 страниц Google и 2747 Яндекса.
Главное для Google: вода, тошнота и читабельность позиций не объясняют. Водность, академическая тошнота, шаблонные обороты, средняя длина предложения и индекс Флеша у топ-20 и у позиций 21–50 одинаковые. Почти всё, что между верхом и низом всё-таки различается, объясняется длиной текста.
Все метрики SEO-анализа текста: топ-20 против позиций 21–50
| Метрика | Ориентир инструмента | Топ-20 | 21–50 | Из 100, верх против низа | Из 100 при равной длине |
|---|---|---|---|---|---|
| Слов в тексте | — | 994 | 842 | 55,5 | — |
| Водность, % | до 31,7 | 23,7 | 23,5 | 50,5 | 49,8 |
| Классическая тошнота | по длине текста | 4,9 | 4,6 | 54,3 | 51,2 |
| Академическая тошнота, % | до 4,4 | 2,4 | 2,5 | 48,1 | 50,2 |
| Шаблонные обороты, % | до 2,9 | 0 | 0 | 50,3 | 49,7 |
| Средняя длина предложения, слов | 8,9–18,1 | 12,4 | 12,6 | 49,7 | 49,9 |
| Разнообразие лексики, % | по длине текста | 53,3 | 55,2 | 45,8 | 48,4 |
| Hapax legomena, % | по длине текста | 73,6 | 74,8 | 45,9 | 48,8 |
| Индекс Флеша | от −18,2 | 4,4 | 3,7 | 50,8 | 50,4 |
| Проверяемых чисел на 100 слов | от 0,9 | 6,2 | 5,7 | 51,3 | 51,5 |
| BM25: вес слов запроса, % потолка | — | 73,0 | 70,7 | 52,9 | 50,6 |
Типичные значения страниц топ-20 и позиций 21–50 Google, тексты от 100 слов, 2767 и 3569 страниц. «Из 100, верх против низа» — в скольких парах «страница топ-20 и страница ниже» значение больше у верхней. «При равной длине» — то же, но пары составлены из страниц одинаковой длины. Слова посчитаны анализатором по его разбору страницы, поэтому числа отличаются от объёма основного текста выше в статье.
В топе тексты длиннее: 994 слова против 842. У длинного текста механически ниже разнообразие лексики, потому что слова начинают повторяться, и выше классическая тошнота: самое частое слово встречается больше раз. Сравните страницы одинаковой длины, и все эти различия сходятся к 48–52 из 100, почти к 50.
Похоже на текстовый сигнал только одно: вес слов запроса по BM25. У топ-20 он чуть выше, 73% потолка против 71%, и перевес виден даже у страниц одного сайта: у 308 сайтов верхняя страница набирает больше веса, у 245 меньше. Но у текстов одинаковой длины разница почти пропадает, до 50,6 из 100. Длинный текст просто чаще повторяет слова запроса.
Вердикт инструмента тоже не различает верх и низ. По шести основным метрикам 81,8% страниц топ-20 проходят без единого «нужно исправить», у позиций 21–50 таких 83,1%.
Зато прогон нашёл проблему в самом инструменте: привычные нормы читаемости к выдаче не подходили. По ним «нужно исправить» получала почти вся выдача: индекс Флеша ниже 25 у 91% страниц из первых пятидесяти мест, LIX выше 55 у 96%, длинных слов больше 40% у 97%. В топ-20 и ниже доли одинаковые. Похоже, для плотного SEO-текста с терминами, названиями и цифрами эти нормы были слишком строгими. По этим данным я пересчитал ориентиры инструмента, об этом ниже.
В Яндексе метрики текста разделяют верх заметнее. В первой десятке слова запроса набирают больше веса по BM25: 73,3% потолка против 69,2%. Перевес держится и по отдельным запросам, 110 выдач против 50, и внутри одного сайта, 80 сайтов против 50. Имён собственных наверху тоже больше, 8,4 на 100 слов против 6,8, но внутри сайта эта разница не держится. Сходится с тем, что полный ключ в title и description в Яндексе до сих пор чаще стоит наверху.
Закономерность по типу запроса
Сильнее, чем от места в выдаче, метрики текста зависят от того, какой это запрос. Транзакционные страницы короче и суше, информационные длиннее и водянистее. Это разведка: разрез я придумал после данных.
Метрики текста по классу запроса: все значения
| Класс запроса | Запросов | Слов в тексте | Водность, % | Академическая тошнота, % | Чисел на 100 слов | BM25, % потолка |
|---|---|---|---|---|---|---|
| Коммерческие | 83 | 906 | 23,0 | 2,5 | 6,7 | 69,5 |
| Транзакционные | 28 | 753 | 19,6 | 3,8 | 12,8 | 61,7 |
| Информационные | 30 | 1068 | 26,6 | 1,8 | 2,9 | 79,2 |
| Смешанные | 18 | 909 | 24,8 | 2,3 | 4,5 | 79,0 |
Google, позиции 1–50, тексты от 100 слов, типичные значения. Класс запроса записан в картах интента до оценки документов.
Транзакционная страница с ценами и характеристиками набирает 12,8 числа на 100 слов и 3,8% академической тошноты: похоже, названия товара и слова запроса стоят в ней плотнее. Информационная статья разбавляет их пояснениями, отсюда 26,6% воды и 2,9 числа на 100 слов. Поэтому сравнивайте водность и тошноту со страницами того же типа запроса. Общая норма здесь мало что говорит.
Калибровка: новые ориентиры SEO-анализа текста
Прежние ориентиры инструмента были редакторскими: так пишут в учебниках и чек-листах. Теперь они сняты с выдачи. Я взял из этого замера 5464 текстовые страницы, то есть страницы, где связный текст занимает не меньше 40% объёма: 3848 из Google и 1616 из Яндекса. «В норме» теперь значит «как у девяти страниц выдачи из десяти». «Нужно исправить» инструмент ставит, только если текст выходит за границу, за которой лежат 5% страниц выдачи.
Классическая тошнота, разнообразие лексики, hapax, энтропия и размах длин предложений сильно зависят от длины текста. У них ориентиры свои для текстов до 500 слов, от 500 до 1500 и длиннее.
Прежние и новые ориентиры инструмента: таблица
| Метрика | Было: в норме | Стало: в норме | Стало: нужно исправить | «Нужно исправить» у страниц выдачи: было → стало |
|---|---|---|---|---|
| Водность, % | до 40 | до 31,7 | выше 33,4 | 0% → 5% |
| Классическая тошнота | до 7 | до 4,6 / 6,3 / 9,4 | выше 5,6 / 7,1 / 11,7 | 4% → 5% |
| Академическая тошнота, % | до 9 | до 4,4 | выше 5,8 | 0,6% → 5% |
| Шаблонные обороты, % | до 15 | до 2,9 | выше 4,2 | 0,1% → 5% |
| Средняя длина предложения, слов | 10–20 | 8,9–18,1 | меньше 7,2 или больше 35,4 | 4% → 5% |
| Разнообразие лексики, % | от 40 | от 51,5 / 46,3 / 34,9 | ниже 43,0 / 40,5 / 25,6 | 3% → 5% |
| Индекс Флеша | от 40 | от −18,2 | ниже −28,2 | 94% → 5% |
| LIX | до 45 | до 80,9 | выше 85,6 | 98% → 5% |
| Длинных слов, % | до 30 | до 64,9 | выше 67,4 | 99% → 5% |
Три значения через косую черту — для текстов до 500 слов, от 500 до 1500 и от 1500 слов. MATTR, hapax, энтропия, ритм, размах длин, повтор 3-грамм, числа, имена собственные и пассив пересчитаны по тому же правилу. Доли «нужно исправить» посчитаны по тем же 5464 текстовым страницам. По тем же нормам считаются рекомендации сервера и балл «Текст» в полном SEO-аудите сайта.
У такого правила есть цена: основные метрики стали строже. По прежним ориентирам без единого «нужно исправить» по шести основным метрикам проходили 92% текстовых страниц выдачи, по новым — 80%. Зато вердикт больше не ругает то, что есть почти у всей выдачи: низкий индекс Флеша и длинные слова.
Второе изменение в инструменте: рядом с каждой метрикой он теперь показывает, где текст стоит среди страниц выдачи и какое значение у типичной страницы.
Эталон: типичные значения SEO-анализа текста на страницах выдачи
Как и с детектором, это справка, чтобы сверять свой текст. Таблица в блоке ниже посчитана по тем же текстовым страницам, что и новые ориентиры, поэтому числа совпадают с тем, что покажет SEO-анализ текста.
Все метрики SEO-анализа текста: типичные значения выдачи
| Метрика в инструменте | Ориентир инструмента | Google, типичная страница | Google, средняя половина | Яндекс, типичная страница | Яндекс, средняя половина |
|---|---|---|---|---|---|
| Слов в тексте | — | 949 | 570…1510 | 1085 | 640…1648 |
| Водность, % | до 31,7 | 25,6 | 22,0…28,9 | 25,5 | 21,9…29,0 |
| Классическая тошнота | по длине текста | 4,5 | 3,5…5,7 | 4,6 | 3,6…5,7 |
| Академическая тошнота, % | до 4,4 | 2,1 | 1,5…3,0 | 1,9 | 1,4…2,8 |
| Шаблонные обороты, % | до 2,9 | 0 | 0…1,4 | 0 | 0…1,2 |
| Средняя длина предложения, слов | 8,9–18,1 | 12,1 | 10,3…14,5 | 12,0 | 10,2…14,4 |
| Разнообразие лексики, % | по длине текста | 56,4 | 50,0…62,8 | 55,5 | 49,1…61,1 |
| MATTR, % | от 80,7 | 91,5 | 87,7…93,7 | 91,4 | 87,7…93,5 |
| Burstiness | от 0,49 | 0,76 | 0,58…1,04 | 0,80 | 0,60…1,09 |
| Повтор 3-грамм, % | до 10,0 | 2,5 | 1,2…4,8 | 2,7 | 1,4…5,2 |
| Индекс Флеша | от −18,2 | 4,3 | −6,0…13,3 | 5,6 | −5,4…14,1 |
| LIX | до 80,9 | 69,8 | 65,2…75,0 | 69,1 | 64,6…74,7 |
| Длинных слов, % | до 64,9 | 57,3 | 53,5…61,3 | 56,9 | 52,9…60,7 |
| Проверяемых чисел на 100 слов | от 0,9 | 4,2 | 1,9…8,2 | 4,5 | 2,3…8,1 |
| Имён собственных на 100 слов | от 1,3 | 4,5 | 2,4…8,4 | 5,0 | 2,5…9,0 |
| Пассив, % предложений | до 26,2 | 14,0 | 8,9…20,3 | 13,3 | 8,5…19,2 |
Текстовые страницы: от 150 слов связного текста, и связный текст занимает не меньше 40% страницы; тексты от 100 слов. Google — 3848 страниц, позиции 1–50; Яндекс — 1616 страниц, позиции 1–10 и нечётные 31–49. Ориентир — новая граница «в норме» в инструменте. У классической тошноты и разнообразия лексики он зависит от длины текста, значения — в таблице выше.
Читается это так. Типичная текстовая страница выдачи — около тысячи слов, воды около 26%, академической тошноты около 2%, предложения по 12 слов. Индекс Флеша у неё около 4–6: для SEO-текста в выдаче это обычное значение.
Итог по тексту: два SEO-ритуала подряд, «Google наказывает ИИ-текст» и «чистим воду и тошноту», на этой выдаче позиций не объяснили. Остаётся то, что лежит под текстом: код, вес и скорость страницы.
Техничка: топ тяжелее, но это свойство сайта
выдержал проверки
Лёгкая и быстрая страница стоит выше
Наверху страницы крупнее, а сервер отвечает так же. Разница по размеру в основном между разными сайтами
Если верить привычным техническим рекомендациям, наверху должны стоять лёгкие и быстрые страницы. Данные спорят с этим с первого же графика: верхние страницы тяжелее. Сервер у них отвечает так же, как у соседей снизу, а сам документ крупнее.
Но есть подвох. Стоит сравнить между собой две страницы одного сайта, и почти вся эта разница исчезает. Большой HTML оказался побочным признаком крупных сайтов с тяжёлыми шаблонами, и растить его ради позиций незачем.
Техничку я снял тем же аудитом, что в замере Яндекса: Site Audit Pro прошёл по каждому адресу выдачи и записал около сотни полей. В счёт пошли 5753 страницы Google, которые отдали код 200 и настоящее содержимое: 2469 из топ-20 и 3284 с позиций 21–50. По размеру картина повторяет Яндекс, только мягче.
Ровно держится до двадцатого места. После границы начинается спуск.
Спускается с первого места. На границе двадцатки отдельной ступеньки нет.
Медианы по полосам позиций Google, Москва, 14.09.2026. Охват темы — доля тематических слов запроса на странице, 5964 страницы с текстом. Размер HTML — 5753 страницы. Шкалы начинаются не с нуля, чтобы была видна форма кривой. Терракотовым отмечены полосы топ-20.
Документ легчает ровно, место за местом, без скачка на границе двадцатки. У тематического покрытия и FAQ картина другая: там перелом приходится ровно на третью страницу выдачи.
Сама связь слабая. По шкале от −1 до 1, где ноль значит «связи нет», здесь выходит −0,122, почти ноль. Верх от низа по размеру отличить можно, место конкретной страницы по нему не угадаешь. Минус стоит потому, что у верхних мест номера меньше.
Чем верх отличается от низа, а чем нет
В аудите 49 числовых полей. Если проверить полсотни признаков, пара-тройка разниц найдётся чисто случайно, поэтому я делал поправку на число проверок. После неё разница держится у двадцати одного поля, и почти все они про одно: сколько на странице всего. Слов, узлов, картинок, ссылок, призывов к действию, блоков разметки.
Числовые признаки аудита: медианы топ-20 и позиций 21–50
| Признак, медиана | Топ-20 | 21–50 | AUC [95% ДИ] |
|---|---|---|---|
| Слов на всей странице | 1697 | 1434 | 57,2 [55,8; 58,6] |
| Уникальных слов | 848 | 729 | 56,6 [55,2; 58,0] |
| DOM-узлов | 1455 | 1218 | 56,5 [55,1; 57,8] |
| Размер HTML, КБ | 246 | 207 | 56,0 [54,7; 57,4] |
| Картинок | 37 | 29 | 55,8 [54,5; 57,2] |
| Ссылок на странице | 176 | 144 | 55,8 [54,0; 57,4] |
| Элементов призыва к действию | 15 | 12 | 55,8 [54,4; 57,2] |
| Объектов микроразметки | 5 | 4 | 54,1 [52,6; 55,6] |
| Списков | 19 | 17 | 53,9 [52,2; 55,4] |
| Файлов JavaScript | 12 | 12 | 50,9 [49,4; 52,5] |
| Файлов CSS | 6 | 5 | 51,0 [49,4; 52,7] |
| Блокирующих скриптов | 2 | 2 | 49,8 [48,3; 51,4] |
| Время ответа сервера, мс | 606 | 601 | 49,8 [48,4; 51,0] |
| Разнообразие слов | 0,515 | 0,534 | 45,3 [43,8; 46,7] |
| Доля шаблонного текста, % | 1,5 | 1,6 | 46,0 [44,6; 47,5] |
AUC — та же шкала «из 100», 50 означает случайный выбор. Выше 50 признак больше у топ-20, ниже 50 — у позиций 21–50. Разнообразие слов — доля уникальных слов в тексте. У длинных текстов она ниже сама собой, поэтому 45,3 не значит, что наверху пишут беднее.
Почти все различия сводятся к одному: страницы наверху крупнее и сложнее, по объёму на 16–28%. А число скриптов, файлов стилей и скорость сервера верх от низа почти не отличают.
Время ответа в топ-20 даже на пять миллисекунд больше, это меньше процента от 606 мс. Первые места тоже не отвечают заметно быстрее последних (550 мс на местах 1–3, 618 на 11–20, 608 на 41–50).
Проверка по запросам: в скольких выдачах верх крупнее
| Признак | Верх больше | Верх меньше | p |
|---|---|---|---|
| Слов на всей странице | 128 | 32 | < 0,001 |
| DOM-узлов | 121 | 39 | < 0,001 |
| Картинок | 110 | 49 | < 0,001 |
| Размер HTML | 108 | 52 | < 0,001 |
| Файлов JavaScript | 80 | 71 | 0,52 |
| Время ответа сервера | 80 | 80 | 1,0 |
Счёт по 160 запросам: в скольких выдачах у типичной страницы топ-20 признак больше, чем у позиций 21–50, и в скольких меньше. Ничьи не считаются. Если бы разницы не было, счёт выходил бы примерно ровным, как 80 на 80 у времени ответа.
Перевес по размеру держится в большинстве выдач, его не делают две-три гигантские страницы. По словам, узлам, картинкам и размеру HTML топ-20 крупнее соседей снизу в двух третях запросов и чаще. По скриптам и времени ответа выходит ничья.
Что стоит на страницах топ-20 чаще
Ещё 33 признака устроены по принципу «есть или нет». После той же поправки на число проверок разница держится у шести, и все шесть маленькие: от 2,5 до 5,1 процентного пункта.
Признаки «есть или нет»: доли страниц и поправка на число проверок
| Признак | Топ-20 | 21–50 | Разница, п. п. | После поправки |
|---|---|---|---|---|
Есть подсказки preload | 44,6% | 39,5% | +5,1 | держится |
| Есть разметка Schema.org | 61,9% | 57,4% | +4,6 | держится |
| Есть картинки WebP или AVIF | 25,8% | 22,0% | +3,7 | держится |
| Ошибки в микроразметке | 14,6% | 11,8% | +2,8 | держится |
| Блок FAQ по разметке аудита | 8,2% | 5,4% | +2,8 | держится |
| HTML тяжелее 1 МБ | 9,1% | 6,6% | +2,5 | держится |
| Хлебные крошки | 78,9% | 76,0% | +2,9 | не держится |
| Canonical отсутствует | 21,8% | 24,4% | −2,6 | не держится |
| Иерархия заголовков без пропусков | 62,5% | 60,0% | +2,5 | не держится |
| Заголовок HSTS | 34,7% | 32,2% | +2,4 | не держится |
| Заголовок CSP | 16,6% | 14,3% | +2,3 | не держится |
| Open Graph | 76,8% | 74,6% | +2,1 | не держится |
| Смешанный контент | 28,0% | 25,9% | +2,1 | не держится |
| Отдаёт Last-Modified | 29,4% | 27,5% | +1,9 | не держится |
| Ровно один H1 | 93,8% | 92,0% | +1,8 | не держится |
| Кэширование включено | 76,1% | 74,5% | +1,7 | не держится |
| Картинки без alt | 44,3% | 43,2% | +1,1 | не держится |
| Тег main | 41,4% | 41,0% | +0,4 | не держится |
| Контент зависит от JS | 93,8% | 93,2% | +0,7 | не держится |
| Сжатие ответа | 97,7% | 98,2% | −0,6 | не держится |
| Индексируемая | 99,4% | 99,4% | +0,1 | не держится |
«Держится» — разница пережила поправку на число проверок. Она нужна потому, что из 33 проверок при обычном пороге 0,05 одна-две прошли бы и без всякой связи. Без поправки разница «нашлась» бы ещё у хлебных крошек, отсутствия canonical, canonical на себя, CSP и ровно одного H1. Как именно считал, описано в методологии.
Картина та же, что в Яндексе: наверху одновременно аккуратнее и грязнее. Там чаще стоят preload, Schema.org и современные форматы картинок, но чаще встречаются ошибки в микроразметке и документы тяжелее мегабайта. Сильный сайт в Google тоже бывает неряшливым. А всё, что аудит обычно красит красным, от canonical до alt и HSTS, верх от низа не отличает.
Сводные баллы аудита о месте тоже почти ничего не говорят. Балл здоровья страницы у обеих групп одинаковый, 79,9. Балл качества HTML у топ-20 чуть выше, 87,5 против 85, но после поправки на число проверок эта разница может оказаться случайностью.
Балл скорости у топ-20 даже ниже: 78,6 против 82, или 46,4 из 100. Причина простая: движок снимает этот балл за размер документа, а наверху документы крупнее. Показывать клиенту такой балл как оценку шансов в выдаче нельзя.
Внутри одного сайта
Теперь обещанный подвох. На этой проверке в замере Яндекса развалилась почти вся техническая картина. Посмотрим, устоит ли она в Google. Беру сайты, у которых есть страницы и в топ-20, и на позициях 21–50, и сравниваю их верхние страницы с их же нижними. Каждый сайт даёт один голос: разница между его типичной верхней и типичной нижней страницей.
| Признак | Между группами | Внутри сайта | Осталось | Верх больше / меньше | p |
|---|---|---|---|---|---|
| Размер HTML | +39,2 КБ | +5,8 КБ | 15% | 285 / 219 | 0,004 |
| DOM-узлов | +237 | +29 | 12% | 288 / 215 | 0,001 |
| Слов на всей странице | +263 | +47,5 | 18% | 280 / 224 | 0,014 |
| Картинок | +8 | 0 | — | 245 / 189 | 0,008 |
| Время ответа сервера | +5 мс | 0 мс | — | 252 / 252 | 1,0 |
| Файлов JavaScript / CSS | 0 / +1 | 0 / 0 | — | 94 / 83 и 64 / 78 | 0,45 и 0,28 |
| Покрытие LSI | +0,050 | +0,026 | 52% | 295 / 223 | 0,002 |
Техничка считалась по 505 сайтам со страницами в обеих группах, тематическое покрытие — по 529. «Верх больше / меньше» — у скольких сайтов верхняя страница больше нижней по признаку и у скольких меньше. «Осталось» — какая часть разрыва между группами сохраняется внутри одного сайта: 5,8 КБ из 39,2 — это 15%.
Настолько HTML верхней страницы тяжелее нижней. Внутри одного сайта от разрыва между сайтами остаётся 15%.
Не устояла.
Направление, правда, сохранилось: верхняя страница сайта чаще крупнее его же нижней, и случайностью такой счёт не объяснить. Но от самой разницы осталась шестая-восьмая часть. По серверу и подключениям остался ровно ноль, они у страниц одного сайта общие.
Выходит, технический размер в основном принадлежит площадке: шаблону, CMS, числу блоков на странице. Большой HTML у лидеров пришёл вместе с сайтом, и тяжелить свою страницу вслед за ними незачем.
Пятьсот с лишним сайтов в одной таблице остаются абстракцией. Две пары страниц понятнее: вот два сайта, которые попали в выборку дважды по одному запросу, «остекление балкона под ключ».
| Страница | Место | JS / CSS | HTML, КБ | DOM | Слов | Интент | LSI |
|---|---|---|---|---|---|---|---|
okno-msk.ru — остекление балкона 3 м | 4 | 4 / 3 | 192 | 1944 | 1057 | 7 из 9 | 0,57 |
okno-msk.ru — остекление балконов и лоджий | 41 | 4 / 3 | 205 | 1978 | 511 | 6 из 9 | 0,40 |
okno.ru — балкон под ключ | 6 | 32 / 31 | 319 | 2699 | 884 | 7 из 9 | 0,54 |
okno.ru — отделка балконов и лоджий | 40 | 32 / 31 | 307 | 2717 | 1658 | 8 из 9 | 0,60 |
Техничка внутри каждой пары почти одинаковая: подключений поровну, DOM расходится на 34 и 18 узлов, HTML на 11–13 килобайт. Страницы расходятся там, где техничка заканчивается. У okno-msk.ru нижняя страница вдвое короче и беднее по теме. У okno.ru наоборот: нижняя длиннее и полнее, но она про отделку балконов, а человек ищет остекление. Выше стоит та страница сайта, которая сделана под этот запрос.
Две пары ничего не доказывают. Зато они показывают, где искать разницу между страницами одного сайта: в тексте и в том, под какой запрос страница сделана.
Сервер, сеть и robots.txt
Может, верх держится на инфраструктуре: HTTP/2, защите, настройках сервера? Этот слой описывает хост целиком, поэтому единица счёта здесь сайт. Сайты со страницами в обеих группах я убрал, иначе один сервер голосовал бы за оба лагеря. Осталось 1273 сайта только из топ-20 и 2102 только с позиций 21–50.
Сеть, сервер и robots.txt: доли сайтов в обеих группах
| Признак сайта | Топ-20 | 21–50 | p |
|---|---|---|---|
| HTTP/2 | 85,6% | 85,9% | 0,83 |
| Заголовок HSTS | 26,6% | 27,7% | 0,54 |
| Сжатие gzip / brotli | 93,4% / 3,0% | 91,4% / 4,3% | 0,05 / 0,09 |
| Переадресация http → https | 93,5% | 94,0% | 0,64 |
| Мягкий 404: несуществующий адрес отдаёт 200 | 2,7% | 2,8% | 0,90 |
| Сервер nginx | 71,9% | 73,2% | 0,47 |
| Защита DDoS-Guard / Qrator | 11,3% / 3,0% | 9,5% / 1,9% | 0,14 / 0,07 |
| Cloudflare | 0,6% | 1,5% | 0,02 |
| IPv6 | 0,1% | 0,0% | 0,19 |
Clean-param в robots.txt | 54,2% | 45,6% | < 0,001 |
Блок User-agent: Yandex | 51,6% | 45,5% | 0,002 |
Директива Host | 36,5% | 39,1% | 0,18 |
Crawl-delay | 9,9% | 9,1% | 0,46 |
| Sitemap указан в robots.txt | 92,6% | 90,9% | 0,12 |
| Правила для AI-ботов | 5,2% | 5,8% | 0,52 |
| Размер robots.txt, медиана | 1521 байт | 1184 байта | AUC 55,8 |
Строк Disallow, медиана | 42 | 32 | AUC 56,4 |
Замер по хосту каждого сайта. Поправки на число проверок здесь нет, поэтому из шестнадцати строк одна-две могут пройти порог 0,05 случайно.
Инфраструктура у двух групп одинаковая: HTTP/2, HSTS, переадресация на https, мягкие 404 и серверы встречаются с той же частотой. Выделяется только то, как ведут файл robots.txt. Наверху чаще стоит Clean-param (директива, которая сообщает Яндексу, какие параметры адреса не меняют содержимое страницы) и отдельный блок для Яндекса, а сам файл крупнее и правил в нём больше. Обе директивы адресованы Яндексу: в спецификации Google поддерживаются только user-agent, allow, disallow и sitemap. Google их не читает. Поэтому совпадение с его топом похоже на след: если robots.txt кто-то регулярно правит, сайт обслуживают и в остальном.
Сколько технической грязи на странице
Чеклист обещает: уберите ошибки, и обгоните конкурента. Проверяю это так же, как в Яндексе. Беру пять претензий, которые выкатывает любой краулер: ошибки микроразметки, параметры в адресе, смешанный контент, картинки без alt, скрытый контент. И считаю, сколько их на одной странице.
страниц топ-20 живут хотя бы с одной типовой претензией краулера и всё равно стоят в топе
Без единой претензии: 19,6% страниц топ-20 и 22,7% страниц ниже двадцатого места.
Точные доли: сколько претензий на странице
| Претензий на странице | Топ-20 | 21–50 |
|---|---|---|
| ни одной | 19,6% | 22,7% |
| одна | 39,2% | 39,3% |
| две | 30,5% | 28,0% |
| три и больше | 10,7% | 10,0% |
Если представить топ Google выпускным классом SEO-аудита, отличников в нём мало, и на первых партах их даже меньше, чем на последних.
С коридорами то же, что в Яндексе. Коридором я называю диапазон, в котором лежит средняя половина страниц топ-20 по признаку: четверть топа ниже него, четверть выше. Во все шесть технических коридоров сразу (размер HTML, DOM, скрипты, стили, картинки и время ответа) попадает примерно одна страница топ-20 из двадцати, 4,7%. Ниже двадцатки таких 3,5%. Технически «идеальная» страница — редкость и наверху, и внизу.
Время ответа сервера по нишам
| Ниша | Топ-20 минус 21–50 | AUC |
|---|---|---|
| Окна | −66 мс | 44,6 |
| Недвижимость | −39 мс | 47,7 |
| Ремонт | −36 мс | 47,5 |
| Товары для дома | −34 мс | 49,5 |
| Общепит | −23 мс | 50,0 |
| Образование | −12 мс | 49,9 |
| Стройматериалы | −2 мс | 49,3 |
| Финансы | +4 мс | 48,3 |
| IT-услуги | +8 мс | 50,4 |
| Автосервис | +14 мс | 50,1 |
| Бытовая техника | +26 мс | 48,4 |
| Красота | +27 мс | 51,3 |
| Спорт | +35 мс | 49,9 |
| Юруслуги | +38 мс | 50,4 |
| Медицина | +46 мс | 53,3 |
| Туризм | +62 мс | 53,0 |
В семи нишах топ-20 отвечает быстрее, в девяти медленнее. Самый заметный перекос в окнах, 66 мс, но и там 44,6 из 100, недалеко от 50.
Тип страницы и совпадение с интентом
не выдержал
Если технически страницы одного сайта почти одинаковы, чем тогда объясняется разница между ними? Первым просится тип страницы. Под «купить» нужен каталог, под «как выбрать» — статья. На эту гипотезу я ставил больше, чем на любую метрику покрытия: страница нужного запросу типа должна стоять выше.
Проверить её в задуманном виде не вышло. В картах интента, которые я записал до оценки первого документа, есть только класс запроса: коммерческий или информационный. Какой тип страницы нужен запросу, там не сказано. Поэтому ниже замена, придуманная уже после данных: класс запроса против типа страницы, который определил слепой оценщик.
Доля документов слепой оценки Google, стоящих в топ-20, по типу страницы. Смешанные запросы исключены. В выборке верх и низ поровну, поэтому база около 50%.
Ставка не сыграла. Четыре страницы из пяти подходят под класс запроса и в топ-20, и на позициях 21–50: 79,8% против 77,8%. Такую разницу легко получить случайно (51,0 из 100, p = 0,34). Подходящий тип внутри первых пятидесяти мест есть почти у всех, поэтому верх от низа он не отличает. Что происходит за пятидесятым местом, замер не видел.
В Яндексе расчёт дал почти то же, 81,4% против 80,9%, но там выделяется один тип: агрегаторы стоят в топ-10 в 66,2% случаев (71 документ). В Google у агрегаторов 51,0%, ровно по базе.
Сколько интентов и LSI нужно для топ-20
Тип страницы верх от низа не отличает, значит, остаётся содержание. А любой бриф на текст рано или поздно упирается в число. Сколько вопросов пользователя закрыть и сколько тематических слов добавить, чтобы страница хотя бы вошла в двадцатку? Если такой порог есть, в данных он выглядит как ступенька: ниже неё страницы в топ-20 почти не попадают, выше — попадают заметно чаще.
Ступеньки нет.
Ни по числу закрытых вопросов, ни по тематическому покрытию. Но ведут себя эти величины по-разному. Закрытые вопросы почти до самого верха долю в топе не сдвигают. Тематическое покрытие поднимает её плавно, полоса за полосой.
Разрезы и пороги в этом разделе я выбирал, когда уже видел данные, так что это разведка.
Полнота интента: ровно до самых полных страниц
Доля составляющих, раскрытых полностью, и доля документов этой полосы, стоящих в топ-20. 1228 документов слепой оценки Google. У последней полосы документов мало, и её перевес может оказаться случайным (интервал [49,4; 69,3] захватывает 50).
Если считать закрытые вопросы штуками, картина та же. Пока страница полностью раскрывает до шести составляющих, доля в топе держится около половины: 49,8%, 46,9% и 52,3% для полос «0–2», «3–4» и «5–6». Заметный плюс есть только у страниц, закрывших семь и больше, — 55,6%.
Это единственная полоса, где перевес не похож на чистую случайность. Но и он на грани: даже осторожная оценка почти совпадает со средним по выборке, 50,7% (интервал [50,6; 60,5]).
Охват темы: ровный подъём
Все 5964 страницы Google с посчитанным покрытием, позиции 1–50. База — доля страниц топ-20 в этом наборе. Она ниже 50%, потому что страниц с позиций 21–50 с посчитанным покрытием больше: 3342 против 2622. У верхней полосы интервал [48,6; 54,0], у нижней [35,8; 41,8].
У тематического покрытия высокой ступеньки тоже нет, зато есть пологая лестница. Чем больше тематических слов выдачи есть на странице, тем чаще она стоит в топе, и так на каждой полосе. Страница, на которой нашлось 70% списка и больше, встречается в топ-20 на треть чаще страницы, где их меньше 30%: 51,3% против 38,6%.
Эта разница держится: даже с учётом разброса крайние полосы не сходятся. Каждые десять пунктов покрытия добавляют к доле в топе от 0,9 до 5,8 пункта.
Считать от типичной страницы своей выдачи
Абсолютные пороги плохо переносятся между запросами. Для «туров в Турцию» страница, которая раскрыла половину вопросов, слабая. Для узкого коммерческого запроса с тремя составляющими — нормальная. Поэтому я сравнил каждую страницу с медианой её же выдачи, то есть с типичной страницей по этому запросу: полнее она соседей или слабее.
в топ-20. Страница не полнее типичной в своей выдаче ни по вопросам, ни по охвату темы. 505 документов, интервал [42,7; 50,0]
в топ-20. Полнее типичной страницы либо по вопросам, либо по охвату темы. 401 документ
в топ-20. Полнее типичной страницы и по вопросам, и по охвату темы. 322 документа, интервал [51,5; 61,3]
По отдельности каждый признак ведёт себя так же. Страницы, которые отвечают на вопросы полнее соседей по выдаче, стоят в топ-20 в 55,0% случаев, слабее соседей — в 47,5% (интервалы [51,1; 59,0] и [44,1; 51,3]). По тематическому покрытию: выше типичной страницы запроса — 47,9%, ниже — 40,5% при базе 44,0%.
Вопросы пользователя. Составьте список вопросов, которые стоят за запросом, и проверьте по нему страницы топ-20: сколько вопросов каждая раскрывает полностью. Ваша страница должна закрыть не меньше, чем типичная из них. Для ориентира: у типичной страницы топ-20 Google закрыто 5 составляющих из 10, у верхней четверти — 6, у верхней десятой части — около 8.
Тематическое покрытие. Соберите тематические слова по той же выдаче и посчитайте, какая доля списка есть у каждого соседа. Типичная страница топ-20 содержит около 56% списка, верхняя четверть — от 70%. Смотрите, каких тем из списка у вас нет, и закрывайте их разделами. Слово, вставленное ради процента, тему не раскрывает.
Где остановиться. Страница, которая обходит соседей и по вопросам, и по темам, стоит в топ-20 на 10 пунктов чаще той, что отстаёт по обоим. Это вся прибавка, которую удалось измерить. Выше покрытия 70% полосы я не дробил, так что о пользе дописывания сверх этого данных нет. Даёт ли раскрытие вопросов что-то сверх тематического покрытия, замер отдельно не проверял. Если страница уже полнее выдачи по обоим признакам, следующий резерв ищите в ссылках, бренде и коммерческих свойствах.
Для сравнения Яндекс. Там закрытые вопросы не связаны с попаданием в топ-10 ни в одном разрезе: доля в топе по полосам полноты скачет около половины без всякого направления (51,7%, 52,3%, 49,2%, 47,1% и 50,0%). Верхняя полоса тематического покрытия и в Яндексе выше базы: при покрытии 70% и выше в топ-10 стоят 58,2% страниц, ниже 30% — 47,2% при базе 48,8%. Но ровного подъёма там нет, средние полосы проседают до 39,6%.
Прежде чем нести эти доли в бриф, одна оговорка. Эксперимента я не ставил, это взгляд на выдачу со стороны. Полная страница может чаще стоять в топе просто потому, что её делают сильные команды на сильных сайтах. Поднимет ли дописывание именно вашу страницу, покажет только правка собственных страниц. И доля в топе здесь не равна шансу попасть туда: выборка собрана поровну из верха и низа выдачи.
Составляющие, которые не закрыл никто
Раз страница, которая обходит соседей, чаще стоит в топе, дешевле всего обходить их там, где соседи не ответили вообще. По каждой составляющей я проверил, раскрыл ли её полностью хоть один проверенный документ этого запроса, из Google или из Яндекса.
составляющих, 9,5%. Ни один проверенный документ не ответил на них полностью
составляющих, включая эти 146, раскрыты полностью меньше чем у 15% документов своего запроса
запросов, во всех шестнадцати нишах
| Запрос | Что осталось без ответа |
|---|---|
| секция единоборств для детей | требования к медицинской справке для допуска к занятиям |
| компьютерная диагностика автомобиля | бесплатная диагностика |
| замена масла в двигателе стоимость | объём масла для замены |
| купить квартиру в новостройке москва | сравнение новостройки и вторичного жилья |
| лечение кариеса стоимость | лечение по ОМС |
| мультиварка или скороварка что лучше | сравнение с аэрогрилем |
На запрос я проверял до двенадцати документов, так что где-то на пятидесятом месте ответ может найтись. Для работы это мало что меняет: проверенные страницы топа на эти вопросы не отвечают.
Перед тем как закрывать такую дыру, убедитесь, что вопрос относится к вашей странице. «Сравнение с аэрогрилем» на странице про выбор между мультиваркой и скороваркой может оказаться лишним.
Дыры нашлись во всех шестнадцати нишах. Но значит ли это, что текст везде работает одинаково?
В какой нише что работает
Всё, что было выше, посчитано по шестнадцати нишам вместе, а средняя цифра умеет прятать исключения. Поэтому первый вопрос SEO-специалиста к такому замеру понятен: а в моей нише так же? Почти везде да. Охват темы отделяет топ-20 от страниц ниже в пятнадцати нишах из шестнадцати. Сила разная: сильнее всего разрыв в спорте, слабее всего в стройматериалах. А в юридических услугах страницы наверху по охвату темы от страниц ниже не отличаются совсем.
В скольких парах из 100 страница топ-20 охватывает тему шире, чем страница с позиций 21–50. Google. Полоса показывает, насколько число ушло от 50. Тёмным — две ниши, где охват темы топ почти не отделяет.
Почему в стройматериалах и туризме охват темы работает слабо, подсказывает соседний столбец с весом страницы. Ниши, где топ выделяется тяжёлым HTML, и ниши, где он выделяется текстом, почти не пересекаются.
| Ниша | LSI, AUC | Полнота интента, AUC | Δ HTML, КБ |
|---|---|---|---|
| Спорт | 62,1 | 59,8 | +7 |
| Бытовая техника | 58,9 | 44,0 | +9 |
| Медицина | 58,3 | 51,9 | +47 |
| Автосервис | 58,0 | 60,7 | +50 |
| Товары для дома | 57,5 | 61,0 | +115 |
| IT-услуги | 57,2 | 54,1 | +23 |
| Ремонт | 57,0 | 45,0 | +16 |
| Красота | 55,5 | 55,0 | −10 |
| Общепит | 55,2 | 54,4 | +62 |
| Образование | 54,8 | 52,6 | +30 |
| Окна | 53,9 | 55,9 | +111 |
| Недвижимость | 53,9 | 56,2 | +39 |
| Туризм | 53,1 | 54,8 | +163 |
| Финансы | 51,9 | 44,0 | +39 |
| Стройматериалы | 51,3 | 41,7 | +124 |
| Юруслуги | 48,9 | 52,9 | +20 |
Δ HTML — насколько типичная страница топ-20 тяжелее типичной страницы с позиций 21–50 (разница медиан). На нишу приходится около 370 страниц для тематического покрытия и технички, но только около 80 документов, которые оценщик читал вслепую. Поэтому в столбце полноты цифры прыгают сильнее всего.
В спорте топ выделяется текстом. Верхняя страница пары здесь заметно чаще охватывает тему шире и полнее отвечает на вопросы пользователя, а HTML у неё тяжелее, чем у соседей снизу, всего на 7 КБ.
В стройматериалах и туризме картина обратная. Страницы наверху тяжелее на 124 и 163 КБ, а по охвату темы верх от низа почти не отличить. В стройматериалах страницы ниже двадцатого места даже полнее отвечают на вопросы, чем страницы топа.
Это ниши каталогов и агрегаторов. Среди проверенных страниц топ-20 они занимают 65% в стройматериалах и 49% в туризме. Для сравнения: в медицине 5%, в юруслугах 2%. По запросу «керамогранит для пола купить» наверху стоят каталоги Петровича и магазинов плитки, где основного текста 190–290 слов. Выдача по «турам в Турцию» из начала статьи устроена так же.
Сходится ли это с Google, Backlinko и Ашмановым
До этого места я спорил с чеклистом в одиночку, а свой замер легко принять за закон поиска. Поэтому я посмотрел, кто ещё проверял те же пункты и что у них вышло. Google публично перечисляет, на что не стоит тратить время. Backlinko вместе с Ahrefs проверял на 11,8 млн результатов Google, что идёт вместе с высокой позицией. Лаборатория поисковой аналитики «Ашманов и партнёры» сравнивала текстовые факторы Яндекса и Google.
Считали все по-разному, рынок другой, так что цифры в лоб не сравнишь. Зато можно сравнить, в какую сторону указывают выводы. Где они совпали, вывод держится не только на моих данных.
- Что это
- Руководство по SEO для начинающих, раздел «Things we believe you shouldn't focus on»
- Что пишут
- «The length of the content alone doesn't matter for ranking purposes». Про число и порядок заголовков: «from Google Search perspective, it doesn't matter if you're using them out of order». Переспам ключами противоречит правилам
- Как соотносится
- Сходится. Возьмите две страницы с одинаковым охватом темы, и объём текста перестаёт что-то объяснять. Плотность ключа даёт 49,2 из 100, почти 50. Подзаголовков H2 в топ-20 больше, но, скорее всего, просто потому, что там закрыто больше тем
- Выборка
- 11,8 млн результатов Google, данные Ahrefs и Clearscope, страница обновлена 14 апреля 2025
- Что нашли
- Полный по теме контент с высоким Content Grade заметно обходил неполный. Ключ в title — «essentially zero correlation». Прямой связи числа слов с позицией нет. Размер HTML с позицией не связан
- Как соотносится
- По тексту сходится почти целиком. Их Content Grade ближе всего к моему тематическому покрытию. Расходимся по размеру HTML. У меня страницы топ-20 тяжелее, но стоит сравнить страницы одного сайта, и от разницы остаётся малая часть
- Выборка
- Информационные выборки «Косметика», «Гаджеты», «Наука» в Яндексе и Google, статья Лаборатории поисковой аналитики от 9 сентября 2024
- Что пишут
- «Значения текстовых параметров в Google ниже, но зависимость позиций от них сильнее и наблюдается чаще». Поисковики учитывают «другие слова по теме». Концентрация слов запроса в тексте «не показывает значимую корреляцию с позицией». Для title в Google корреляция с позицией «если и была, то очень слабая»
- Как соотносится
- Сходится по тематическим словам, плотности ключа и title. Сходится и вывод про поисковики: в Google текст отделяет верх сильнее, чем в Яндексе, это видно в конце статьи. Расходимся в объёме текста. У Лаборатории он «сильный параметр для ранжирования», у меня при одинаковом охвате темы объём перестаёт что-то объяснять. Разница ещё и в том, что считали: Лаборатория меряет текст страницы целиком, вместе с меню и перелинковкой, я — только основной текст
| Признак | Google, Backlinko, Ашманов | Этот замер |
|---|---|---|
| Полнота раскрытия темы | Backlinko: полный контент обходит неполный. Ашманов: учитываются «другие слова по теме» | LSI: 53,8 из 100, держится во всех проверках. Полнота интента: 52,3, но при равной длине текста перестаёт держаться |
| Ключ в title и H1 | Backlinko: связи почти нет. Ашманов: для title в Google корреляция «если и была, то очень слабая» | 50,6 и 50,0 из 100 |
| Длина текста | Google: сама по себе не важна. Backlinko: прямой связи нет. Ашманов: «сильный параметр» | 53,4 из 100, при равном покрытии LSI может оказаться случайностью |
| Размер HTML | Backlinko: связи нет | 54,5 из 100 между разными сайтами. Внутри одного сайта от разницы остаётся 15% |
| Скорость | Backlinko: связи со скоростью домена нет | Время ответа сервера 49,4 из 100 |
Итог сверки короткий. По ключу в title, плотности ключа и ширине темы мои данные и чужие указывают в одну сторону. Расхождений два: объём текста у Ашманова и размер HTML у Backlinko.
С Backlinko по размеру HTML я разошёлся и в замере Яндекса. Объяснение, скорее всего, то же. Когда считаешь по всей выдаче сразу, в одну кучу попадают разные сайты, а крупные площадки с тяжёлыми шаблонами чаще стоят наверху. Сравните две страницы одного сайта, и от разницы мало что останется. Почему у Backlinko связи нет вовсе, мои данные не объясняют.
Коридор страницы топ-20
Почти все числа до этого места — медианы и перевесы в парах. Из таких замеров чаще всего выносят одну цифру: у типичной страницы топа столько-то слов, значит, и нам нужно столько же. Но наверху стоят страницы и в разы короче типичной, и в разы длиннее.
Поэтому свою страницу полезнее сверять с разбросом. По каждому признаку ниже пять точек: где кончается самая бедная десятая часть топ-20, где лежит средняя половина страниц, где середина и где начинается самая богатая десятая часть.
Google, Москва, 14.09.2026. Покрытие LSI посчитано у 2622 страниц топ-20.
Все значения таблицей, с медианой позиций 21–50
| Признак | Край 10% | Четверть ниже | Середина | Четверть выше | Край 90% | Медиана 21–50 |
|---|---|---|---|---|---|---|
| Слов основного текста | 157 | 408 | 842 | 1480 | 2358 | 707 |
| Покрытие LSI | 0,244 | 0,391 | 0,556 | 0,700 | 0,792 | 0,506 |
| Подзаголовков H2 | 0 | 2 | 6 | 10 | 15 | 5 |
| Подзаголовков H3 | 0 | 0 | 2 | 8 | 19 | 2 |
| Списков | 0 | 0 | 10 | 26 | 53 | 9 |
| Длина title, знаков | 44 | 56 | 71 | 89 | 110 | 70 |
| Длина description, знаков | 91 | 134 | 168 | 210 | 261 | 162 |
| Плотность ключа, % | 2,0 | 3,4 | 5,2 | 7,4 | 9,6 | 5,3 |
| Полнота интента, доля на 2 | 0,167 | 0,333 | 0,500 | 0,636 | 0,778 | 0,455 |
| Раскрыто полностью, штук | 1 | 3 | 5 | 6 | 7,8 | 4 |
| Размер HTML, КБ | 81 | 141 | 246 | 504 | 959 | 207 |
| DOM-узлов | 573 | 899 | 1455 | 2419 | 4102 | 1218 |
| Картинок | 8 | 17 | 37 | 80 | 153 | 29 |
| Файлов JavaScript | 3 | 6 | 12 | 22 | 33 | 12 |
| Ответ сервера, мс | 341 | 436 | 606 | 899 | 1518 | 601 |
Разбор реальной страницы
Хватит медиан, посмотрим на одну страницу. Самый неудобный для SEO-специалиста случай выглядит так. Страница отвечает почти на всё, о чём спрашивают люди, охватывает тему шире топа, техничка в норме. А она болтается на 45-м месте.
Такую страницу я искал нарочно. Среди позиций 21–50 взял ту, что по числу полностью раскрытых составляющих сильнее всего обгоняет лучшую проверенную страницу топ-20 своего запроса. При равенстве брал ту, у которой шире охват темы, и только из страниц с техническим аудитом. Правило я придумал, уже видя список кандидатов, поэтому это пример для наглядности. Доказательством он служить не может.
Нашлась remo-nt.ru: страница услуги с ценами, 45-е место по запросу «сколько стоит ремонт однокомнатной квартиры», ниша ремонта. Прогоним её по коридору из предыдущего раздела.
Та же карта таблицей
| Признак | Страница | Коридор топ-20 | Статус |
|---|---|---|---|
| Раскрыто полностью, составляющих | 10 из 11 | 3…6 | выше края топа |
| Покрытие LSI | 0,88 | 0,391…0,700 | выше края топа |
| Слов основного текста | 2247 | 408…1480 | верхняя четверть |
| Размер HTML, КБ | 185 | 141…504 | в норме |
| DOM-узлов | 1637 | 899…2419 | в норме |
| Ответ сервера, мс | 636 | 436…899 | в норме |
| Полный ключ в title | нет | у 43% топа есть | не различает |
По тексту это лучшая страница своей выдачи из проверенных. Из одиннадцати вопросов, которые стоят за запросом, она полностью отвечает на десять. Тему охватывает шире, чем девять страниц топ-20 из десяти.
Единственное, что не раскрыто полностью, — стоимость уборки после ремонта, и та упомянута. Причём полностью про уборку не написал ни один из двенадцати проверенных документов этого запроса.
Техничка тоже в норме: вес HTML, число DOM-узлов и ответ сервера лежат внутри коридора. Придраться можно только к title. Там «1-комнатной» вместо «однокомнатной», так что полного ключа формально нет. Выходит, по карте разбора страница не дотягивает ровно в одной привычной рекомендации, и как раз в той, которая топ-20 от страниц ниже не отличает.
Тогда кто её обходит? Проверенные страницы топ-20 по тому же запросу:
| Место | Сайт | Тип | Раскрыто полностью | LSI | Слов |
|---|---|---|---|---|---|
| 4 | 169.ru | статья | 6 из 11 | 0,70 | 1165 |
| 6 | profi.ru | агрегатор | 0 из 11 | 0,03 | 356 |
| 12 | profistroy1.ru | статья | 4 из 11 | 0,59 | 5185 |
| 17 | mir-rem.ru | страница услуги | 6 из 11 | 0,87 | 7500 |
| 45 | remo-nt.ru | страница услуги | 10 из 11 | 0,88 | 2247 |
У mir-rem.ru основной текст 7500 слов, у profistroy1.ru — 5185. Оценщик читал только первые 2500 слов, так что на деле эти страницы могут отвечать на вопросы полнее, чем показано в таблице.
Самый показательный сосед — Профи.ру на шестом месте. В его основной текст попали в основном отзывы о мастерах. Полного ответа ни на один из одиннадцати вопросов там нет, а тематических слов из списка набирается три на сотню.
Оговорюсь: во всём HTML страницы около 5300 слов, и часть цен могла просто не попасть в извлечённый текст. Главного это не меняет. Агрегатор с узнаваемым брендом стоит выше страниц, которые на вопрос о цене отвечают прямо.
А страница, которая отвечает на запрос полнее всех проверенных, так и болтается на 45-м месте.
Страница отвечает на вопросы полнее типичной страницы своей выдачи и шире охватывает тему. Техничка в коридоре. Страница сделана под этот запрос, и другая страница того же сайта его не перехватывает.
Дальше данные текстовой работе ничего не подсказывают. Страницы с тематическим покрытием выше 0,7 я на группы не делил, так что о пользе дописывания сверх этого сказать нечего. Впихнуть полный ключ в title? Ключ в title топ от низа не отличает. Раздуть текст? При равном охвате темы преимущество длины может оказаться случайностью. У remo-nt.ru раскрыто 10 вопросов из 11 и покрытие 0,88, а страница стоит на 45-м месте.
Здесь текстовая работа заканчивается. Дальше вопросы другого класса. Сколько ссылок на страницу и на сайт у тех, кто выше? Что страница показывает коммерчески: цены, отзывы, гарантии, способы связи? Узнают ли бренд по брендовым запросам? Этот замер их не трогал.
Если свести все разделы в одну шпаргалку, ситуаций у страницы набирается четыре. Страница remo-nt.ru попала в клетку «Хватит переписывать текст»: сильнее соседей по обоим признакам, но не в топ-20. Для каждой из четырёх следующий шаг свой.
Что делать в четырёх ситуациях
Шпаргалка вышла заметно короче чеклиста, с которого я начинал. Ключ в title и H1, плотность ключа и время ответа сервера топ-20 Google от страниц ниже не отделили. Число слов «как у топа» отделяет, но при равном охвате темы его перевес почти исчезает. Лёгкий HTML тоже не выдержал: между сайтами топ тяжелее, а внутри одного сайта от разницы остаётся малая часть. Полнота интента отделяет топ, но слабо. Почти все проверки выдержал один текстовый пункт, охват темы выдачи. На нём матрица и держится.
На вопросы страница уже отвечает. Соберите тематические слова выдачи и допишите разделы под темы, которых нет.
в топ-20: 51,6%*Текст, похоже, уже не узкое место. Проверьте, та ли это страница сайта под запрос, потом ссылки, бренд и коммерческие свойства.
в топ-20: 56,5%. Здесь же remo-nt.ru с 45-го местаЗакройте составляющие интента и темы, которые есть у соседей по выдаче.
в топ-20: 46,3%Тема раскрыта шире соседей, а на вопросы пользователя страница отвечает хуже. Закройте недостающие составляющие интента.
в топ-20: 51,6%*Соседи — типичная страница выдачи того же запроса. Доли — сколько документов слепой оценки Google стоят в топ-20; верх и низ в выборке поровну, в среднем 50,7%. * 51,6% — обе клетки «сильнее по одному признаку» вместе. Даёт ли полнота интента что-то сверх охвата темы, я отдельно не проверял.
Та же шпаргалка таблицей
| Ситуация | Что делать |
|---|---|
| Страница слабее медианы выдачи и по интенту, и по LSI | Закрыть составляющие и темы, которые есть у соседей. В данных это связано с прибавкой: страницы слабее соседей по обоим признакам стоят в топ-20 в 46,3% случаев, сильнее по обоим — в 56,5%, в среднем по выборке 50,7% |
| Страница сильнее соседей по одному признаку | Добрать второй. Страницы, которые сильнее соседей только по одному признаку, стоят в топ-20 реже, чем сильные по обоим: 51,6% против 56,5%. Даёт ли полнота интента что-то сверх LSI, я отдельно не проверял |
| Страница сильнее соседей по обоим, но не в топ-20 | Текст закончен. Проверить, та ли это страница сайта под этот запрос, потом смотреть ссылочный разрыв, бренд и коммерческие свойства |
| Наверху каталоги крупных площадок с тяжёлыми шаблонами | Одним текстом, похоже, не обогнать: в стройматериалах и туризме LSI отделяет верх слабо, а каталоги и агрегаторы — половина и больше проверенных страниц топа. Считать ассортимент, цену, фильтры и силу сайта |
Делать
- Темы, которые раскрывают соседи по выдаче вашего запроса
- Вопросы пользователя, на которые не ответил никто из соседей
- Отдельный раздел под каждую тему
Держать в норме
- Полнота интента не ниже, чем у типичного соседа по выдаче
- Техничка в коридоре топ-20
- Контент отдаётся в HTML
- Страница сделана под этот запрос
- Понятный title под клик
Не тратить на это время
- Ключ в title, H1 и description
- Плотность ключа
- Число слов «как у топа»
- Время ответа сервера ради позиций
Google против Яндекса
Всё, что выше, снято с выдачи Google. У русскоязычного сайта есть ещё Яндекс, и сразу возникает вопрос: получится ли одна страница под оба поисковика? Сначала я посмотрел, насколько похожи сами выдачи. Те же 160 запросов я снимал в Яндексе на пять дней раньше, и без всякой статистики видно: выдачи разные.
Из десяти адресов первой страницы у двух поисковиков совпадают примерно два: в среднем 1,86, в типичной выдаче 2. В 33 выдачах из 160 общих адресов в первой десятке нет совсем. Общих доменов в типичной выдаче 3.
Граница здесь другая, чем в остальной статье. В Яндексе, как и в моём техническом замере Яндекса, я снимал только первую десятку и позиции 31–49 через одну. Чтобы сравнение было равным, Google делю так же: верх — позиции 1–10, низ — 31–49 через одну.
| Признак | Google, верх / низ | AUC | Яндекс, верх / низ | AUC |
|---|---|---|---|---|
| Полнота интента | 0,500 / 0,400 | 56,3 | 0,455 / 0,500 | 48,3 |
| Покрытие LSI | 0,564 / 0,491 | 57,6 | 0,586 / 0,533 | 55,3 |
| Слов основного текста | 858 / 660 | 56,2 | 837 / 796 | 51,5 |
| Подзаголовков H2 | 6 / 4 | 56,7 | 6 / 5 | 53,4 |
| Полный ключ в title | 43,7% / 39,9% | 51,9 | 45,8% / 36,9% | 54,4 |
| Полный ключ в description | 36,1% / 33,8% | 51,2 | 39,9% / 31,5% | 54,2 |
| Есть FAQ | 26,5% / 19,3% | 53,6 | 28,1% / 21,1% | 53,5 |
| Размер HTML, КБ | 270 / 195 | 59,5 | 384 / 238 | 62,9 |
| DOM-узлов | 1581 / 1220 | 58,7 | 1793 / 1331 | 59,9 |
| Картинок | 40 / 27 | 58,6 | 42 / 34 | 55,2 |
| Время ответа сервера, мс | 592 / 625 | 47,1 | 559 / 641 | 42,4 |
Верх / низ — значения типичной страницы (медианы) и доли. AUC — та же шкала «из 100»: в скольких парах из ста значение у страницы сверху больше, чем у страницы снизу. У времени ответа число ниже 50 значит, что наверху сервер быстрее. Google — 14.09.2026, Яндекс — 09.09.2026, Москва. Время ответа снимали в разные дни разными прогонами. Поэтому Google с Яндексом по нему не сравнить, только верх с низом внутри одного поисковика. На основной границе статьи, топ-20 против 21–50, время ответа в Google верх от низа не отличает. На границе 1–10 против 31–49 первая десятка отвечает чуть быстрее: 47,1 из 100. Интервал, в котором лежит настоящее значение, от 44,9 до 49,4, целиком ниже 50, так что этот перевес выглядит устойчивым.
Полнота интента 56,3, объём основного текста 56,2, подзаголовки 56,7 из 100. Ключ в title — всего 51,9, почти 50
Объёмы страницы: HTML 59,5, DOM 58,7, картинки 58,6
Ключ в title 54,4 и в description 54,2 из 100, быстрый ответ сервера 42,4 (ниже 50 — наверху быстрее). Полнота интента 48,3 и объём текста 51,5 — около 50
Объёмы страницы: HTML 62,9, DOM 59,9, картинки 55,2
Главных различий три.
Первое — полнота интента, то есть на сколько вопросов пользователя отвечает страница. В Google страницы первой десятки отвечают на большее их число, чем страницы с позиций 31–49. В Яндексе разницы не видно ни в одном разрезе: ни на этой границе, ни по уровням полноты, ни в сравнении с типичной страницей своей выдачи. Правда, выборка у Яндекса вдвое меньше.
Второе — ключ в title и description. Тот самый ключ, который в Google почти ничего не различал, в Яндексе ещё отделяет верх: страницы с полным ключом в этих местах до сих пор чаще стоят наверху. В Google эта разница едва заметна.
Третье — тематическое покрытие внутри одного сайта. В Google, если сравнить верхнюю и нижнюю страницы одного сайта, от разницы по покрытию остаётся половина. В Яндексе внутри сайта разницы не видно. Но сайтов для такого сравнения там всего 119, и оценка размытая: настоящая разница может оказаться в любую сторону.
То же расхождение по текстовым факторам видит Лаборатория поисковой аналитики «Ашманов и партнёры»: «Значения текстовых параметров в Google ниже, но зависимость позиций от них сильнее и наблюдается чаще».
Отдельно про агрегаторы. В Яндексе они заметно чаще стоят наверху: из проверенных агрегаторов в топ-10 попадают 66,2%. В Google на его границе, топ-20 против 21–50, таких 51,0%. Это не больше, чем у проверенных страниц в среднем.
Здесь меня могла подвести первая же выдача статьи. Остановись я на «турах в Турцию», записал бы агрегаторы в сильные стороны Google: в той выдаче агрегатор выглядел сильным. На всей выборке Google этой силы не видно. Она видна в Яндексе, и по тем же турам обе проверенные страницы его топ-10 тоже агрегаторы, 1001tur и unitours.
- Что проверяли
- Те же 160 запросов в Google и Яндексе. Верх и низ поделены одинаково: позиции 1–10 против 31–49. Списки тематических слов и карты интента одни и те же, оценка вслепую и по одним правилам.
- Что нашли
- В обоих поисковиках верх сильнее всего отличается размером страницы. Если размер отложить, в Google верх выделяется полнотой ответа и объёмом текста, в Яндексе — ключом в title и description и быстрым ответом сервера. Тематическое покрытие отделяет верх в обоих.
- Что это значит
- Одна и та же страница может быть сильной для Google и средней для Яндекса. Общее у двух поисковиков — покрытие тем выдачи.
- Что делать
- Под оба поисковика начинайте с тем выдачи и с вопросов, на которые должна ответить страница. Для Яндекса отдельно проверьте, есть ли полный ключ в title и description.
Чего этот замер не знает
Я мерил только то, что видно на самой странице: текст, разметку, техничку и то, насколько полно страница отвечает на запрос. Ссылки на страницу и на сайт, бренд, поведение пользователей, коммерческие свойства, возраст домена и мобильную выдачу я не проверял. Страница remo-nt.ru на 45-м месте намекает: всё это вместе может перевесить то, что я измерил. Продолжать я бы стал с того места, где она застряла: со ссылок, бренда и коммерческих свойств.
Сильнее всего топ-20 от позиций 21–50 отличает число слов на всей странице: 57,2 из 100. И даже он часто промахивается. Возьмите страницу из топ-20 и страницу ниже: примерно в 43 случаях из 100 слов больше как раз у нижней. Такой признак показывает, что топ-20 в целом отличается от страниц ниже. Место конкретной страницы по нему не угадать.
Все таблицы статьи описывают, чем топ-20 отличается в среднем. Ни одна не обещает, что правка поднимет вашу страницу.
Полнота интента оказалась внизу списка. Здесь я упёрся скорее в размер выборки, чем в саму оценку.
Сама оценка аккуратная: два оценщика почти всегда ставят одно и то же. Но по восемь документов на запрос набирается всего 1228 наблюдений. На таком объёме разницу в два-три пункта из 100 трудно отличить от случайности, и отделить одно от другого на этих данных я не смог.
Настоящее значение для полноты лежит где-то между 49,5 и 55,6 из 100, разброс около шести пунктов. В этот промежуток помещаются и 50, то есть разницы может не быть вовсе, и перевес в два-три пункта.
Поэтому вывод «полнота отличает топ слабо и вместе с объёмом текста» я считаю обоснованным. Вывод «полнота не работает совсем» — слишком сильным.
Типичная страница топ-50 Google и Яндекса
Все проверки выше сравнивали верх выдачи с низом. А что делать странице, которой нет даже в первых пятидесяти? Равняться на первое место или на топ-20 ей рано. Сначала полезнее понять, как выглядят страницы, которые в выдачу уже попали.
Поэтому здесь типичные значения по всем страницам, которые я измерил, без деления на верх и низ.
На графиках у каждого признака две полосы: тёмная — Google, терракотовая — Яндекс. Полоса показывает среднюю половину страниц: четверть лежит левее неё, четверть правее. Риска внутри — типичная страница, медиана. Если значение вашей страницы левее полосы, по этому признаку она уступает трём четвертям страниц, которые уже есть в выдаче. Шкала у каждой строки своя, поэтому сравнивайте полосы внутри строки. У признаков «есть или нет» полоса показывает долю страниц.
Текст и структура
Где стоит ключ, есть ли FAQ и цены
Полнота интента
Техничка
Тип страницы по слепой оценке
Остальные числовые поля аудита: 12 признаков
Технические признаки «есть или нет» и число претензий краулера
Сеть, сервер и robots.txt: доли сайтов
SEO-анализ текста: 24 метрики текстовых страниц
Детектор ИИ-текста: общий сигнал и признаки
Основные значения таблицей
| Признак | Google, медиана | Google, средняя половина | Яндекс, медиана | Яндекс, средняя половина |
|---|---|---|---|---|
| Слов основного текста | 766 | 363…1398 | 815 | 358…1502 |
| Покрытие LSI | 0,525 | 0,369…0,676 | 0,556 | 0,380…0,694 |
| Подзаголовков H2 | 5 | 2…9 | 6 | 2…10 |
| Подзаголовков H3 | 2 | 0…8 | 2 | 0…9 |
| Списков в основном тексте | 9 | 0…25 | 10 | 0…28 |
| Длина title, знаков | 70 | 55…89 | 70 | 56…89 |
| Длина description, знаков | 164 | 131…207 | 165 | 134…205 |
| Плотность ключа, % | 5,3 | 3,5…7,5 | 4,9 | 3,1…7,0 |
| Полнота интента, доля раскрытых полностью | 0,46 | 0,30…0,63 | 0,46 | 0,27…0,64 |
| Раскрыто полностью, составляющих | 4 | 3…6 | 4 | 2…6 |
| Составляющих в карте интента | 10 | 8…11 | 10 | 8…11 |
| Что есть на странице | Яндекс | |
|---|---|---|
| Полный ключ в title | 41,8% | 41,3% |
| Точный ключ в title, слово в слово | 10,1% | 8,7% |
| Полный ключ в H1 | 22,2% | 21,1% |
| Полный ключ в description | 34,2% | 35,6% |
| Блок FAQ | 23,5% | 24,5% |
| Цены в основном тексте | 40,3% | 43,4% |
| Признак | Google, медиана | Google, средняя половина | Яндекс, медиана | Яндекс, средняя половина |
|---|---|---|---|---|
| Размер HTML, КБ | 224 | 120…461 | 293 | 154…602 |
| DOM-узлов | 1322 | 803…2258 | 1506 | 931…2559 |
| Слов на всей странице | 1551 | 969…2343 | 1652 | 1030…2537 |
| Картинок | 32 | 15…70 | 37 | 17…77 |
| Ссылок на странице | 158 | 88…288 | 157 | 89…311 |
| Файлов JavaScript | 12 | 6…21 | 12 | 6…22 |
| Файлов CSS | 5 | 2…12 | 5 | 2…11 |
| Блокирующих скриптов | 2 | 0…9 | 2 | 0…7 |
| Скриптов JSON-LD | 1 | 0…2 | 1 | 0…2 |
| Время ответа сервера, мс | 603 | 442…897 | 602 | 412…901 |
Сколько страниц за графиками. Google — все позиции 1–50, снимок 14.09.2026: текст и ключи — 6516 страниц (покрытие LSI посчитано у 5964, плотность ключа — у 5391), полнота интента и тип страницы — 1228 документов слепой оценки, техничка — 5753 страницы, сеть и robots.txt — 3563 сайта (robots.txt отдали 3408), SEO-анализ текста — 3848 текстовые страницы, детектор — 3134 страницы с общим сигналом. Яндекс — только позиции 1–10 и нечётные 31–49, других мест в замере Яндекса нет, снимок 09.09.2026: текст — 2849 (покрытие — 2549, плотность — 2331), интент — 634, техничка — 2533, сеть — 2181 сайт (robots.txt — 2064), SEO-анализ текста — 1616, детектор — 1420. Если страница стоит сразу в нескольких запросах, она считается в каждом; в SEO-анализе текста каждая страница считается один раз. Время ответа сервера снимали разными прогонами в разные дни. Объекты микроразметки — все найденные аудитом объекты, скрипты JSON-LD — отдельные блоки <script type="application/ld+json">.
Если свести графики в портрет, выйдет так. Типичная страница из первых пятидесяти мест Google — около 770 слов основного текста, пять подзаголовков H2, title на 70 знаков и description на 164. В Яндексе почти то же: 815 слов, шесть H2, те же 70 знаков в title.
Полный ключ в title есть только у 42% страниц в обоих поисковиках, в H1 — у каждой пятой. Из десяти частей запроса типичная страница полностью раскрывает четыре. Техничка тоже похожа: 12 скриптов, 5 файлов стилей, сервер отвечает примерно за 600 мс.
Расходятся поисковики в весе страницы. Типичный HTML в Яндексе весит 293 КБ, в Google — 224.
Часть этой разницы объясняет состав выборки. В замере Яндекса половина страниц из первой десятки, а первая десятка тяжелее. Если взять у Google те же позиции, типичный HTML вырастает до 232 КБ, DOM — до 1424 узлов. Текст на этих позициях у Google почти не меняется: 770 слов, покрытие темы 0,532, то есть около 53% тематических слов.
Выходит, что даже на одних и тех же позициях страницы в выдаче Яндекса заметно тяжелее.
Мерилом для такой страницы остаётся выдача её собственного запроса. Чеклист на эту роль не годится: ключ и плотность из него топ-20 от страниц ниже не отделили, перевес длинных текстов почти исчезает при равном охвате темы, а темы, которые стоит закрыть, у каждой выдачи свои.
Частые вопросы
Из текстовых признаков — покрытие LSI, то есть доля тематических слов запроса, которые есть на странице. Страница с большим покрытием стоит выше соседки по выдаче в 53,8 случая из 100 при монетке в 50. Технические объёмы различают чуть сильнее, но внутри одного сайта от их разрыва остаётся около седьмой части, а у LSI — половина.
Для порядка мест в этих данных нет. Полный ключ в title стоит у 43,0% страниц топ-20 и у 40,8% страниц с позиций 21–50, по парам внутри выдачи это 50,6 из 100 — уровень монетки. Ключ в H1 даёт ровно 50,0. К тому же выводу пришёл Backlinko на 11,8 млн результатов Google.
Порога нет. У медианной страницы топ-20 полностью раскрыто 5 составляющих из 10, у медианной страницы с позиций 21–50 — 4. Работает сравнение с соседями: в выборке, где верх и низ поровну, страница полнее медианы своей выдачи стоит в топ-20 в 55 случаях из 100, а страница ниже медианы — в 47,5.
Резкой ступени нет, доля топа растёт плавно. Среди страниц с первых пятидесяти мест при покрытии ниже 0,3 в топ-20 стоят 38,6%, при 0,7 и выше — 51,3% при среднем 44,0%. Медиана топ-20 — 0,556, средняя половина страниц лежит между 0,391 и 0,700.
Страницы топ-20 крупнее: HTML 246 КБ против 207, но внутри одного сайта разница падает до 5,8 КБ. Время ответа сервера группы не различает: 606 мс против 601, по парам 49,4 из 100. Быстрый сервер нужен людям, но позиций в этих данных он не объясняет.
В обоих сильнее всего верх отделяют объёмы страницы: размер HTML, DOM, картинки. Различие в тексте: в Google верх заметнее отделяют полнота интента, объём основного текста и подзаголовки, в Яндексе — ключ в title и description. Покрытие LSI различает в обоих, 53,8 из 100 пар внутри запроса, но внутри одного сайта разрыв по нему виден только в Google. Топ-10 двух систем по одному запросу делят в среднем меньше двух URL.
Методология и ограничения
- Выдача
- XMLRiver, Google, Москва, google.ru, десктоп
- Аудит страниц
- Site Audit Pro, батч-режим
- Основной текст
- trafilatura вырезает текст без меню и подвала, pymorphy3 приводит слова к словарной форме (леммы)
- Карты интента
- Вордстат, подсказки Яндекса, блоки Google
- Оценка
- слепой оценщик — языковая модель, не видит позицию и домен; шкала 0/1/2
- Статистика
- AUC (в скольких парах из 100 у верхней страницы значение больше), бутстреп и перестановки по запросам (насколько число гуляет и не случайно ли оно), логит (сравнение страниц одной длины и типа)
- Снимок выдачи
- 14.09.2026
Выборка. 160 запросов, шестнадцать ниш по десять, те же, что в техническом замере Яндекса. Позиции 1–50, пять страниц выдачи по десять результатов. 7401 строка выдачи, 7370 уникальных адресов, 4432 домена. Позиции нумеровались только по сплошному ряду страниц: если страница выдачи не отдавалась, всё после неё в счёт не шло, чтобы номера не съезжали.
Ошибка, из-за которой первый сбор ушёл в корзину. Код региона Москвы я сначала взял из документации к собственному скиллу сбора выдачи. Сверка по справочнику регионов показала, что это код Аргентины. Первый прогон выброшен целиком, выдача собрана заново с правильным кодом региона, языком и доменом google.ru.
Текст и заглушки. Основной текст извлекался без меню и подвала. Без пригодного текста остались 354 страницы из 3200 в топ-20 и 531 из 4201 на позициях 21–50. Сюда попали экраны антибота YouTube, Ozon, Спортмастера и Пульса цен, JSON-оболочки Маркета, страницы «не найдено» с кодом 200 и окна согласия Google и YouTube. Первые классы нашёл сам оценщик, получив вместо страницы заглушку, остальные — поиск по всему корпусу после каждой такой находки. После каждой находки весь корпус пересчитывался заново, а результаты до пересчёта объявлялись недействительными. У 15 страниц сломалась кодировка: сервер объявлял UTF-8 и отдавал битые байты. Текст восстановлен перекодированием, проверка на 300 случайных страницах изменений у остальных не нашла.
Неравный отсев. Без пригодного текста остались 11,1% страниц топ-20 и 12,6% страниц ниже, почти поровну. Но отсев приходится на крупные площадки: больше всего таких адресов у YouTube (229), zoon.ru (43), Ozon (25), Домклика (35 вместе с блогом) и Профи.ру (17). Поэтому агрегаторы в текстовых расчётах представлены хуже остальных сайтов, а у тех, что остались, основной текст извлекается хуже: у Профи.ру в него попали отзывы вместо цен.
Техничка. 7322 строки аудита, из них 5753 страницы с кодом 200 и настоящим содержимым.
LSI. Это список тематических слов на каждый запрос: леммы, то есть слова в словарной форме, и пары лемм из основного текста всех измеренных позиций обоих поисковиков. Термин берётся, если встречается хотя бы на 30% страниц выдачи и хотя бы втрое чаще, чем на страницах других ниш. Слова запроса исключаются во всех вариантах их разбора. Одна словоформа может разбираться на разные леммы: «стекла» — это и существительное «стекло», и глагол «стечь». В первой версии исключение смотрело только на первый разбор, и в 16 списков из 160 попало по слову самого запроса. Ошибку нашла сверка этой статьи, списки и все расчёты с LSI пересчитаны. Пары слов, где одно слово из запроса, в списках остаются. Один список на запрос для Google и Яндекса, чтобы сравнение поисковиков в конце было равным. Медианный список — 78,5 термина. При расчёте покрытия страницы её собственный домен из статистики вынимается, чтобы сайт не подстраивал список под себя.
Карты интента. Строились из спроса: частые фразы и ассоциации Вордстата, подсказки Яндекса, блоки «Похожие вопросы» и «Похожие запросы» Google. Построитель не видел выдачу, второй участник вслепую проверял каждую карту на домыслы, дубли и дрейф от запроса, решения применялись механически. 159 карт, 1533 составляющие. Один запрос исключён по заранее заданному правилу: у него набралось меньше трёх составляющих. Карты зафиксированы хешем до оценки первого документа. Хеш — цифровой отпечаток файла: любая поздняя правка карты его бы изменила.
Слепая оценка. На запрос случайно отобраны по четыре документа из топ-20 и четыре с позиций 21–50 Google, по два из топ-10 и два с позиций 31–49 Яндекса. Всего 1908 документов. Из анализа исключены 40, которые при пересчёте оказались заглушками, и 6, у которых в партии оценки был нечитаемый текст. Осталось 1862. Оценщик видел запрос, составляющие с определениями и текст страницы до 2500 слов, но не видел позицию, домен и поисковик. Десятая часть документов оценена повторно независимым оценщиком: 1877 решений, совпадение 0,880, взвешенная каппа 0,863. Каппа — доля совпадений с поправкой на те, что вышли бы и при оценках наугад: ноль означает угадывание, единица — полное согласие.
Как считалось. Шесть гипотез я записал до того, как посмотрел в данные. Главные сравнения — AUC «топ-20 больше позиций 21–50», то есть в скольких парах из 100 у страницы топ-20 значение больше, чем у страницы ниже. Интервалы к нему — бутстреп по запросам: набор запросов много раз собирается заново случайным образом, и видно, как сильно гуляет число. Проверка на случайность — перестановка меток внутри каждого запроса: метки «топ» и «ниже» перемешиваются наугад, и считается, как часто такая же разница выходит сама собой. 5000 повторов для заявленной гипотезы по LSI, 2000 и поправка Холма для разведочных признаков, которые я смотрел без заранее записанной гипотезы. Поправка Холма ужесточает порог, когда признаков проверяется много. Контроль длины и типа страницы — логистическая регрессия с ошибками, сгруппированными по запросам: она позволяет сравнивать страницы одной длины и одного типа. Группировка нужна потому, что восемь документов одной выдачи похожи друг на друга сильнее, чем документы разных запросов, и без неё интервалы вышли бы уже, чем позволяют данные. Доли пар внутри запроса считаются по всем парам, ничьи пополам.
Детектор ИИ-текста. Разведка: гипотезу до данных я не записывал. Страницы прогнаны локально движком детектора ИИ-текста из репозитория сайта, PHP 8.3 CLI. Функции те же, что при проверке по адресу страницы: извлечение основного текста, прозаический профиль, структурные признаки, ритм и перплексия по n-граммной модели. Вход — HTML, сохранённые при съёме выдачи, для тех же чистых страниц, что в текстовом анализе: 6491 уникальный адрес Google и 2849 Яндекса. Общий сигнал и пороги признаков посчитаны по константам клиента инструмента: восемь весов, смещение 3,55, порог 2,0, минимум 500 слов связного текста, отсечка перечней. Сравнения — AUC с бутстрепом по запросам и перестановка меток внутри запроса: 5000 повторов для сигнала, 2000 и поправка Холма для признаков.
SEO-анализ текста. Тоже разведка. Те же сохранённые HTML прогнаны локально движком SEO-анализа текста: извлечение основного текста, базовые метрики (водность, тошнота, шаблонные обороты, длина предложений, разнообразие лексики), продвинутые метрики, семантический слой и BM25 по запросу, по которому адрес стоит в выдаче. В счёт шли тексты от 100 слов: 6336 строк Google и 2747 Яндекса. Сравнения — AUC и перестановка меток внутри запроса, 2000 повторов и поправка Холма на 27 метрик. «При равной длине» — AUC внутри пяти равных по числу слов частей выборки, средневзвешенный. Показатели абзацев из блока извлекаемости я не брал: при разборе по адресу у 94% страниц текст приходит без разметки абзацев.
Калибровка инструментов. SEO-анализ текста: 5464 уникальные текстовые страницы (прозаический профиль детектора применился: от 150 слов связного текста и не меньше 40% страницы), тексты от 100 слов. Для метрик, где плохо, когда много, «в норме» — до 90-го перцентиля, «проверьте» — до 95-го; где плохо, когда мало, — зеркально от 10-го и 5-го; у средней длины предложения норма от 10-го до 90-го, граница «нужно исправить» — 2,5-й и 97,5-й. Классическая тошнота, TTR, hapax, энтропия и размах длин предложений — по трём полосам длины: 100–499, 500–1499, от 1500 слов. Детектор: сетка перцентилей сигнала и признаков по 4542 страницам, где сигнал считается; веса и порог не менялись. Скрипт — calibrate.py рядом с данными исследования.
Шесть гипотез и их исход. H1: полнота интента у топ-20 выше — в Google направление есть, но p = 0,063 выше порога 0,05, поэтому гипотеза не подтверждена; в Яндексе нет. H2: покрытие LSI у топ-20 выше — подтверждена в обоих поисковиках, p = 0,0002. H3: H1 и H2 держатся при контроле объёма текста — для LSI да, для полноты нет. H4: совпадение типа страницы с интентом различает сильнее покрытия — в задуманном виде не проверена; признак, которым её заменили уже после данных, топ от низа не отличает. H5: технический градиент Яндекса повторяется в Google по знаку — да, HTML и DOM у топ-20 крупнее. H6: разрыв сохраняется между страницами одного домена — для LSI да, для полноты интента не виден на 63 доменах.
Ограничения. Один регион, одна дата, десктоп. Корреляция без причинности: данные показывают, что идёт вместе, а что чем вызвано, они не говорят. Оценщик интента — языковая модель, и хотя согласие двух оценщиков высокое, человеческой разметкой оно не калибровалось. Текст длиннее 2500 слов оценщик видел обрезанным, поэтому полнота самых длинных страниц может быть занижена. На запрос проверено восемь документов Google, а не вся выдача. Снимок Яндекса сделан на пять дней раньше. Гипотезу о совпадении типа страницы с интентом не удалось проверить в задуманном виде: её замена придумана после данных.
Что проверить дальше. Повторить на второй дате и в мобильной выдаче. И поставить эксперимент: взять страницы, которые слабее медианы своей выдачи, закрыть недостающие составляющие и темы и замерить сдвиг. Без эксперимента это остаётся наблюдением.
Страницы топ-20 Google раскрывают тему шире соседей. Технический размер в основном принадлежит сайту.
Проверить это на своей странице
Если нужно разобрать, чем ваша страница уступает топу своего запроса по интенту, тематике и техничке, — это SEO-аудит сайта. Быстро посмотреть текст страницы по двадцати метрикам помогает SEO-анализ текста.