По запросу «туры в турцию все включено» на 26-м месте Google стоит страница tours-spb.ru. Из одиннадцати вещей, которые люди ищут по этому запросу, она полностью раскрывает все одиннадцать: города вылета, курорты, сезон, звёздность отелей, цены, недорогие варианты, горящие туры, перелёт, туры с детьми и на двоих, продолжительность. Весит 118 килобайт.

На пятом месте стоит tours.tutu.ru. Основной текст этой страницы, по сути список отелей, полностью раскрывает две вещи из одиннадцати, а HTML весит 2,3 мегабайта. На восьмом — Tripadvisor с одной.

26-е место
11/11

вопросов раскрыто полностью

tours-spb.ru · 118 КБ

5-е место
2/11

вопроса раскрыто полностью

tours.tutu.ru · 2,3 МБ

Запрос «туры в турцию все включено», Google, Москва, 14.09.2026.

Я смотрел на эти две строки и не мог понять, как такое вообще возможно. По любому SEO-чеклисту должно быть наоборот: в пятёрке страница, которая ответила на все вопросы и весит почти в двадцать раз меньше, а список отелей на третьей странице выдачи.

Такую картину легко выдать за доказательство, что полнота ответа в Google ничего не значит. Но одна выдача ничего не доказывает.

Составлять ещё один список факторов я не собирался. Хотел обратного: взять привычный SEO-чеклист, от ключа в title и объёма текста до лёгкого HTML и чистого технического аудита, и посмотреть, сколько его пунктов переживут встречу с реальной выдачей. Поэтому я проверил то же самое на 160 запросах и 7370 адресах: отдельно полноту ответа, охват темы, ключи, объём текста и техничку.

Паспорт замера Method
Выборка
7370 адресов выдачи, 4432 домена
Запросы
160, шестнадцать ниш по десять
Группы
топ-20 против позиций 21–50
Регион
Москва, google.ru, десктоп
Дата съёма
14.09.2026
Интент
1228 документов Google и 634 Яндекса, слепая оценка
Сравнение
Яндекс, те же запросы, 09.09.2026
Исключения
заглушки ботозащиты, окна согласия, битая кодировка

Одна выдача целиком

Вот та самая выдача. Из каждой из 160 выдач я случайно взял по четыре страницы из топ-20 и по четыре с позиций 21–50.

Эти страницы читал слепой оценщик, языковая модель. Он видел запрос, текст страницы и список составляющих интента, то есть вопросов, которые стоят за запросом. Позиции, домена и поисковика он не видел. За каждый вопрос страница получала 2, если отвечает на него полностью, 1, если только упоминает, и 0, если ответа нет.

Выдача Google по запросу «туры в турцию все включено»: полнота интента, LSI, объём
МестоСайт11 составляющих интентаРаскрыто полностьюLSIСловHTML, КБ
21001tur.ru60,49912506
5tours.tutu.ru20,124172287
8tripadvisor.ru10,26854
14coral.ru70,626331216
26tours-spb.ru110,771348118
31ru.trip.com90,772007838
33travelata.ru40,25536
44light-tur.ru90,65107340
раскрыто полностью только упомянуто нет ответа затемнённые строки — позиции 21–50; прочерк — у страницы нет данных технического аудита

Составляющие слева направо: города вылета, лучшие месяцы, курорты, звёздность отеля, цена тура, недорогие варианты, горящие туры, перелёт в стоимости, тур на двоих или компанией, тур с детьми, продолжительность. Google, Москва, 14.09.2026.

Четыре страницы из топ-20 полностью ответили на 16 вопросов на всех. Четыре страницы с позиций 21–50 — на 33, вдвое больше.

Тему нижняя четвёрка тоже охватывает шире. В колонке LSI стоит доля тематических слов запроса, которые нашлись на странице: 0,77 — это примерно три слова из четырёх, 0,12 — одно из восьми. Внизу три страницы из четырёх охватывают тему шире любой страницы верхней четвёрки.

Что это за выдача, видно по первым строкам. Наверху в основном агрегаторы туров и Tripadvisor с узнаваемыми брендами. Внизу турагентства и агрегаторы поменьше, зато они отвечают на большую часть вопросов.

Остановись я на этой таблице, статья вышла бы короткой и неправильной: «полнота не нужна». Из одной выдачи следует немного: полнота ответа сама по себе силу площадки не перебивает. Обратного она не доказывает. Может, в среднем полнота всё-таки работает, а туризм просто исключение. Дальше — то же самое на всех 160 запросах.

Что мерил и чем это отличается от замеров Яндекса

Прежде чем идти по всем запросам, пара слов о том, откуда взялся этот замер. Он третий в серии и отвечает на вопросы, которые оставили два первых.

Первый, по on-page в Яндексе, смотрел только внутрь топ-20 и не нашёл там ни одного признака, который объяснял бы порядок мест. Но страниц за пределами двадцатки в той выборке не было. Вопрос «помогает ли полнота вообще попасть в двадцатку» остался открытым.

Второй, по техничке Яндекса, сравнивал топ-10 с позициями 31–49. Он показал, что технический вес страницы — в основном свойство сайта.

Здесь оба пробела закрыты сразу, но на Google. Граница проходит по двадцатому месту: топ-20 против позиций 21–50, то есть первые две страницы выдачи против третьей, четвёртой и пятой. On-page, полнота ответа, охват темы и техничка сняты с одних и тех же адресов.

В конце статьи Google сравнивается с Яндексом на границе из технического замера Яндекса, 1–10 против 31–49. Так числа двух поисковиков можно сравнивать напрямую.

Шесть гипотез и способ счёта я записал до того, как посмотрел на результаты. Список с исходом каждой есть в методологии.

Проверки, которые я придумал уже после данных, помечены в тексте словом «разведка», и им я доверяю меньше. Если после данных перебрать десятки разрезов, какой-нибудь из них покажет разницу чисто случайно.

Три величины и как читать цифры

Дальше почти в каждом разделе встречаются три величины. Без них цифры легко прочитать неверно, поэтому коротко о каждой.

Полнота интента. За каждым запросом стоит несколько вопросов. Человек, который ищет «туры в турцию все включено», хочет знать цену, курорт, город вылета, входит ли перелёт в стоимость, можно ли ехать с детьми, и так далее. Для каждого запроса я составил такой список, а потом проверил, на сколько вопросов из него страница отвечает полностью, на двойку. Доля таких ответов и есть полнота интента. В тексте я чаще говорю проще: насколько страница отвечает на вопросы пользователя.

Список строился по спросу: частые фразы и ассоциации Вордстата, подсказки Яндекса, блоки «Похожие вопросы» и «Похожие запросы» Google. Страницы из выдачи в него не попадали, иначе список подгонялся бы под тех, кто уже стоит наверху. На запрос выходит от трёх до шестнадцати составляющих, у типичного — десять.

Покрытие LSI. Это рабочее название охвата темы. К старому «LSI-копирайтингу» и к латентно-семантическому анализу оно отношения не имеет. Речь просто о доле тематических слов и понятий, которые постоянно встречаются на страницах по запросу. Для «туров в Турцию» это «путёвка», «перелёт», «курорт», «трансфер», «питание», «туроператор» и ещё десятки слов. Я считаю, какая доля такого списка есть на конкретной странице. Чем выше доля, тем шире страница охватывает тему. Дальше в тексте это чаще называется охватом темы или тематическим покрытием.

Технически список очищен от случайных и слишком общих слов, а слова самого запроса из него убраны, чтобы покрытие не повторяло вхождение ключа. Подробная формула есть в методологии.

Из 100 пар. Это самая простая шкала статьи. Беру две страницы одного запроса и смотрю, выше ли стоит та, у которой признак больше. Так по всем парам всех выдач.

Если признак с местом никак не связан, выйдет около 50 из 100, обычная монетка. 55 из 100 — небольшой перевес: признак угадывает, какая страница выше, в 55 парах из ста и ошибается в 45. Там, где связь заведомо есть, эта же шкала показывает 90 и выше. Когда у обеих страниц признак одинаковый, например у обеих нет полного ключа в title, пара считается ничьей и делится пополам.

Что означают цифры в скобках

В таблицах и на графиках встречаются обозначения из статистики. Для основного текста они не нужны. Если захотите заглянуть в точные данные, читайте их так.

53,8 из 100
Небольшой перевес над монеткой: в 53,8 паре из ста выше стоит страница, у которой признак больше. 50 — монетка
AUC 55,3
То же самое, только в каждой паре страница из топ-20 и страница с позиций 21–50. Так эта шкала подписана в таблицах
95% интервал [53,6; 56,9]
Насколько может гулять эта цифра. Если в интервал попадает 50, уверенного перевеса нет
p = 0,0002
Насколько легко получить такую разницу случайно. Меньше 0,05 — разница выглядит устойчивой, больше — вывод на ней не построишь
медиана
Типичная страница: у половины страниц значение больше, у половины меньше. Один гигантский сайт её не перекосит

Двадцать признаков на одной шкале

Что сильнее отличает топ: ключ в title, длина текста или охват темы? Прежде чем разбирать пункты по одному, я сложил на эту шкалу сразу двадцать признаков. Техничка страницы взята из аудита, on-page из основного текста, полнота интента из слепой оценки. Все двадцать посчитаны одинаково: пары страниц внутри одной выдачи Google, позиции с первой по пятидесятую.

4050 — монетка60
Слов на всей страницетехничка, аудит
55,4 из 100
DOM-узловтехничка, аудит
55,0 из 100
Размер HTMLтехничка, аудит
54,5 из 100
Картиноктехничка, аудит
54,5 из 100
Покрытие LSIтекст
53,8 из 100
Подзаголовков H2текст
53,6 из 100
Объектов микроразметкитехничка, аудит
53,5 из 100
Слов основного текстатекст
53,4 из 100
Полнота интентаслепая оценка
52,3 из 100
Подсказок preloadтехничка, аудит
52,1 из 100
Семантических теговтехничка, аудит
51,8 из 100
Есть блок FAQтекст
51,7 из 100
Списковтекст
51,5 из 100
Полный ключ в descriptionтекст
50,7 из 100
Длина titleтекст
50,7 из 100
Полный ключ в titleтекст
50,6 из 100
Полный ключ в H1текст
50,0 из 100
Файлов JavaScriptтехничка, аудит
50,0 из 100
Время ответа сервератехничка, аудит
49,4 из 100
Плотность ключатекст
49,2 из 100

Google, Москва, 14.09.2026, позиции 1–50, пары внутри запроса, ничьи пополам. Техничка: 5753 страницы, 102 968 пар. Текст: 6516 страниц, 130 712 пар. Полнота интента: 1228 документов слепой оценки, 4151 пара. Серым — технические признаки, цветом — две главные величины статьи.

Ни один признак не уходит от 50 дальше чем на пять с половиной пунктов. Наверху шкалы объёмы, из текстовых признаков первым идёт тематическое покрытие, ключи стоят на пятидесяти.

Дальше всех от 50 уходят объёмы: сколько на странице слов, DOM-узлов (элементов разметки, из которых браузер строит страницу), килобайт и картинок. Из того, что правится в тексте, впереди тематическое покрытие. Почти вровень с ним идут подзаголовки и объём основного текста.

Полнота ответа на вопросы пользователя отстаёт от покрытия темы на полтора пункта. А все вхождения ключа, от title до плотности, лежат на пятидесяти, на уровне случайного выбора.

Глядя на такой график, легко решить, что шкала «из 100» просто не умеет показывать больше. Я проверил её на признаках, которые заведомо связаны между собой. Покрытие темы и число найденных тематических слов меняются в одну сторону в 99,4 паре из 100. Строгая и мягкая версии полноты интента — в 90,0. Полнота и покрытие темы — в 73,1.

Где связь есть, шкала спокойно показывает девяносто. Значит, 53,8 у тематического покрытия говорит о слабой связи, а 50,6 у ключа в title — о том, что связи нет. Шкала тут ни при чём.

Как это читать на практике. Даже при 53,8 из 100 в 46 парах из ста страница с большим охватом темы стоит ниже соседки. Рычага, который сам переставляет страницы, среди двадцати признаков нет. Вопрос в том, какие из этих слабых различий переживают дополнительные проверки, а какие рассыпаются.

Вывод без статистики По ключу в title, H1 и description в этих данных не угадать, какая из двух соседних страниц стоит выше: все три признака сидят около пятидесяти. Если времени хватает на одну задачу, проверьте, какие темы запроса страница не закрыла, и посмотрите на подзаголовки. Это отделяет топ сильнее, чем ещё одно вхождение ключа.

Раскрывает ли топ интент полнее?

неясно

Ожидание

Страница, которая полнее отвечает на запрос, стоит выше

В данных

Чуть полнее, но у страниц одной длины разницы не видно. Больше вопросов закрывают просто более длинные тексты

Первой я проверял главную гипотезу замера: чем полнее страница отвечает на запрос, тем выше она стоит. После выдачи с турами я надеялся, что туризм окажется исключением, а на 160 запросах полнота своё возьмёт. Данные оказались куда неприятнее.

Типичная страница топ-20 полностью раскрывает половину частей запроса, типичная страница с позиций 21–50 — 45,5%. В штуках это 5 закрытых вопросов пользователя против 4. В расчёт вошли 1228 документов Google из 1272 отобранных, по четыре сверху и по четыре снизу на запрос.

Топ-20 против 21–50
52,7

из 100: перевес такой маленький, что его мог дать случай

Страницы одной длины и типа
≈ 0

у страниц одной длины и типа преимущество полноты почти исчезает, а длина держится

Самый верх против глубины
56,3

позиции 1–10 против 31–49: здесь полнота уже отличает верх. Полнота 0,5 против 0,4

Вердикт: между первой десяткой и четвёртой-пятой страницами выдачи полнота различима. На границе двадцатки она почти не работает, а то, что видно, совпадает с различием в длине текста. неясно

Точные значения. Страницы одной длины и типа: p = 0,66 у полноты и 0,0095 у длины. Позиции 1–10 против 31–49: 56,3 из 100, интервал [51,5; 61,1], на случайность такой перевес уже не спишешь.

Чем дальше друг от друга позиции, тем заметнее полнота. На соседних страницах выдачи её перекрывают объём и сила площадки.

Первое впечатление: топ отвечает на вопросы полнее. Но разница такая маленькая, что её вполне мог дать случай. Если раздать страницам места «топ» и «ниже» наугад внутри каждого запроса, такая же или бо́льшая разница выпадает примерно в шести попытках из ста. На такой разнице вывод строить нельзя, и то, что она лежит близко к условному порогу, ничего «почти» не доказывает.

Дальше я проверил, не объясняется ли всё длиной текста. На этой проверке моя главная гипотеза и сломалась: эффект почти исчез.

Возьмите две страницы одинаковой длины и одного типа: преимущество более полной почти пропадает, и то, что от него осталось, вполне может быть случайностью. Длина текста в том же сравнении держится. Проверял сразу на всех 1228 документах, точные значения стоят на графике выше.

Получается простая вещь. Длинная статья за счёт объёма закрывает больше вопросов пользователя, а с местом в топ-20 в этом сравнении связана именно длина.

Остальные проверки полноту не спасли.

По запросам: полнее верх в 85 выдачах из 159, низ — в 60, в 14 поровну. Перевес есть, но далеко не везде.

Внутри одного сайта разница почти нулевая. У 63 доменов есть страницы и в топ-20, и ниже. Верхняя страница полнее у 32 из них, слабее у 27. Типичная разница +0,027: при десяти частях запроса это меньше трети одного вопроса.

По полосам позиций типичная полнота стоит на месте: половина частей запроса на местах 1–3 и на 41–50, чуть меньше на 11–20 и 31–40 (0,455 и 0,444).

Все варианты счёта полноты
Полнота интента: топ-20 против позиций 21–50 в Google
ВеличинаТоп-2021–50AUC [95% ДИ]p
Доля составляющих на 2 — основная0,5000,45552,7 [49,5; 55,6]0,063
Доля на 1 или 2 — мягкая0,6670,66752,5 [49,4; 55,4]0,081
Доля на 2, взвешенная спросом0,5970,56252,9 [50,1; 55,8]0,045
Только составляющие из Вордстата0,5000,50049,2 [45,5; 52,7]

623 документа топ-20 и 605 документов с позиций 21–50, 159 запросов. p — перестановка меток внутри запроса, 5000 повторов. Взвешенная величина проходит порог 0,05 на грани, основная и мягкая — нет. Взвешенная спросом доля даёт больший вес составляющим, которые чаще ищут. Когда одно и то же посчитано четырьмя способами, то, что один из них едва перешёл порог, мало что добавляет.

Одна деталь мешает списать всё на шум. Сила эффекта зависит от типа запроса. Сильнее всего верх полнее низа в смешанных запросах, где человеку нужно сразу несколько разных вещей, как в «перепланировка квартиры согласование»: 59,2 из 100 на 138 документах. У транзакционных 54,6, у коммерческих 51,5, у информационных 51,3.

Это разведка: разбивку я придумал уже после данных, и выборки внутри классов маленькие. Но направление понятное: чем больше в запросе разных потребностей, тем важнее закрыть их все.

Можно ли верить самой оценке? Десятую часть документов я отдал второму, независимому прогону оценщика. На 1877 решениях оценки совпали в 88 случаях из 100. Если сделать поправку на совпадения, которые дали бы оценки наугад, согласие остаётся почти таким же высоким.

Значит, шкала воспроизводима: независимый прогон ставит почти те же оценки, и слабый результат полноты разбросом оценок не объясняется. С человеческой разметкой шкалу не сверяли. Эта проверка показывает устойчивость оценок, а правы ли они, она не показывает.

Что проверяли
1228 документов Google, по четыре из топ-20 и четыре с позиций 21–50 на запрос. Список вопросов к запросу собран из спроса, оценщик не видел позицию и домен.
Что нашли
Топ-20 отвечает на вопросы пользователя чуть полнее: на 4,5 пункта, 52,7 из 100. На такой разнице вывод строить нельзя. У страниц одной длины и типа разницы по полноте не видно. Самый верх против глубины выдачи — 56,3 из 100.
Что это значит
Полнота ответа отличает первую страницу выдачи от пятой. На границе двадцатки почти не отличает. Длинный текст закрывает больше вопросов, и в данных полнота идёт вместе с объёмом.
Что делать
Закрыть то, что закрывают соседи по выдаче. Прибавку от дописанного сверх этого данные не показывают.

Охват темы: текстовый признак, который выдержал все проверки

выдержал проверки

Ожидание

Тематические слова — пережиток старого SEO, Google понимает смысл и без них

В данных

Из двух главных величин все проверки выдержало только покрытие темы: на длину текста, внутри одного сайта и по нишам

Сама полнота оказалась слабее, чем я ждал. А что, если считать ширину темы вместо закрытых вопросов? Здесь результат уже другой.

Из всех текстовых признаков лучше всего держится охват темы. Он обходит и ключ в title, и длину текста. В таблицах и на графиках эта метрика называется покрытием LSI. Тематические слова многие считают пережитком старого SEO, а из текстовых рекомендаций удержалась именно эта.

Если по запросу «туры в Турцию» конкуренты раз за разом пишут про перелёт, питание, трансфер и курорты, страницы топ-20 чаще тоже закрывают эти темы. Разница остаётся, даже когда сравниваешь две страницы одного сайта.

В цифрах она скромная. Типичная страница топ-20 содержит около 56% тематических слов своего запроса, типичная страница с позиций 21–50 — около 51%. Это примерно пять слов из каждой сотни в списке. Для «туров в Турцию» со списком из 61 слова это три слова, например «трансфер», «питание» и «туроператор».

Покрытие LSI по полосам позиций Google Медиана покрытия LSI: 0,551 на позициях 1–3, 0,567 на 4–10, 0,540 на 11–20, 0,521 на 21–30, 0,506 на 31–40, 0,486 на 41–50. 0,5511–3 0,5674–10 0,54011–20 0,52121–30 0,50631–40 0,48641–50 Медиана доли тематических слов запроса на странице
Внутри топ-20 покрытие ровное, дальше каждая страница выдачи беднее предыдущей. 5964 страницы с текстом, Google, Москва, 14.09.2026.

Форма кривой важнее самих чисел. Внутри первых двух страниц выдачи покрытие к первому месту не растёт: у мест 1–3 оно даже чуть ниже, чем у 4–10. А после двадцатки идёт ровная лестница вниз.

В замере Яндекса текстовые признаки порядок мест внутри двадцатки тоже не объясняли. Попадание в двадцатку тот замер не видел. Здесь видно, что ступенька по охвату темы приходится на её границу.

Эту гипотезу я записал до данных и проверял строже остальных. Возьмём пару: одна страница из топ-20, другая с позиций 21–50 того же запроса. Более широкий охват темы оказывается у верхней в 55,3 случая из 100.

Перевес небольшой, но устойчивый: даже по самой осторожной оценке он на 3,6 пункта выше 50, а когда я 5000 раз раздавал страницам места «верх» и «низ» наугад, такой разницы не выпало ни разу.

Только пять с небольшим пунктов над монеткой не та цифра, ради которой открывают шампанское. Кроме случая, у такого перевеса хватает скучных объяснений, и поверить ему сразу я не смог. Поэтому попробовал его убить.

Может, это просто длинные тексты? Нет.
Может, наверху просто сайты посильнее? Нет.
Может, среднее тянут несколько огромных выдач? Нет.
Одна удачная ниша? Тоже нет.
Маркетплейсы и агрегаторы? Выкинул их, результат остался.

Проверки устойчивости покрытия LSI в Google
ПроверкаЧто получилосьДержится
Может, это просто длина текста?Если сравнивать страницы одной длины, LSI всё равно отличает топ, p = 0,0004. А длина при одинаковом LSI уже может оказаться случайностью, p = 0,058да
Может, наверху просто другие сайты?529 доменов со страницами в обеих группах. Верхняя страница сайта богаче нижней на 0,026 [0,011; 0,042]: у 295 доменов больше, у 223 меньше, p = 0,002да
Может, это пара огромных выдач?В 111 запросах из 160 медиана LSI в топ-20 выше, чем на 21–50. Ниже — в 48да
Может, это одна ниша?Верх богаче в 15 нишах из 16. Исключение — юридические услуги, 48,9 из 100да
Может, это маркетплейсы и агрегаторы?Без Ozon, Маркета, Avito, Wildberries, 2ГИС, YouTube, Дзена, отзовиков и других агрегаторов результат тот же: 55,3 из 100 [53,7; 56,9]да

Не сломался.

Первая строка таблицы самая важная. В длинном тексте просто больше слов, в том числе тематических. Можно было ожидать, что охват темы окажется всего лишь другим способом посчитать длину.

Вышло наоборот. Если сравнить страницы одинаковой длины, покрытие темы всё равно отличает топ. А если сравнить страницы с одинаковым покрытием, преимущество длины может оказаться случайностью. Если мерить оба признака одной линейкой, обычным разбросом между страницами, охват темы связан с попаданием в топ-20 вдвое сильнее, чем длина текста.

Вторая строка отличает Google от Яндекса. В Google даже у одного и того же сайта верхняя страница чаще охватывает больше тем, чем его же страница ниже. От разницы между разными сайтами внутри одного сайта остаётся половина. Поэтому покрытие темы здесь больше похоже на свойство конкретной страницы.

В Яндексе на той же проверке разницы внутри сайта не видно: у типичного сайта она нулевая. Но сайтов для такого сравнения всего 119, и оценка размытая: разница может оказаться и в плюс, и в минус (от −0,033 до +0,045).

Доля страниц, перешагнувших уровень покрытия
Доля страниц с покрытием LSI не ниже уровня
Покрытие LSI не нижеТоп-20Позиции 21–50Разница, п. п.
0,385,4%81,8%+3,6
0,474,4%68,9%+5,5
0,559,3%51,8%+7,5
0,641,9%34,4%+7,5
0,725,1%18,6%+6,5

2622 страницы топ-20 и 3342 страницы с позиций 21–50, у которых посчитано покрытие LSI.

Здесь легко сделать опасный вывод, поэтому одна оговорка. Это связь, эксперимента за ней нет. Совет «вставьте LSI-слова» из данных не следует. Скорее наоборот: страница, где автор разобрался в теме, сама собой содержит «трансфер» и «питание». Если нужные слова естественно появились в тексте, значит, тема действительно раскрыта.

Список полезен как проверка того, о чём соседи по выдаче говорят, а вы нет.

Что это значит для SEO Соберите тематические слова по выдаче своего запроса и посмотрите, каких тем на странице нет. Дописывайте разделы, которые эти темы раскрывают: слова, вставленные в конец абзацев, тему не закрывают. Из признаков, которые прошли все проверки, в Google только охват темы отличает топ-20 от соседей и держится даже внутри одного сайта.

Ключ в title, H1 и description

не выдержал

Ожидание

Ключ в title и H1 — первое, что поднимает страницу

В данных

Почти случайный выбор. Полный ключ в title у 43,0% топа и у 40,8% соседних страниц, в H1 разницы нет

Если содержание что-то различает, что тогда с самым старым SEO-ритуалом, ключом в title?

Здесь обиднее всего за SEO-ТЗ, которые открываются этим пунктом. Ключ в title нужен для релевантности и клика. Но внутри первых 50 результатов его наличие почти ничего не говорит о том, кто окажется выше.

Полный ключ в title есть у 43% страниц топ-20 и у 41% страниц ниже. В H1 разницы практически нет вообще.

Полным вхождением я считаю все значимые слова ключа в любых формах. Для запроса «остекление балкона под ключ» title «Остекление балконов и лоджий под ключ в Москве недорого» даёт полное вхождение, «Отделка балконов и лоджий под ключ - Цены в Москве - Быстро и недорого!» — нет.

Доля страниц с полным ключом по полосам позиций Google
Зона1–34–1011–2021–3031–4041–50Из 100 пар
Полный ключ в title46,4%42,6%42,4%41,8%39,5%41,4%50,6
Полный ключ в description40,1%34,4%35,3%32,0%33,2%34,5%50,7
Полный ключ в H123,3%21,8%22,5%21,4%22,8%21,9%50,0

6516 страниц с текстом, Google, позиции 1–50. Последняя колонка — доля пар внутри запроса, 130 712 пар.

Полный ключ в H1
50,0

из 100: так ключ в H1 угадывает, какая из двух страниц одной выдачи стоит выше. Подброшенная монетка даёт ровно столько же.

Первые три места чуть чаще несут ключ в title и description, на четыре-шесть пунктов. Дальше полосы ровные до пятидесятого места.

На границе двадцатки разница по title 2,2 пункта (51,1 из 100), и на такой разнице вывод строить нельзя. По H1 разницы нет совсем: 22,4% против 22,0%. Четыре страницы топ-20 из пяти обходятся без полного ключа в H1. Старый пункт ТЗ про ключ в заголовке эту проверку не пережил.

С остальными ключевыми признаками та же история. Точное вхождение в title — 10,6% в топ-20 против 9,7% ниже. Длина title — 71 знак против 70.

Плотность ради плотности тоже ничего не дала: у типичной страницы 5,2% в топ-20 и 5,3% ниже. По парам это 49,2 из 100: страница с большей плотностью стоит ниже даже чуть чаще, чем выше.

На что не тратить день Внутри первых пятидесяти мест полный ключ в title и H1 порядок почти не различает, кроме небольшого перевеса на местах 1–3. Убирать ключ из-за этого не нужно: страницы без релевантного title могли вообще не попасть в пятьдесят. Но отдельный заход, чтобы впихнуть ключ в title страницы, которая уже в выдаче, эти данные не поддерживают. Плотность ключа как метрику можно убрать из ТЗ.

Объём текста и подзаголовки

неясно

Ключ почти ничего не дал. Может, Google просто любит больше текста?

В топе текста действительно больше. На секунду показалось, что старое доброе «сделаем на 20% больше текста, чем у конкурента» вернулось в строй.

Ненадолго.

У типичной страницы топ-20 около 840 слов основного текста, у страниц ниже около 700. Подзаголовков H2 шесть против пяти. Блок частых вопросов есть у 27,0% страниц топ-20 и у 20,8% страниц ниже. В 110 запросах из 160 типичный текст в топ-20 длиннее.

По шкале пар объём и подзаголовки отделяют топ-20 заметнее ключей: 54,3 из 100 у объёма текста и 54,9 у подзаголовков. Перевес небольшой, но достаточно устойчивый, чтобы не списывать его на случайность (интервалы [53,0; 55,7] и [53,6; 56,1]).

Объём текста, подзаголовки и FAQ по полосам позиций Google
Признак1–34–1011–2021–3031–4041–50
Слов основного текста, медиана844861817738704662
Подзаголовков H2, медиана666544
Есть блок FAQ26,3%26,6%27,5%21,6%19,6%21,6%

Картина та же, что у тематического покрытия: внутри двадцатки ровно, после неё ступенька. Блок FAQ держится на 26–27% три полосы подряд и падает до 20–22% ровно на третьей странице выдачи.

Почему тогда «неясно»? Всё решила проверка на длину из раздела про охват темы. Если сравнить страницы с одинаковым покрытием темы, преимущество длины практически исчезает. Похоже, длинные тексты чаще стоят в топ-20 из-за числа закрытых тем: в длинный текст их просто помещается больше.

Это совпадает с тем, что пишет сам Google в руководстве для начинающих: длина контента сама по себе на ранжирование не влияет, волшебного числа слов нет.

Что поменять в ТЗ Не раздувайте статью до объёма конкурента только потому, что у него столько слов. Посмотрите, какие темы он этими словами раскрыл. В ТЗ ставьте список тем, которые закрывают соседи по выдаче, и по разделу H2 на тему. Длина получится сама. С попаданием в топ-20 в данных связано именно покрытие темы.

Объём сам по себе топ не объясняет. Остаётся убеждение посвежее: Google будто бы наказывает текст, написанный нейросетью. Если это правда, машинного текста в топе должно быть заметно меньше, чем ниже.

Бонусный прогон 1 из 2 · детектор ИИ-текста

Машинный текст: что показал наш детектор

не выдержал

Ожидание

Google понижает тексты, похожие на сгенерированные, и в топе их меньше

В данных

В Google топ-20 и позиции 21–50 по детектору не отличаются. Выше порога примерно одна страница из десяти и там, и там

Проверить это убеждение, «Google наказывает ИИ-текст», мне было чем. У сайта есть свой детектор ИИ-текста, и я заодно прогнал через него все страницы выдачи из этого замера.

Результат вышел скучным, и этим он полезен.

Детектор верх выдачи Google от соседей снизу не отличает. Выше порога 2,0, с которого инструмент считает текст похожим на машинный, стоят 10,5% страниц топ-20 и 10,9% страниц с позиций 21–50. Возьмите две страницы одного запроса, и сигнал окажется выше у верхней в 49,7 случая из 100. Внутри одного сайта то же самое: верхняя страница «машиннее» нижней у 134 сайтов и «человечнее» у 136.

Движок тот же, что работает в инструменте. Запускал я его на своём компьютере по HTML, сохранённым при съёме выдачи: 6491 адрес Google и 2849 адресов Яндекса. Общий сигнал детектор считает только по связному тексту от 500 слов, и такой текст нашёлся примерно у половины страниц: 48% в Google и 50% в Яндексе. Остальное — каталоги, карточки и короткие страницы услуг (36% в Google) или перечни, где тире и двоеточия стоят вместо фраз (13%). Поэтому всё ниже касается страниц со статьями и длинными описаниями.

Общий сигнал детектора ИИ-текста в верху и низу выдачи Google и Яндекса
ПоказательGoogle, топ-20Google, 21–50Яндекс, топ-10Яндекс, 31–49
Сигнал считается, % страниц51,6%45,4%50,3%49,4%
Страниц с сигналом14681666703717
Сигнал типичной страницы−1,24−1,13−0,92−1,29
Средняя половина страниц−2,95…0,48−2,89…0,63−2,82…0,85−3,47…0,33
Выше порога 2,010,5%10,9%12,8%9,6%

Порог 2,0 тот же, что в инструменте: выше него текст по восьми признакам похож на машинный. Отрицательный сигнал лежит ниже порога с запасом. Google — 14.09.2026, позиции 1–50. Яндекс — 09.09.2026, позиции 1–10 и нечётные 31–49.

В Яндексе верх по детектору даже чуть «машиннее» низа: выше порога 12,8% страниц первой десятки и 9,6% на позициях 31–49. Держится этот перевес плохо. Разница в 3,2 пункта может оказаться и нулевой, а по отдельным запросам сигнал верха выше в 78 выдачах и ниже в 70, почти поровну. У Google на тех же позициях разницы нет: 9,2% против 10,0%.

В прошлом замере Яндекса машинных примет наверху было чуть меньше. Числа напрямую не сравниваются: там я смотрел слои детектора по отдельности и места внутри топ-20, здесь общий сигнал на границе 1–10 против 31–49. Главное сходится: рычагом позиций сигнал детектора не работает ни там, ни здесь.

По отдельным признакам в Google разница тоже мелкая. После поправки на число проверок держатся две, и обе далеко от порогов: у страниц топ-20 чуть больше тире-связок, 10,7 на тысячу слов против 9,0, и чуть сильнее разброс длины абзацев, 0,64 против 0,61. Первое по шкале детектора ближе к машинному письму, второе к человеческому.

Эталон: типичные значения детектора на страницах выдачи

Это справка для тех, кто хочет сверить свой текст. В раскрывающемся блоке ниже типичные значения всех признаков детектора на страницах, которые уже стоят в первых пятидесяти результатах. Проверьте текст в детекторе и сравните его показатели со строками таблицы.

Все признаки детектора: типичные значения выдачи
Типичные значения признаков детектора ИИ-текста на страницах выдачи Google и Яндекса
Признак в детектореПорог в инструментеGoogle, типичная страницаGoogle, средняя половинаЯндекс, типичная страницаЯндекс, средняя половина
Общий сигналот 2,0−1,19−2,91…0,55−1,13−3,14…0,56
Двоеточие-перечисление, на 1000 словот 10,13,81,6…7,33,91,6…7,5
Параллельные начала, %от 21,813,05,0…22,212,54,5…21,3
Тире-коннектор, на 1000 словот 26,99,94,4…16,810,64,6…17,6
Ритм (burstiness)до 0,460,580,47…0,820,580,47…0,85
Повтор триграмм, %на нуле1,90,9…4,62,00,9…5,1
Метод Ильдарадо 0,0450,250,14…0,350,250,15…0,35
Первое лицо, на 1000 словна нуле2,40,5…7,82,20,3…8,6
Начала с союза, %до 0,93,11,1…5,92,90,9…5,7
Ровные абзацы, %от 52,928,114,7…42,428,913,9…43,4
Разброс абзацевдо 0,410,620,50…0,830,610,49…0,79
Шаблонные обороты, % предложенийсправочно00…1,500…1,2
Слов связного текстаот 500961702…1427992717…1480

Страницы, где детектор считает общий сигнал: Google — 3134 из 6516, позиции 1–50; Яндекс — 1420 из 2849. Порог — значение, с которого признак срабатывает в инструменте. Ровные абзацы и разброс абзацев в общий сигнал не входят, шаблонные обороты показываются справочно, так же как в самом детекторе.

Если коротко, типичная страница выдачи от машинного профиля далеко. Общий сигнал около −1,2 при пороге 2,0, и ни один признак у неё порога не берёт. Заметнее всего в этом портрете безличность: первого лица 2,4 слова на тысячу, а у живых текстов, на которых калибровали детектор, около 12.

Эти же данные теперь встроены в детектор: рядом с общим сигналом и каждым признаком он показывает, где текст стоит среди 4542 страниц выдачи, а на графике — полосу, в которой лежит половина этих страниц. Веса и порог 2,0 я не менял. Страницы выдачи не размечены, и какие из них написаны моделью, неизвестно, поэтому переучить на них детектор нельзя.

Проверка для вашей страницы Прогоните текст через детектор. Сигнал выше 2,0 значит, что по восьми признакам текст похож на машинный; в выдаче таких страниц около 11%. Посмотрите, какие признаки вышли за порог, и сравните их с типичными значениями из таблицы: так видны редакторские привычки. Переписывать страницу ради самого сигнала смысла нет. Позиций в Google он не объясняет: текст, машинный по шкале детектора, стоит в топ-20 так же часто, как ниже.

Бонусный прогон 2 из 2 · SEO-анализ текста

Вода, тошнота и читабельность: что показал SEO-анализ текста

не выдержал

Ожидание

Текст в топе «чище»: меньше воды и тошноты, читается легче

В данных

Вода, тошнота и читабельность у топа и соседей одинаковые. Остальные различия почти целиком объясняются длиной текста

Детектор ищет машинную манеру. Чистка воды и тошноты — ритуал постарше, и для него у сайта есть второй инструмент, SEO-анализ текста. Те же страницы я прогнал через него, тоже локально и тем же движком, что работает на сайте. Целевым запросом для каждой страницы ставил тот, по которому она стоит в выдаче: так инструмент считает, насколько текст набирает вес по словам запроса. В счёт шли тексты от 100 слов: 6336 страниц Google и 2747 Яндекса.

Главное для Google: вода, тошнота и читабельность позиций не объясняют. Водность, академическая тошнота, шаблонные обороты, средняя длина предложения и индекс Флеша у топ-20 и у позиций 21–50 одинаковые. Почти всё, что между верхом и низом всё-таки различается, объясняется длиной текста.

Все метрики SEO-анализа текста: топ-20 против позиций 21–50
Метрики SEO-анализа текста: топ-20 против позиций 21–50 в Google
МетрикаОриентир инструментаТоп-2021–50Из 100, верх против низаИз 100 при равной длине
Слов в тексте99484255,5
Водность, %до 31,723,723,550,549,8
Классическая тошнотапо длине текста4,94,654,351,2
Академическая тошнота, %до 4,42,42,548,150,2
Шаблонные обороты, %до 2,90050,349,7
Средняя длина предложения, слов8,9–18,112,412,649,749,9
Разнообразие лексики, %по длине текста53,355,245,848,4
Hapax legomena, %по длине текста73,674,845,948,8
Индекс Флешаот −18,24,43,750,850,4
Проверяемых чисел на 100 словот 0,96,25,751,351,5
BM25: вес слов запроса, % потолка73,070,752,950,6

Типичные значения страниц топ-20 и позиций 21–50 Google, тексты от 100 слов, 2767 и 3569 страниц. «Из 100, верх против низа» — в скольких парах «страница топ-20 и страница ниже» значение больше у верхней. «При равной длине» — то же, но пары составлены из страниц одинаковой длины. Слова посчитаны анализатором по его разбору страницы, поэтому числа отличаются от объёма основного текста выше в статье.

В топе тексты длиннее: 994 слова против 842. У длинного текста механически ниже разнообразие лексики, потому что слова начинают повторяться, и выше классическая тошнота: самое частое слово встречается больше раз. Сравните страницы одинаковой длины, и все эти различия сходятся к 48–52 из 100, почти к 50.

Похоже на текстовый сигнал только одно: вес слов запроса по BM25. У топ-20 он чуть выше, 73% потолка против 71%, и перевес виден даже у страниц одного сайта: у 308 сайтов верхняя страница набирает больше веса, у 245 меньше. Но у текстов одинаковой длины разница почти пропадает, до 50,6 из 100. Длинный текст просто чаще повторяет слова запроса.

Вердикт инструмента тоже не различает верх и низ. По шести основным метрикам 81,8% страниц топ-20 проходят без единого «нужно исправить», у позиций 21–50 таких 83,1%.

Зато прогон нашёл проблему в самом инструменте: привычные нормы читаемости к выдаче не подходили. По ним «нужно исправить» получала почти вся выдача: индекс Флеша ниже 25 у 91% страниц из первых пятидесяти мест, LIX выше 55 у 96%, длинных слов больше 40% у 97%. В топ-20 и ниже доли одинаковые. Похоже, для плотного SEO-текста с терминами, названиями и цифрами эти нормы были слишком строгими. По этим данным я пересчитал ориентиры инструмента, об этом ниже.

В Яндексе метрики текста разделяют верх заметнее. В первой десятке слова запроса набирают больше веса по BM25: 73,3% потолка против 69,2%. Перевес держится и по отдельным запросам, 110 выдач против 50, и внутри одного сайта, 80 сайтов против 50. Имён собственных наверху тоже больше, 8,4 на 100 слов против 6,8, но внутри сайта эта разница не держится. Сходится с тем, что полный ключ в title и description в Яндексе до сих пор чаще стоит наверху.

Закономерность по типу запроса

Сильнее, чем от места в выдаче, метрики текста зависят от того, какой это запрос. Транзакционные страницы короче и суше, информационные длиннее и водянистее. Это разведка: разрез я придумал после данных.

Метрики текста по классу запроса: все значения
Типичные значения метрик текста по классу запроса в Google
Класс запросаЗапросовСлов в текстеВодность, %Академическая тошнота, %Чисел на 100 словBM25, % потолка
Коммерческие8390623,02,56,769,5
Транзакционные2875319,63,812,861,7
Информационные30106826,61,82,979,2
Смешанные1890924,82,34,579,0

Google, позиции 1–50, тексты от 100 слов, типичные значения. Класс запроса записан в картах интента до оценки документов.

Транзакционная страница с ценами и характеристиками набирает 12,8 числа на 100 слов и 3,8% академической тошноты: похоже, названия товара и слова запроса стоят в ней плотнее. Информационная статья разбавляет их пояснениями, отсюда 26,6% воды и 2,9 числа на 100 слов. Поэтому сравнивайте водность и тошноту со страницами того же типа запроса. Общая норма здесь мало что говорит.

Калибровка: новые ориентиры SEO-анализа текста

Прежние ориентиры инструмента были редакторскими: так пишут в учебниках и чек-листах. Теперь они сняты с выдачи. Я взял из этого замера 5464 текстовые страницы, то есть страницы, где связный текст занимает не меньше 40% объёма: 3848 из Google и 1616 из Яндекса. «В норме» теперь значит «как у девяти страниц выдачи из десяти». «Нужно исправить» инструмент ставит, только если текст выходит за границу, за которой лежат 5% страниц выдачи.

Классическая тошнота, разнообразие лексики, hapax, энтропия и размах длин предложений сильно зависят от длины текста. У них ориентиры свои для текстов до 500 слов, от 500 до 1500 и длиннее.

Прежние и новые ориентиры инструмента: таблица
Прежние и новые ориентиры SEO-анализа текста
МетрикаБыло: в нормеСтало: в нормеСтало: нужно исправить«Нужно исправить» у страниц выдачи: было → стало
Водность, %до 40до 31,7выше 33,40% → 5%
Классическая тошнотадо 7до 4,6 / 6,3 / 9,4выше 5,6 / 7,1 / 11,74% → 5%
Академическая тошнота, %до 9до 4,4выше 5,80,6% → 5%
Шаблонные обороты, %до 15до 2,9выше 4,20,1% → 5%
Средняя длина предложения, слов10–208,9–18,1меньше 7,2 или больше 35,44% → 5%
Разнообразие лексики, %от 40от 51,5 / 46,3 / 34,9ниже 43,0 / 40,5 / 25,63% → 5%
Индекс Флешаот 40от −18,2ниже −28,294% → 5%
LIXдо 45до 80,9выше 85,698% → 5%
Длинных слов, %до 30до 64,9выше 67,499% → 5%

Три значения через косую черту — для текстов до 500 слов, от 500 до 1500 и от 1500 слов. MATTR, hapax, энтропия, ритм, размах длин, повтор 3-грамм, числа, имена собственные и пассив пересчитаны по тому же правилу. Доли «нужно исправить» посчитаны по тем же 5464 текстовым страницам. По тем же нормам считаются рекомендации сервера и балл «Текст» в полном SEO-аудите сайта.

У такого правила есть цена: основные метрики стали строже. По прежним ориентирам без единого «нужно исправить» по шести основным метрикам проходили 92% текстовых страниц выдачи, по новым — 80%. Зато вердикт больше не ругает то, что есть почти у всей выдачи: низкий индекс Флеша и длинные слова.

Второе изменение в инструменте: рядом с каждой метрикой он теперь показывает, где текст стоит среди страниц выдачи и какое значение у типичной страницы.

Эталон: типичные значения SEO-анализа текста на страницах выдачи

Как и с детектором, это справка, чтобы сверять свой текст. Таблица в блоке ниже посчитана по тем же текстовым страницам, что и новые ориентиры, поэтому числа совпадают с тем, что покажет SEO-анализ текста.

Все метрики SEO-анализа текста: типичные значения выдачи
Типичные значения метрик SEO-анализа текста на текстовых страницах выдачи Google и Яндекса
Метрика в инструментеОриентир инструментаGoogle, типичная страницаGoogle, средняя половинаЯндекс, типичная страницаЯндекс, средняя половина
Слов в тексте949570…15101085640…1648
Водность, %до 31,725,622,0…28,925,521,9…29,0
Классическая тошнотапо длине текста4,53,5…5,74,63,6…5,7
Академическая тошнота, %до 4,42,11,5…3,01,91,4…2,8
Шаблонные обороты, %до 2,900…1,400…1,2
Средняя длина предложения, слов8,9–18,112,110,3…14,512,010,2…14,4
Разнообразие лексики, %по длине текста56,450,0…62,855,549,1…61,1
MATTR, %от 80,791,587,7…93,791,487,7…93,5
Burstinessот 0,490,760,58…1,040,800,60…1,09
Повтор 3-грамм, %до 10,02,51,2…4,82,71,4…5,2
Индекс Флешаот −18,24,3−6,0…13,35,6−5,4…14,1
LIXдо 80,969,865,2…75,069,164,6…74,7
Длинных слов, %до 64,957,353,5…61,356,952,9…60,7
Проверяемых чисел на 100 словот 0,94,21,9…8,24,52,3…8,1
Имён собственных на 100 словот 1,34,52,4…8,45,02,5…9,0
Пассив, % предложенийдо 26,214,08,9…20,313,38,5…19,2

Текстовые страницы: от 150 слов связного текста, и связный текст занимает не меньше 40% страницы; тексты от 100 слов. Google — 3848 страниц, позиции 1–50; Яндекс — 1616 страниц, позиции 1–10 и нечётные 31–49. Ориентир — новая граница «в норме» в инструменте. У классической тошноты и разнообразия лексики он зависит от длины текста, значения — в таблице выше.

Читается это так. Типичная текстовая страница выдачи — около тысячи слов, воды около 26%, академической тошноты около 2%, предложения по 12 слов. Индекс Флеша у неё около 4–6: для SEO-текста в выдаче это обычное значение.

Что это значит для SEO Вода, тошнота и читабельность позиций в Google не объясняют. Шлифовать эти цифры внутри средней половины выдачи смысла нет: в этих данных они с местом не связаны. Смотрите на выбросы. Если инструмент ставит «нужно исправить», текст вышел за границу, за которой лежат 5% страниц выдачи: например, воды больше 33,4% при типичных 26%. Такой текст стоит перечитать руками. Сравнивайте со страницами своего типа запроса: норма коммерческой карточки и информационной статьи разная. Низкий индекс Флеша у SEO-текста скорее норма, у 91% страниц выдачи он ниже 25.

Итог по тексту: два SEO-ритуала подряд, «Google наказывает ИИ-текст» и «чистим воду и тошноту», на этой выдаче позиций не объяснили. Остаётся то, что лежит под текстом: код, вес и скорость страницы.

Техничка: топ тяжелее, но это свойство сайта

выдержал проверки

Ожидание

Лёгкая и быстрая страница стоит выше

В данных

Наверху страницы крупнее, а сервер отвечает так же. Разница по размеру в основном между разными сайтами

Если верить привычным техническим рекомендациям, наверху должны стоять лёгкие и быстрые страницы. Данные спорят с этим с первого же графика: верхние страницы тяжелее. Сервер у них отвечает так же, как у соседей снизу, а сам документ крупнее.

Но есть подвох. Стоит сравнить между собой две страницы одного сайта, и почти вся эта разница исчезает. Большой HTML оказался побочным признаком крупных сайтов с тяжёлыми шаблонами, и растить его ради позиций незачем.

Техничку я снял тем же аудитом, что в замере Яндекса: Site Audit Pro прошёл по каждому адресу выдачи и записал около сотни полей. В счёт пошли 5753 страницы Google, которые отдали код 200 и настоящее содержимое: 2469 из топ-20 и 3284 с позиций 21–50. По размеру картина повторяет Яндекс, только мягче.

Текст страницы
Охват темы

Ровно держится до двадцатого места. После границы начинается спуск.

Покрытие LSI по полосам позиций GoogleМедиана покрытия LSI: 0,551 на позициях 1–3, 0,567 на 4–10, 0,540 на 11–20, 0,521 на 21–30, 0,506 на 31–40, 0,486 на 41–50.0,480,520,56граница топ-200,5511–30,5674–100,54011–200,52121–300,50631–400,48641–50места в выдаче
Техничка
Размер HTML, КБ

Спускается с первого места. На границе двадцатки отдельной ступеньки нет.

Размер HTML по полосам позиций GoogleМедиана размера HTML: 292 КБ на позициях 1–3, 261 КБ на 4–10, 229 КБ на 11–20, 222 КБ на 21–30, 206 КБ на 31–40, 185 КБ на 41–50.180240300граница топ-202921–32614–1022911–2022221–3020631–4018541–50места в выдаче

Медианы по полосам позиций Google, Москва, 14.09.2026. Охват темы — доля тематических слов запроса на странице, 5964 страницы с текстом. Размер HTML — 5753 страницы. Шкалы начинаются не с нуля, чтобы была видна форма кривой. Терракотовым отмечены полосы топ-20.

Охват темы ведёт себя как граница двадцатки, размер HTML — как плавный профиль сайтов. Графики показывают форму данных, причину они не доказывают.

Документ легчает ровно, место за местом, без скачка на границе двадцатки. У тематического покрытия и FAQ картина другая: там перелом приходится ровно на третью страницу выдачи.

Сама связь слабая. По шкале от −1 до 1, где ноль значит «связи нет», здесь выходит −0,122, почти ноль. Верх от низа по размеру отличить можно, место конкретной страницы по нему не угадаешь. Минус стоит потому, что у верхних мест номера меньше.

Чем верх отличается от низа, а чем нет

В аудите 49 числовых полей. Если проверить полсотни признаков, пара-тройка разниц найдётся чисто случайно, поэтому я делал поправку на число проверок. После неё разница держится у двадцати одного поля, и почти все они про одно: сколько на странице всего. Слов, узлов, картинок, ссылок, призывов к действию, блоков разметки.

Числовые признаки аудита: медианы топ-20 и позиций 21–50
Технические признаки: топ-20 против позиций 21–50 в Google
Признак, медианаТоп-2021–50AUC [95% ДИ]
Слов на всей странице1697143457,2 [55,8; 58,6]
Уникальных слов84872956,6 [55,2; 58,0]
DOM-узлов1455121856,5 [55,1; 57,8]
Размер HTML, КБ24620756,0 [54,7; 57,4]
Картинок372955,8 [54,5; 57,2]
Ссылок на странице17614455,8 [54,0; 57,4]
Элементов призыва к действию151255,8 [54,4; 57,2]
Объектов микроразметки5454,1 [52,6; 55,6]
Списков191753,9 [52,2; 55,4]
Файлов JavaScript121250,9 [49,4; 52,5]
Файлов CSS6551,0 [49,4; 52,7]
Блокирующих скриптов2249,8 [48,3; 51,4]
Время ответа сервера, мс60660149,8 [48,4; 51,0]
Разнообразие слов0,5150,53445,3 [43,8; 46,7]
Доля шаблонного текста, %1,51,646,0 [44,6; 47,5]

AUC — та же шкала «из 100», 50 означает случайный выбор. Выше 50 признак больше у топ-20, ниже 50 — у позиций 21–50. Разнообразие слов — доля уникальных слов в тексте. У длинных текстов она ниже сама собой, поэтому 45,3 не значит, что наверху пишут беднее.

Почти все различия сводятся к одному: страницы наверху крупнее и сложнее, по объёму на 16–28%. А число скриптов, файлов стилей и скорость сервера верх от низа почти не отличают.

Время ответа в топ-20 даже на пять миллисекунд больше, это меньше процента от 606 мс. Первые места тоже не отвечают заметно быстрее последних (550 мс на местах 1–3, 618 на 11–20, 608 на 41–50).

Проверка по запросам: в скольких выдачах верх крупнее
В скольких запросах медиана топ-20 больше медианы позиций 21–50
ПризнакВерх большеВерх меньшеp
Слов на всей странице12832< 0,001
DOM-узлов12139< 0,001
Картинок11049< 0,001
Размер HTML10852< 0,001
Файлов JavaScript80710,52
Время ответа сервера80801,0

Счёт по 160 запросам: в скольких выдачах у типичной страницы топ-20 признак больше, чем у позиций 21–50, и в скольких меньше. Ничьи не считаются. Если бы разницы не было, счёт выходил бы примерно ровным, как 80 на 80 у времени ответа.

Перевес по размеру держится в большинстве выдач, его не делают две-три гигантские страницы. По словам, узлам, картинкам и размеру HTML топ-20 крупнее соседей снизу в двух третях запросов и чаще. По скриптам и времени ответа выходит ничья.

Что стоит на страницах топ-20 чаще

Ещё 33 признака устроены по принципу «есть или нет». После той же поправки на число проверок разница держится у шести, и все шесть маленькие: от 2,5 до 5,1 процентного пункта.

Признаки «есть или нет»: доли страниц и поправка на число проверок
Доли страниц с техническими признаками в Google
ПризнакТоп-2021–50Разница, п. п.После поправки
Есть подсказки preload44,6%39,5%+5,1держится
Есть разметка Schema.org61,9%57,4%+4,6держится
Есть картинки WebP или AVIF25,8%22,0%+3,7держится
Ошибки в микроразметке14,6%11,8%+2,8держится
Блок FAQ по разметке аудита8,2%5,4%+2,8держится
HTML тяжелее 1 МБ9,1%6,6%+2,5держится
Хлебные крошки78,9%76,0%+2,9не держится
Canonical отсутствует21,8%24,4%−2,6не держится
Иерархия заголовков без пропусков62,5%60,0%+2,5не держится
Заголовок HSTS34,7%32,2%+2,4не держится
Заголовок CSP16,6%14,3%+2,3не держится
Open Graph76,8%74,6%+2,1не держится
Смешанный контент28,0%25,9%+2,1не держится
Отдаёт Last-Modified29,4%27,5%+1,9не держится
Ровно один H193,8%92,0%+1,8не держится
Кэширование включено76,1%74,5%+1,7не держится
Картинки без alt44,3%43,2%+1,1не держится
Тег main41,4%41,0%+0,4не держится
Контент зависит от JS93,8%93,2%+0,7не держится
Сжатие ответа97,7%98,2%−0,6не держится
Индексируемая99,4%99,4%+0,1не держится

«Держится» — разница пережила поправку на число проверок. Она нужна потому, что из 33 проверок при обычном пороге 0,05 одна-две прошли бы и без всякой связи. Без поправки разница «нашлась» бы ещё у хлебных крошек, отсутствия canonical, canonical на себя, CSP и ровно одного H1. Как именно считал, описано в методологии.

Картина та же, что в Яндексе: наверху одновременно аккуратнее и грязнее. Там чаще стоят preload, Schema.org и современные форматы картинок, но чаще встречаются ошибки в микроразметке и документы тяжелее мегабайта. Сильный сайт в Google тоже бывает неряшливым. А всё, что аудит обычно красит красным, от canonical до alt и HSTS, верх от низа не отличает.

Сводные баллы аудита о месте тоже почти ничего не говорят. Балл здоровья страницы у обеих групп одинаковый, 79,9. Балл качества HTML у топ-20 чуть выше, 87,5 против 85, но после поправки на число проверок эта разница может оказаться случайностью.

Балл скорости у топ-20 даже ниже: 78,6 против 82, или 46,4 из 100. Причина простая: движок снимает этот балл за размер документа, а наверху документы крупнее. Показывать клиенту такой балл как оценку шансов в выдаче нельзя.

Внутри одного сайта

Теперь обещанный подвох. На этой проверке в замере Яндекса развалилась почти вся техническая картина. Посмотрим, устоит ли она в Google. Беру сайты, у которых есть страницы и в топ-20, и на позициях 21–50, и сравниваю их верхние страницы с их же нижними. Каждый сайт даёт один голос: разница между его типичной верхней и типичной нижней страницей.

Разница между верхней и нижней страницей одного сайта
ПризнакМежду группамиВнутри сайтаОсталосьВерх больше / меньшеp
Размер HTML+39,2 КБ+5,8 КБ15%285 / 2190,004
DOM-узлов+237+2912%288 / 2150,001
Слов на всей странице+263+47,518%280 / 2240,014
Картинок+80245 / 1890,008
Время ответа сервера+5 мс0 мс252 / 2521,0
Файлов JavaScript / CSS0 / +10 / 094 / 83 и 64 / 780,45 и 0,28
Покрытие LSI+0,050+0,02652%295 / 2230,002

Техничка считалась по 505 сайтам со страницами в обеих группах, тематическое покрытие — по 529. «Верх больше / меньше» — у скольких сайтов верхняя страница больше нижней по признаку и у скольких меньше. «Осталось» — какая часть разрыва между группами сохраняется внутри одного сайта: 5,8 КБ из 39,2 — это 15%.

Между разными сайтами
+39,2 КБ
Внутри одного сайта
+5,8 КБ

Настолько HTML верхней страницы тяжелее нижней. Внутри одного сайта от разрыва между сайтами остаётся 15%.

Не устояла.

Направление, правда, сохранилось: верхняя страница сайта чаще крупнее его же нижней, и случайностью такой счёт не объяснить. Но от самой разницы осталась шестая-восьмая часть. По серверу и подключениям остался ровно ноль, они у страниц одного сайта общие.

Выходит, технический размер в основном принадлежит площадке: шаблону, CMS, числу блоков на странице. Большой HTML у лидеров пришёл вместе с сайтом, и тяжелить свою страницу вслед за ними незачем.

Пятьсот с лишним сайтов в одной таблице остаются абстракцией. Две пары страниц понятнее: вот два сайта, которые попали в выборку дважды по одному запросу, «остекление балкона под ключ».

Две страницы одного сайта по одному запросу
СтраницаМестоJS / CSSHTML, КБDOMСловИнтентLSI
okno-msk.ru — остекление балкона 3 м44 / 3192194410577 из 90,57
okno-msk.ru — остекление балконов и лоджий414 / 320519785116 из 90,40
okno.ru — балкон под ключ632 / 3131926998847 из 90,54
okno.ru — отделка балконов и лоджий4032 / 31307271716588 из 90,60

Техничка внутри каждой пары почти одинаковая: подключений поровну, DOM расходится на 34 и 18 узлов, HTML на 11–13 килобайт. Страницы расходятся там, где техничка заканчивается. У okno-msk.ru нижняя страница вдвое короче и беднее по теме. У okno.ru наоборот: нижняя длиннее и полнее, но она про отделку балконов, а человек ищет остекление. Выше стоит та страница сайта, которая сделана под этот запрос.

Две пары ничего не доказывают. Зато они показывают, где искать разницу между страницами одного сайта: в тексте и в том, под какой запрос страница сделана.

Сервер, сеть и robots.txt

Может, верх держится на инфраструктуре: HTTP/2, защите, настройках сервера? Этот слой описывает хост целиком, поэтому единица счёта здесь сайт. Сайты со страницами в обеих группах я убрал, иначе один сервер голосовал бы за оба лагеря. Осталось 1273 сайта только из топ-20 и 2102 только с позиций 21–50.

Сеть, сервер и robots.txt: доли сайтов в обеих группах
Сеть, сервер и robots.txt по сайтам
Признак сайтаТоп-2021–50p
HTTP/285,6%85,9%0,83
Заголовок HSTS26,6%27,7%0,54
Сжатие gzip / brotli93,4% / 3,0%91,4% / 4,3%0,05 / 0,09
Переадресация http → https93,5%94,0%0,64
Мягкий 404: несуществующий адрес отдаёт 2002,7%2,8%0,90
Сервер nginx71,9%73,2%0,47
Защита DDoS-Guard / Qrator11,3% / 3,0%9,5% / 1,9%0,14 / 0,07
Cloudflare0,6%1,5%0,02
IPv60,1%0,0%0,19
Clean-param в robots.txt54,2%45,6%< 0,001
Блок User-agent: Yandex51,6%45,5%0,002
Директива Host36,5%39,1%0,18
Crawl-delay9,9%9,1%0,46
Sitemap указан в robots.txt92,6%90,9%0,12
Правила для AI-ботов5,2%5,8%0,52
Размер robots.txt, медиана1521 байт1184 байтаAUC 55,8
Строк Disallow, медиана4232AUC 56,4

Замер по хосту каждого сайта. Поправки на число проверок здесь нет, поэтому из шестнадцати строк одна-две могут пройти порог 0,05 случайно.

Инфраструктура у двух групп одинаковая: HTTP/2, HSTS, переадресация на https, мягкие 404 и серверы встречаются с той же частотой. Выделяется только то, как ведут файл robots.txt. Наверху чаще стоит Clean-param (директива, которая сообщает Яндексу, какие параметры адреса не меняют содержимое страницы) и отдельный блок для Яндекса, а сам файл крупнее и правил в нём больше. Обе директивы адресованы Яндексу: в спецификации Google поддерживаются только user-agent, allow, disallow и sitemap. Google их не читает. Поэтому совпадение с его топом похоже на след: если robots.txt кто-то регулярно правит, сайт обслуживают и в остальном.

Сколько технической грязи на странице

Чеклист обещает: уберите ошибки, и обгоните конкурента. Проверяю это так же, как в Яндексе. Беру пять претензий, которые выкатывает любой краулер: ошибки микроразметки, параметры в адресе, смешанный контент, картинки без alt, скрытый контент. И считаю, сколько их на одной странице.

4 из 5

страниц топ-20 живут хотя бы с одной типовой претензией краулера и всё равно стоят в топе

Без единой претензии: 19,6% страниц топ-20 и 22,7% страниц ниже двадцатого места.

Точные доли: сколько претензий на странице
Сколько типовых проблем на одной странице
Претензий на страницеТоп-2021–50
ни одной19,6%22,7%
одна39,2%39,3%
две30,5%28,0%
три и больше10,7%10,0%

Если представить топ Google выпускным классом SEO-аудита, отличников в нём мало, и на первых партах их даже меньше, чем на последних.

С коридорами то же, что в Яндексе. Коридором я называю диапазон, в котором лежит средняя половина страниц топ-20 по признаку: четверть топа ниже него, четверть выше. Во все шесть технических коридоров сразу (размер HTML, DOM, скрипты, стили, картинки и время ответа) попадает примерно одна страница топ-20 из двадцати, 4,7%. Ниже двадцатки таких 3,5%. Технически «идеальная» страница — редкость и наверху, и внизу.

Время ответа сервера по нишам
Разница времени ответа по нишам в Google
НишаТоп-20 минус 21–50AUC
Окна−66 мс44,6
Недвижимость−39 мс47,7
Ремонт−36 мс47,5
Товары для дома−34 мс49,5
Общепит−23 мс50,0
Образование−12 мс49,9
Стройматериалы−2 мс49,3
Финансы+4 мс48,3
IT-услуги+8 мс50,4
Автосервис+14 мс50,1
Бытовая техника+26 мс48,4
Красота+27 мс51,3
Спорт+35 мс49,9
Юруслуги+38 мс50,4
Медицина+46 мс53,3
Туризм+62 мс53,0

В семи нишах топ-20 отвечает быстрее, в девяти медленнее. Самый заметный перекос в окнах, 66 мс, но и там 44,6 из 100, недалеко от 50.

Что забрать в работу В Google техничка закрывается один раз на уровне шаблона. Время ответа, HTTP/2, сжатие, HSTS, canonical и alt у топ-20 и у позиций 21–50 одинаковые, так что обещать за них позиции нечем. Чинить стоит то, что мешает роботу: недоступность, мягкие 404, закрытые от индекса страницы. Гнать вес страницы к топу незачем. Разницу между страницами одного сайта ищите в тексте и в том, под какой запрос страница сделана.

Тип страницы и совпадение с интентом

не выдержал

Если технически страницы одного сайта почти одинаковы, чем тогда объясняется разница между ними? Первым просится тип страницы. Под «купить» нужен каталог, под «как выбрать» — статья. На эту гипотезу я ставил больше, чем на любую метрику покрытия: страница нужного запросу типа должна стоять выше.

Проверить её в задуманном виде не вышло. В картах интента, которые я записал до оценки первого документа, есть только класс запроса: коммерческий или информационный. Какой тип страницы нужен запросу, там не сказано. Поэтому ниже замена, придуманная уже после данных: класс запроса против типа страницы, который определил слепой оценщик.

−10база 50,7%+10
Категория товаров86 документов
54,7% в топ-20
Страница услуги465 документов
51,4% в топ-20
Агрегатор, каталог компаний149 документов
51,0% в топ-20
Статья, руководство278 документов
50,7% в топ-20
Обзор, рейтинг59 документов
45,8% в топ-20

Доля документов слепой оценки Google, стоящих в топ-20, по типу страницы. Смешанные запросы исключены. В выборке верх и низ поровну, поэтому база около 50%.

Ни один тип страницы не даёт заметного преимущества. Разброс от 45,8% до 54,7% на небольших группах.

Ставка не сыграла. Четыре страницы из пяти подходят под класс запроса и в топ-20, и на позициях 21–50: 79,8% против 77,8%. Такую разницу легко получить случайно (51,0 из 100, p = 0,34). Подходящий тип внутри первых пятидесяти мест есть почти у всех, поэтому верх от низа он не отличает. Что происходит за пятидесятым местом, замер не видел.

В Яндексе расчёт дал почти то же, 81,4% против 80,9%, но там выделяется один тип: агрегаторы стоят в топ-10 в 66,2% случаев (71 документ). В Google у агрегаторов 51,0%, ровно по базе.

Сколько интентов и LSI нужно для топ-20

Тип страницы верх от низа не отличает, значит, остаётся содержание. А любой бриф на текст рано или поздно упирается в число. Сколько вопросов пользователя закрыть и сколько тематических слов добавить, чтобы страница хотя бы вошла в двадцатку? Если такой порог есть, в данных он выглядит как ступенька: ниже неё страницы в топ-20 почти не попадают, выше — попадают заметно чаще.

Ступеньки нет.

Ни по числу закрытых вопросов, ни по тематическому покрытию. Но ведут себя эти величины по-разному. Закрытые вопросы почти до самого верха долю в топе не сдвигают. Тематическое покрытие поднимает её плавно, полоса за полосой.

Разрезы и пороги в этом разделе я выбирал, когда уже видел данные, так что это разведка.

Полнота интента: ровно до самых полных страниц

−10база 50,7%+10
Меньше 20%152 документа
48,7% в топ-20
20–40%312 документов
47,1% в топ-20
40–60%369 документов
52,3% в топ-20
60–80%303 документа
51,2% в топ-20
80% и больше92 документа
58,7% в топ-20

Доля составляющих, раскрытых полностью, и доля документов этой полосы, стоящих в топ-20. 1228 документов слепой оценки Google. У последней полосы документов мало, и её перевес может оказаться случайным (интервал [49,4; 69,3] захватывает 50).

Пока страница раскрывает меньше 80% вопросов, доля в топе стоит на месте. У самых полных страниц она выше, но их всего 92, и прибавка может оказаться случайностью.

Если считать закрытые вопросы штуками, картина та же. Пока страница полностью раскрывает до шести составляющих, доля в топе держится около половины: 49,8%, 46,9% и 52,3% для полос «0–2», «3–4» и «5–6». Заметный плюс есть только у страниц, закрывших семь и больше, — 55,6%.

Это единственная полоса, где перевес не похож на чистую случайность. Но и он на грани: даже осторожная оценка почти совпадает со средним по выборке, 50,7% (интервал [50,6; 60,5]).

Охват темы: ровный подъём

−10база 44,0%+10
Меньше 0,3992 страницы
38,6% в топ-20
0,3–0,4721 страница
40,1% в топ-20
0,4–0,5966 страниц
41,0% в топ-20
0,5–0,61036 страниц
44,0% в топ-20
0,6–0,7969 страниц
45,5% в топ-20
0,7 и больше1280 страниц
51,3% в топ-20

Все 5964 страницы Google с посчитанным покрытием, позиции 1–50. База — доля страниц топ-20 в этом наборе. Она ниже 50%, потому что страниц с позиций 21–50 с посчитанным покрытием больше: 3342 против 2622. У верхней полосы интервал [48,6; 54,0], у нижней [35,8; 41,8].

Каждая следующая полоса покрытия стоит в топе чуть чаще предыдущей. От нижней полосы до верхней — почти 13 пунктов.

У тематического покрытия высокой ступеньки тоже нет, зато есть пологая лестница. Чем больше тематических слов выдачи есть на странице, тем чаще она стоит в топе, и так на каждой полосе. Страница, на которой нашлось 70% списка и больше, встречается в топ-20 на треть чаще страницы, где их меньше 30%: 51,3% против 38,6%.

Эта разница держится: даже с учётом разброса крайние полосы не сходятся. Каждые десять пунктов покрытия добавляют к доле в топе от 0,9 до 5,8 пункта.

Считать от типичной страницы своей выдачи

Абсолютные пороги плохо переносятся между запросами. Для «туров в Турцию» страница, которая раскрыла половину вопросов, слабая. Для узкого коммерческого запроса с тремя составляющими — нормальная. Поэтому я сравнил каждую страницу с медианой её же выдачи, то есть с типичной страницей по этому запросу: полнее она соседей или слабее.

Не полнее соседей ни по одному
46,3%

в топ-20. Страница не полнее типичной в своей выдаче ни по вопросам, ни по охвату темы. 505 документов, интервал [42,7; 50,0]

Сильнее по одному
51,6%

в топ-20. Полнее типичной страницы либо по вопросам, либо по охвату темы. 401 документ

Сильнее по обоим
56,5%

в топ-20. Полнее типичной страницы и по вопросам, и по охвату темы. 322 документа, интервал [51,5; 61,3]

Разница 10 пунктов. Страница, которая обходит соседей по выдаче и по интенту, и по тематике, стоит в топ-20 заметно чаще той, что не обходит их ни по одному. Интервалы крайних групп не пересекаются.
Доля в топе растёт вместе с отрывом от своей выдачи. 1228 документов слепой оценки Google, типичная страница определяется внутри каждого запроса. Разведка: этот разрез придуман после данных.

По отдельности каждый признак ведёт себя так же. Страницы, которые отвечают на вопросы полнее соседей по выдаче, стоят в топ-20 в 55,0% случаев, слабее соседей — в 47,5% (интервалы [51,1; 59,0] и [44,1; 51,3]). По тематическому покрытию: выше типичной страницы запроса — 47,9%, ниже — 40,5% при базе 44,0%.

Как задавать это в брифе

Вопросы пользователя. Составьте список вопросов, которые стоят за запросом, и проверьте по нему страницы топ-20: сколько вопросов каждая раскрывает полностью. Ваша страница должна закрыть не меньше, чем типичная из них. Для ориентира: у типичной страницы топ-20 Google закрыто 5 составляющих из 10, у верхней четверти — 6, у верхней десятой части — около 8.

Тематическое покрытие. Соберите тематические слова по той же выдаче и посчитайте, какая доля списка есть у каждого соседа. Типичная страница топ-20 содержит около 56% списка, верхняя четверть — от 70%. Смотрите, каких тем из списка у вас нет, и закрывайте их разделами. Слово, вставленное ради процента, тему не раскрывает.

Где остановиться. Страница, которая обходит соседей и по вопросам, и по темам, стоит в топ-20 на 10 пунктов чаще той, что отстаёт по обоим. Это вся прибавка, которую удалось измерить. Выше покрытия 70% полосы я не дробил, так что о пользе дописывания сверх этого данных нет. Даёт ли раскрытие вопросов что-то сверх тематического покрытия, замер отдельно не проверял. Если страница уже полнее выдачи по обоим признакам, следующий резерв ищите в ссылках, бренде и коммерческих свойствах.

Для сравнения Яндекс. Там закрытые вопросы не связаны с попаданием в топ-10 ни в одном разрезе: доля в топе по полосам полноты скачет около половины без всякого направления (51,7%, 52,3%, 49,2%, 47,1% и 50,0%). Верхняя полоса тематического покрытия и в Яндексе выше базы: при покрытии 70% и выше в топ-10 стоят 58,2% страниц, ниже 30% — 47,2% при базе 48,8%. Но ровного подъёма там нет, средние полосы проседают до 39,6%.

Прежде чем нести эти доли в бриф, одна оговорка. Эксперимента я не ставил, это взгляд на выдачу со стороны. Полная страница может чаще стоять в топе просто потому, что её делают сильные команды на сильных сайтах. Поднимет ли дописывание именно вашу страницу, покажет только правка собственных страниц. И доля в топе здесь не равна шансу попасть туда: выборка собрана поровну из верха и низа выдачи.

Что это значит для SEO Универсального числа «сколько раскрыть» для Google эти данные не дают. Рабочее правило для брифа — страница раскрывает больше вопросов и больше тем, чем типичная страница топ-20 по этому запросу. Такие страницы стоят в топе на 10 пунктов чаще отстающих по обоим признакам. Когда этот уровень взят, текст, судя по данным, перестаёт быть узким местом.

Составляющие, которые не закрыл никто

Раз страница, которая обходит соседей, чаще стоит в топе, дешевле всего обходить их там, где соседи не ответили вообще. По каждой составляющей я проверил, раскрыл ли её полностью хоть один проверенный документ этого запроса, из Google или из Яндекса.

Не закрыта ни разу
146 из 1533

составляющих, 9,5%. Ни один проверенный документ не ответил на них полностью

Закрыта редко
258

составляющих, включая эти 146, раскрыты полностью меньше чем у 15% документов своего запроса

Где есть дыры
81 из 159

запросов, во всех шестнадцати нишах

В половине запросов есть вопрос, на который выдача не отвечает. Составляющие взяты из спроса, хотя часть из них соседняя по смыслу.
Примеры составляющих интента, которые не раскрыл ни один проверенный документ
ЗапросЧто осталось без ответа
секция единоборств для детейтребования к медицинской справке для допуска к занятиям
компьютерная диагностика автомобилябесплатная диагностика
замена масла в двигателе стоимостьобъём масла для замены
купить квартиру в новостройке москвасравнение новостройки и вторичного жилья
лечение кариеса стоимостьлечение по ОМС
мультиварка или скороварка что лучшесравнение с аэрогрилем

На запрос я проверял до двенадцати документов, так что где-то на пятидесятом месте ответ может найтись. Для работы это мало что меняет: проверенные страницы топа на эти вопросы не отвечают.

Перед тем как закрывать такую дыру, убедитесь, что вопрос относится к вашей странице. «Сравнение с аэрогрилем» на странице про выбор между мультиваркой и скороваркой может оказаться лишним.

Что делать с этим на проекте Прежде чем переписывать то, что есть у всех, найдите, чего нет ни у кого. Обойти типичную страницу выдачи проще вопросом, на который не ответил ни один сосед, чем шлифовкой тем, закрытых у всех.

Дыры нашлись во всех шестнадцати нишах. Но значит ли это, что текст везде работает одинаково?

В какой нише что работает

Всё, что было выше, посчитано по шестнадцати нишам вместе, а средняя цифра умеет прятать исключения. Поэтому первый вопрос SEO-специалиста к такому замеру понятен: а в моей нише так же? Почти везде да. Охват темы отделяет топ-20 от страниц ниже в пятнадцати нишах из шестнадцати. Сила разная: сильнее всего разрыв в спорте, слабее всего в стройматериалах. А в юридических услугах страницы наверху по охвату темы от страниц ниже не отличаются совсем.

Спорт62,1
Бытовая техника58,9
Медицина58,3
Автосервис58,0
Товары для дома57,5
IT-услуги57,2
Ремонт57,0
Красота55,5
Общепит55,2
Образование54,8
Окна53,9
Недвижимость53,9
Туризм53,1
Финансы51,9
Стройматериалы51,3
Юруслуги48,9

В скольких парах из 100 страница топ-20 охватывает тему шире, чем страница с позиций 21–50. Google. Полоса показывает, насколько число ушло от 50. Тёмным — две ниши, где охват темы топ почти не отделяет.

В спорте охват темы отделяет топ сильнее, чем в любой другой нише. В юридических услугах не отделяет совсем.

Почему в стройматериалах и туризме охват темы работает слабо, подсказывает соседний столбец с весом страницы. Ниши, где топ выделяется тяжёлым HTML, и ниши, где он выделяется текстом, почти не пересекаются.

Что отделяет топ-20 Google по нишам
НишаLSI, AUCПолнота интента, AUCΔ HTML, КБ
Спорт62,159,8+7
Бытовая техника58,944,0+9
Медицина58,351,9+47
Автосервис58,060,7+50
Товары для дома57,561,0+115
IT-услуги57,254,1+23
Ремонт57,045,0+16
Красота55,555,0−10
Общепит55,254,4+62
Образование54,852,6+30
Окна53,955,9+111
Недвижимость53,956,2+39
Туризм53,154,8+163
Финансы51,944,0+39
Стройматериалы51,341,7+124
Юруслуги48,952,9+20

Δ HTML — насколько типичная страница топ-20 тяжелее типичной страницы с позиций 21–50 (разница медиан). На нишу приходится около 370 страниц для тематического покрытия и технички, но только около 80 документов, которые оценщик читал вслепую. Поэтому в столбце полноты цифры прыгают сильнее всего.

В спорте топ выделяется текстом. Верхняя страница пары здесь заметно чаще охватывает тему шире и полнее отвечает на вопросы пользователя, а HTML у неё тяжелее, чем у соседей снизу, всего на 7 КБ.

В стройматериалах и туризме картина обратная. Страницы наверху тяжелее на 124 и 163 КБ, а по охвату темы верх от низа почти не отличить. В стройматериалах страницы ниже двадцатого места даже полнее отвечают на вопросы, чем страницы топа.

Это ниши каталогов и агрегаторов. Среди проверенных страниц топ-20 они занимают 65% в стройматериалах и 49% в туризме. Для сравнения: в медицине 5%, в юруслугах 2%. По запросу «керамогранит для пола купить» наверху стоят каталоги Петровича и магазинов плитки, где основного текста 190–290 слов. Выдача по «турам в Турцию» из начала статьи устроена так же.

Что это значит для SEO Прежде чем заказывать текст, откройте топ своей ниши. Наверху статьи и страницы услуг, как в спорте, медицине или автосервисе? Тогда охват темы работает, и закрывать недостающие темы есть смысл. Наверху каталоги крупных площадок, как в стройматериалах и туризме? Одним текстом их, похоже, не обогнать. Считать тогда стоит ассортимент, цену и силу сайта.

Сходится ли это с Google, Backlinko и Ашмановым

До этого места я спорил с чеклистом в одиночку, а свой замер легко принять за закон поиска. Поэтому я посмотрел, кто ещё проверял те же пункты и что у них вышло. Google публично перечисляет, на что не стоит тратить время. Backlinko вместе с Ahrefs проверял на 11,8 млн результатов Google, что идёт вместе с высокой позицией. Лаборатория поисковой аналитики «Ашманов и партнёры» сравнивала текстовые факторы Яндекса и Google.

Считали все по-разному, рынок другой, так что цифры в лоб не сравнишь. Зато можно сравнить, в какую сторону указывают выводы. Где они совпали, вывод держится не только на моих данных.

Google Search Central

Что это
Руководство по SEO для начинающих, раздел «Things we believe you shouldn't focus on»
Что пишут
«The length of the content alone doesn't matter for ranking purposes». Про число и порядок заголовков: «from Google Search perspective, it doesn't matter if you're using them out of order». Переспам ключами противоречит правилам
Как соотносится
Сходится. Возьмите две страницы с одинаковым охватом темы, и объём текста перестаёт что-то объяснять. Плотность ключа даёт 49,2 из 100, почти 50. Подзаголовков H2 в топ-20 больше, но, скорее всего, просто потому, что там закрыто больше тем

Backlinko

Выборка
11,8 млн результатов Google, данные Ahrefs и Clearscope, страница обновлена 14 апреля 2025
Что нашли
Полный по теме контент с высоким Content Grade заметно обходил неполный. Ключ в title — «essentially zero correlation». Прямой связи числа слов с позицией нет. Размер HTML с позицией не связан
Как соотносится
По тексту сходится почти целиком. Их Content Grade ближе всего к моему тематическому покрытию. Расходимся по размеру HTML. У меня страницы топ-20 тяжелее, но стоит сравнить страницы одного сайта, и от разницы остаётся малая часть

Ашманов и партнёры

Выборка
Информационные выборки «Косметика», «Гаджеты», «Наука» в Яндексе и Google, статья Лаборатории поисковой аналитики от 9 сентября 2024
Что пишут
«Значения текстовых параметров в Google ниже, но зависимость позиций от них сильнее и наблюдается чаще». Поисковики учитывают «другие слова по теме». Концентрация слов запроса в тексте «не показывает значимую корреляцию с позицией». Для title в Google корреляция с позицией «если и была, то очень слабая»
Как соотносится
Сходится по тематическим словам, плотности ключа и title. Сходится и вывод про поисковики: в Google текст отделяет верх сильнее, чем в Яндексе, это видно в конце статьи. Расходимся в объёме текста. У Лаборатории он «сильный параметр для ранжирования», у меня при одинаковом охвате темы объём перестаёт что-то объяснять. Разница ещё и в том, что считали: Лаборатория меряет текст страницы целиком, вместе с меню и перелинковкой, я — только основной текст
Сверка выводов с Google и Backlinko
ПризнакGoogle, Backlinko, АшмановЭтот замер
Полнота раскрытия темыBacklinko: полный контент обходит неполный. Ашманов: учитываются «другие слова по теме»LSI: 53,8 из 100, держится во всех проверках. Полнота интента: 52,3, но при равной длине текста перестаёт держаться
Ключ в title и H1Backlinko: связи почти нет. Ашманов: для title в Google корреляция «если и была, то очень слабая»50,6 и 50,0 из 100
Длина текстаGoogle: сама по себе не важна. Backlinko: прямой связи нет. Ашманов: «сильный параметр»53,4 из 100, при равном покрытии LSI может оказаться случайностью
Размер HTMLBacklinko: связи нет54,5 из 100 между разными сайтами. Внутри одного сайта от разницы остаётся 15%
СкоростьBacklinko: связи со скоростью домена нетВремя ответа сервера 49,4 из 100

Итог сверки короткий. По ключу в title, плотности ключа и ширине темы мои данные и чужие указывают в одну сторону. Расхождений два: объём текста у Ашманова и размер HTML у Backlinko.

С Backlinko по размеру HTML я разошёлся и в замере Яндекса. Объяснение, скорее всего, то же. Когда считаешь по всей выдаче сразу, в одну кучу попадают разные сайты, а крупные площадки с тяжёлыми шаблонами чаще стоят наверху. Сравните две страницы одного сайта, и от разницы мало что останется. Почему у Backlinko связи нет вовсе, мои данные не объясняют.

Коридор страницы топ-20

Почти все числа до этого места — медианы и перевесы в парах. Из таких замеров чаще всего выносят одну цифру: у типичной страницы топа столько-то слов, значит, и нам нужно столько же. Но наверху стоят страницы и в разы короче типичной, и в разы длиннее.

Поэтому свою страницу полезнее сверять с разбросом. По каждому признаку ниже пять точек: где кончается самая бедная десятая часть топ-20, где лежит средняя половина страниц, где середина и где начинается самая богатая десятая часть.

Текст страницы
2846 страниц топ-20
медиана
Слов основного тексташтук
1572 358
842коридор 408…1 480
Покрытие LSIдоля списка
0,240,79
0,556коридор 0,391…0,700
Подзаголовков H2штук
015
6коридор 2…10
Длина titleзнаков
44110
71коридор 56…89
Длина descriptionзнаков
91261
168коридор 134…210
Полнота интента
623 документа слепой оценки
медиана
Раскрыто полностьюдоля составляющих
0,170,78
0,50коридор 0,33…0,64
Раскрыто полностьюсоставляющих
17,8
5коридор 3…6
Техничка
2469 страниц топ-20
медиана
Размер HTMLкилобайты
81959
246коридор 141…504
DOM-узловштук
5734 102
1 455коридор 899…2 419
Картинокштук
8153
37коридор 17…80
Файлов JavaScriptштук
333
12коридор 6…22
Ответ серверамиллисекунды
3411 518
606коридор 436…899
тут лежит половина страниц топ-20серединакрая: по десятой части топа с каждой стороны

Google, Москва, 14.09.2026. Покрытие LSI посчитано у 2622 страниц топ-20.

Внутри топ-20 уживаются очень разные по объёму страницы. Основной текст на длинном краю в пятнадцать раз больше, чем на коротком, HTML — почти в двенадцать.
Как этим пользоваться Снимите со своей страницы те же признаки и найдите ей место на каждой полосе. Если значение лежит в средней части полосы, по этому признаку страница выглядит как типичная страница топа. Смотреть глазами надо на выпадения за края. Тематическое покрытие ниже 0,24, то есть меньше четверти тематических слов выдачи, значит, что на странице нет большинства тем, о которых говорит выдача. Основной текст короче 157 слов — сначала проверьте, отдаётся ли контент в HTML вообще. Меньше трёх полностью закрытых составляющих интента — страница отвечает на вопросы пользователя хуже трёх четвертей топа. Сам по себе коридор ничего не гарантирует: он показывает, где искать.
Все значения таблицей, с медианой позиций 21–50
Разброс признаков страницы в топ-20 Google
ПризнакКрай 10%Четверть нижеСерединаЧетверть вышеКрай 90%Медиана 21–50
Слов основного текста15740884214802358707
Покрытие LSI0,2440,3910,5560,7000,7920,506
Подзаголовков H202610155
Подзаголовков H30028192
Списков001026539
Длина title, знаков4456718911070
Длина description, знаков91134168210261162
Плотность ключа, %2,03,45,27,49,65,3
Полнота интента, доля на 20,1670,3330,5000,6360,7780,455
Раскрыто полностью, штук13567,84
Размер HTML, КБ81141246504959207
DOM-узлов5738991455241941021218
Картинок817378015329
Файлов JavaScript3612223312
Ответ сервера, мс3414366068991518601

Разбор реальной страницы

Хватит медиан, посмотрим на одну страницу. Самый неудобный для SEO-специалиста случай выглядит так. Страница отвечает почти на всё, о чём спрашивают люди, охватывает тему шире топа, техничка в норме. А она болтается на 45-м месте.

Такую страницу я искал нарочно. Среди позиций 21–50 взял ту, что по числу полностью раскрытых составляющих сильнее всего обгоняет лучшую проверенную страницу топ-20 своего запроса. При равенстве брал ту, у которой шире охват темы, и только из страниц с техническим аудитом. Правило я придумал, уже видя список кандидатов, поэтому это пример для наглядности. Доказательством он служить не может.

Нашлась remo-nt.ru: страница услуги с ценами, 45-е место по запросу «сколько стоит ремонт однокомнатной квартиры», ниша ремонта. Прогоним её по коридору из предыдущего раздела.

Диагностическая карта страницы
remo-nt.ru
«сколько стоит ремонт однокомнатной квартиры» · страница услуги с ценами
место в Google45
Признак
где страница среди топ-20 своего коридора
страница
Раскрыто полностьюсоставляющих интента
10 из 11выше края топа
Покрытие LSIдоля тематических слов
0,88выше края топа
Слов основного тексташтук
2247верхняя четверть
Размер HTMLКБ
185в норме
DOM-узловштук
1637в норме
Ответ серверамс
636в норме
Полный ключ в title«1-комнатной» вместо «однокомнатной»
у 43% страниц топ-20 полный ключ в title есть
нетне различает
половина страниц топ-20середина топаот края до края: без десятой части топа с каждой стороныremo-nt.ru
Та же карта таблицей
Разбор страницы по коридору топ-20 Google
ПризнакСтраницаКоридор топ-20Статус
Раскрыто полностью, составляющих10 из 113…6выше края топа
Покрытие LSI0,880,391…0,700выше края топа
Слов основного текста2247408…1480верхняя четверть
Размер HTML, КБ185141…504в норме
DOM-узлов1637899…2419в норме
Ответ сервера, мс636436…899в норме
Полный ключ в titleнету 43% топа естьне различает

По тексту это лучшая страница своей выдачи из проверенных. Из одиннадцати вопросов, которые стоят за запросом, она полностью отвечает на десять. Тему охватывает шире, чем девять страниц топ-20 из десяти.

Единственное, что не раскрыто полностью, — стоимость уборки после ремонта, и та упомянута. Причём полностью про уборку не написал ни один из двенадцати проверенных документов этого запроса.

Техничка тоже в норме: вес HTML, число DOM-узлов и ответ сервера лежат внутри коридора. Придраться можно только к title. Там «1-комнатной» вместо «однокомнатной», так что полного ключа формально нет. Выходит, по карте разбора страница не дотягивает ровно в одной привычной рекомендации, и как раз в той, которая топ-20 от страниц ниже не отличает.

Тогда кто её обходит? Проверенные страницы топ-20 по тому же запросу:

Страницы топ-20 по запросу «сколько стоит ремонт однокомнатной квартиры»
МестоСайтТипРаскрыто полностьюLSIСлов
4169.ruстатья6 из 110,701165
6profi.ruагрегатор0 из 110,03356
12profistroy1.ruстатья4 из 110,595185
17mir-rem.ruстраница услуги6 из 110,877500
45remo-nt.ruстраница услуги10 из 110,882247

У mir-rem.ru основной текст 7500 слов, у profistroy1.ru — 5185. Оценщик читал только первые 2500 слов, так что на деле эти страницы могут отвечать на вопросы полнее, чем показано в таблице.

Самый показательный сосед — Профи.ру на шестом месте. В его основной текст попали в основном отзывы о мастерах. Полного ответа ни на один из одиннадцати вопросов там нет, а тематических слов из списка набирается три на сотню.

Оговорюсь: во всём HTML страницы около 5300 слов, и часть цен могла просто не попасть в извлечённый текст. Главного это не меняет. Агрегатор с узнаваемым брендом стоит выше страниц, которые на вопрос о цене отвечают прямо.

А страница, которая отвечает на запрос полнее всех проверенных, так и болтается на 45-м месте.

Когда текст уже не главная проблема

Страница отвечает на вопросы полнее типичной страницы своей выдачи и шире охватывает тему. Техничка в коридоре. Страница сделана под этот запрос, и другая страница того же сайта его не перехватывает.

Дальше данные текстовой работе ничего не подсказывают. Страницы с тематическим покрытием выше 0,7 я на группы не делил, так что о пользе дописывания сверх этого сказать нечего. Впихнуть полный ключ в title? Ключ в title топ от низа не отличает. Раздуть текст? При равном охвате темы преимущество длины может оказаться случайностью. У remo-nt.ru раскрыто 10 вопросов из 11 и покрытие 0,88, а страница стоит на 45-м месте.

Здесь текстовая работа заканчивается. Дальше вопросы другого класса. Сколько ссылок на страницу и на сайт у тех, кто выше? Что страница показывает коммерчески: цены, отзывы, гарантии, способы связи? Узнают ли бренд по брендовым запросам? Этот замер их не трогал.

Если свести все разделы в одну шпаргалку, ситуаций у страницы набирается четыре. Страница remo-nt.ru попала в клетку «Хватит переписывать текст»: сильнее соседей по обоим признакам, но не в топ-20. Для каждой из четырёх следующий шаг свой.

Что делать в четырёх ситуациях

Шпаргалка вышла заметно короче чеклиста, с которого я начинал. Ключ в title и H1, плотность ключа и время ответа сервера топ-20 Google от страниц ниже не отделили. Число слов «как у топа» отделяет, но при равном охвате темы его перевес почти исчезает. Лёгкий HTML тоже не выдержал: между сайтами топ тяжелее, а внутри одного сайта от разницы остаётся малая часть. Полнота интента отделяет топ, но слабо. Почти все проверки выдержал один текстовый пункт, охват темы выдачи. На нём матрица и держится.

Вопросы пользователя ↓ · охват темы →
Тема уже, чем у соседей
Тема шире, чем у соседей
Отвечает полнее соседей
вопросы полнее · тема уже Добрать темы

На вопросы страница уже отвечает. Соберите тематические слова выдачи и допишите разделы под темы, которых нет.

в топ-20: 51,6%*
вопросы полнее · тема шире Хватит переписывать текст

Текст, похоже, уже не узкое место. Проверьте, та ли это страница сайта под запрос, потом ссылки, бренд и коммерческие свойства.

в топ-20: 56,5%. Здесь же remo-nt.ru с 45-го места
Отвечает слабее соседей
вопросы слабее · тема уже Дописывать

Закройте составляющие интента и темы, которые есть у соседей по выдаче.

в топ-20: 46,3%
вопросы слабее · тема шире Добрать вопросы

Тема раскрыта шире соседей, а на вопросы пользователя страница отвечает хуже. Закройте недостающие составляющие интента.

в топ-20: 51,6%*

Соседи — типичная страница выдачи того же запроса. Доли — сколько документов слепой оценки Google стоят в топ-20; верх и низ в выборке поровну, в среднем 50,7%. * 51,6% — обе клетки «сильнее по одному признаку» вместе. Даёт ли полнота интента что-то сверх охвата темы, я отдельно не проверял.

Отдельный случай: наверху каталоги крупных площадок с тяжёлыми шаблонами. Одним текстом их, похоже, не обогнать: в стройматериалах и туризме охват темы отделяет верх слабо, а каталоги и агрегаторы занимают половину и больше проверенных страниц топа. Считать тогда стоит ассортимент, цену, фильтры и силу сайта.
Та же шпаргалка таблицей
Что делать в четырёх ситуациях
СитуацияЧто делать
Страница слабее медианы выдачи и по интенту, и по LSIЗакрыть составляющие и темы, которые есть у соседей. В данных это связано с прибавкой: страницы слабее соседей по обоим признакам стоят в топ-20 в 46,3% случаев, сильнее по обоим — в 56,5%, в среднем по выборке 50,7%
Страница сильнее соседей по одному признакуДобрать второй. Страницы, которые сильнее соседей только по одному признаку, стоят в топ-20 реже, чем сильные по обоим: 51,6% против 56,5%. Даёт ли полнота интента что-то сверх LSI, я отдельно не проверял
Страница сильнее соседей по обоим, но не в топ-20Текст закончен. Проверить, та ли это страница сайта под этот запрос, потом смотреть ссылочный разрыв, бренд и коммерческие свойства
Наверху каталоги крупных площадок с тяжёлыми шаблонамиОдним текстом, похоже, не обогнать: в стройматериалах и туризме LSI отделяет верх слабо, а каталоги и агрегаторы — половина и больше проверенных страниц топа. Считать ассортимент, цену, фильтры и силу сайта
Отделяет топ-20

Делать

  • Темы, которые раскрывают соседи по выдаче вашего запроса
  • Вопросы пользователя, на которые не ответил никто из соседей
  • Отдельный раздел под каждую тему
Нужно, но не как рычаг

Держать в норме

  • Полнота интента не ниже, чем у типичного соседа по выдаче
  • Техничка в коридоре топ-20
  • Контент отдаётся в HTML
  • Страница сделана под этот запрос
  • Понятный title под клик
В Google топ этим не выделяется

Не тратить на это время

  • Ключ в title, H1 и description
  • Плотность ключа
  • Число слов «как у топа»
  • Время ответа сервера ради позиций

Google против Яндекса

Всё, что выше, снято с выдачи Google. У русскоязычного сайта есть ещё Яндекс, и сразу возникает вопрос: получится ли одна страница под оба поисковика? Сначала я посмотрел, насколько похожи сами выдачи. Те же 160 запросов я снимал в Яндексе на пять дней раньше, и без всякой статистики видно: выдачи разные.

Из десяти адресов первой страницы у двух поисковиков совпадают примерно два: в среднем 1,86, в типичной выдаче 2. В 33 выдачах из 160 общих адресов в первой десятке нет совсем. Общих доменов в типичной выдаче 3.

Граница здесь другая, чем в остальной статье. В Яндексе, как и в моём техническом замере Яндекса, я снимал только первую десятку и позиции 31–49 через одну. Чтобы сравнение было равным, Google делю так же: верх — позиции 1–10, низ — 31–49 через одну.

Что отделяет верх выдачи в Google и в Яндексе
ПризнакGoogle, верх / низAUCЯндекс, верх / низAUC
Полнота интента0,500 / 0,40056,30,455 / 0,50048,3
Покрытие LSI0,564 / 0,49157,60,586 / 0,53355,3
Слов основного текста858 / 66056,2837 / 79651,5
Подзаголовков H26 / 456,76 / 553,4
Полный ключ в title43,7% / 39,9%51,945,8% / 36,9%54,4
Полный ключ в description36,1% / 33,8%51,239,9% / 31,5%54,2
Есть FAQ26,5% / 19,3%53,628,1% / 21,1%53,5
Размер HTML, КБ270 / 19559,5384 / 23862,9
DOM-узлов1581 / 122058,71793 / 133159,9
Картинок40 / 2758,642 / 3455,2
Время ответа сервера, мс592 / 62547,1559 / 64142,4

Верх / низ — значения типичной страницы (медианы) и доли. AUC — та же шкала «из 100»: в скольких парах из ста значение у страницы сверху больше, чем у страницы снизу. У времени ответа число ниже 50 значит, что наверху сервер быстрее. Google — 14.09.2026, Яндекс — 09.09.2026, Москва. Время ответа снимали в разные дни разными прогонами. Поэтому Google с Яндексом по нему не сравнить, только верх с низом внутри одного поисковика. На основной границе статьи, топ-20 против 21–50, время ответа в Google верх от низа не отличает. На границе 1–10 против 31–49 первая десятка отвечает чуть быстрее: 47,1 из 100. Интервал, в котором лежит настоящее значение, от 44,9 до 49,4, целиком ниже 50, так что этот перевес выглядит устойчивым.

Google: кроме объёмов, верх отделяет
текст

Полнота интента 56,3, объём основного текста 56,2, подзаголовки 56,7 из 100. Ключ в title — всего 51,9, почти 50

Объёмы страницы: HTML 59,5, DOM 58,7, картинки 58,6

Яндекс: кроме объёмов, верх отделяют
ключ в title и description

Ключ в title 54,4 и в description 54,2 из 100, быстрый ответ сервера 42,4 (ниже 50 — наверху быстрее). Полнота интента 48,3 и объём текста 51,5 — около 50

Объёмы страницы: HTML 62,9, DOM 59,9, картинки 55,2

В обоих поисковиках верх сильнее всего отличается размером страницы: HTML, DOM, картинки. Если размер отложить, в Google верх заметнее выделяет текст, в Яндексе — ключ в title и description. Тематическое покрытие отделяет верх и там и там: 57,6 из 100 в Google и 55,3 в Яндексе, если сравнивать первую десятку с позициями 31–49. На всех парах страниц внутри одного запроса у каждого поисковика выходит по 53,8 из 100.

Главных различий три.

Первое — полнота интента, то есть на сколько вопросов пользователя отвечает страница. В Google страницы первой десятки отвечают на большее их число, чем страницы с позиций 31–49. В Яндексе разницы не видно ни в одном разрезе: ни на этой границе, ни по уровням полноты, ни в сравнении с типичной страницей своей выдачи. Правда, выборка у Яндекса вдвое меньше.

Второе — ключ в title и description. Тот самый ключ, который в Google почти ничего не различал, в Яндексе ещё отделяет верх: страницы с полным ключом в этих местах до сих пор чаще стоят наверху. В Google эта разница едва заметна.

Третье — тематическое покрытие внутри одного сайта. В Google, если сравнить верхнюю и нижнюю страницы одного сайта, от разницы по покрытию остаётся половина. В Яндексе внутри сайта разницы не видно. Но сайтов для такого сравнения там всего 119, и оценка размытая: настоящая разница может оказаться в любую сторону.

То же расхождение по текстовым факторам видит Лаборатория поисковой аналитики «Ашманов и партнёры»: «Значения текстовых параметров в Google ниже, но зависимость позиций от них сильнее и наблюдается чаще».

Отдельно про агрегаторы. В Яндексе они заметно чаще стоят наверху: из проверенных агрегаторов в топ-10 попадают 66,2%. В Google на его границе, топ-20 против 21–50, таких 51,0%. Это не больше, чем у проверенных страниц в среднем.

Здесь меня могла подвести первая же выдача статьи. Остановись я на «турах в Турцию», записал бы агрегаторы в сильные стороны Google: в той выдаче агрегатор выглядел сильным. На всей выборке Google этой силы не видно. Она видна в Яндексе, и по тем же турам обе проверенные страницы его топ-10 тоже агрегаторы, 1001tur и unitours.

Что проверяли
Те же 160 запросов в Google и Яндексе. Верх и низ поделены одинаково: позиции 1–10 против 31–49. Списки тематических слов и карты интента одни и те же, оценка вслепую и по одним правилам.
Что нашли
В обоих поисковиках верх сильнее всего отличается размером страницы. Если размер отложить, в Google верх выделяется полнотой ответа и объёмом текста, в Яндексе — ключом в title и description и быстрым ответом сервера. Тематическое покрытие отделяет верх в обоих.
Что это значит
Одна и та же страница может быть сильной для Google и средней для Яндекса. Общее у двух поисковиков — покрытие тем выдачи.
Что делать
Под оба поисковика начинайте с тем выдачи и с вопросов, на которые должна ответить страница. Для Яндекса отдельно проверьте, есть ли полный ключ в title и description.

Чего этот замер не знает

Я мерил только то, что видно на самой странице: текст, разметку, техничку и то, насколько полно страница отвечает на запрос. Ссылки на страницу и на сайт, бренд, поведение пользователей, коммерческие свойства, возраст домена и мобильную выдачу я не проверял. Страница remo-nt.ru на 45-м месте намекает: всё это вместе может перевесить то, что я измерил. Продолжать я бы стал с того места, где она застряла: со ссылок, бренда и коммерческих свойств.

Сильнее всего топ-20 от позиций 21–50 отличает число слов на всей странице: 57,2 из 100. И даже он часто промахивается. Возьмите страницу из топ-20 и страницу ниже: примерно в 43 случаях из 100 слов больше как раз у нижней. Такой признак показывает, что топ-20 в целом отличается от страниц ниже. Место конкретной страницы по нему не угадать.

Все таблицы статьи описывают, чем топ-20 отличается в среднем. Ни одна не обещает, что правка поднимет вашу страницу.

На что можно опираться и насколько
Тематическое покрытие у топ-20 выше, и это видно даже у страниц одного сайта
Ключ в title и H1 в Google топ от низа не отличает
Технический вес страницы в основном задаёт весь сайт
Порога полноты интента для топ-20 нет
При равной длине текста не видно, чтобы полнота интента что-то добавляла

Полнота интента оказалась внизу списка. Здесь я упёрся скорее в размер выборки, чем в саму оценку.

Сама оценка аккуратная: два оценщика почти всегда ставят одно и то же. Но по восемь документов на запрос набирается всего 1228 наблюдений. На таком объёме разницу в два-три пункта из 100 трудно отличить от случайности, и отделить одно от другого на этих данных я не смог.

Настоящее значение для полноты лежит где-то между 49,5 и 55,6 из 100, разброс около шести пунктов. В этот промежуток помещаются и 50, то есть разницы может не быть вовсе, и перевес в два-три пункта.

Поэтому вывод «полнота отличает топ слабо и вместе с объёмом текста» я считаю обоснованным. Вывод «полнота не работает совсем» — слишком сильным.

Типичная страница топ-50 Google и Яндекса

Все проверки выше сравнивали верх выдачи с низом. А что делать странице, которой нет даже в первых пятидесяти? Равняться на первое место или на топ-20 ей рано. Сначала полезнее понять, как выглядят страницы, которые в выдачу уже попали.

Поэтому здесь типичные значения по всем страницам, которые я измерил, без деления на верх и низ.

На графиках у каждого признака две полосы: тёмная — Google, терракотовая — Яндекс. Полоса показывает среднюю половину страниц: четверть лежит левее неё, четверть правее. Риска внутри — типичная страница, медиана. Если значение вашей страницы левее полосы, по этому признаку она уступает трём четвертям страниц, которые уже есть в выдаче. Шкала у каждой строки своя, поэтому сравнивайте полосы внутри строки. У признаков «есть или нет» полоса показывает долю страниц.

Текст и структура

Признак
GoogleЯндекс
медиана · средняя половина
Слов основного тексташтук
766363…1398815358…1502
Покрытие LSIдоля списка
0,5250,369…0,6760,5560,380…0,694
Подзаголовков H2штук
52…962…10
Подзаголовков H3штук
20…820…9
Списков в основном текстештук
90…25100…28
Таблиц в основном текстештук
00…000…0
Длина titleзнаков
7055…897056…89
Длина descriptionзнаков
164131…207165134…205
Плотность ключа%
5,33,5…7,54,93,1…7,0

Где стоит ключ, есть ли FAQ и цены

Признак
GoogleЯндекс
доля страниц

Полнота интента

Признак
GoogleЯндекс
медиана · средняя половина
Раскрыто полностьюдоля составляющих
0,460,30…0,630,460,27…0,64
Раскрыто хотя бы частичнодоля составляющих
0,670,50…0,800,670,50…0,80
Раскрыто полностьюсоставляющих
43…642…6
Составляющих в карте интенташтук
108…11108…11

Техничка

Признак
GoogleЯндекс
медиана · средняя половина
Размер HTMLКБ
224120…461293154…602
DOM-узловштук
1322803…22581506931…2559
Слов на всей страницештук
1551969…234316521030…2537
Картинокштук
3215…703717…77
Ссылок на страницештук
15888…28815789…311
Файлов JavaScriptштук
126…21126…22
Файлов CSSштук
52…1252…11
Время ответа серверамс
603442…897602412…901
Тип страницы по слепой оценке
Признак
GoogleЯндекс
доля документов
Остальные числовые поля аудита: 12 признаков
Признак
GoogleЯндекс
медиана · средняя половина
Уникальных словштук
780518…1106817524…1160
Элементов призыва к действиюштук
135…29146…34
Списков по разметкештук
189…33188…35
Блокирующих скриптовштук
20…920…7
Скриптов JSON-LDштук
10…210…2
Объектов микроразметкиштук
41…1041…11
Тегов Open Graphштук
51…863…8
Разнообразие словдоля
0,5250,438…0,6030,5130,424…0,591
Доля шаблонного текста%
1,50,9…2,51,40,8…2,4
Балл здоровья страницыиз 100
79,976,4…83,479,676,0…83,2
Балл качества HTMLиз 100
85,077,5…100,087,580,0…100,0
Балл скоростииз 100
80,450,0…94,074,836,5…91,6
Технические признаки «есть или нет» и число претензий краулера
Признак
GoogleЯндекс
доля страниц
Google
21,4%39,2%29,1%
Яндекс
21,6%41,0%28,3%
ни одной: 21,4% · 21,6%одна: 39,2% · 41,0%две: 29,1% · 28,3%три и больше: 10,3% · 9,0%
Сеть, сервер и robots.txt: доли сайтов
Признак
GoogleЯндекс
доля сайтов
Признак
GoogleЯндекс
медиана · средняя половина
Размер robots.txtбайт
1433565…30341582654…3678
Строк Disallowштук
3614…803915…92
SEO-анализ текста: 24 метрики текстовых страниц
Признак
GoogleЯндекс
медиана · средняя половина
Слов в текстештук
949570…15101085640…1648
Водность%
25,622,0…28,925,521,9…29,0
Классическая тошнота
4,53,5…5,74,63,6…5,7
Академическая тошнота%
2,01,4…3,01,91,4…2,8
Шаблонные обороты% предложений
00…1,400…1,2
Канцеляризмовштук
10…310…3
Средняя длина предложенияслов
12,110,3…14,512,010,2…14,4
Разнообразие лексики, TTR%
56,450,0…62,855,549,1…61,1
MATTR%
91,587,7…93,791,487,7…93,5
Hapax legomena%
75,170,7…79,374,069,8…78,2
Энтропия распределения
0,9520,937…0,9640,9500,936…0,962
Burstiness
0,760,58…1,040,800,60…1,09
Размах длин предложенийслов
5735…956138…103
В полосе 10–20 слов% предложений
43,334,5…52,342,233,3…50,6
Повтор 3-грамм%
2,51,2…4,82,71,4…5,2
Индекс Флеша
4,3−6,0…13,35,5−5,4…14,1
LIX
69,865,2…75,069,164,6…74,7
Длинных слов%
57,353,5…61,356,952,9…60,7
Зависимых предложений%
5,52,4…9,25,02,1…8,6
Проверяемых чиселна 100 слов
4,21,9…8,24,52,3…8,1
Имён собственныхна 100 слов
4,52,4…8,45,02,5…9,0
Пассив% предложений
14,08,9…20,313,38,5…19,2
Плотность самой частой леммы%
3,72,8…5,03,52,6…4,7
BM25: вес слов запроса% потолка
74,358,6…84,774,256,8…85,4
Детектор ИИ-текста: общий сигнал и признаки
Признак
GoogleЯндекс
медиана · средняя половина
Общий сигналпорог 2,0
−1,19−2,91…0,55−1,13−3,14…0,56
Двоеточие-перечислениена 1000 слов
3,81,6…7,33,91,6…7,5
Параллельные начала%
13,05,0…22,212,54,5…21,3
Тире-коннекторна 1000 слов
9,94,4…16,810,64,6…17,6
Ритм, burstiness
0,580,47…0,820,580,47…0,85
Повтор триграмм%
1,90,9…4,62,00,9…5,1
Метод Ильдара
0,250,14…0,350,250,15…0,35
Первое лицона 1000 слов
2,30,5…7,82,20,3…8,6
Начала с союза%
3,11,1…5,92,90,9…5,7
Ровные абзацы%
28,114,6…42,428,913,9…43,4
Разброс абзацев
0,620,50…0,830,610,49…0,79
Шаблонные обороты% предложений
00…1,500…1,2
Признак
GoogleЯндекс
доля страниц
Основные значения таблицей
Текст и полнота интента: медианы всех измеренных страниц выдачи Google и Яндекса
ПризнакGoogle, медианаGoogle, средняя половинаЯндекс, медианаЯндекс, средняя половина
Слов основного текста766363…1398815358…1502
Покрытие LSI0,5250,369…0,6760,5560,380…0,694
Подзаголовков H252…962…10
Подзаголовков H320…820…9
Списков в основном тексте90…25100…28
Длина title, знаков7055…897056…89
Длина description, знаков164131…207165134…205
Плотность ключа, %5,33,5…7,54,93,1…7,0
Полнота интента, доля раскрытых полностью0,460,30…0,630,460,27…0,64
Раскрыто полностью, составляющих43…642…6
Составляющих в карте интента108…11108…11
Как часто встречаются ключевые зоны, FAQ и цены на всех измеренных страницах выдачи Google и Яндекса
Что есть на страницеGoogleЯндекс
Полный ключ в title41,8%41,3%
Точный ключ в title, слово в слово10,1%8,7%
Полный ключ в H122,2%21,1%
Полный ключ в description34,2%35,6%
Блок FAQ23,5%24,5%
Цены в основном тексте40,3%43,4%
Техничка: медианы всех измеренных страниц выдачи Google и Яндекса
ПризнакGoogle, медианаGoogle, средняя половинаЯндекс, медианаЯндекс, средняя половина
Размер HTML, КБ224120…461293154…602
DOM-узлов1322803…22581506931…2559
Слов на всей странице1551969…234316521030…2537
Картинок3215…703717…77
Ссылок на странице15888…28815789…311
Файлов JavaScript126…21126…22
Файлов CSS52…1252…11
Блокирующих скриптов20…920…7
Скриптов JSON-LD10…210…2
Время ответа сервера, мс603442…897602412…901

Сколько страниц за графиками. Google — все позиции 1–50, снимок 14.09.2026: текст и ключи — 6516 страниц (покрытие LSI посчитано у 5964, плотность ключа — у 5391), полнота интента и тип страницы — 1228 документов слепой оценки, техничка — 5753 страницы, сеть и robots.txt — 3563 сайта (robots.txt отдали 3408), SEO-анализ текста — 3848 текстовые страницы, детектор — 3134 страницы с общим сигналом. Яндекс — только позиции 1–10 и нечётные 31–49, других мест в замере Яндекса нет, снимок 09.09.2026: текст — 2849 (покрытие — 2549, плотность — 2331), интент — 634, техничка — 2533, сеть — 2181 сайт (robots.txt — 2064), SEO-анализ текста — 1616, детектор — 1420. Если страница стоит сразу в нескольких запросах, она считается в каждом; в SEO-анализе текста каждая страница считается один раз. Время ответа сервера снимали разными прогонами в разные дни. Объекты микроразметки — все найденные аудитом объекты, скрипты JSON-LD — отдельные блоки <script type="application/ld+json">.

Если свести графики в портрет, выйдет так. Типичная страница из первых пятидесяти мест Google — около 770 слов основного текста, пять подзаголовков H2, title на 70 знаков и description на 164. В Яндексе почти то же: 815 слов, шесть H2, те же 70 знаков в title.

Полный ключ в title есть только у 42% страниц в обоих поисковиках, в H1 — у каждой пятой. Из десяти частей запроса типичная страница полностью раскрывает четыре. Техничка тоже похожа: 12 скриптов, 5 файлов стилей, сервер отвечает примерно за 600 мс.

Расходятся поисковики в весе страницы. Типичный HTML в Яндексе весит 293 КБ, в Google — 224.

Часть этой разницы объясняет состав выборки. В замере Яндекса половина страниц из первой десятки, а первая десятка тяжелее. Если взять у Google те же позиции, типичный HTML вырастает до 232 КБ, DOM — до 1424 узлов. Текст на этих позициях у Google почти не меняется: 770 слов, покрытие темы 0,532, то есть около 53% тематических слов.

Выходит, что даже на одних и тех же позициях страницы в выдаче Яндекса заметно тяжелее.

Что это значит для SEO Если страница не входит даже в первые пятьдесят, начните с первого блока, про текст и полноту интента. Отметьте строки, где страница ниже левой границы средней половины: основного текста меньше 360 слов, покрытие темы ниже 0,37 (меньше 37% тематических слов), меньше двух H2, полностью раскрыто меньше трёх частей запроса из десяти (в Яндексе меньше двух). По каждой такой строке страница уступает трём четвертям тех, кто в выдачу уже попал. Это и стоит закрывать первым. Если по всем строкам страница в средней половине, по этим признакам она уже похожа на соседей из выдачи. Дальше смотрите на то, чего замер не видел: индексацию, ссылки, коммерческие свойства сайта. Типичные значения детектора ИИ-текста — в разделе «Машинный текст». Только не принимайте эти границы за порог входа: ниже каждой из них лежит четверть страниц топ-50.

Мерилом для такой страницы остаётся выдача её собственного запроса. Чеклист на эту роль не годится: ключ и плотность из него топ-20 от страниц ниже не отделили, перевес длинных текстов почти исчезает при равном охвате темы, а темы, которые стоит закрыть, у каждой выдачи свои.

Частые вопросы

Из текстовых признаков — покрытие LSI, то есть доля тематических слов запроса, которые есть на странице. Страница с большим покрытием стоит выше соседки по выдаче в 53,8 случая из 100 при монетке в 50. Технические объёмы различают чуть сильнее, но внутри одного сайта от их разрыва остаётся около седьмой части, а у LSI — половина.

Для порядка мест в этих данных нет. Полный ключ в title стоит у 43,0% страниц топ-20 и у 40,8% страниц с позиций 21–50, по парам внутри выдачи это 50,6 из 100 — уровень монетки. Ключ в H1 даёт ровно 50,0. К тому же выводу пришёл Backlinko на 11,8 млн результатов Google.

Порога нет. У медианной страницы топ-20 полностью раскрыто 5 составляющих из 10, у медианной страницы с позиций 21–50 — 4. Работает сравнение с соседями: в выборке, где верх и низ поровну, страница полнее медианы своей выдачи стоит в топ-20 в 55 случаях из 100, а страница ниже медианы — в 47,5.

Резкой ступени нет, доля топа растёт плавно. Среди страниц с первых пятидесяти мест при покрытии ниже 0,3 в топ-20 стоят 38,6%, при 0,7 и выше — 51,3% при среднем 44,0%. Медиана топ-20 — 0,556, средняя половина страниц лежит между 0,391 и 0,700.

Страницы топ-20 крупнее: HTML 246 КБ против 207, но внутри одного сайта разница падает до 5,8 КБ. Время ответа сервера группы не различает: 606 мс против 601, по парам 49,4 из 100. Быстрый сервер нужен людям, но позиций в этих данных он не объясняет.

В обоих сильнее всего верх отделяют объёмы страницы: размер HTML, DOM, картинки. Различие в тексте: в Google верх заметнее отделяют полнота интента, объём основного текста и подзаголовки, в Яндексе — ключ в title и description. Покрытие LSI различает в обоих, 53,8 из 100 пар внутри запроса, но внутри одного сайта разрыв по нему виден только в Google. Топ-10 двух систем по одному запросу делят в среднем меньше двух URL.

Методология и ограничения

Как это повторить
Выдача
XMLRiver, Google, Москва, google.ru, десктоп
Аудит страниц
Site Audit Pro, батч-режим
Основной текст
trafilatura вырезает текст без меню и подвала, pymorphy3 приводит слова к словарной форме (леммы)
Карты интента
Вордстат, подсказки Яндекса, блоки Google
Оценка
слепой оценщик — языковая модель, не видит позицию и домен; шкала 0/1/2
Статистика
AUC (в скольких парах из 100 у верхней страницы значение больше), бутстреп и перестановки по запросам (насколько число гуляет и не случайно ли оно), логит (сравнение страниц одной длины и типа)
Снимок выдачи
14.09.2026

Выборка. 160 запросов, шестнадцать ниш по десять, те же, что в техническом замере Яндекса. Позиции 1–50, пять страниц выдачи по десять результатов. 7401 строка выдачи, 7370 уникальных адресов, 4432 домена. Позиции нумеровались только по сплошному ряду страниц: если страница выдачи не отдавалась, всё после неё в счёт не шло, чтобы номера не съезжали.

Ошибка, из-за которой первый сбор ушёл в корзину. Код региона Москвы я сначала взял из документации к собственному скиллу сбора выдачи. Сверка по справочнику регионов показала, что это код Аргентины. Первый прогон выброшен целиком, выдача собрана заново с правильным кодом региона, языком и доменом google.ru.

Текст и заглушки. Основной текст извлекался без меню и подвала. Без пригодного текста остались 354 страницы из 3200 в топ-20 и 531 из 4201 на позициях 21–50. Сюда попали экраны антибота YouTube, Ozon, Спортмастера и Пульса цен, JSON-оболочки Маркета, страницы «не найдено» с кодом 200 и окна согласия Google и YouTube. Первые классы нашёл сам оценщик, получив вместо страницы заглушку, остальные — поиск по всему корпусу после каждой такой находки. После каждой находки весь корпус пересчитывался заново, а результаты до пересчёта объявлялись недействительными. У 15 страниц сломалась кодировка: сервер объявлял UTF-8 и отдавал битые байты. Текст восстановлен перекодированием, проверка на 300 случайных страницах изменений у остальных не нашла.

Неравный отсев. Без пригодного текста остались 11,1% страниц топ-20 и 12,6% страниц ниже, почти поровну. Но отсев приходится на крупные площадки: больше всего таких адресов у YouTube (229), zoon.ru (43), Ozon (25), Домклика (35 вместе с блогом) и Профи.ру (17). Поэтому агрегаторы в текстовых расчётах представлены хуже остальных сайтов, а у тех, что остались, основной текст извлекается хуже: у Профи.ру в него попали отзывы вместо цен.

Техничка. 7322 строки аудита, из них 5753 страницы с кодом 200 и настоящим содержимым.

LSI. Это список тематических слов на каждый запрос: леммы, то есть слова в словарной форме, и пары лемм из основного текста всех измеренных позиций обоих поисковиков. Термин берётся, если встречается хотя бы на 30% страниц выдачи и хотя бы втрое чаще, чем на страницах других ниш. Слова запроса исключаются во всех вариантах их разбора. Одна словоформа может разбираться на разные леммы: «стекла» — это и существительное «стекло», и глагол «стечь». В первой версии исключение смотрело только на первый разбор, и в 16 списков из 160 попало по слову самого запроса. Ошибку нашла сверка этой статьи, списки и все расчёты с LSI пересчитаны. Пары слов, где одно слово из запроса, в списках остаются. Один список на запрос для Google и Яндекса, чтобы сравнение поисковиков в конце было равным. Медианный список — 78,5 термина. При расчёте покрытия страницы её собственный домен из статистики вынимается, чтобы сайт не подстраивал список под себя.

Карты интента. Строились из спроса: частые фразы и ассоциации Вордстата, подсказки Яндекса, блоки «Похожие вопросы» и «Похожие запросы» Google. Построитель не видел выдачу, второй участник вслепую проверял каждую карту на домыслы, дубли и дрейф от запроса, решения применялись механически. 159 карт, 1533 составляющие. Один запрос исключён по заранее заданному правилу: у него набралось меньше трёх составляющих. Карты зафиксированы хешем до оценки первого документа. Хеш — цифровой отпечаток файла: любая поздняя правка карты его бы изменила.

Слепая оценка. На запрос случайно отобраны по четыре документа из топ-20 и четыре с позиций 21–50 Google, по два из топ-10 и два с позиций 31–49 Яндекса. Всего 1908 документов. Из анализа исключены 40, которые при пересчёте оказались заглушками, и 6, у которых в партии оценки был нечитаемый текст. Осталось 1862. Оценщик видел запрос, составляющие с определениями и текст страницы до 2500 слов, но не видел позицию, домен и поисковик. Десятая часть документов оценена повторно независимым оценщиком: 1877 решений, совпадение 0,880, взвешенная каппа 0,863. Каппа — доля совпадений с поправкой на те, что вышли бы и при оценках наугад: ноль означает угадывание, единица — полное согласие.

Как считалось. Шесть гипотез я записал до того, как посмотрел в данные. Главные сравнения — AUC «топ-20 больше позиций 21–50», то есть в скольких парах из 100 у страницы топ-20 значение больше, чем у страницы ниже. Интервалы к нему — бутстреп по запросам: набор запросов много раз собирается заново случайным образом, и видно, как сильно гуляет число. Проверка на случайность — перестановка меток внутри каждого запроса: метки «топ» и «ниже» перемешиваются наугад, и считается, как часто такая же разница выходит сама собой. 5000 повторов для заявленной гипотезы по LSI, 2000 и поправка Холма для разведочных признаков, которые я смотрел без заранее записанной гипотезы. Поправка Холма ужесточает порог, когда признаков проверяется много. Контроль длины и типа страницы — логистическая регрессия с ошибками, сгруппированными по запросам: она позволяет сравнивать страницы одной длины и одного типа. Группировка нужна потому, что восемь документов одной выдачи похожи друг на друга сильнее, чем документы разных запросов, и без неё интервалы вышли бы уже, чем позволяют данные. Доли пар внутри запроса считаются по всем парам, ничьи пополам.

Детектор ИИ-текста. Разведка: гипотезу до данных я не записывал. Страницы прогнаны локально движком детектора ИИ-текста из репозитория сайта, PHP 8.3 CLI. Функции те же, что при проверке по адресу страницы: извлечение основного текста, прозаический профиль, структурные признаки, ритм и перплексия по n-граммной модели. Вход — HTML, сохранённые при съёме выдачи, для тех же чистых страниц, что в текстовом анализе: 6491 уникальный адрес Google и 2849 Яндекса. Общий сигнал и пороги признаков посчитаны по константам клиента инструмента: восемь весов, смещение 3,55, порог 2,0, минимум 500 слов связного текста, отсечка перечней. Сравнения — AUC с бутстрепом по запросам и перестановка меток внутри запроса: 5000 повторов для сигнала, 2000 и поправка Холма для признаков.

SEO-анализ текста. Тоже разведка. Те же сохранённые HTML прогнаны локально движком SEO-анализа текста: извлечение основного текста, базовые метрики (водность, тошнота, шаблонные обороты, длина предложений, разнообразие лексики), продвинутые метрики, семантический слой и BM25 по запросу, по которому адрес стоит в выдаче. В счёт шли тексты от 100 слов: 6336 строк Google и 2747 Яндекса. Сравнения — AUC и перестановка меток внутри запроса, 2000 повторов и поправка Холма на 27 метрик. «При равной длине» — AUC внутри пяти равных по числу слов частей выборки, средневзвешенный. Показатели абзацев из блока извлекаемости я не брал: при разборе по адресу у 94% страниц текст приходит без разметки абзацев.

Калибровка инструментов. SEO-анализ текста: 5464 уникальные текстовые страницы (прозаический профиль детектора применился: от 150 слов связного текста и не меньше 40% страницы), тексты от 100 слов. Для метрик, где плохо, когда много, «в норме» — до 90-го перцентиля, «проверьте» — до 95-го; где плохо, когда мало, — зеркально от 10-го и 5-го; у средней длины предложения норма от 10-го до 90-го, граница «нужно исправить» — 2,5-й и 97,5-й. Классическая тошнота, TTR, hapax, энтропия и размах длин предложений — по трём полосам длины: 100–499, 500–1499, от 1500 слов. Детектор: сетка перцентилей сигнала и признаков по 4542 страницам, где сигнал считается; веса и порог не менялись. Скрипт — calibrate.py рядом с данными исследования.

Шесть гипотез и их исход. H1: полнота интента у топ-20 выше — в Google направление есть, но p = 0,063 выше порога 0,05, поэтому гипотеза не подтверждена; в Яндексе нет. H2: покрытие LSI у топ-20 выше — подтверждена в обоих поисковиках, p = 0,0002. H3: H1 и H2 держатся при контроле объёма текста — для LSI да, для полноты нет. H4: совпадение типа страницы с интентом различает сильнее покрытия — в задуманном виде не проверена; признак, которым её заменили уже после данных, топ от низа не отличает. H5: технический градиент Яндекса повторяется в Google по знаку — да, HTML и DOM у топ-20 крупнее. H6: разрыв сохраняется между страницами одного домена — для LSI да, для полноты интента не виден на 63 доменах.

Ограничения. Один регион, одна дата, десктоп. Корреляция без причинности: данные показывают, что идёт вместе, а что чем вызвано, они не говорят. Оценщик интента — языковая модель, и хотя согласие двух оценщиков высокое, человеческой разметкой оно не калибровалось. Текст длиннее 2500 слов оценщик видел обрезанным, поэтому полнота самых длинных страниц может быть занижена. На запрос проверено восемь документов Google, а не вся выдача. Снимок Яндекса сделан на пять дней раньше. Гипотезу о совпадении типа страницы с интентом не удалось проверить в задуманном виде: её замена придумана после данных.

Что проверить дальше. Повторить на второй дате и в мобильной выдаче. И поставить эксперимент: взять страницы, которые слабее медианы своей выдачи, закрыть недостающие составляющие и темы и замерить сдвиг. Без эксперимента это остаётся наблюдением.

Страницы топ-20 Google раскрывают тему шире соседей. Технический размер в основном принадлежит сайту.

Проверить это на своей странице

Если нужно разобрать, чем ваша страница уступает топу своего запроса по интенту, тематике и техничке, — это SEO-аудит сайта. Быстро посмотреть текст страницы по двадцати метрикам помогает SEO-анализ текста.