Новые данные о работе Google Discover раскрыли внутреннюю логику отбора и показа материалов. Исследование показало: формирование ленты проходит через несколько последовательных фильтров, и некоторые сайты выбывают из процесса еще до расчета позиций.
Discover — это фильтр
Главный вывод исследования: прежде чем материал начнет ранжироваться, он проходит предварительный отбор. Если страница или домен не соответствуют требованиям системы, они просто не попадают в дальнейший процесс.
Процесс можно разделить на три крупных блока.
1. Квалификация контента
Система:
- сканирует и интерпретирует страницу;
- считывает ключевые метатеги (og:title, og:image и др.);
- определяет тип материала — новостной, аналитический или вечнозеленый;
- проверяет, не заблокирован ли сайт пользователем.
Если пользователь ранее отключил показ материалов с сайта, его домен исключается из ленты. Это происходит еще до этапа сопоставления интересов и расчета кликабельности.
2. Персональное сопоставление и прогноз клика
После первичного отбора контент сопоставляется с интересами аудитории, а затем система оценивает вероятность клика с помощью модели pCTR.
В расчет берутся:
- заголовок страницы;
- размер и качество изображения;
- свежесть публикации;
- исторические данные по показам и кликам URL;
- корректность загрузки визуала.
Модель работает на стороне серверов Google и напрямую не отображается издателям.
3. Формирование и динамика ленты
После расчета прогнозной кликабельности система:
- формирует карточку материала;
- определяет ее размер и формат;
- размещает в ленте;
- фиксирует поведенческую реакцию пользователя.
Лента обновляется в реальном времени: карточки могут исчезать, перемещаться или добавляться без перезагрузки.
Свежесть материала напрямую влияет на его видимость в ленте
Контент распределяется по временным окнам:
- 1–7 дней — максимальный приоритет;
- 8–14 дней — умеренная видимость;
- 15–30 дней — ограниченное присутствие;
- старше 30 дней — постепенное снижение охвата.
Для вечнозеленого контента применяется отдельная логика оценки, однако приоритет чаще получают более свежие публикации.
Визуальные требования — не формальность
Без корректного изображения карточка не формируется. Для крупного формата необходима ширина не менее 1200 пикселей. Более мелкие изображения обычно приводят к отображению в виде миниатюр, что снижает кликабельность.
Если основной метатег отсутствует, система пытается использовать альтернативы — например, Twitter Title или стандартный HTML-заголовок. При этом наличие метатегов nopagereadaloud и notranslate может полностью исключить страницу из Discover.
Персонализация глубже, чем кажется
На формирование ленты влияют:
- поведенческие данные пользователя в экосистеме Google;
- сигналы об издателе, включая регистрацию в Publisher Center;
- действия пользователя — подписки, сохранения, скрытия;
- вовлеченность, включая время чтения.
Если пользователь скрыл конкретный материал, он не возвращается в его ленту повторно.






