Мультимодальный поиск Google: как отслеживать Lens и поиск по картинкам в Search Console

04.10.2026 11 мин 3 просмотров Максим Вагизов 100%1 оценка
Мультимодальный поиск Google с использованием камеры и веб-страниц
В мультимодальном поиске отправной точкой может быть изображение или объект перед камерой, а результатом — обычные веб-страницы.

Суть материала

Главное за минуту

С 24 сентября 2026 года Google Search Console отдельно показывает данные Web: multimodal — поиск, в котором пользователь начинает с изображения. В отчёт входят Lens, Circle to Search, загрузка изображения в Google и Search this image в Chrome. Разбираем, где найти данные, как читать страницы и запросы и что улучшать на сайте.

24 сентября 2026 года Google добавил в Search Console отдельную отчётность для web multimodal Search. Теперь владелец сайта может отделить обычный текстовый веб-поиск от сценариев, в которых пользователь начинает поиск с изображения — например, наводит камеру смартфона на объект или загружает фотографию.

На 4 октября 2026 года официальный список источников выглядит так:

  • Google Lens;
  • Circle to Search на Android;
  • загрузка изображения непосредственно в Google Search;
  • функция Chrome Search this image.

Google не сообщил о расширении этого списка после первоначального анонса. Интеграция данных разворачивается глобально, а отдельные показатели появляются у свойства, если сайт действительно получает трафик из таких сценариев.

Для SEO это прежде всего новый разрез измерения, а не новый фактор ранжирования. Сам факт появления строки Web: multimodal не означает, что сайт стал оптимизирован лучше. Точно так же отсутствие заметного роста после работы с изображениями ещё не означает, что оптимизация была бесполезной.

Новый отчёт отвечает на более конкретный вопрос:

как страницы сайта показываются и получают переходы, когда пользователь начинает поиск с изображения, а не только с набранного текста?

Что именно Google считает мультимодальным поиском

Обычный веб-поиск начинается с текстового запроса: пользователь вводит слова в поисковую строку.

Мультимодальный сценарий сложнее. В запросе появляется визуальная информация: фотография, объект перед камерой, часть экрана или ранее сохранённое изображение. Поисковая система интерпретирует визуальный объект и связывает его с возможными веб-результатами.

Схема работы мультимодального поиска от изображения до сайта
Изображение становится частью поискового запроса, после чего Google может связать распознанный объект и контекст с веб-страницами.

Например, человек видит неизвестную деталь инженерного оборудования. Вместо запроса вроде «металлическая деталь с резьбой и шестигранником» он фотографирует её. Система получает визуальный объект и пытается определить, что именно пользователь ищет и какие веб-страницы могут помочь.

Другой пользователь видит предмет на фотографии в браузере, выделяет его через Circle to Search или запускает поиск изображения в Chrome. Начальная форма взаимодействия отличается, но в Search Console эти сценарии теперь объединены в Web: multimodal.

Важно не путать такой поиск с обычным Google Images.

В актуальном интерфейсе Search Console Search type разделён на:

Search typeЧто учитывается
Web: text-basedобычный веб-поиск, начинающийся с текстового запроса
Web: multimodalвеб-поиск, в котором используется изображение
Imageрезультаты из вкладки Google Images
Videoвидеопоиск
Newsновостной поиск

То есть Web: multimodal и Image — разные источники данных. Пользователь может начать поиск с фотографии и получить веб-страницу — это не то же самое, что переход из вкладки «Картинки».

Lens, Circle to Search, загрузка изображения и Search this image
Google объединяет четыре официально перечисленных визуальных сценария в тип поиска Web: multimodal.

Где найти Web: multimodal в Search Console

Основной путь:

Search Console → Performance → Search results → Search type → Web: multimodal

В текущей документации отчёт Search results позволяет анализировать стандартные метрики:

Clicks → Impressions → CTR → Average position

и группировать данные по измерениям:

Queries → Pages → Countries → Devices → Search appearance → Dates.

Можно менять диапазон дат и временную детализацию, а для дальнейшего анализа выгружать данные через Export. Google отдельно упомянул экспорт в первоначальном анонсе multimodal reporting.

При этом нужно помнить об обычных ограничениях Search Console. Часть запросов скрывается для защиты конфиденциальности, а таблицы не обязаны содержать абсолютно все строки, которые входят в суммарные показатели графика.

Поэтому задача анализа — не найти буквальное описание каждого объекта, который кто-то сфотографировал, а определить страницы и поисковые сегменты, через которые сайт уже участвует в визуальном поиске.

Полезно продолжить такой анализ обычными данными Search Console. На Vagizov.com отдельно разобрано, как сопоставлять реальные запросы и URL: поисковые запросы Google и работа с ними в Search Console.

Web: multimodal есть и в отчёте Generative AI features

Это ещё одна деталь сентябрьского обновления.

Google сообщил, что Web: multimodal доступен не только в обычном Performance report for Search results, но и в отчёте Generative AI features.

Здесь устройство отчёта отличается.

На текущую дату Generative AI performance report показывает прежде всего impressions, а данные можно группировать по Pages, Countries, Dates и Devices. В нём также появился фильтр:

Web: text-based / Web: multimodal.

Это позволяет отдельно посмотреть, в каких страницах сайт получает видимость в поддерживаемых generative AI features при мультимодальном поисковом сценарии.

Но смешивать два отчёта не стоит. В обычном Search results report доступны стандартные показатели поисковой эффективности, включая клики, CTR и позицию. В Generative AI report Google сейчас описывает прежде всего показы сайта в поддерживаемых AI-функциях.

Практический сценарий: сайт услуг получил multimodal-показы

Представим сайт компании, которая занимается ремонтом и отделкой.

У неё есть статья:

«Почему трескается плитка и когда её нужно менять»

В статье опубликованы собственные крупные фотографии:

  • трещины в глазури;
  • скола на краю;
  • разрушения шва;
  • отслоения плитки от основания.

После появления Web: multimodal владелец видит показы этой страницы.

Неправильный вывод:

«Google любит наши фотографии, значит нужно срочно добавить по 20 изображений на каждую страницу».

Правильный вопрос:

«Почему именно этот URL оказывается релевантным визуальному сценарию и можно ли сделать страницу понятнее пользователю и поисковой системе?»

Сначала открываем Pages и сравниваем эту страницу с другими URL.

Затем смотрим Queries, если для сегмента доступны содержательные строки.

После этого — Devices. Для визуального поиска особенно полезно понимать, какую долю составляет mobile, но не нужно заранее считать, что весь Web: multimodal обязательно мобильный: среди официальных источников присутствует и Chrome Search this image.

Потом проверяем Countries и динамику Dates.

Получается уже не абстрактный совет «оптимизировать картинки», а конкретный объект анализа:

страница → изображения → контекст → multimodal impressions → clicks

Какие страницы проверять в первую очередь

Если у сайта появились данные Web: multimodal, начинать разумнее не со всей медиатеки WordPress.

Сначала выделите URL, которые:

  1. уже получают multimodal impressions;
  2. получают multimodal clicks;
  3. заметно отличаются от остальных страниц по объёму показов;
  4. имеют изображения, без которых пользовательский ответ был бы существенно хуже;
  5. связаны с объектами, товарами, визуальными проблемами, инструкциями, сравнением или идентификацией.

Для сайта услуг это могут быть фотографии неисправностей, примеры работ, материалы, элементы интерьера, оборудование или визуальные признаки проблемы.

Для контентного проекта — растения, инструменты, крепёж, продукты, детали конструкции, интерфейсы, схемы, достопримечательности, устройства и любые другие объекты, которые человеку проще показать камере, чем точно описать словами.

Но Search Console показывает фактические данные конкретного сайта. Не нужно заранее объявлять какую-либо тематику «приоритетной для Lens» только потому, что она визуальная.

Что проверять на самой странице

Проверка изображения, alt, контекста и доступности страницы
Google понимает изображение не из одного alt: важны само изображение, содержание страницы, окружающий текст и техническая доступность.

Качество изображения

Google рекомендует качественные и чёткие изображения: они удобнее пользователю и привлекательнее в поисковых превью. При этом изображения часто составляют значительную часть веса страницы, поэтому качество нужно сочетать с нормальной производительностью и responsive image techniques.

Практически это означает:

  • объект должен быть различим;
  • фотография не должна быть неоправданно размытой;
  • важная деталь не должна занимать несколько процентов кадра;
  • разрешение должно быть достаточным для нормального просмотра;
  • размер файла не должен бесконтрольно ухудшать загрузку страницы.

Уникальность изображения

Здесь важно не превращать здравый смысл в выдуманный фактор ранжирования.

Google не заявляет, что «уникальная фотография» сама по себе даёт бонус Web: multimodal.

Но собственный снимок может содержать полезную информацию, которой нет на типовом стоке: конкретный дефект, реальный этап работ, устройство детали, сравнение материалов, результат ремонта.

Поэтому оригинальность ценна прежде всего тогда, когда изображение действительно добавляет странице информацию.

Стоковая фотография человека с ноутбуком не становится полезной для мультимодального поиска только потому, что её ещё не использовали конкуренты.

Окружающий текст

Это один из наиболее недооценённых элементов.

Google прямо указывает, что извлекает сведения о предмете изображения из содержимого страницы и рекомендует располагать изображение рядом с релевантным текстом на странице, соответствующей его теме.

Фотография треснувшей плитки рядом с разделом о причинах растрескивания понятнее, чем та же фотография в случайной галерее внизу страницы.

Изображение должно поддерживать смысл конкретного фрагмента материала.

Alt

alt помогает поисковой системе понимать предмет изображения и одновременно решает задачу доступности.

Google использует alt вместе с computer vision и содержимым страницы. При этом рекомендация предельно конкретна: alt должен быть полезным, информативным и соответствовать контексту. Заполнять его перечнем ключевых слов не нужно.

Хорошо:

alt="Трещина вдоль края керамической плитки"

Плохо:

alt="плитка ремонт плитки трещина плитки цена ремонт плитки купить плитку"

Мультимодальный поиск не делает keyword stuffing полезнее.

Подпись

Google отдельно указывает captions среди источников информации о предмете изображения.

Подпись особенно полезна, когда без неё фотография допускает несколько трактовок.

Например:

«Трещина проходит только по глазури и не продолжается через всю толщину плитки»

Такая подпись добавляет информацию пользователю. Она не должна существовать только ради ещё одного повторения ключевой фразы.

Контекст всей страницы

Одной идеально оформленной фотографии недостаточно, если URL в целом отвечает на другую тему.

Google отмечает, что содержание и метаданные landing page способны существенно влиять на то, где и как изображение появляется в поиске.

Поэтому нужно смотреть шире:

H1 → основной текст → раздел рядом с изображением → подпись → alt → общий интент страницы

Если все элементы описывают одну пользовательскую задачу, изображение существует в понятной смысловой среде.

Техническая доступность изображения

Google должен иметь возможность обнаружить и обработать файл.

В документации рекомендуется использовать стандартные HTML-элементы изображения. Google находит URL в src элемента <img>; CSS background images при этом не индексируются как обычные изображения. Для <picture> рекомендуется сохранять <img> с src как fallback.

Проверяем:

<img> и рабочий src
→ ответ сервера
→ доступность Googlebot
→ отсутствие случайной блокировки
→ корректную загрузку
→ responsive-варианты
→ скорость страницы.

Для изображений, которые Google может не обнаружить обычным обходом, существует image sitemap.

Что новый отчёт не доказывает

Появление Web: multimodal создаёт соблазн сделать слишком много выводов из одного фильтра.

Например:

Есть показы → Google считает изображение качественным.

Не обязательно. Impression означает факт появления результата в соответствующем поисковом контексте, а не сертификат качества изображения.

Показов стало больше → позиции сайта улучшились.

Тоже не обязательно. Объём визуального спроса может изменяться, а поисковые сценарии пользователей — расширяться.

У страницы нет multimodal-трафика → изображения сделаны неправильно.

Оснований для такого вывода нет. Возможно, задача страницы просто редко начинается с фотографии.

Высокий CTR Web: multimodal → нужно переделать весь сайт под Lens.

Сначала стоит понять абсолютный объём данных и бизнес-результат.

Оценивать SEO разумнее цепочкой от видимости до целевого действия, а не отдельной метрикой. Этот принцип подробнее разобран в материале SEO сайта: из чего состоит оптимизация и как оценивать результат.

Как использовать данные на практике

Самая полезная стратегия после появления нового фильтра — не создавать отдельное «Lens SEO», а добавить multimodal к обычной аналитике страниц.

Рабочая последовательность выглядит так:

Web: multimodal → Pages → Queries → Devices/Countries → конкретный URL → изображение и контекст → техническая проверка → изменение → повторное сравнение

Если страница уже получает визуальный спрос, можно проверить, достаточно ли хорошо она отвечает пользователю.

Если качественная фотография скрыта далеко от связанного с ней текста — приблизить её к нужному разделу.

Если alt пустой у содержательного изображения — написать нормальное описание.

Если подпись способна объяснить деталь, которую трудно понять из одного кадра, — добавить её.

Если изображение загружается только как CSS background или Googlebot не может получить файл — исправить техническую реализацию.

Если URL содержит десятки декоративных фотографий, не нужно автоматически придумывать SEO-описание каждой из них. Оптимизация должна следовать назначению изображения.

И после изменений возвращаемся не к абстрактной проверке «стало ли Google нравиться больше», а к данным Search Console.

Multimodal Search меняет не правила SEO, а видимость данных

Само визуальное взаимодействие с Google существовало и раньше. Существенное изменение сентября 2026 года заключается в том, что владельцу сайта стало проще отделить этот сценарий в Search Console.

Теперь обычный web search разделён на text-based и multimodal, а значит, можно анализировать визуально инициированный поиск не только через догадки о Google Lens.

При этом базовые рекомендации для изображения остались знакомыми:

  • качественный и полезный визуал;
  • понятный контекст;
  • релевантный окружающий текст;
  • содержательный alt;
  • полезная подпись;
  • корректная техническая реализация;
  • доступная и индексируемая страница.

Главное новшество — возможность проверить эту работу отдельными данными.

Для владельца сайта вопрос теперь звучит не «нужно ли нам оптимизироваться под Lens вообще?», а значительно точнее:

какие наши страницы уже участвуют в мультимодальном поиске, почему именно они и что можно улучшить для пользователя, который начинает поиск с изображения?

Практика

Как проверить мультимодальный поиск сайта в Google Search Console

01

Откройте отчёт Search results

Перейдите в Performance → Search results нужного свойства Search Console. Убедитесь, что анализируете правильный сайт и подходящий период.

02

Выберите Web: multimodal

Откройте фильтр Search type и переключите его на Web: multimodal. Этот тип включает веб-поиск, где изображение используется как часть запроса.

03

Найдите страницы с показами и кликами

Перейдите во вкладку Pages и определите URL, которые уже получают multimodal impressions или clicks. Начинайте аудит именно с них, а не со всех изображений сайта подряд.

04

Проверьте запросы и сегменты

Изучите Queries, Countries, Devices и Dates. Сравните, связана ли активность с отдельными страницами, мобильными устройствами, страной или конкретным периодом.

05

Проверьте изображение и контекст страницы

Оцените качество изображения, его соответствие теме страницы, окружающий текст, подпись, alt, имя файла и смысловую связь изображения с содержанием URL.

06

Проверьте техническую доступность

Убедитесь, что страница и изображение доступны Google, изображение используется через обычный HTML с рабочим src, не заблокировано правилами обхода и нормально загружается на мобильных устройствах.

07

Сравните результат после изменений

Не оценивайте работу по одному дню. После изменения конкретной страницы сравните сопоставимые периоды Web: multimodal и посмотрите, изменились ли показы, клики и набор URL, сохраняя остальные изменения контролируемыми.

FAQ

Как работать с данными мультимодального поиска

Это отдельный тип веб-поиска, в котором изображение используется как часть поискового запроса. Google относит сюда Lens, Circle to Search на Android, загрузку изображений в Google Search и поиск изображения через Chrome.

Нет. В Search Console это разные Search type. Image относится к результатам во вкладке Google Images, а Web: multimodal — к веб-поиску, инициированному с использованием изображения.

Google указывает, что метрики появляются, если сайт получает трафик из таких запросов. Малый объём данных или отсутствие соответствующих показов может означать, что отдельной статистики пока практически нет.

Alt должен точно и полезно описывать изображение в контексте страницы. Google прямо рекомендует не заполнять alt списками ключевых слов: keyword stuffing ухудшает доступность и может восприниматься как спам.

Нет. Новый фильтр даёт дополнительный разрез данных. Рост или падение нужно оценивать по динамике, страницам, запросам и бизнес-результату, а само наличие данных не является положительным или отрицательным SEO-сигналом.

Рейтинг статьи

100%1 оценка

Материал был полезен?

Оценка помогает понимать, какие материалы стоит обновлять и расширять.