Поиск с использованием искусственного интеллекта показывает пользователю не только список ссылок. Система находит материалы, извлекает факты, сопоставляет сведения из нескольких источников и формирует готовый ответ. Для бизнеса это создает дополнительную точку входа на сайт: страницу могут указать как источник, привести ее данные в ответе или не использовать вовсе.
Технический GEO (Generative Engine Optimization) — техническая подготовка сайта к генеративному поиску, чтобы системы с искусственным интеллектом могли находить, понимать и использовать его содержимое при формировании ответов.
В практическом гайде «Как подготовить сайт и контент под ИИ-поиск» мы разобрали общие принципы подготовки сайта к ИИ-поиску. В этой статье подробнее рассмотрим техническую часть: доступ роботов, структурированные данные и специальные файлы для передачи информации ИИ-системам.
Что означает технический GEO
Технический GEO, или geo-оптимизация сайта, отвечает за то, чтобы поисковая система или ИИ-агент мог открыть страницу, найти на ней нужные сведения и правильно определить связи между разделами сайта.
Техническая подготовка помогает:
- открыть нужные страницы для поисковых роботов;
- показать поисковой системе основную версию страницы;
- передать сведения о товарах, услугах и компании в текстовой форме;
- связать страницы между собой понятной навигацией;
- обозначить назначение кнопок, ссылок и полей формы;
- уменьшить количество дублей и технических ошибок.
Поисковый робот — программа, которая автоматически посещает страницы и передает сведения о них поисковой системе. У разных сервисов могут быть свои роботы и правила обхода.
Откройте нужные страницы для роботов
Работу с техническим GEO начинают с проверки доступа. Если робот не может открыть страницу и получить ее содержание, он не сможет проанализировать структуру сайта, сведения о компании и связи между разделами. Поэтому сначала проверьте, какие страницы доступны для обхода, а затем переходите к их содержанию и разметке.
Проверьте файл robots.txt
Файл robots.txt размещают в корне сайта, например: site.ru/robots.txt. В нем указывают, какие разделы робот может посещать.
Проверьте, не закрыты ли от обхода:
- главная страница;
- каталог товаров или услуг;
- страницы отдельных предложений;
- статьи и инструкции;
- разделы с адресами, условиями работы и контактами.
Для российского сайта файл можно проверить в Яндекс Вебмастере через «Инструменты» → «Анализ robots.txt». Там же доступна проверка отдельных страниц. Инструкция есть в справке Яндекса.
Учитывайте различия между роботами
У каждого сервиса есть собственные роботы, которые выполняют разные задачи.
Сначала проверьте доступ поисковых роботов:
- YandexBot — основной робот Яндекса, который индексирует страницы сайта;
- Googlebot — робот Google, который используется для страниц в Google Search.
Разрешение одного робота не открывает доступ для остальных. Например, компания может разрешить OAI-SearchBot, чтобы страницы появлялись в поиске ChatGPT, и запретить GPTBot, если не хочет разрешать использование материалов для обучения моделей.
У многих зарубежных ИИ-сервисов есть отдельные роботы, которыми можно управлять через robots.txt. У российских список отдельных ботов короче и обновляется реже; YandexBot остается основным роботом для классической индексации. Если сервис публикует отдельного робота, это обычно можно проверить в его официальной документации или в Яндекс Вебмастере.
Примеры роботов генеративных сервисов
У ИИ-сервисов отдельные роботы отвечают за поиск и подготовку ответов:
- OAI-SearchBot — ищет страницы для ответов ChatGPT;
- PerplexityBot — находит сайты для поиска Perplexity и добавляет ссылки на источники;
- Claude-SearchBot — используется для поиска в сервисах Claude.
Отдельные роботы могут выполнять другие задачи:
- GPTBot обходит материалы, которые OpenAI может использовать для обучения моделей;
- ClaudeBot собирает открытые материалы для возможного использования в обучении моделей Anthropic;
- ChatGPT-User, Perplexity-User и Claude-User получают страницы по запросу пользователя.
Перед изменением robots.txt определите, какие виды доступа допустимы для компании. Не копируйте готовые правила из чужих инструкций без проверки: они могут закрыть нужные разделы или разрешить обход служебных страниц.
Технический аудит покажет, что мешает роботам и ИИ-агентам индексировать сайт — от robots.txt до дублей и ошибок обхода
Подготовьте страницы к индексации
Доступ робота к странице не гарантирует ее появление в поиске. Система должна понять, какую страницу считать основной, разрешено ли ее показывать и как она связана с другими разделами сайта.
Проверьте доступность страниц для поисковых роботов
Страница может нормально открываться у посетителя, но быть недоступной для поискового робота. Например, сайт может отдавать техническую ошибку, запрещать обход страницы или не показывать ее без авторизации. В таком случае поисковая система не добавит страницу в результаты, а ИИ-система не сможет использовать ее как источник.
Проверьте главную страницу, страницы услуг и товаров, статьи и другие разделы, которые должны приводить посетителей:
- страница открывается без логина и пароля;
- при переходе на нее не появляется ошибка;
- на страницу можно перейти из меню или другого раздела сайта;
- ее адрес не закрыт правилами файла robots.txt;
- в настройках страницы нет запрета на добавление в поиск;
- страница не повторяет полностью другую страницу сайта.
Проверить доступность страниц можно в сервисах для вебмастеров, например в Яндекс Вебмастере или Google Search Console.
Проверьте запрет на индексацию
Иногда страница открывается для посетителя, но поисковым системам запрещено добавлять ее в поиск. Такой запрет задается специальной настройкой noindex.
Проверить ее можно:
- в настройках страницы в административной панели сайта;
- в коде страницы, если доступен просмотр исходного кода;
- в отчетах Яндекс Вебмастера или Google Search Console.
Если вы не работаете с кодом, достаточно передать эту проверку разработчику или специалисту по продвижению. На страницах услуг, категорий, товаров и статей запрет noindex обычно не нужен. Его используют для служебных страниц, результатов поиска по сайту, личного кабинета и других разделов, которые не должны появляться в поиске.
Укажите основной адрес страницы
Одна и та же страница может открываться по нескольким адресам. Например, карточка товара может иметь основной адрес и дополнительные варианты со ссылками фильтра, сортировки или рекламными метками.
Поисковой системе нужно указать, какой адрес считать основным. Этот адрес называют каноническим, или основным URL. Его указывают в коде страницы с помощью специального атрибута canonical. Проверить настройку можно в исходном коде или сервисе для вебмастеров.
Например, для карточки товара основным может быть адрес:
site.ru/catalog/oborudovanie/model-1
А ссылки с дополнительными параметрами могут вести на то же содержание:
site.ru/catalog/oborudovanie/model-1?sort=price
Канонический адрес помогает поисковой системе не воспринимать такие страницы как несколько самостоятельных материалов. Проверить его можно в исходном коде страницы или в инструментах для вебмастеров. На сайтах с системой управления он часто задается автоматически, но после доработок его стоит проверить.
Создайте карту сайта
Карта сайта, или файл sitemap.xml, содержит адреса страниц, которые нужно учитывать при обходе. Она помогает поисковым системам находить новые и обновленные разделы, особенно на крупных, сложных и недавно запущенных сайтах.
Карта сайта не заменяет обычную навигацию. Страницы должны быть связаны с сайтом через меню, категории и ссылки внутри материалов.
В sitemap.xml не добавляют:
- страницы с ошибками;
- дубли;
- служебные разделы;
- страницы с запретом на индексацию;
- устаревшие адреса после изменения структуры сайта.
Проверьте внутренние ссылки
Роботам проще понимать структуру сайта, если страницы связаны ссылками с понятным текстом. Вместо кнопки «Подробнее» лучше использовать «Условия доставки по России» или «Посмотреть цены на обслуживание». Такие ссылки сразу показывают, что находится на странице, и помогают поисковой системе определить тематику разделов и связи между ними.
Передайте содержание в текстовой форме
ИИ-системам проще определить содержание страницы, когда сведения о товаре или услуге размещены обычным текстом. Если все условия находятся только на изображении, в баннере или внутри интерактивного элемента, системе может быть сложнее их извлечь.
Разместите ключевые сведения на странице
Ключевые сведения размещайте в текстовом формате:
- название товара или услуги;
- основные характеристики;
- цену или способ ее расчета;
- условия заказа;
- сроки выполнения;
- адрес и регион работы;
- гарантии, ограничения и требования;
- способы связи с компанией.
Изображения дополняют текст, но не заменяют его. Для информативных картинок добавьте краткое описание в поле alt. Например, для фотографии выполненной работы подойдет описание «монтаж кондиционера в офисе». Декоративным изображениям такое описание не требуется.
Разделите страницу на понятные блоки
Заголовки помогают посетителю быстро найти нужный раздел и понять структуру страницы. Используйте один основной заголовок Н1 с названием товара, услуги или темы, а внутри страницы выделяйте отдельные разделы:
- кому подходит услуга;
- что входит в работу;
- сколько она стоит и сколько длится;
- как оформить заказ;
- какие вопросы задают клиенты.
Заголовки H2 используются для крупных разделов, а H3 — для вложенных тем. Заголовок должен описывать содержание блока, а не просто привлекать внимание.
Не нужно разбивать материал на множество коротких фрагментов ради ИИ-систем. У страницы нет универсальной длины или обязательного размера отдельных блоков. Структура должна помогать последовательно раскрыть тему и отвечать на вопросы посетителя.
Проверьте интерактивные элементы
Цена, характеристики, сроки и условия заказа должны быть видны на странице без нажатия на вкладки, раскрывающие кнопки и другие элементы. Если посетителю нужно выполнить несколько действий, чтобы увидеть ключевые сведения, поисковой системе тоже может быть сложнее их обработать.
Интерактивные элементы можно сохранить для удобства посетителей, но основные условия продублируйте в открытом тексте страницы. Если это невозможно, попросите разработчика проверить, видит ли поисковый робот содержание, которое появляется после нажатия на элементы.
Используйте структурированную разметку
SEO для нейросетей не сводится к тексту — важную роль играет и структурированная разметка, которую также называют микроразметкой. Это дополнительные сведения в коде страницы, которые помогают поисковой системе понять, что на ней находится: компания, товар, статья, мероприятие или другой объект. Обычно ее добавляет разработчик или специалист по продвижению.
Для описания таких объектов используют Schema.org — общий справочник типов и свойств для сайтов. С его помощью можно указать:
- название и логотип компании;
- адрес и часы работы;
- название товара, цену и наличие;
- заголовок статьи, автора и дату публикации;
- путь страницы в структуре сайта;
- сведения о мероприятии или вакансии.
Поисковая система может использовать эти сведения, чтобы показать страницу в расширенном виде: например, вывести цену и наличие товара, адрес компании или цепочку навигации.
Свяжите разметку с содержанием страницы
В разметке указывайте только те сведения, которые действительно есть на странице и доступны посетителю. Если в коде указана цена 10 000 рублей, а на странице написано 15 000 рублей, данные нужно исправить.
Структурированная разметка:
- не заменяет обычный текст;
- не продвигает страницу сама по себе;
- не гарантирует показ специального блока в результатах поиска;
- не является отдельной настройкой для попадания в ответ ИИ-системы;
- требует проверки после добавления и при изменении информации на странице.
После внедрения разметку проверяют специальными инструментами, например Rich Results Test или Schema Markup Validator. Если сведения в коде не соответствуют странице, поисковая система может не использовать их в результатах.
Не создавайте файлы для ИИ без задачи
В техническом GEO обсуждают дополнительные файлы, которые могут передавать ИИ-системам сведения о компании и содержании сайта. К ним относят llms.txt, ai-data.json и другие форматы. Универсального файла, обязательного для Яндекса, Google, OpenAI, Anthropic, Perplexity и других сервисов, пока нет.
Сначала следует проверить, как сайт представлен в поиске Яндекса и ответах Алисы. В Яндекс Вебмастере появился отдельный инструмент «Видимость сайта в Алисе AI», который показывает, становится ли сайт источником ответов и по каким запросам это происходит. Если страницы не попадают в ответы, сначала проверьте их доступность, содержание, структуру и актуальность данных.
- llms.txt
Предложенный текстовый файл с краткими сведениями о сайте и ссылками на его основные материалы. Яндекс не называет его обязательным условием для ответов Алисы AI. Google также указывает, что не использует этот файл для обычного поиска и генеративных функций. Поддерживать llms.txt можно для конкретного сервиса, если он прямо сообщает о работе с таким форматом. - ai-data.json
Нестандартный файл, который в отдельных подходах используют для передачи структурированных сведений об организации, товарах и услугах. Его содержание зависит от конкретной реализации. Общепринятого формата и подтвержденной поддержки со стороны Яндекса, Google и других крупных сервисов нет.
Дополнительный файл не заменяет доступные страницы, обычный текст, карту сайта, структурированную разметку и актуальные сведения о компании. Если на сайте закрыт каталог или устарели цены, создание нового файла не решит проблему.
Специалисты Megagroup настраивают весь комплекс технического GEO:
от доступа роботов до структурированных данных и видимости в Алисе AI и других ИИ-поисковиках
Поддерживайте единые данные о компании
ИИ-сервисы и поисковые системы могут учитывать сведения с сайта, из профилей компании на картах и других открытых источников. Если в них указаны разные телефоны, адреса или часы работы, системе сложнее определить, какие данные считать актуальными.
Сверьте информацию на сайте с профилями компании в Яндекс Бизнесе, Яндекс Картах, 2ГИС и других сервисах, которыми пользуются ваши клиенты.
Сверьте, чтобы везде совпадали:
- название компании;
- товары и услуги;
- адреса и регионы работы;
- телефоны, электронная почта и другие способы связи;
- часы работы;
- цены и условия заказа;
- сроки доставки или выполнения;
- гарантии и ограничения.
Интернет-магазинам нужно регулярно обновлять цены, наличие товаров и условия доставки. Компаниям с физическими точками — проверять адреса, график работы и контакты. После изменения этих данных обновите их на сайте и во внешних профилях.
Подготовьте сайт к действиям ИИ-агентов
Чтобы разобраться, как сделать сайт понятным для ИИ-агента, учтите: он может показать товар в готовом ответе или сразу выполнить действие — открыть каталог, выбрать параметры, заполнить форму или перейти к оформлению заказа. У этих двух сценариев разные требования к сайту.
Агент подбирает и показывает вариант. Так работает, например, Алиса AI в поиске Яндекса: она предлагает пользователю подходящие товары или предложения, ориентируясь на данные сайта и вероятность конверсии. Для этого сценария достаточно актуального текста, цены или стоимости услуги и разметки Schema.org.
Агент доводит пользователя до целевого действия. Здесь агент не просто находит вариант, а сам заполняет форму, оформляет заказ или запись. Например, агенты Алисы AI уже бронируют столик в ресторане, записывают в салон красоты, вызывают такси или оформляют заказ в магазине через партнерские интеграции конкретных сервисов.
Для сайта услуг тот же принцип работает через форму заявки, расчета стоимости или записи: агенту, как и человеку, нужно однозначно понимать, какое поле за что отвечает и что произойдёт после нажатия кнопки.
Для обоих сценариев полезно, чтобы названия и функции элементов интерфейса были понятны:
- Навигация оформлена ссылками, а действия — кнопками.
- У каждого поля формы есть понятная подпись с объяснением, что вводить.
- Названия кнопок описывают результат: «Рассчитать стоимость», «Записаться на консультацию», «Добавить в корзину», «Отправить заявку».
- Основные элементы страницы не перекрываются баннерами и всплывающими окнами.
- Форма работает на мобильном устройстве.
- Основные кнопки и ссылки видны сразу и не требуют наведения курсора для появления или активации.
Не стоит оформлять ссылку как кнопку, а кнопку как обычный текстовый блок, если они выполняют разные задачи. Для интерфейса используют стандартные элементы сайта: ссылки для перехода и кнопки для действий.
Такая проверка нужна не только для ИИ-агентов. Понятный интерфейс помогает посетителям быстрее ориентироваться на странице, снижает количество ошибок и делает сайт удобнее для людей, которые используют клавиатуру, экранное увеличение или программы чтения с экрана.
Проверьте результат
После изменений проверьте, доступны ли страницы для роботов, добавляются ли они в поиск, работают ли ссылки и формы, а также приводят ли страницы посетителей и заявки.
|
Задача |
Инструмент |
|---|---|
|
Проверить доступ роботов, индексацию и файл robots.txt
|
Яндекс Вебмастер
|
|
Посмотреть, становится ли сайт источником ответов Алисы AI
|
Инструмент «Видимость сайта в Алисе AI» в Яндекс Вебмастере
|
|
Проверить страницы в Google
|
Google Search Console, если сайт получает трафик из Google
|
|
Отследить посетителей и заявки
|
Яндекс Метрика или другая система аналитики
|
|
Найти обращения роботов и ошибки сервера
|
Серверные журналы, с помощью разработчика
|
В Яндекс Вебмастере можно проверить доступность страниц, настройки robots.txt и присутствие сайта в ответах Алисы AI.
Проведите первичную проверку:
- Определите страницы, которые должны приводить посетителей и заявки.
- Проверьте, что они открыты для роботов и не закрыты от индексации.
- Убедитесь, что страницы связаны между собой внутренними ссылками.
- Проверьте карту сайта и актуальность адресов в ней.
- Посмотрите, доступны ли в обычном тексте цены, характеристики, условия заказа и контакты.
- Проверьте заголовки, ссылки, кнопки и формы на компьютере и смартфоне.
- Убедитесь, что структурированные данные совпадают с содержанием страниц.
- Отслеживайте посещения, заявки и появление сайта в ответах ИИ-систем.
Результаты проверки зафиксируйте в таблице: укажите адрес страницы, найденную проблему, ответственного и статус исправления. После доработок повторите проверку и сравните данные с предыдущими результатами.
Главное о техническом GEO для сайта и ИИ-систем
Технический GEO начинается с базовой поисковой оптимизации. Разрешите роботам доступ к нужным страницам, настройте индексацию, устраните дубли, выстройте понятную навигацию и разместите ключевые сведения в текстовом виде.
Структурированная разметка помогает системам точнее определить содержание страницы, а карта сайта — находить нужные адреса. Эти настройки не гарантируют цитирование в ответах ИИ. Дополнительные файлы могут использоваться отдельными сервисами, но не заменяют доступный сайт с актуальной информацией.
Проверяйте сайт с трех сторон: как его видит посетитель, как его обходит поисковый робот и как с его интерфейсом может работать браузерный агент. Такой подход помогает находить ошибки, которые влияют на видимость сайта, заявки, заказы и удобство работы с ним.
Если сайт доступен для роботов, но редко появляется в ответах ИИ-систем, нужно проверить не только технические настройки, но и содержание, структуру и актуальность данных