Одни сайты регулярно появляются в генеративных ответах, другие остаются незаметными даже при хороших материалах. Причина не сводится к одному параметру: разные сервисы используют свои поисковые индексы, модели, режимы и способы подбора источников.
Чтобы сведения с сайта могли попасть в ответ, который ИИ готовит с помощью интернет-поиска, страницу нужно обнаружить и открыть, понять её содержание, сопоставить с вопросом и выбрать полезные фрагменты. Поэтому в работе важны сразу несколько направлений: доступный сайт + сильное SEO + понятные экспертные материалы + однозначные сведения + независимые подтверждения + регулярное наблюдение.
Такую работу часто называют GEO — оптимизацией видимости в генеративных системах. Google рассматривает оптимизацию для своих генеративных функций как часть обычного SEO. В этой статье термин GEO используется шире — для работы с видимостью сайта в разных ИИ-сервисах.
01
Как ИИ готовит ответ с поиском
Ниже — упрощённая схема ответа с интернет-поиском.
- Пользователь задаёт вопрос.
- Система определяет задачу и при необходимости формирует несколько связанных поисковых запросов.
- Поиск или другой механизм подбора находит подходящие страницы и доступные источники.
- Из выбранных материалов извлекаются сведения, относящиеся к вопросу.
- Модель сопоставляет сведения и формирует связный ответ.
- В готовом ответе могут появиться факты с сайта, его название, цитата или ссылка на конкретную страницу.
ИИ может отвечать и без актуального веб-поиска — на основе ранее полученных знаний, содержания текущего диалога и других доступных данных. Поэтому отсутствие ссылки не доказывает техническую проблему сайта, а знакомая формулировка не означает, что система открывала страницу именно во время ответа.
По показанным ссылкам не всегда можно установить, какие материалы повлияли на формулировку ответа. Источник рядом с ответом может подтверждать только его часть.
RAG и query fan-out: что это такое
RAG, или генерация с опорой на найденные сведения, — подход, при котором модель сначала получает материалы из поиска или другой базы, а затем использует их при подготовке ответа. Query fan-out — формирование нескольких связанных запросов по подтемам исходного вопроса. Google официально описывает оба подхода для своих генеративных функций поиска; у других платформ реализация может отличаться.
Отсюда следует практическая рекомендация: страница должна не повторять одну точную фразу, а полноценно раскрывать вопрос и естественно связанные с ним темы. Создавать отдельный URL под каждую формулировку запроса не нужно.
02
Почему единого алгоритма нет
ChatGPT, Алиса, Gemini, Perplexity и другие системы не используют одну общую поисковую базу и не публикуют единую таблицу факторов. Даже внутри одного сервиса результат может зависеть от режима, региона, языка, формулировки вопроса, текущего состава индекса и модели.
Использование сведений, упоминание сайта, цитирование и показ ссылки — разные события. Сервис может назвать организацию без ссылки или дать ссылку на страницу, которая подтверждает лишь часть ответа. Поэтому выражение «факторы ранжирования ИИ» удобно как название темы, но его нельзя понимать как официальную универсальную формулу.
Что подтверждено, а что остаётся гипотезой
- Подтверждённые сведения опираются на документацию самой платформы. Например, Google связывает свои генеративные функции с обычным поисковым индексом и базовыми правилами SEO, Яндекс — с позициями в Поиске и качеством содержания, а OpenAI и Perplexity описывают назначение своих роботов.
- Практические выводы следуют из устройства поиска и наблюдений, но не объявлены универсальными факторами. К ним относятся согласованность сведений об организации, прямые ответы и присутствие в надёжных внешних источниках.
- Причина выбора конкретной страницы — гипотеза, если платформа не раскрыла её или вывод не подтверждён проверяемым экспериментом.
03
Что влияет на видимость сайта
Ниже перечислены восемь групп факторов. Это не официальный чек-лист всех ИИ-платформ, а сочетание требований обычного поиска, рекомендаций сервисов и осторожных практических выводов.
1. Доступность для роботов и индексация
Если сервис подбирает источники через поисковый индекс, непроиндексированная страница обычно не попадёт в подбор. При прямом открытии страницы по ссылке механизм может работать иначе. В любом случае система должна получить доступ к содержанию: этому могут помешать авторизация, цикл переадресаций, ошибка сервера, защита от автоматических запросов или настройки CDN и WAF.
Для генеративных функций Google страница должна быть проиндексирована и допущена к показу в обычном поиске со сниппетом. Яндекс связывает видимость в ответах Алисы AI с представленностью и позициями сайта в Поиске. OpenAI и Perplexity рекомендуют разрешать поисковым роботам доступ к страницам и опубликованным диапазонам IP-адресов.
Что говорят robots.txt и noindex
robots.txt управляет обходом URL роботами, которые соблюдают его правила. noindex сообщает поддерживающей его системе, что страницу не следует включать в индекс; при этом робот должен суметь открыть страницу и увидеть директиву. canonical указывает предпочтительный адрес среди дублей, а Sitemap сообщает о важных URL, но не гарантирует обход и индексацию.
В серверных логах важно различать агентов. Googlebot и YandexBot используются для поискового обхода. Для ограничения показа уже проиндексированного контента в быстрых ответах и Поиске с Алисой Яндекс учитывает правила robots.txt для YandexAdditionalBot и YandexAdditional. Сами эти агенты страницы не индексируют. У OpenAI OAI-SearchBot отвечает за поиск в ChatGPT, GPTBot — за обход материалов, которые могут использоваться при обучении моделей, а ChatGPT-User открывает страницы по отдельным действиям пользователей. У Perplexity похожее разделение действует между PerplexityBot и Perplexity-User.
Как проверить доступность страницы
Для важного URL проверьте ответ сервера 200, отсутствие пароля и обязательной проверки, доступ нужных роботов, отсутствие случайного noindex, корректный canonical, наличие в Sitemap и видимость основного текста без сложного взаимодействия. Одной строки Allow недостаточно: CDN или WAF может блокировать запросы по IP, географии или частоте. Поэтому нужны инструменты для вебмастеров и серверные логи, а не только просмотр страницы в браузере.
2. Сильная основа классического SEO
Генеративная видимость не отменяет обычный поиск. Google указывает, что его генеративные функции опираются на основной индекс, системы ранжирования и качества. Яндекс пишет о релевантных, информативных и качественных страницах, которые обычно хорошо представлены в Поиске.
Сохраняют значение техническая стабильность, логичная структура, внутренние ссылки, корректная индексация, соответствие страницы запросу, мобильная версия и удобство чтения. Сначала стоит исправить дубли, неверные canonical, потерянные страницы, случайные запреты, слабую перелинковку и нестабильную загрузку. GEO дополняет SEO, а не заменяет его.
3. Соответствие реальным вопросам
ИИ-система ищет сведения, которые помогают решить задачу, а не страницу с максимальным числом повторов ключевой фразы. Один вопрос часто распадается на подтемы: определение, условия, ограничения, порядок действий, сравнение вариантов и подтверждения.
Соберите небольшой перечень вопросов из поиска, обращений и разговоров со специалистами, сгруппируйте их по задачам и проверьте, есть ли на сайте сильные страницы услуг и полноценные экспертные материалы. Google отдельно предостерегает от множества страниц под вариации запросов ради манипулирования поиском и генеративными ответами.
4. Понятная структура и прямые ответы
Человеку и системе проще работать со страницей, когда у неё ясный предмет, последовательные заголовки и однозначные формулировки. Определение лучше давать рядом с термином, вывод — рядом с объяснением, а важные условия не прятать в конце длинного текста.
Короткий ответ в начале смыслового раздела помогает читателю быстро понять главное, но не является опубликованным фактором ранжирования. У Google нет требования делить текст на блоки по 2–4 предложения или подбирать «идеальную» длину страницы. Заголовки, списки и таблицы нужны там, где они действительно упрощают чтение.
5. Экспертность, оригинальность и доказательства
Пересказ общих фраз редко добавляет материалу ценность. Гораздо полезнее собственный опыт, методика, расчёт, пример, наблюдение, фотография, документ, данные исследования или точное объяснение ограничений. Google рекомендует оригинальное содержание с опытом и собственной точкой зрения; Яндекс отмечает экспертность, полезность, оригинальность и содержательность.
Проверка проста: внешний факт должен вести к первичному источнику, собственный результат — сопровождаться контекстом и способом измерения, рекомендация — объяснением, а меняющиеся данные — датой актуальности. Если доказательств нет, утверждение лучше смягчить или обозначить как гипотезу.
6. Однозначные сведения о сайте и организации
Система сопоставляет название сайта, данные об организации, авторов, услуги, адреса, профили и публикации на разных страницах. Расхождения мешают понять, относятся ли сведения к одному объекту.
На сайте и значимых внешних площадках должны совпадать название, домен, контакты, описание деятельности, география работы и сведения об авторах. Платформы не называют единообразие отдельным универсальным фактором, но согласованные данные снижают риск неверного сопоставления.
7. Независимые подтверждения
Сайт рассказывает о себе сам, а другие площадки могут подтвердить существование организации, её опыт, документы, публикации и репутацию. В зависимости от темы это карты, отраслевые каталоги, профессиональные объединения, государственные реестры, СМИ, сайты партнёров, библиотеки, конференции и авторские профили.
Полезны настоящие и уместные упоминания, которые не противоречат основному сайту. Массовые публикации одинаковых текстов на сомнительных площадках и купленные упоминания не создают надёжной доказательной базы. Оценивайте не количество, а качество источника, точность данных и связь с темой.
8. Регулярное наблюдение за ответами
Генеративные ответы меняются вместе с поисковой выдачей, индексом, моделями и формулировками запросов. Яндекс предупреждает, что ответ и набор источников по одному вопросу могут различаться в разное время.
Для сравнения сохраняйте одинаковые условия: сервис, режим, регион и язык. Достаточно небольшого стабильного набора важных вопросов. Фиксируйте упоминание сайта или организации, точность описания, наличие ссылки, использованную страницу, другие названные источники и заметные изменения со временем. Причины выбора конкретного источника записывайте как гипотезы.
Сотни обязательных ручных запросов обычно не нужны. Платформенные отчёты, если они доступны, и выборочные контрольные проверки дают более понятную картину, чем большой массив несопоставимых скриншотов.
04
Что даёт микроразметка
На сайте стоит внедрять стандартную корректную микроразметку. Она помогает поисковым системам точнее распознавать организацию, сайт, услуги, материалы, авторов и структуру страниц. Но сама по себе не обеспечивает попадание в ответы ИИ.
Разметка должна соответствовать видимому содержанию. Нельзя указывать несуществующие услуги, скрытые отзывы, неподтверждённые рейтинги или вопросы, которых нет на странице.
Schema.org и JSON-LD
Микроразметку Schema.org часто внедряют в формате JSON-LD — как отдельный блок структурированных данных в коде страницы. Для генеративных функций Google не требуется специальная Schema.org-разметка. Выбор типов зависит от содержания страницы:
- Organization — сведения об организации.
- WebSite — сведения о сайте.
- Service — описание конкретной услуги.
- Article или BlogPosting — заголовок материала, автор и даты.
- BreadcrumbList — путь страницы в структуре сайта.
- Person — сведения об авторе или специалисте.
- FAQPage — только при наличии на странице видимых вопросов и полных ответов.
Не нужно добавлять все типы сразу или придумывать отдельную «AI-разметку». Выберите только подходящие сущности, заполните достоверные свойства, проверьте валидность и совпадение с текстом страницы. После изменений шаблона разметку следует проверять повторно.
05
Каким советам не стоит верить
- Отдельной гарантированной кнопки GEO нет. Улучшения сайта повышают вероятность видимости, но не обязывают сервис использовать источник.
- llms.txt сам по себе не обеспечивает попадание в ответы. Google прямо сообщает, что не использует этот файл для видимости в своём поиске; другие сервисы могут относиться к нему иначе.
- Специальные тексты «для нейросетей» не заменяют нормальные страницы, полезные и понятные человеку.
- Доступ для поисковых роботов ИИ-сервисов может быть необходимым, но не гарантирует упоминания: он лишь позволяет получить страницу.
- Микроразметка не заменяет содержание и доказательства, а только описывает уже опубликованные сведения.
- Массовые сгенерированные публикации и искусственные упоминания могут создавать шум и противоречия и не дают устойчивой видимости.
- Гарантировать появление конкретного сайта в ChatGPT, Алисе, Gemini или Perplexity нельзя.
06
Что проверить на сайте в первую очередь
- Доступность: ответы сервера, robots.txt, noindex, canonical, Sitemap, индексацию и ограничения CDN или WAF.
- Поисковую основу: дубли, внутренние ссылки, техническую стабильность, мобильную версию и полноту важных страниц.
- Содержание: реальные вопросы, прямые ответы, понятную структуру, авторов, даты, примеры и первичные источники.
- Однозначность: совпадают ли название, контакты, услуги, авторы и другие идентифицирующие сведения на сайте и внешних площадках.
- Микроразметку: соответствует ли Schema.org-разметка видимому содержанию страницы.
- Наблюдение: небольшой стабильный набор вопросов, единые условия проверки и отдельная фиксация данных и гипотез.
07
Что важно запомнить
ИИ-системы с веб-поиском работают с ограниченным набором найденных источников. Сайту помогает техническая доступность, сильная поисковая основа, ясное и доказательное содержание, согласованные сведения и подтверждения на других площадках. Ни один из этих элементов не гарантирует ссылку в конкретном ответе.
Работа над видимостью в ответах ИИ — это последовательное развитие сайта и наблюдение за результатами, а не отдельный технический приём. В «ИнтернетЗоне» мы проводим такую диагностику и готовим план улучшений в рамках направления «Продвижение в ответах искусственного интеллекта (GEO)».
08
Официальные источники
- Google Search Central: оптимизация сайта для генеративных функций поиска
- Google Search Central: AI-функции и сайт
- Google Search Central: введение в структурированные данные
- Google Search Central: общие правила структурированных данных
- Google Search Central: robots.txt и управление обходом
- Google Search Central: noindex
- Google Search Central: canonical
- Google Search Central: Sitemap
- Яндекс Вебмастер: видимость сайта в Алисе AI
- Яндекс Вебмастер: роботы Яндекса
- OpenAI: обзор поисковых роботов и пользовательских агентов
- Perplexity: поисковые роботы и пользовательские агенты
- Schema.org: словарь типов структурированных данных