SEO

Как подготовить сайтк ответамнейросетей: чек-лист

Начинать нужно с доступа: если AI-краулеры закрыты в robots.txt, всё остальное бессмысленно. Дальше — формат текста, чтобы ответ можно было вырезать одним куском, разметка данных, снятие технических барьеров и работа с внешними источниками. Разбираем по пунктам, что делать руками, и как потом проверить, что это сработало.

Редакция MARKETLINE 10 минут чтения AEOGEOнейросетиrobots.txtSchema.orgMARKETLINE
Обложка 1440 px
Правила robots.txt для AI-краулеров и выделенная строка в ответе нейросети
Коротко
01 Краулеры разделились на два типа: обучающие и поисковые — их можно разрешать по отдельности
02 Прямой ответ в первых двух предложениях раздела: именно такие блоки модели забирают чаще всего
03 Разметка Schema.org помогает: Organization, Service, FAQPage, Article — по типам страниц
04 Текст в скриптах, на картинках и в PDF без текстового слоя для модели не существует
05 Проверять результат нужно повторяемо: одни и те же вопросы, записанные ответы, сравнение через месяц

Шаг 1: откройте сайт AI-краулерам

Первое, что стоит проверить, — пускаете ли вы нейросети на сайт вообще. Многие владельцы в своё время закрыли AI-ботов в robots.txt, чтобы контент не уходил на обучение моделей, и с тех пор об этом не вспоминали. Результат предсказуемый: в ответах нейросетей их нет и быть не может.

Важная деталь, о которой мало пишут: краулеры разделились на два типа, и это разные решения. Обучающие — GPTBot, ClaudeBot, Google-Extended, CCBot — собирают тексты впрок, для тренировки моделей. Поисковые — OAI-SearchBot, Claude-SearchBot, PerplexityBot — заходят на страницу в момент, когда пользователь задаёт вопрос, и забирают контент для ответа здесь и сейчас.

Отсюда практический вывод: можно закрыть обучение, но остаться доступным для цитирования. Если вас смущает, что тексты уйдут в обучающую выборку, закрывайте обучающих ботов и оставляйте открытыми поисковых — именно они отвечают за то, попадёте ли вы в ответ.

Ещё одна оговорка: robots.txt — это просьба, а не запрет. Крупные операторы её соблюдают и документируют свои user-agent, но техническим барьером она не является.

Откройте robots.txt и найдите правила для AI-ботов
Решите, нужно ли вам закрывать обучающих краулеров
Поисковых краулеров оставьте открытыми — они отвечают за цитирование
Проверьте, что нужные разделы сайта не закрыты общими правилами
Убедитесь, что в логах сервера видны заходы этих ботов

Можно закрыть обучение и при этом остаться доступным для цитирования. За попадание в ответ отвечают поисковые краулеры, а не обучающие.

Иллюстрация 1160 px
Шаг 1: откройте сайт AI-краулерам

Шаг 2: пишите так, чтобы ответ можно было вырезать

Модель не пересказывает страницу целиком. Она ищет фрагмент, который отвечает на вопрос пользователя, и берёт его. Значит, задача — сделать так, чтобы такой фрагмент на странице был и его легко было отделить от остального.

Работающий приём простой: прямой ответ в первых двух предложениях раздела, детали после. Не разгон на три абзаца перед сутью, а сразу конкретика, а потом уже нюансы, оговорки и примеры. Этот же принцип полезен и живому читателю, так что терять тут нечего.

Второе правило — один смысловой блок на один вопрос. Если в разделе смешаны цена, сроки и условия работы, вырезать из него чистый ответ трудно. Разделите: отдельный подзаголовок на каждый вопрос, который реально задают.

Третье — формулируйте подзаголовки так, как спрашивают люди. Не «Тарификация услуг», а «Сколько стоит». Не «Временные рамки реализации», а «Сколько занимает». Совпадение формулировки с вопросом заметно повышает шансы, что именно ваш блок возьмут в ответ.

И четвёртое: блоки «вопрос-ответ» работают особенно хорошо, потому что там структура уже готовая — вопрос и короткий ответ рядом.

Прямой ответ в первых двух предложениях раздела
Один подзаголовок — один вопрос, без смешивания тем
Подзаголовки формулируйте так, как спрашивают люди
Добавьте блоки «вопрос-ответ» на страницы услуг
Списки и таблицы вместо сплошного текста там, где это уместно
Иллюстрация 1160 px
Сравнение структуры: ответ спрятан в середине текста против прямого ответа в начале раздела
Сравнение структуры: ответ спрятан в середине текста против прямого ответа в начале раздела

Шаг 3: разметьте данные

Разметка Schema.org — это способ сказать машине прямым текстом, что именно находится на странице: где название организации, где услуга, где вопрос и ответ. Человек это понимает по вёрстке, машина — по разметке.

Базовый набор небольшой. На главной и странице «О компании» — Organization с названием, контактами, адресом и ссылками на профили. На страницах услуг — Service с описанием и, если публикуете, ценой. На блоках «вопрос-ответ» — FAQPage. На статьях блога — Article с датой публикации и автором.

Отдельно про единообразие данных. Название компании, адрес и телефон должны совпадать везде: на сайте, в разметке, в карточках на картах, в каталогах. Разнобой мешает связать все упоминания с одной организацией, и вместо накопленного веса получается несколько разрозненных следов.

Стоит упомянуть и llms.txt — предлагаемый формат текстового файла с описанием сайта для языковых моделей. Стандарт пока не устоявшийся и поддерживается не всеми, поэтому относиться к нему стоит как к дешёвому эксперименту, а не как к обязательному пункту: сделать можно, рассчитывать на него как на основной инструмент — нет.

Ещё одно замечание из практики. Разметка должна описывать то, что реально есть на странице, а не то, что хотелось бы. Соблазн проставить FAQPage там, где никаких вопросов и ответов нет, или указать в Service цену, которой на странице не видно, — плохая идея: расхождение между разметкой и содержимым в лучшем случае игнорируется, в худшем воспринимается как попытка обмануть.

Organization — главная и страница «О компании»
Service — страницы услуг, с ценой если она публикуется
FAQPage — блоки «вопрос-ответ»
Article — статьи блога, с датой и автором
Название, адрес и телефон одинаковые везде, включая внешние площадки
Иллюстрация 1160 px
Соответствие типов разметки страницам: Organization, Service, FAQPage, Article
Соответствие типов разметки страницам: Organization, Service, FAQPage, Article

Шаг 4: уберите барьеры, из-за которых текст не читается

Бывает, что на странице всё есть — и цены, и условия, и ответы на вопросы, — а для модели страница пустая. Причина техническая: контент физически недоступен в разметке.

Самый частый случай — текст, который подгружается скриптами уже после загрузки страницы. Поисковые системы с этим научились справляться в разной степени, но полагаться на это не стоит: если ключевая информация появляется только после выполнения кода, велик шанс, что её не увидят.

Второй случай — текст на картинке. Прайс-лист, оформленный как изображение, красивая инфографика с условиями, схема работы в виде баннера. Для человека нормально, для машины — пустое место. Всё, что важно, должно быть текстом, а картинка — дополнением.

Третий — PDF без текстового слоя. Отсканированные документы и коммерческие предложения, сохранённые как изображения, не читаются.

Четвёртый — контент за формой входа или за кнопкой «показать ещё». Если информация доступна только после действия пользователя, краулер до неё не дойдёт.

Проверить всё это можно грубо, но быстро: откройте страницу с отключённым JavaScript и посмотрите, что осталось. То, что осталось, и видит модель.

Ключевой текст не должен подгружаться скриптами
Цены и условия — текстом, а не картинкой
PDF только с текстовым слоем
Важное не прячьте за формой входа и кнопкой «показать ещё»
Проверка: откройте страницу без JavaScript и посмотрите, что осталось

Откройте страницу с отключённым JavaScript. То, что осталось на экране, — это и есть ваш сайт глазами модели.

Иллюстрация 1160 px
Барьеры между краулером и контентом: скрипты, текст на картинке, PDF без текстового слоя, форма входа
Барьеры между краулером и контентом: скрипты, текст на картинке, PDF без текстового слоя, форма входа

Шаг 5: работайте с внешними источниками

Пункт, который чаще всего пропускают, хотя он влияет сильно. Нейросеть собирает ответ не только с вашего сайта — она опирается на всё, что нашла: каталоги, отраслевые подборки, отзывы, публикации.

Отсюда неприятный, но полезный вывод: можно идеально подготовить сайт и всё равно не попадать в ответы, если во внешних источниках вас нет. Особенно это заметно на вопросах формата «посоветуй компанию» — там модель часто опирается на подборки и рейтинги, а не на сайты отдельных фирм.

Что делать. Найдите, кого называют вместо вас: задайте нейросети вопрос, который задал бы клиент, и посмотрите на источники. Обычно всплывают одни и те же каталоги и статьи-подборки. Это и есть список площадок, где вас не хватает.

Дальше — присутствие. Профильные каталоги, отраслевые рейтинги, карточки на картах, отзывы на площадках. Это скучная работа, но именно она формирует ту базу, из которой модель собирает ответ.

Подробнее про то, каким бизнесам это направление вообще окупается, мы разбирали в материале для какого бизнеса имеет смысл GEO.

Посмотрите, на какие источники ссылается нейросеть в ответах по вашей теме
Разместитесь в профильных каталогах и отраслевых рейтингах
Заведите и заполните карточки на картах
Работайте с отзывами на площадках, которые попадают в выдачу
Следите, чтобы данные о компании везде совпадали
Иллюстрация 1160 px
Схема: вокруг сайта — каталоги, подборки, отзывы и профильные СМИ как источники для ответа нейросети
Схема: вокруг сайта — каталоги, подборки, отзывы и профильные СМИ как источники для ответа нейросети

Шаг 6: как проверять, что всё это работает

Здесь придётся смириться с неудобным фактом: привычной метрики вроде позиции в выдаче тут нет. Ответ нейросети зависит от формулировки вопроса, от сервиса и меняется со временем. Единственный рабочий подход — регулярная повторяемая проверка.

Схема простая. Составьте список из четырёх-пяти вопросов, которые задал бы ваш клиент — именно так, как он их формулирует, а не по названию компании. Задайте их в нескольких сервисах. Запишите, кого называют, в каком порядке и на какие источники ссылаются. Повторяйте раз в месяц по тому же списку.

Главное здесь — сделать первую запись до начала работ. Без точки отсчёта через месяц будет не с чем сравнивать, и любые выводы окажутся ощущениями.

И честная оговорка, которую мы повторяем всегда: гарантировать попадание в ответ нейросети невозможно. Модели меняются, ответ зависит от формулировки. Реально управляемая часть — сделать сайт понятным для машин и обеспечить присутствие во внешних источниках. Что из этого во что складывается, мы разбирали в статье про выбор между GEO и SEO.

Если хочется не разбираться самому, а получить готовый разбор — этим занимается продвижение в AI-поиске, а состояние сайта в целом показывает SEO-аудит.

Разберём вашу ситуацию бесплатно: посмотрим, доступен ли сайт для моделей и что мешает попадать в ответы → оставить заявку

Составьте список из 4-5 вопросов так, как их формулирует клиент
Задайте их в нескольких сервисах и запишите ответы
Зафиксируйте, кого называют и на какие источники ссылаются
Сделайте первую запись до начала работ
Повторяйте проверку раз в месяц по тому же списку

Гарантировать попадание в ответ нейросети невозможно. Управляемая часть — доступность сайта для моделей и присутствие во внешних источниках.

Иллюстрация 1160 px
Цикл проверки: задать вопрос, записать ответ, повторить в разных сервисах, сравнить через месяц
Цикл проверки: задать вопрос, записать ответ, повторить в разных сервисах, сравнить через месяц

Вопросы, которые задают чаще

5 вопросов
С чего начать подготовку сайта к ответам нейросетей?

С проверки robots.txt: если AI-краулеры закрыты, остальные меры бессмысленны. Дальше — формат текста с прямым ответом в начале раздела, разметка Schema.org, снятие технических барьеров и работа с внешними источниками.

Каких AI-ботов пускать на сайт?

Краулеры делятся на обучающие (GPTBot, ClaudeBot, Google-Extended, CCBot) и поисковые (OAI-SearchBot, Claude-SearchBot, PerplexityBot). Поисковых стоит оставить открытыми — именно они отвечают за попадание в ответы. Обучающих можно закрыть, если не хотите отдавать тексты в тренировку моделей.

Какая разметка нужна для AI-поиска?

Базовый набор Schema.org: Organization на главной и странице «О компании», Service на страницах услуг, FAQPage на блоках «вопрос-ответ», Article на статьях блога. Важно, чтобы название, адрес и телефон совпадали везде — и в разметке, и на внешних площадках.

Почему сайт есть, а нейросети его не цитируют?

Частых причин три: краулеры закрыты в robots.txt, ключевой текст недоступен в разметке (подгружается скриптами, лежит на картинке или в PDF без текстового слоя), либо о компании ничего нет во внешних источниках, на которые модель опирается.

Как проверить, видят ли нейросети мой сайт?

Задайте в нескольких сервисах четыре-пять вопросов так, как их сформулировал бы клиент, и запишите, кого называют и на какие источники ссылаются. Повторяйте раз в месяц по тому же списку. Первую запись нужно сделать до начала работ, иначе сравнивать будет не с чем.

Бесплатный разбор

Разберём вашу задачу и покажем точки роста

Посмотрим, что у вас сейчас, и скажем честно, где теряются заявки. Один день, без обязательств.

Заявка у нас — ответим в рабочее время.

Читайте также

Все статьи →