Сайт может держаться в топе обычного поиска и при этом почти не появляться в ответах нейропомощников: у ИИ-поиска свои краулеры, свои требования к тексту и свои метрики. Проверить видимость можно за один вечер и почти без бюджета - нужны доступ к логам, браузер и панели вебмастера. Ниже чек-лист из семи шагов со свежими данными 2026 года и понятными критериями «прошли / не прошли».
Сначала разделите три разные вещи
Фраза «нас видит ИИ» на практике означает три независимых состояния, и путать их - главная ошибка при аудите:
- Обход. Краулер физически заходит на страницы и получает код 200.
- Цитирование. Поисковая нейросеть берёт вашу страницу как источник, когда формулирует ответ.
- Переходы. Из ответа кто-то кликает по ссылке и доходит до сайта.
Эти состояния связаны слабее, чем кажется. По данным Cloudflare, к июню 2026 года боты генерируют около 57,5% всего HTML-трафика в вебе, и примерно половина обходов ИИ-краулерами делается ради обучения моделей, а не ради ответов со ссылками. У обучающих краулеров соотношение «обходов к переходам» измеряется тысячами к одному, тогда как у классического поискового робота оно около 5:1. Практический вывод: нулевой трафик из ассистентов не означает, что вас не читают, и наоборот. Проверять нужно каждый уровень отдельно. Что такое AEO и как оно устроено, мы подробно разбирали в статье «Что такое AEO и почему сайтам пора готовиться к ИИ-поиску».
Шаг 1. Логи сервера: боты вообще приходят?
Самый честный источник - серверные логи или статистика CDN. Отфильтруйте запросы по User-Agent известных ИИ-краулеров и посмотрите на три вещи:
- Есть ли визиты вообще и как часто они повторяются.
- Какие коды ответа отдаются ботам: 200, 301, 403 или 404.
- Какие разделы обходятся чаще: часто это неожиданно старые страницы, а не свежие материалы.
Ключевые разделы сайта посещаются ИИ-ботами хотя бы несколько раз в месяц и отдают 200. Если в логах пусто, дальше идти бессмысленно: вопрос не в контенте, а в доступе. Если логи недоступны, попросите их у хостинга - это стандартный запрос.
Шаг 2. Доступ: robots.txt, CDN и антибот-защита
Блокировка редко бывает осознанной. Чаще она приезжает с обновлением защиты от ботов или с настройками CDN, а владелец сайта об этом не знает. По разным оценкам, около трети русскоязычных сайтов закрывают ИИ-краулеров, причём значительная часть - случайно.
Что проверить:
- Откройте
/robots.txtи убедитесь, что правилаDisallowне задевают нужные разделы. - Разделяйте типы ботов: один и тот же вендор может использовать разные User-Agent для обучения моделей и для поиска в реальном времени. Можно закрыть обучение и оставить открытым поисковый обход.
- Проверьте правила WAF и CDN отдельно от robots.txt. Классическая ситуация: в robots.txt всё разрешено, а на периметре бот получает 403.
- Проверьте, не стоит ли на страницах
<meta name="robots" content="noindex">, оставшийся с этапа разработки.
Запрос к странице с User-Agent ИИ-бота возвращает 200 и полный HTML, а не заглушку, капчу или 403.
Шаг 3. Текст читается без JavaScript?
Многие ИИ-краулеры забирают сырой HTML и не выполняют скрипты. Если цены, характеристики или условия подгружаются на клиенте, для модели их просто нет.
Проверка занимает минуту: откройте страницу через view-source: (именно исходный код, а не панель Elements в DevTools) и поищите в нём ключевые факты - название услуги, цену, срок, город, контакты. Если находится только пустой контейнер, факт невидим.
- Табы и аккордеоны, содержимое которых подгружается по клику.
- Цены и калькуляторы, считающиеся в браузере.
- Важные документы, которые существуют только в виде PDF: их содержимое почти не участвует в ответах.
- Факты, зашитые в картинку или инфографику без текстового дубля.
Заодно посмотрите на скорость ответа сервера: при отклике больше секунды боты заходят реже и обходят меньше страниц.
Шаг 4. Структура и микроразметка
Нейропоиску нужен извлекаемый фрагмент: короткий прямой ответ, который можно процитировать целиком. Помогает простая дисциплина - один H1, логичные H2 и H3, короткие абзацы, списки, таблицы, определения в первом предложении раздела.
Из разметки Schema.org наибольший вес имеют Article (автор, дата, заголовок), FAQPage для блоков вопрос-ответ, Organization с контактами и профилями, BreadcrumbList для понимания структуры сайта, Product для товаров. Проверить разметку можно валидатором Schema.org и тестом расширенных результатов Google.
Разметка должна соответствовать содержимому. FAQPage на странице без вопросов и ответов или HowTo без шагов - это расхождение, которое системы распознают, и оно работает против вас. Живой пример корректного блока вопрос-ответ есть на нашей странице частых вопросов.
Шаг 5. llms.txt и карта сайта
Файл llms.txt - это компактная карта ключевых страниц в Markdown, предложенная в 2024 году как неформальная спецификация. Ни одна организация по стандартизации её не утверждала, и волшебной таблеткой она не является: если о компании никто не пишет и на сайте нет содержательных материалов, файл ничего не изменит. Но он снимает лишние поводы вас не понять.
Минимальные требования: файл лежит в корне домена, отдаёт код 200 (не редирект и не 404), доступен без авторизации и содержит актуальные ссылки. Проверьте заодно, что sitemap.xml открывается, содержит все важные URL и корректные даты lastmod: устаревшие даты сбивают приоритет обхода.
Шаг 6. Отчёты в панелях вебмастера
В 2026 году видимость в ИИ-ответах наконец стала измеримой штатными инструментами.
В апреле 2026 года в разделе «Эффективность» появился отчёт «Видимость сайта в Алисе AI». Он показывает долю запросов, где сайт используется источником ответа (Share of Voice), примеры запросов и тематик, похожие сайты, которые попадают в те же ответы, и темы, по которым нейросеть уже ищет источники, а вас там нет. Отчёт доступен всем, кто подтвердил права на сайт. Масштаб понятен по цифре самого Яндекса: быстрые ответы Алисы AI ежемесячно получают 46,5 млн пользователей.
3 июня 2026 года Google запустил отчёты по генеративным ответам: они появляются в разделе «Эффективность» под отчётом по результатам поиска. Пока это только показы с разбивкой по страницам, странам, устройствам и датам - без кликов, CTR и запросов, и поверхности смешаны в одну корзину. Выкатывается отчёт постепенно, поэтому его может пока не быть. Отдельно проверьте, не включён ли у вас отказ от показа в генеративных функциях: с 17 июня 2026 года Google эту настройку соблюдает, и сайт перестаёт получать оттуда и показы, и трафик.
Шаг 7. Спросите ассистентов и загляните в аналитику
Финальная проверка - фактическое цитирование. Задайте нейропомощникам вопросы, ради которых к вам приходят клиенты, и посмотрите, попадает ли ваш сайт в источники.
- Берите выборку минимум из 20 запросов: по одному промпту выводы делать нельзя, ответы генерируются заново каждый раз.
- Спрашивайте не только про бренд, но и про задачу: «как выбрать...», «сколько стоит...», «чем отличается...».
- Зафиксируйте базовый замер до правок, иначе оценить эффект будет не с чем.
- В веб-аналитике выделите переходы с доменов ассистентов в отдельный сегмент.
- Смотрите на рост брендовых запросов без рекламной активности: это косвенный признак, что вас начали упоминать в ИИ-ответах. Эффект обычно виден через два-три месяца.
- Добавьте в форму заявки вопрос «как вы о нас узнали»: если один-два лида из десяти называют нейропомощника, канал уже работает.
Пять ошибок, которые встречаются чаще всего
- Открыть бота в robots.txt и одновременно резать его на CDN.
- Прятать ключевые факты в JavaScript, PDF и картинках.
- Писать маркетингово, без прямых ответов и конкретных цифр: цитировать нечего.
- Путать доступ к обучению, попадание в ответы и трафик и делать выводы по одной метрике.
- Оценивать результат только по кликам: в ИИ-поиске значительная часть контакта с брендом происходит без перехода.
С чего начать, если времени мало
Порядок действий на первую неделю выглядит так: снять блокировки (шаги 1-2), вытащить факты из JavaScript и PDF в обычный HTML (шаг 3), подключить отчёты в панелях вебмастера и сделать базовый замер по 20 запросам (шаги 6-7). Микроразметка и llms.txt - следующий заход.
Технические правки переиндексируются быстро: ИИ-краулеры обходят сайты часто, и изменения в robots.txt, llms.txt и разметке подхватываются за срок от нескольких дней до пары недель. А вот рост цитируемости - это уже работа с содержанием: материалы должны быть экспертными, оригинальными и содержательными, и именно эти критерии Яндекс называет ключевыми для попадания в ИИ-ответы.
Отдельный сюжет - что происходит с посетителем после перехода. Аудитория из ассистентов приходит с уже сформулированным вопросом, поэтому ей нужен быстрый конкретный ответ на сайте: здесь помогают ИИ-чаты и консультанты, отвечающие по вашей базе знаний. Как устроен такой поиск по документам изнутри, разобрано в материале «Что такое RAG».
Короткие ответы
Посмотрите логи: если визитов ИИ-ботов нет или они получают 403 и 404, проблема в доступе, а не в контенте. Это первое, что нужно чинить.
Нет, это неформальная спецификация, не утверждённая стандартом. Он полезен как карта ключевых страниц, но не заменяет доступность сайта и качество материалов.
Это осознанный выбор. Обучающий обход почти не приносит переходов, поисковый - приносит. Разумный компромисс: закрыть то, что используется для обучения, и оставить открытым то, что формирует ответы со ссылками.
Технические изменения подхватываются за дни или недели. Рост упоминаний и брендовых запросов обычно заметен через два-три месяца, поэтому важен базовый замер до правок.
Нет. Ответ генерируется заново под каждый запрос. Управлять можно только вероятностью: технической доступностью, машиночитаемостью текста и качеством самих материалов.