Дмитрий Анашкин

Сайт на JavaScript: почему нейросети его не видят и как это проверить за пять минут

Опубликовано 10 окт. 2026 г.8 мин чтенияНачальный
Три маленьких робота-паука без эмблем изучают пустую картонную коробку рядом с ноутбуком, на экране макет сайта. Никаких логотипов, иконок сервисов и названий брендов
Туториал
Сайт на JavaScript
Дмитрий Анашкин · 8 мин
Чему вы научитесь
  • Почему краулеры ChatGPT, Claude и Perplexity видят сайт-приложение пустым
  • Что показал аудит собственного запуска глазами робота
  • Почему Google видит больше, чем нейросети, и где у него ловушка с языком
  • Как проверить свой сайт за пять минут
  • Что исправлять первым, не переписывая всё приложение
Начальный

Коротко

Что видит нейросеть, когда открывает сайт на JavaScript?

Разберём простым языком, как это устроено. Когда ты открываешь сайт, браузер делает две вещи: скачивает страницу и выполняет скрипты, которые на ней лежат. На классическом сайте текст уже есть в скачанной странице. На сайте-приложении в скачанной странице только каркас вида «здесь будет приложение», а весь текст приносит скрипт.

Человек разницы не замечает. Робот замечает, если не умеет выполнять скрипты.

Vercel проанализировал поведение AI-краулеров и сделал однозначный вывод: ни один крупный AI-краулер не рендерит JavaScript. В списке краулеры OpenAI (GPTBot, OAI-SearchBot, ChatGPT-User), Anthropic (ClaudeBot), Perplexity, Meta и ByteDance. Исключения - Gemini, который пользуется инфраструктурой Googlebot, и Applebot: эти скрипты выполняют.

ChatGPT and Claude don't execute JavaScript, so any important content should be server-rendered.

- Vercel, The rise of the AI crawler

Для бренда это значит простую вещь. Можно годами вкладываться в тексты на сайте, а нейросеть, которая отвечает покупателю, их ни разу не прочитает.

Аудит своего запуска: ноль слов для бота

Сапожник без сапог - это про меня. Я продаю продвижение в ответах нейросетей, а свой сервис коротких видео Zaletai запустил как классическое приложение на React. Через десять дней после подключения своего домена я провёл аудит: запросил страницы так, как их запрашивают Googlebot, YandexBot и GPTBot, без выполнения скриптов.

Что проверялЧто увидел ботЧто это значит
Тело любой страницытолько пустой контейнер, ноль словнейросети нечего цитировать
Заголовок и описаниеодин и тот же на всех страницахглавная, тарифы и витрина неотличимы
robots.txt, sitemap.xml, llms.txtвместо файлов - та же HTML-страницау робота нет ни правил, ни карты сайта
Несуществующий адресответ 200, как у настоящей страницыв индекс может попасть любой мусор
Личный кабинет и админкаоткрыты для индексаприватное без запрета на индексацию
Зеркало с wwwработает без перенаправлениядве копии сайта на разных адресах

Отдельной строкой: сайта не было в индексе Google и Bing по запросу site:, а панели вебмастеров не были подключены. Для сервиса, которому нужен трафик, это нулевая точка.

Ничего из этого не видно глазами в браузере. Сайт открывается, всё работает, красиво. Проблема существует только для робота, и поэтому её годами никто не замечает.

Почему Google видит сайт, а нейросеть нет?

Google в документации по JavaScript описывает обработку в три фазы: обход, рендеринг и индексирование. Страница с JavaScript встаёт в очередь на рендеринг, и только после него Google видит текст, который нарисовал скрипт.

У Яндекса в Вебмастере есть настройка «Индексирование страниц с JavaScript». По умолчанию робот решает сам: может сравнить страницу со скриптами и без и взять ту, что полезнее. Если сайт целиком на клиентском рендеринге, это решение лучше не оставлять на усмотрение робота.

И вот тут самое интересное. Рендеринг поисковика - тоже браузер, со своими настройками.

Интерфейс Zaletai определял язык по браузеру посетителя, а Google рендерит страницы с английской локалью. В итоге русский сайт уходил в индекс Google по-английски. Это лечится одной строкой - язык по умолчанию русский, английский только по выбору, - но заметить это можно только проверкой глазами робота.

Как отличить настоящих роботов нейросетей от подделок и что разрешать в robots.txt, разбирал в материале о том, кто из нейросетей заходит на сайт.

Как проверить свой сайт за пять минут?

  1. Исходный код страницы

    В браузере правый клик по странице - «Просмотр кода страницы». Найди поиском первую фразу своего главного текста. Нет её в коде - нет её и для нейросети.

  2. Страница без скриптов

    В настройках браузера для сайта отключи JavaScript и обнови страницу. Что осталось на экране, то и видит краулер нейросети.

  3. Проверка глазами робота

    Попроси ИИ-агента скачать главную, тарифы и одну статью командой без выполнения скриптов, с именем робота GPTBot в запросе, и показать, сколько слов текста в теле каждой страницы.

  4. Служебные файлы

    Открой адреса /robots.txt, /sitemap.xml и /llms.txt. Должны прийти файлы, а не копия главной страницы.

  5. Мусорный адрес

    Открой /takoy-stranicy-net. Правильный ответ - страница 404 с кодом 404. Если приходит обычная страница с кодом 200, поисковик может проиндексировать мусор.

Если хотя бы один шаг провален, сайт нуждается в доработке до того, как ты начнёшь вкладываться в контент на нём.

Порядок исправлений: публичные страницы первыми

В Zaletai я не стал переделывать приложение целиком. Порядок был такой:

  1. Статьи - готовым HTML с сервера. Блог отдаётся сервером полностью, без скриптов: его читают и поисковики, и краулеры нейросетей.
  2. Свои заголовок, описание и канонический адрес для каждой публичной страницы, подставленные сервером до отправки.
  3. Короткая текстовая сводка для робота без JavaScript на страницах приложения: название, описание и ссылки на разделы.
  4. robots.txt с явным разрешением для поисковиков и краулеров нейросетей, sitemap.xml с датами и llms.txt с картой ключевых страниц. Что класть в llms.txt и зачем он нужен, разбирал в материале про llms.txt для сайта.
  5. Запрет индексации личного кабинета, админки и чужих разборов, которые пользователи отправляют друг другу ссылкой.
  6. 404 на несуществующие адреса и один канонический домен вместо двух зеркал.
  7. Разметка schema.org для организации, сайта и продукта. Какая разметка нужна статье, товару и компании, подробно разобрано в статье про микроразметку для нейросетей.
Кабинет может остаться приложением

Личный кабинет, настройки, оплата нейросети цитировать не нужно. Достаточно, чтобы готовым HTML отдавались страницы, которые отвечают на вопросы покупателя: главная, описание продукта, тарифы, статьи, частые вопросы.

Как понять, что исправления сработали?

Технический результат проверяется в тот же день. Результат по существу - позже и в двух местах.

Первое место - журнал сервера. Если после правок в нём появились визиты GPTBot, ClaudeBot, PerplexityBot к статьям, значит, двери открыты и роботы ими пользуются.

Второе место - ответы нейросетей. Открытые двери не гарантируют цитирования: нейросеть берёт страницу, когда в ней есть удобный для ответа фрагмент. Поэтому после технических правок начинается работа с содержанием, а измеряется она замером видимости по вопросам покупателя. Как это делается руками и сервисом, разбирал в статье про замер видимости бренда.

Частые вопросы

Частые вопросы

Главный вывод

Я сам наступил на это на собственном запуске, хотя каждый день объясняю клиентам, как нейросети читают сайты. Ловушка в том, что проблема невидима человеку: сайт открывается, всё красиво, и только робот получает пустую коробку.

Практический шаг на сегодня: открой исходный код своей главной страницы и найди в нём первую фразу главного текста. Это одна минута, и она покажет, видит ли тебя ChatGPT.

Ты уже смотрел на свой сайт глазами робота, или пока только глазами клиента?

Источники

Отправь другу или себе в избранное в Telegram, чтобы не потерять.

Поделиться в Telegram
Было полезно?
Автор
Дмитрий Анашкин
Практик-интегратор ИИ в бизнес

Основатель NeuroDA и SMAIPL. Корпоративные воркшопы по ИИ, внедрение AI в бизнес-процессы.

Похожие гайды

Ответ Алисы AI над выдачей: как сайту попасть в нейроответ Яндекса и Google

Над выдачей Яндекса и Google всё чаще стоит готовый ответ нейросети, и он забирает клики у первых позиций. Разбираю, на какие страницы опирается Алиса AI в поиске, что пишет Google про AI Overviews, как проверить сайт в отчёте Вебмастера и какие страницы переписать первыми.

8 мин

Реклама в нейросетях: можно ли купить место в ответе ChatGPT и Алисы

ChatGPT тестирует рекламу под ответами, Яндекс показывает объявления рядом с Алисой AI, Google - в AI Overviews. Разбираю, где стоит рекламный блок, почему место внутри ответа не продаётся, что из этого доступно бизнесу в России и как совмещать рекламу с GEO.

10 мин

Микроразметка для нейросетей: какая schema.org нужна статье, товару и компании

Особой разметки для нейросетей не существует, а обещания «плюс N процентов цитирований» ничем не подтверждены. Разбираю, как schema.org работает через поисковые индексы, какой набор нужен статье, товару и компании, как разметка собрана на этом блоге и как её проверить.

10 мин

Сколько стоит продвижение в нейросетях (GEO): из чего складывается бюджет

Бюджет на продвижение в нейросетях складывается из замера, работы с источниками ответа и материалов, и только первое считается заранее. Разбираю вилки рынка, что входит в пакет, почему честную цену называют после разговора о категории и как считать окупаемость без выдуманного ROI.

11 мин

Связанные понятия