Видят ли ваш сайт нейросети
26 проверок: пускает ли сайт ИИ-краулеров, доходит ли до них текст, понятно ли моделям, кто вы, и есть ли на странице то, что можно процитировать. Результат — за минуту.
Открываем главную страницу
- Главная страница
- robots.txt
- Карта сайта
- Файл llms.txt
- Внутренние страницы
- Проба ИИ-краулерами
- Зеркала и коды ответа
Смотрим главную и несколько страниц из карты сайта — не больше 24 обращений. Нагрузки на сайт это не создаёт.
Как выглядит отчёт
Так выглядит отчёт о видимости сайта в нейросетях. Ниже — реальная проверка нашего собственного сайта от 20 августа 2026: мы не выбирали удобный пример, инструмент нашёл семь недоработок, включая две наши давние технические задачи.
geosecrets.org · проверено 20 августа 2026GeosecretsAuditBot
сайт готов к цитированию
Нейросети видят сайт и могут на него ссылаться. Узкие места точечные.
Что нашлось на нашем сайте
Требует правок
geosecrets.org и www.geosecrets.org отвечают независимо друг от друга — для поиска это два сайта с одинаковым содержимым.
/services и /services/ оба отдают 200.
Формата «вопрос — короткий ответ» на проверенных страницах не нашлось.
Замечания
Article есть, автор указан, но нет даты обновления.
На двух страницах пропущен уровень: H1 сразу переходит в H3.
Нет реквизитов — они отличают компанию от анонимного сайта.
В среднем 2,3 внешних ссылки на страницу — мало.
Пройдено — 19 проверок
- robots.txt доступен и разбираетсяОтдаётся текстом, синтаксис читается без ошибок.
- Поисковые роботы допущеныGooglebot и YandexBot не закрыты.
- Доступ ИИ-агентовВсе 18 агентов допущены, запрещающих строк нет.
- Сайт реально пускает краулеровОтвет боту совпадает с браузерным, 200.
- Мета-теги и заголовки не запрещают показНи noindex, ни nosnippet, ни noai.
- Контент виден без JavaScriptВ исходном HTML весь основной текст.
- Карта сайтаsitemap.xml объявлен в robots.txt, валиден, 34 адреса.
- Файл llms.txtНа месте, структура по спецификации.
- Язык и кодировкаlang="ru" и charset UTF-8.
- Лента RSS или AtomRSS доступен и валиден.
- Микроразметка JSON-LDБлоки разбираются без ошибок.
- Разметка организацииOrganization с логотипом и sameAs.
- Прямой ответ в началеПервый абзац понятен без остального текста.
- Цитаты и статистика с датойУ числовых фактов указан период.
- Свежесть материаловСамая свежая дата — 20 августа 2026.
- HTTPS и переход с httpСертификат валиден, http переадресуется.
- Адрес canonicalЗадан, абсолютный, на свой домен.
- Скорость ответа и вес страницыTTFB 180 мс, HTML 48 КБ.
- Код ответа несуществующей страницыВыдаётся 404.
Мы показываем это специально. Агентство, которое продаёт видимость в нейросетях, должно уметь показать собственные недочёты — иначе первый же посетитель проверит наш сайт нашим же инструментом и сделает выводы сам.
26 проверок в пяти группах
У каждой группы свой вес в итоговой оценке: он отражает не удобство измерения, а влияние на попадание в ответы. Проверки, которые выполнить не удалось, оценку не занижают — они исключаются из расчёта, а в отчёте видно покрытие.
Доступ ИИ-краулеров
Самая дорогая группа, и самая частая причина невидимости. Если краулер не попадает на страницу, всё остальное не имеет значения: цитировать нечего.
- robots.txt доступен и разбирается
- Файл на месте, отдаётся текстом, синтаксис читается. Ошибка сервера на этом файле краулеры трактуют как запрет обходить сайт целиком.
- Поисковые роботы допущены
- Googlebot и YandexBot не закрыты. Без индексации в поиске сайт почти не попадает и в ответы моделей.
- Доступ ИИ-агентов
- Проверяем 18 агентов: GPTBot и OAI-SearchBot от OpenAI, ClaudeBot и Claude-SearchBot, PerplexityBot, Google-Extended, YandexAdditional и другие. Отчёт показывает таблицу целиком и строку robots.txt, которая закрывает доступ.
- Сайт реально пускает краулеров
- Заходим на сайт с User-Agent реальных ботов и сравниваем ответ с браузерным. Ловит случай, когда robots.txt разрешает, а защита от ботов на сервере или CDN отдаёт 403.
- Мета-теги и заголовки не запрещают показ
- Ищем noindex, nosnippet, noai и X-Robots-Tag. Директива nosnippet прямо запрещает использовать текст страницы в ответе — это отказ от цитирования.
Машиночитаемость
Доходит ли до краулера сам текст и может ли он понять структуру страницы.
- Контент виден без JavaScript
- Считаем слова в исходном HTML. Основные ИИ-краулеры скрипты не выполняют: если страница собирается в браузере, для них она пустая.
- Карта сайта
- Есть ли sitemap.xml, объявлен ли в robots.txt, валиден ли, сколько адресов и заполнены ли даты обновления.
- Файл llms.txt
- Наличие и структура по спецификации llmstxt.org. Отсутствие файла даёт половину веса, а не ноль: подтверждённого влияния на видимость у него нет.
- Структура заголовков
- Один H1 на страницу, уровни без пропусков, заголовки не пустые.
- Язык и кодировка
- Атрибут lang и charset. По ним модель понимает, на каком языке отвечать.
- Лента RSS или Atom
- Дешёвый канал для агрегаторов и мониторингов. Не обязателен — отсутствие стоит половину веса.
Сущность бренда
Понимает ли модель, кто вы такие, и может ли связать сайт с брендом. Разметка важна не сама по себе, а как способ это сказать однозначно.
- Микроразметка JSON-LD
- Есть ли блоки и разбираются ли они. Сломанный JSON хуже отсутствия: он молча игнорируется, а по коду кажется, что всё сделано.
- Разметка организации
- Organization с названием, логотипом и sameAs. Именно sameAs связывает сайт, профили в соцсетях и упоминания в каталогах в один бренд.
- Разметка материалов и авторства
- Article с автором и датами публикации и обновления. По ним модель решает, можно ли ссылаться на текст как на источник.
- Идентификация компании на странице
- Контакты, раздел о компании, реквизиты — в видимом тексте, а не только в разметке.
Цитируемость контента
Есть ли на странице то, что удобно процитировать. Проверки этой группы эвристические — они оценивают текст правилами, а не понимают его, поэтому вес группы маленький.
- Прямой ответ в начале
- Модель цитирует абзац, понятный без остального текста. Страница, начинающаяся со слогана, такого абзаца не даёт.
- Ссылки на первоисточники
- Сколько внешних ссылок в теле материалов и на что они ведут.
- Цифры и статистика с датой
- Числовые факты и указан ли рядом период. Цифра без даты быстро устаревает.
- Блоки вопросов и ответов
- Заголовки-вопросы и разметка FAQPage. Формат «вопрос — короткий ответ» ложится в ответ модели почти без переработки.
- Свежесть материалов
- Самая свежая дата из разметки, карты сайта и заголовков ответа.
Доставка и гигиена
Не про GEO напрямую, но ломает всё остальное: дубли размывают цитирование, медленный ответ обрывает обход, битый сертификат закрывает сайт целиком.
- HTTPS и переход с http
- Валиден ли сертификат и переадресуется ли незащищённая версия.
- Один основной адрес
- Отвечают ли независимо версии с www и без. Если да, сигналы делятся между двумя адресами.
- Адрес canonical
- Задан ли, абсолютный ли, не указывает ли на чужой домен.
- Дубли по завершающему слешу
- Открывается ли одна страница по двум адресам.
- Скорость ответа и вес страницы
- Время до первого байта и объём HTML. Замер делается с нашего сервера — это не скорость для посетителя, и в отчёте об этом сказано.
- Код ответа несуществующей страницы
- Отдаёт ли сервер 404 там, где страницы нет.
Как сделать сайт видимым для нейросетей
Правки имеет смысл делать в этом порядке: каждый следующий шаг бессмысленен, пока не сделан предыдущий.
- Впустить краулеров. Убрать из robots.txt запреты для поисковых агентов ИИ-сервисов и проверить, что защита от ботов на сервере их не режет. Пока сюда не попадают, остальное не работает вовсе.
- Отдать текст с сервера. Если страница собирается в браузере, краулер видит пустой каркас. Нужен серверный рендеринг или пререндер хотя бы для продвигаемых страниц.
- Сказать, кто вы. Разметка Organization с sameAs, Article с автором и датой обновления, контакты и реквизиты в видимом тексте. Это то, по чему модель связывает сайт с брендом и решает, можно ли на него ссылаться.
- Дать то, что удобно процитировать. Прямой ответ первым абзацем, ссылки на первоисточники рядом с фактом, цифры с датой, блок вопросов и ответов. Подробный разбор — в материале как попасть в ответы ChatGPT и других нейросетей.
- Убрать дубли и починить доставку. Один основной адрес, canonical, корректный 404, разумный вес страницы.
Порядок не произвольный. Приёмы из четвёртого шага — цитаты, статистика и ссылки на источники — единственные, чей эффект замерен публично: в исследовании GEO: Generative Engine Optimization (KDD 2024) они дают прирост видимости 30–40% по одной метрике и 15–30% по другой, тогда как насыщение ключевыми словами опускает результат ниже базового уровня. Но всё это работает только при выполненных первых двух шагах: измерять цитируемость страницы, до которой краулер не доходит, бессмысленно.
Списки агентов сверяются с документацией вендоров: OpenAI, Anthropic, Perplexity, Google, Яндекс. Сверено 20 августа 2026 года.
GEO-аудит сайта: что делает инструмент, а что человек
Бесплатная проверка и полноценный GEO-аудит сайта отвечают на разные вопросы, и подменять один другим нечестно.
Проверка на этой странице
бесплатно, около минуты
- Пускает ли сайт ИИ-краулеров — в robots.txt и на деле
- Доходит ли текст до краулера без JavaScript
- Есть ли разметка, автор, даты, контакты
- Дубли, коды ответа, вес страницы
- Оценка видимости сайта в нейросетях по 26 пунктам
GEO-аудит
от 60 000 ₽, 5–7 дней
- Что нейросети отвечают о вашем бренде на реальных запросах
- Кого называют вместо вас и на какие источники ссылаются
- Видимость компании в нейросетях в сравнении с конкурентами
- Мониторинг упоминаний бренда в ChatGPT и других моделях
- План работ с приоритетами и оценкой эффекта
Инструмент не опрашивает модели и не считает упоминания: автоматически это делается либо дорого, либо неточно. Если вам нужен именно ответ на вопрос «что ИИ говорит о нас» — это работа человека, и она платная. Сколько стоит GEO-аудит и что входит в результат — на странице услуг.
Частые вопросы о видимости в нейросетях
Почему нейросети не видят мой сайт?
Чаще всего по одной из трёх причин. Первая — сайт закрыт для ИИ-агентов в robots.txt: строку вроде «User-agent: GPTBot / Disallow: /» часто добавляют «на всякий случай», не понимая, что вместе с обучением закрывается и цитирование. Вторая — защита от ботов на сервере или CDN отдаёт краулерам 403, хотя robots.txt их пускает; проверить это можно только запросом от имени бота. Третья — текст страницы собирается в браузере, а в исходном HTML почти пусто: краулеры ИИ-сервисов скрипты не выполняют. Наша проверка разбирает все три случая по отдельности.
Как нейросети проверяют достоверность сайта?
Прямого «рейтинга достоверности» у моделей нет. На практике они опираются на косвенные признаки: есть ли у материала автор и дата обновления, ссылается ли текст на первоисточники, указана ли организация и связана ли она с внешними профилями через sameAs, подтверждается ли утверждение другими источниками. Поэтому в проверке отдельная группа отведена разметке сущности бренда, а другая — цитируемости текста.
Что такое GPTBot и нужно ли его пускать?
GPTBot — краулер OpenAI, который собирает контент для обучения моделей. Он не единственный: у OpenAI есть отдельный OAI-SearchBot, который отвечает за показ сайта в результатах поиска ChatGPT. Разница принципиальна: закрывая GPTBot, вы влияете на то, что модель будет знать о вас через полгода, а закрывая OAI-SearchBot — теряете цитирование прямо сейчас. Если контент не хочется отдавать в обучение, разумная середина — закрыть обучающих агентов и оставить поисковых.
Нужен ли сайту файл llms.txt?
Подтверждённого влияния на видимость у llms.txt пока нет: крупные вендоры его чтение официально не декларируют, замеров эффекта в открытом доступе тоже нет. Поэтому в нашей проверке отсутствие файла даёт половину веса, а не ноль — это не ошибка. Сделать его дёшево, и хуже от него не будет, но ждать роста цитируемости только от него не стоит.
Чем бесплатная проверка отличается от GEO-аудита?
Проверка смотрит техническую сторону: пускает ли сайт краулеров, доходит ли текст, есть ли разметка, нет ли дублей. Это 26 пунктов, которые можно измерить автоматически. GEO-аудит отвечает на другой вопрос — что нейросети сейчас говорят о вашем бренде, кого называют вместо вас и какие источники цитируют в вашей нише. Такое измеряется опросом моделей и разбором ответов вручную, автоматической проверкой это не заменить.
Сколько стоит GEO-аудит?
GEO-аудит начинается от 60 000 ₽ и занимает 5–7 дней. В него входит разбор ответов нейросетей по вашей нише, сравнение с конкурентами и план работ. Техническая проверка на этой странице бесплатна и не требует ни регистрации, ни контактов.
Вы не создаёте нагрузку на проверяемый сайт?
Нет. За одну проверку сканер делает не больше 24 обращений: главная, robots.txt, карта сайта, llms.txt, три страницы из карты и несколько служебных запросов. Обычный браузер при открытии одной страницы грузит больше. Сканер представляется как GeosecretsAuditBot и не проверяет один и тот же сайт чаще раза в 15 минут.
Что делать с результатом?
Отчёт можно скопировать в markdown одной кнопкой и отдать разработчику: в нём есть и что найдено, и чем это подтверждается, и что конкретно править. Начинать стоит сверху — пункты отсортированы по влиянию, а не по порядку проверки.
Проверить свой сайт
Проверка бесплатная, занимает около минуты и не требует контактов. Если после отчёта останутся вопросы — расскажем, что делать в вашем случае.