
Полная версия
Как попасть в ответы нейросетей
Ещё одна платформа со своим набором — GigaChat от Сбера. По обзорным материалам (первичной технической документацией это не подтверждено, поэтому — с оговоркой), он приоритизирует русскую Википедию и Викиданные, материалы Дзена с подтверждёнными авторами, открытые государственные реестры и официальные сайты в зоне gov.ru, а также СМИ из реестра Роскомнадзора.¹³ Своя логика, отличная и от Алисы, и от глобальных моделей.
И, наконец, локальный бизнес. Для него на российской карте главные — карты и справочники: Яндекс. Карты в связке с Яндекс. Бизнесом, 2ГИС, отзовики. Без заполненного и согласованного профиля здесь Алиса просто не назовёт вас по локальному запросу. Ключевое слово — согласованного: название, адрес и телефон должны совпадать дословно на всех площадках, иначе система не свяжет их в один бизнес.
Сравните две карты. Глобально работают YouTube и Википедия — они одинаково сильны везде. Но дальше пути расходятся: там, где в мире стоит Reddit, в Рунете — россыпь из Pikabu, DTF, Habr и vc.ru; где в мире Trustpilot и Amazon, в России — Отзовик, Ozon и Wildberries; и над всем этим в Рунете висит жёсткая привязка к топу Яндекса, которой у глобальных платформ нет. Это не одна карта с переведёнными названиями. Это две разные карты.
Почему пулы почти не пересекаются
Возникает законный вопрос: а нельзя ли угодить всем сразу? Почти нет — и доказательства такие.
Мы уже приводили цифру Ahrefs: в среднем лишь около 12% ссылок, которые дают ИИ-ассистенты, попадают в топ-10 обычной выдачи Google по тому же запросу.¹⁴ За этим средним прячется разброс по системам: у Perplexity пересечение 28,6%, а у Gemini, Copilot и ChatGPT — всего 6—8,6%.¹⁴ Perplexity ближе всех к классическому поиску, остальные идут своей дорогой.
Это не единичный замер. Академическая работа исследователей из Университета Торонто (arXiv 2601.16858, конференция EDBT/ICDT 2026) на тысяче ранжирующих запросов даёт другие по величине, но те же по направлению числа: у всех проверенных моделей пересечение с топ-10 Google измеряется единицами процентов, и лишь у Perplexity подбирается к пятнадцати.¹⁵ Разная методология, разный период — а вывод один: пересечение везде низкое, и Perplexity стабильно ближе всех к обычному поиску.
Но самый наглядный замер — у BuzzStream (обновлён в июне 2026): 30 тысяч цитирований, 595 запросов, четыре системы — Google AI Overviews, AI Mode, Gemini и ChatGPT.¹⁶ Результат: 76,1% всех цитирований уникальны для одной-единственной платформы, и лишь 0,8% ссылок встречаются одновременно во всех четырёх системах.¹⁶ Сильнее всего между собой пересекаются два продукта Google — AI Overviews и AI Mode (37,4%), — а ChatGPT почти ни с кем не совпадает.¹⁶ Из той крохотной доли, что цитируют все четыре платформы разом, 35% приходится на Википедию.¹⁶ То есть общего у платформ ровно столько — общая энциклопедия и почти ничего больше.
Что это значит на практике, легко представить на одном материале. Экспертная статья, которую с удовольствием цитирует ChatGPT, может остаться полностью невидимой для Алисы — если она не в топе Яндекса. Пост на vc.ru, который Алиса берёт в ответ, может ни разу не всплыть у Perplexity с её собственным индексом. Один и тот же текст на разных платформах живёт разной жизнью, и это не исключение, а правило: до трёх четвертей цитирований, как мы только что видели, уникальны одной системе.
Отсюда прямой вывод, который определит всю вашу стратегию: традиционный успех в поиске и цитируемость в ИИ — почти параллельные вселенные, и сами платформы между собой пересекаются слабо.¹⁰ Один материал, который «зайдёт всем», сделать нельзя — он рискует не зайти никому. Придётся выбирать пулы осознанно и вести глобальную и российскую дорожки порознь.
Как выбрать свои 10—15 площадок
Теперь к главному. Площадок в карте — десятки, а сил у вас на все не хватит. Хорошая новость: их и не нужно. Раз пятнадцать доменов забирают 68% всех цитирований, вам достаточно попасть в правильные десять-пятнадцать — не пятьдесят. Всё дело в том, чтобы выбрать те, что кормят ответы именно в вашей нише и на вашем рынке. Разложим выбор по трём шагам.
Шаг 1. Определите рынок: Россия или мир. Это первая развилка, и она задаёт всю карту. Если ваши клиенты в России, отправная точка — Алиса и Яндекс, а значит, сначала классическое SEO, потом уже площадки. Если аудитория глобальная — ChatGPT, Perplexity, Gemini и их пулы. Пытаться накрыть оба рынка одним набором площадок бессмысленно: пулы почти не пересекаются.
Шаг 2. Определите тип бизнеса: B2B, локальный или e-commerce. Внутри каждого рынка пул зависит от ниши. Ниже — рабочие наборы под типовые сценарии. Это ориентир на снимок 2026 года, а не вечная константа.
Глобальный B2B / SaaS. Собственный сайт со сравнениями, Википедия, Reddit, LinkedIn, G2, Capterra, YouTube, Quora, профильные деловые медиа (Forbes, TechRadar).
Глобальный B2C / e-commerce. Собственный сайт, YouTube, Reddit, Википедия, Trustpilot, Amazon, Instagram/TikTok, тематические обзорные площадки (тип Fandom для ниши).
Российский B2B / технологии. Топ Яндекса (свой сайт), vc.ru, Habr, Яндекс. Дзен, русская Википедия, YouTube и RuTube, профильные Telegram-каналы и форумы.
Российский e-commerce. Топ Яндекса, Ozon, Wildberries, Яндекс. Маркет, Отзовик и iRecommend, Яндекс. Дзен, YouTube.
Российский локальный бизнес. Топ Яндекса, Яндекс. Карты и Яндекс. Бизнес, 2ГИС, Отзовик и iRecommend, русская Википедия (если есть значимость).
Шаг 3. Учтите характер платформ внутри пула. Perplexity жаден до свежего и первоисточников — держите материалы актуальными. Claude любит длинную авторитетную журналистику — туда пробиваются через публикации в качественных медиа. Google тянется к видео — значит, YouTube. Алиса живёт топом Яндекса — значит, SEO. Это тонкая настройка поверх выбранного набора, а не вместо него.
Выбрали набор — теперь расставьте внутри него порядок, потому что делать всё сразу тоже не выйдет. Начинайте с той площадки, где два условия совпадают: вас там сегодня нет, и при этом она несёт большую долю пула вашей ниши. Для российского локального бизнеса это почти всегда карты и топ Яндекса, для глобального B2B — LinkedIn и профильная площадка отзывов, для e-commerce — маркетплейсы и отзовики. Дешёвые действия с доказанным эффектом — заполненный профиль, собранные отзывы, понятная карточка — ставьте вперёд дорогих. А площадки, которые требуют долгой работы (публикации в авторитетных медиа, присутствие в сообществах), запускайте параллельно, но не ждите от них мгновенного результата.
И два правила, которые уберегут от типичных ошибок. Первое: не распыляйтесь. Соблазн завести профили на всех сорока площадках из карты велик, но силы уйдут в песок. Лучше десять площадок, где вы реально присутствуете и обновляетесь, чем полсотни мёртвых профилей. Второе: сверяйтесь с реальностью по своим запросам. Карта в этой главе — общая; ваша ниша может вести себя иначе. Возьмите пять-десять запросов, по которым клиент должен находить именно вас, и посмотрите, кого по ним реально цитируют ваши целевые нейросети. Делать это можно руками, ведя простую таблицу, или через сервис мониторинга, который сам прогоняет запросы и показывает, какие источники сейчас в ходу у каждой нейросети. Так вы уточните общую карту под свою конкретную нишу — и не будете строить присутствие вслепую.
Итог главы
Единого «интернета», из которого ИИ берёт факты, нет. Есть узкие, почти не пересекающиеся пулы площадок: пятнадцать доменов забирают около 68% глобальных цитирований, у каждой платформы свой любимый набор, а российская карта — вообще отдельная, с жёсткой привязкой к топу Яндекса и своей россыпью площадок вместо Reddit. Три независимых замера — Ahrefs, работа Университета Торонто и BuzzStream — сходятся: пулы платформ пересекаются слабо, до 76% цитирований уникальны одной системе.
Если унести из главы одну мысль, пусть будет эта: не пытайтесь быть везде — выберите десять-пятнадцать площадок под свой рынок и нишу и займите их всерьёз.
Сделайте сейчас одну вещь: определите по двум развилкам — Россия или мир, B2B, или локальный, или e-commerce — свой сценарий из таблицы, выпишите эти десять-пятнадцать площадок и отметьте, на скольких из них вас сегодня вообще нет. С самой важной из пустых клеток и начнёте.
Мы разложили карту чужих площадок. Но у неё есть центр, с которого всё начинается и который целиком в вашей власти, — ваш собственный сайт. О том, как переделать его так, чтобы нейросеть легко вас читала и цитировала, — в следующей главе.
Глава 11. Ваш сайт: как переделать под ИИ
Идеальная статья, которую никто не прочитал
Представьте: вы неделю писали материал. Вылизали каждый абзац, собрали цифры, взяли комментарий у эксперта, десять раз перечитали. Публикуете и ждёте, что нейросети начнут вас цитировать.
А они молчат. Не потому, что текст плохой. А потому, что бот ИИ до него либо вообще не добрался, либо добрался — и увидел пустую страницу.
Оба провала до обидного частые. Первый: ваш хостинг или защитный экран молча заблокировал нужного бота. По одной оценке на выборке около трёх тысяч сайтов, примерно 27% случайно закрывают доступ хотя бы одному крупному ИИ-краулеру — и чаще не в своих настройках, а на уровне CDN или файрвола, о котором владелец даже не знает.¹ Цифру берите как сигнал, а не как закон — это один замер, в основном по бизнесу США и Британии, разошедшийся по блогам без независимого повтора. Но механизм реален: с 1 июля 2025 года Cloudflare, через сеть которого идёт около пятой части мирового трафика, по умолчанию блокирует ИИ-краулеров для новых доменов.² Вы могли ничего не запрещать — а бот всё равно не проходит.
Второй провал тоньше. Ваш сайт построен на JavaScript и собирает текст прямо в браузере посетителя. Человек видит статью, а бот — нет. И об этом — вся эта глава.
В прошлой главе мы разложили карту чужих площадок. Теперь — про единственную площадку, которая целиком в вашей власти: ваш сайт. Разговор чисто технический, поэтому сразу расставлю приоритеты, чтобы вы не утонули в мелочах. Сначала — доступ ботов и извлекаемость. Потом — разметка. И только в самом конце, по остаточному принципу, — модные файлы вроде llms. txt.
Приоритет первый: проверьте, что вас вообще пускают
Начинать надо не с красоты, а с двери. Если бот не может войти, всё остальное бессмысленно. А управляет дверью маленький текстовый файл в корне сайта — robots. txt. В нём вы построчно говорите каждому боту по имени: сюда можно, сюда нельзя.
И тут первое, что нужно понять: у крупных провайдеров не один бот, а несколько, и у каждого своё имя и своё назначение. Путают их постоянно, и ошибка тут дорогая: одной строчкой можно вычеркнуть себя из ответов.
Как мы уже видели раньше, боты разведены на два лагеря. Одни ходят по сайтам, чтобы собирать данные для будущего обучения моделей. Другие — чтобы формировать живые ответы прямо сейчас. Это разные боты с разными именами, и блокировать их можно раздельно.³ Вот кто есть кто на середину 2026 года.
OpenAI. GPTBot — сбор данных для обучения. OAI-SearchBot — живой поиск для ответов ChatGPT. Это два независимых правила: закрыли один — второй по-прежнему ходит.⁴
Anthropic. У Claude официально три бота, и это стоит запомнить дословно, потому что в сторонних каталогах их путают. ClaudeBot — сбор данных для обучения. Claude-SearchBot — индексация для поисковых ответов Claude. Claude-User — получение конкретной страницы по запросу живого пользователя в моменте. Так прямо и написано на странице Anthropic: «информация о трёх роботах, которых использует Anthropic», — без четвёртого.⁵ ⁶ Если вам где-то встретится «claude-code» в одном ряду с ними — это не бот Anthropic, а юзер-агент инструмента для программистов, отдельная история; в свой robots. txt его как «четвёртого краулера» не вписывайте.
Perplexity. PerplexityBot — краулер для индекса, из которого модель цитирует источники. Отдельно Perplexity-User — запрос страницы по инициативе пользователя.⁷
Google и Apple — а вот тут ловушка. Google-Extended и Applebot-Extended звучат как имена ботов, но это не краулеры. Сами по себе они не делают ни одного запроса к сайту. Это токены-разрешения: ими вы говорите уже существующим роботам Google и Apple, можно ли использовать собранный контент для обучения ИИ — отдельно от обычной индексации.⁸ Заблокировать Google-Extended, надеясь «закрыться от ИИ Google», и при этом остаться в поиске — можно. А вот заблокировать самого Googlebot — значит выпасть из выдачи целиком.
Отсюда простое правило настройки. Раз обучающие и поисковые боты разведены, вы можете закрыть первых и оставить вторых. Не хотите кормить будущие версии моделей своим контентом — закройте GPTBot, ClaudeBot, Google-Extended. Но обязательно оставьте открытыми OAI-SearchBot, Claude-SearchBot и PerplexityBot — иначе вы своими руками вычеркнете сайт из живых ответов.³ В robots. txt это пишется по имени юзер-агента:
User-agent: OAI-SearchBot
Disallow:
User-agent: PerplexityBot
Disallow:
User-agent: GPTBot
Disallow: /
Пустой Disallow: — «ходи везде», Disallow: / — «не ходи никуда». Заметьте, к чему привела осторожность многих: по одному замеру, 39 из 107 топовых сайтов (36,4%) на середину июня 2026 года блокировали хотя бы одного бота Anthropic, и почти все блокировки пришлись именно на обучающий ClaudeBot.⁹ Методология этой выборки раскрыта не полностью, так что перед вами скорее ориентир, чем точный замер. Но тренд ясный: обучающих ботов закрывают охотно, и это нормально — лишь бы заодно не прихлопнуть поисковых.
Что сделать руками прямо сегодня. Откройте вашсайт.ру/robots. txt в браузере и прочитайте его глазами. Нет ли там Disallow: / для поисковых ботов? Затем проверьте уровень выше — CDN и защитный экран. Если сайт на Cloudflare, зайдите в настройки управления ИИ-ботами и убедитесь, что поисковые краулеры не перекрыты по умолчанию. Пять скучных минут — а от них зависит, существуете вы для нейросети или нет.
Приоритет второй: чтобы бот увидел текст, а не пустоту
Дверь открыта, бот вошёл. Теперь — увидит ли он ваш текст? Здесь и живёт вторая, самая коварная причина невидимости.
Многих этот факт застаёт врасплох. ИИ-краулеры в массе своей не исполняют JavaScript. У них нет браузерного движка, нет DOM, нет цикла событий — они просто скачивают тот HTML, что сервер отдал в ответ, и вытаскивают из него готовый текст.¹⁰ GPTBot, ClaudeBot, PerplexityBot работают именно так.
Многие современные сайты устроены как одностраничные приложения: сервер отдаёт почти пустую оболочку — заголовок, спиннер загрузки и ссылки на скрипты, — а сам текст статьи «дорисовывается» уже в браузере посетителя после загрузки этих скриптов. Человек видит полноценную страницу. А бот, который скрипты не запускает, получает ту самую пустую оболочку.¹⁰ Ваша идеальная статья для него просто не существует.
Проверить себя можно за минуту. Откройте страницу, нажмите правой кнопкой «Просмотр исходного кода страницы» (view-source) — и поищите в нём текст своей статьи. Есть текст в исходном HTML — бот его увидит. Нет, только скрипты — вы невидимка.
Лечится это известным способом, и он не такой страшный, как кажется. Нужен серверный рендеринг (SSR, server-side rendering) — когда сервер отдаёт уже готовую HTML-страницу с текстом внутри, а не собирает её в браузере. Это умеют делать фреймворки вроде Next. js, Nuxt или Angular Universal.¹¹ Если полный переход на SSR не по силам, есть более дешёвая замена — пре-рендеринг: сервер заранее готовит статичные HTML-версии страниц специально для ботов.¹¹ Смысл в обоих случаях один: важный текст должен лежать прямо в ответе сервера, а не появляться после того, как отработают скрипты.
Дальше — как этот текст разложить, чтобы его было легко «вынуть». Здесь напомню коротко механику, которую мы уже разбирали: генеративный поиск не читает страницу целиком, а заранее режет её на смысловые куски (chunking) и на этапе ответа достаёт тот кусок, что ближе всего к запросу.¹² Значит, ваша задача — нарезать текст за систему, а не оставлять это на её усмотрение. Три конкретных приёма.
Заголовки-вопросы. Оформляйте подзаголовки как прямые вопросы, которые задал бы человек: «Сколько стоит доставка?», «Чем отличается тариф Pro от Basic?». Вопрос в теге
и следующие за ним два-три предложения ответа — это ровно тот шаблон, который система легче всего распознаёт и вырезает как готовую пару «вопрос-ответ». ¹²
Ответная капсула. Практики GEO сходятся на ориентире: 40—80 слов на один самодостаточный ответ в начале смыслового блока — сначала прямой ответ, потом раскрытие.¹³ Тут важно не обмануться: это отраслевая эвристика, а не измеренный в эксперименте норматив. Используйте как рабочий ориентир длины, а не как магическое число. Каждая такая капсула должна быть понятна сама по себе, без «как мы писали выше» и провисающих «он», «это», «там» — чтобы её можно было процитировать, не таща за собой остальной текст.
Блок FAQ. Раздел «Частые вопросы» — это концентрат капсул: десяток прямых вопросов, под каждым — короткий самодостаточный ответ. Формат, будто созданный под нарезку.
И ещё одна вещь, почти бесплатная, — семантический HTML. Это значит размечать страницу осмысленными тегами вместо бесконечных безымянных

