Оптимизация под ChatGPT: как попасть в ответы

Чем оптимизация под ChatGPT отличается от обычного SEO: как его веб-поиск выбирает источники, при чём тут индекс Bing и краулер OAI-SearchBot.

Оптимизация под ChatGPT: как попасть в ответы
обновлено 28 июля 20264 мин
Содержание
  1. Откуда ChatGPT берёт источники
  2. Что делает страницу цитируемой
  3. Частые ошибки
  4. С чего начать

Оптимизация под ChatGPT сводится к двум вещам: оказаться в источниках, которые он подтягивает при веб-поиске, и дать на странице текст, который удобно вынуть абзацем и процитировать со ссылкой. «Понравиться модели» здесь нельзя — можно только попасть в её поисковый индекс и облегчить ей цитирование. Практически это три шага: быть проиндексированным (в первую очередь в Bing), не закрывать краулеры OpenAI в robots.txt и выкладывать факты короткими самодостаточными кусками. Ниже — почему именно так и в чём специфика ChatGPT, а не поиска вообще.

Откуда ChatGPT берёт источники

Когда у ChatGPT включён веб-поиск, на свежий или фактический вопрос он не сочиняет ответ из головы, а идёт в интернет, находит несколько страниц и цитирует их со ссылками. Значит, весь вопрос — попасть в эти несколько страниц. И вот здесь ChatGPT ведёт себя не так, как Google или Яндекс: у него свой поисковый контур.

За веб-поиск отвечает собственный краулер OpenAI — OAI-SearchBot: он обходит сайты и складывает их в индекс, из которого потом берутся источники для ответов. Всего у OpenAI три робота, и путать их не стоит: GPTBot собирает данные для обучения моделей, OAI-SearchBot строит поисковый индекс, а ChatGPT-User заходит на страницу в момент запроса пользователя, если для ответа нужно что-то подгрузить прямо сейчас. Список и правила — в документации OpenAI по ботам. Полную кухню OpenAI не раскрывает; по ряду наблюдений веб-поиск опирается ещё и на индекс Bing, поэтому регистрация сайта в Bing Webmaster Tools и отправка туда карты сайта лишними не будут.

Вывод простой и неудобный: сайт может быть первым в Google и при этом невидимым для ChatGPT, потому что это разные индексы. Если в robots.txt вы на всякий случай закрыли «ботов ИИ» — а так делают часто, ради защиты контента, — то в ответы ChatGPT вы не попадёте вообще, как бы хорошо ни был написан текст.

Что делает страницу цитируемой

Дальше начинается то, что мы в Редстаре видим на своих проектах: в ответы ИИ охотнее попадают страницы с конкретными цифрами, ценами и фактами, с микроразметкой (особенно блоком FAQ) и с данными, которые совпадают во всех источниках — на сайте, в отраслевых подборках, в отзывах и агрегаторах. Противоречия между источниками, наоборот, выбивают сайт из ответов: если на странице одна цена, а в карточке агрегатора другая, модель не понимает, какой факт цитировать, и берёт чужой. Это общие правила оптимизации под нейросети — чем такая GEO отличается от классического SEO, разбираем отдельно, здесь же — специфика ChatGPT.

Для ChatGPT к этому добавляется одна деталь. Он вынимает из страницы тот фрагмент, который прямо отвечает на вопрос, а вводные абзацы пропускает. Поэтому ответ должен стоять в начале раздела короткими, самодостаточными предложениями — так, чтобы абзац можно было процитировать без остального текста и он остался понятным. Если прямой ответ спрятан в середине лонгрида после трёх абзацев рассуждений, шанс, что его достанут, ниже.

Частые ошибки

Первая — считать, что хватит хорошего места в Google. Не хватит: у ChatGPT свой поисковый контур, так что видимость надо проверять отдельно.

Вторая — закрыть краулеров OpenAI в robots.txt и забыть об этом. Тогда оптимизировать нечего: вас просто нет в индексе.

Третья — путать веб-поиск ChatGPT с «знаниями» самой модели. Без включённого поиска ChatGPT отвечает из обучающих данных со своим срезом по дате, и попасть туда через правку страницы быстро не получится — это долгий и неуправляемый путь. Оптимизация имеет смысл именно под веб-поиск, где есть ссылки на источники.

И четвёртая — ждать гарантий. Гарантированного способа попасть в ответы ChatGPT нет, и любой, кто такой способ продаёт, продаёт воздух. Есть приёмы, которые повышают шанс, — они выше. Кстати, у Perplexity свой краулер и своя логика, но принцип тот же: быть в индексе и давать цитируемые факты, так что работа на ChatGPT попутно работает и на него.

С чего начать

Проверьте три вещи по порядку: открыты ли OAI-SearchBot и ChatGPT-User в robots.txt, заведён ли сайт в Bing Webmaster Tools с отправленной картой сайта, и стоит ли на нужных страницах короткий прямой ответ в первых двух-трёх предложениях раздела плюс FAQ-разметка. Это тот минимум, без которого остальное не имеет смысла. К этому же дешёвому набору относится и файл llms.txt — короткая карта сайта для нейросетей.

ChatGPT — не замена поиску, а ещё один канал в одном ряду с классическим SEO, контекстной и таргетированной рекламой: у поиска просто появился сильный конкурент, и для бизнеса это скорее плюс. Тема новая, единых рецептов пока нет, поэтому выигрывает тот, кто зашёл раньше и мерил руками, а не ждал готовой инструкции — за плечами основателя Редстара больше 800 проектов, и общая картина по всем нейросетям, включая Алису и GigaChat, собрана в опорной статье кластера: как попасть в ответы нейросетей Яндекса и ИИ-поиска.

Услуга по темеGEO-оптимизация (под ИИ-поиск)Оптимизация под ИИ-поиск: чтобы нейроответы Яндекса, ChatGPT и Perplexity в ответах называли вас, а не конкурентов.

Термины из этой статьи

Контекстная реклама
Контекстная реклама — объявления, которые показываются человеку в ответ на его поисковый запрос или интерес. Оплата идёт за клик, а не за показ, поэтому деньги тратятся на тех, кто уже что-то ищет.
Нейросеть
Нейросеть — программа, обученная на больших массивах данных и способная генерировать текст, изображения или код по запросу. В маркетинге так обычно называют генеративные модели вроде ChatGPT, GigaChat или Midjourney.
Структурированные данные
Структурированные данные — разметка на странице, которая объясняет поисковику, что именно на ней находится: товар, цена, автор, отзыв. Помогает получать расширенные сниппеты и попадать в ответы ИИ.
llms.txt
llms.txt — текстовый файл в корне сайта, описывающий его содержание для языковых моделей. Предложен как стандарт, но обязательным для ИИ-систем пока не является.
robots.txt
robots.txt — файл в корне сайта, которым владелец просит поисковых роботов не обходить отдельные разделы. Это рекомендация для робота, а не защита: закрытая страница остаётся доступной по прямой ссылке.
SEO
SEO (search engine optimization) — работы, которые помогают сайту занимать более высокие места в результатах поиска и получать больше переходов из Яндекса и Google без оплаты за клик.

Все термины