ChatGPT и источники · механика изнутри

Как ChatGPT выбирает источники: разбор 3 ботов OpenAI

ChatGPT не читает весь интернет каждый раз, когда отвечает. У него работают три отдельных робота с разными задачами, и по документации OpenAI (проверено живым запросом 04.09.2026) только один решает, что покажет ChatGPT источником прямо в диалоге. И у него есть слабое место: без готового списка страниц от Bing он часто не процитирует даже открытую для него страницу

К концу статьи ты будешь знать: как называются все три бота OpenAI и чем они занимаются, как за одну минуту проверить, пускает ли твой сайт нужного из них, почему одного открытого robots.txt мало и что ещё нужно, чтобы ChatGPT вообще заметил твою страницу

Открой свой robots.txt (адрес твой-сайт.ru/robots.txt) и проверь глазами, разрешены ли там строки OAI-SearchBot и ChatGPT-User - именно эти два бота решают, увидит ли ChatGPT твою страницу вообще, третий бот GPTBot к живым ответам отношения не имеет

Три бота ChatGPT - и только один ищет ответ на твой вопрос

У OpenAI три разных робота-обходчика, и они называются по-разному не для красоты - каждый занят своим делом, и правило "открыт для одного - открыт для всех" тут не работает

GPTBot. Собирает тексты по всему интернету, чтобы на них потом ОБУЧАЛАСЬ будущая версия модели - как студент, который читает учебники заранее, до экзамена. К тому, что ChatGPT покажет тебе СЕГОДНЯ в диалоге как источник, этот робот отношения не имеет: он не ищет ответ на твой вопрос, он копит материал на будущее

OAI-SearchBot. Вот это и есть тот самый робот, который ищет ответ на конкретный вопрос ПРЯМО СЕЙЧАС и решает, какую страницу процитировать в диалоге. По официальной формулировке OpenAI: сайты, закрывшие доступ именно этому боту, не покажутся в поисковых ответах ChatGPT - даже если та же страница отлично видна в обычном поиске Google или Яндекса

ChatGPT-User. Выполняет прямую просьбу живого человека внутри диалога - когда ты сам просишь "открой вот эту ссылку и перескажи мне" или пользуешься встроенным помощником с доступом к конкретному сайту. Это не самостоятельный обход интернета, а разовое поручение по твоей же команде

Официальная страница документации OpenAI про трёх ботов - GPTBot, OAI-SearchBot и ChatGPT-User
Официальная документация OpenAI про краулеров, открыта 04.09.2026: три отдельных бота с разными именами и разными задачами

Отсюда практический вывод: если тебе важно, чтобы ChatGPT цитировал твои страницы в живых ответах, смотреть нужно конкретно на OAI-SearchBot, а не на GPTBot. Спутать их - частая ошибка, разбираю её отдельно ниже в разделе про частые ошибки

Три бота рядом: у кого какая работа и что с этим делать

Собрал разницу между ботами в одну таблицу, чтобы не листать три отдельных абзаца туда-обратно, когда нужно быстро вспомнить, кто из них что делает:

БотЧто делаетВлияет ли на сегодняшний ответ ChatGPTЧто сделать владельцу сайта
GPTBotсобирает тексты для обучения будущей моделинет, это работа на будущеене обязателен для сегодняшних цитат, но и закрывать без причины не стоит
OAI-SearchBotищет ответ на конкретный вопрос прямо сейчасда, это и есть бот живого поискадержать открытым в robots.txt - без этого цитат не будет вообще
ChatGPT-Userвыполняет прямую просьбу человека внутри диалогада, но только по разовой команде самого человеканичего специально настраивать не нужно, страница открыта - работает

Таблица прокручивается вбок →

Из таблицы видно главное: если тебе нужны живые цитаты твоего сайта в ответах ChatGPT, есть ровно одна строка, которая решает исход, - разрешение для OAI-SearchBot. Остальные два бота либо работают на будущее, либо срабатывают по отдельной команде человека

Проверь свой robots.txt: пускаешь ли ты вообще нужного бота

Файл robots.txt - это список правил на твоём же сайте, который говорит роботам, куда им можно заходить, а куда нельзя. Он лежит по прямому адресу: твой-сайт.ru/robots.txt - открывается в любом браузере, как обычная страница, ничего скачивать не нужно

Три шага, чтобы проверить у себя:

  1. Набери в браузере адрес своего сайта плюс /robots.txt. Например, theivansergeev.com/robots.txt. Откроется страница с обычным текстом - не картинка, не файл для скачивания, а просто текстовые строчки
  2. Найди глазами строку User-agent: OAI-SearchBot. Это заголовок раздела для нужного тебе бота (Ctrl+F или Cmd+F по слову SearchBot находит её за секунду)
  3. Посмотри, что написано в следующей строке. Allow: / значит "заходи куда хочешь", Disallow: / значит "не заходи вообще" - если такого раздела нет совсем, большинство сайтов по умолчанию открыты, но лучше вписать явную строку самому, чтобы не зависеть от умолчаний хостинга

Так это выглядит у меня самого - я собственный robots.txt проверял живым запросом в тот же день, когда писал эту статью:

Я открыл свой собственный robots.txt живым запросом 04.09.2026: у меня явно прописаны все 3 бота OpenAI поимённо (GPTBot, OAI-SearchBot, ChatGPT-User), и у каждого стоит разрешение `Allow: /`

Если у тебя раздела с этими именами нет вообще - не паника, но и не гарантия: лучше добавить явную строку, чем полагаться на то, что хостинг настроил правильно по умолчанию

Что делать, если бот запрещён

Если строка Disallow: / стоит именно у OAI-SearchBot - это либо решение прошлого владельца сайта, либо настройка хостинга по умолчанию, о которой никто не думал. Три шага для правки:

  1. Открой файл robots.txt на своём хостинге. У большинства платформ (Tilda, WordPress, самописный сайт) он лежит либо в корневой папке сайта, либо редактируется через отдельный пункт настроек SEO - название пункта зависит от платформы, поищи слово "robots" в поиске по настройкам
  2. Замени Disallow: / на Allow: / в блоке нужного бота. Если блока User-agent: OAI-SearchBot нет вообще, добавь его отдельными двумя строками, как показано на кадре выше
  3. Сохрани файл и проверь результат тем же способом, что и в разделе выше - снова открой твой-сайт/robots.txt в браузере и убедись, что строка поменялась

Результат правки применяется не мгновенно (подробности в разделе про Bing ниже), но сама смена строки в файле происходит сразу же

Без индекса Bing цитаты не будет, даже если у тебя всё разрешено

Здесь прячется практическая ловушка, из-за которой открытый robots.txt иногда не помогает вообще

OAI-SearchBot - маленький и узкий робот. Он физически не может заново обойти весь интернет при каждом вопросе пользователя - это заняло бы часы, а ответ должен появиться за секунды. Поэтому он работает как человек, который вместо похода в библиотеку открывает уже готовый каталог: таким каталогом служит поисковый индекс Bing

Практический вывод из нескольких независимых разборов документации (не прямая цитата OpenAI, а логичное следствие из его же официального описания): чтобы ChatGPT процитировал твою страницу, нужны сразу ДВА условия одновременно, а не одно

УсловиеЧто это значитКак проверить
Страница открыта для OAI-SearchBotтвой robots.txt не запрещает этому боту заходитьшаги выше, раздел про robots.txt
Страница есть в индексе BingBing вообще знает о существовании этой страницыбесплатный сервис Bing Webmaster Tools

Таблица прокручивается вбок →

Открытый robots.txt без индекса Bing - это открытая дверь в комнату, о существовании которой никто не знает. Формально войти можно, но искать её никто не будет

Как узнать, знает ли Bing про твой сайт

Bing Webmaster Tools - бесплатный сервис самого Bing, куда владелец сайта добавляет свой адрес и смотрит, что поисковик о нём знает. Три шага, чтобы проверить у себя без специальных знаний:

  1. Зайди на сайт Bing Webmaster Tools и войди через существующую почту (Microsoft, Google или Facebook - сервис принимает разные варианты входа). Откроется рабочий экран с полем для ввода адреса сайта
  2. Впиши адрес своего сайта и подтверди владение. Подтверждение обычно происходит через уже настроенный Google Search Console (если он у тебя есть) - это самый быстрый способ, сервис сам заберёт нужные данные
  3. Посмотри раздел с числом проиндексированных страниц. Если там ноль или сервис пишет, что сайт ещё не обходили - вот причина, по которой ChatGPT не может процитировать твои страницы, даже если robots.txt разрешает всё

Настройка Bing Webmaster Tools - отдельная тема сама по себе, здесь достаточно знать, что она существует и решает именно эту задачу

Что физически видит модель, прежде чем открыть твою страницу

Тут ещё один слой механики, который многие пропускают. Прежде чем ChatGPT откроет страницу целиком и вчитается в неё, он сначала видит её как ТРИ короткие строчки: заголовок, короткое описание страницы и сам адрес - примерно то же самое, что ты видишь в выдаче Google, когда ищешь что-то сам

По методологии независимого разбора этого поведения (не первоисточник OpenAI, вторичный анализ): именно по этим трём строчкам модель принимает первое решение - открывать страницу полностью или пропустить. Значит то, что написано у тебя в заголовке страницы и в коротком описании под ним, физически влияет на то, откроет ли модель твою страницу вообще, ещё до того, как она увидит содержимое

Официальная справка самого OpenAI подтверждает механику поиска в общих чертах - модель ищет в сети, когда решает, что вопросу нужны свежие данные, и показывает ссылки на источники прямо в ответе:

Официальная справочная страница OpenAI Searching the web with ChatGPT, открыта в браузере
Официальная справка OpenAI Searching the web with ChatGPT, открыта живым браузером 04.09.2026: с первой попытки автоматическим способом сервис не пускал, а обычным браузером страница открылась нормально

Практический вывод: заголовок и короткое описание страницы - не формальность для галочки, а первый фильтр, через который твоя страница вообще должна пройти, прежде чем у неё появится шанс попасть в ответ

Заголовок и описание страницы: что проверить у себя за минуту

Раз эти две строчки - первый фильтр, разберём, что в них должно быть, тремя шагами:

  1. Открой любую свою страницу и посмотри на вкладку браузера сверху. Там показан заголовок страницы - если там написано что-то техническое вроде названия файла или общее "Главная страница", а не то, о чём страница реально рассказывает, это сигнал переписать заголовок
  2. Найди своё описание страницы через поиск в Google (набери в поиске site:твой-сайт.ru и найди нужную страницу в результатах). Под заголовком в выдаче покажется короткий текст - это и есть описание, которое видит и модель
  3. Проверь, отвечает ли описание сразу на вопрос "о чём эта страница". Если там общие слова без конкретики - перепиши так, чтобы человек, прочитавший только эти две строчки, понял суть без перехода на саму страницу

Если у тебя уже есть чёткий заголовок и понятное описание - этот пункт не требует правок, переходи к следующему разделу

Официальный список адресов OAI-SearchBot от OpenAI в формате JSON, открыт в браузере
Официальный список адресов OAI-SearchBot, снят 04.09.2026: так OpenAI официально подтверждает, каким именно роботам верить, а каким нет

Здесь же лежит защита от подделки: файл с адресами каждого бота публикует сам OpenAI (тот же кадр выше), и любой сайт при желании может сверить, что к нему действительно постучался официальный робот OpenAI, а не кто-то, кто просто представился его именем в заголовке запроса. Тема для владельца сайта скорее техническая, разбирать её здесь не буду - для большинства достаточно знать, что такая проверка вообще существует

Решает ли ChatGPT искать в интернете вообще

Ещё один момент, который стоит понимать: ChatGPT не ходит в интернет за каждым вопросом подряд. Модель сама решает, нужен ли ей свежий поиск, или она ответит по тому, что уже знает из обучения

По разборам поведения модели: вопросы про недавние события, конкретные компании, актуальные цены или живых людей чаще запускают поиск - модель понимает, что её собственные знания могут устареть. Широкие вопросы про общие понятия чаще получают ответ без похода в сеть вообще

Отсюда следствие для владельца сайта: если твоя тема - что-то стабильное, не завязанное на свежие цифры и события, у тебя меньше шансов попасть в живой поиск ChatGPT в принципе, и тут работает уже общая SEO-настройка сайта под генеративный поиск, а не тонкости именно этих трёх ботов

Чем это отличается от обычного поиска Google и Яндекса

Логично спросить: если ChatGPT в итоге тоже смотрит на заголовок, описание и индекс, чем это вообще отличается от обычного SEO под Google или Яндекс? Разница в том, откуда каждый берёт свой список страниц:

СистемаЧей индекс используетДополнительное условие
Обычный поиск Googleсобственный индекс Googleничего сверх обычного SEO
Обычный поиск Яндексасобственный индекс Яндексаничего сверх обычного SEO
ChatGPT (живой поиск)индекс Bing, через своего бота OAI-SearchBotстраница обязана быть открыта именно для OAI-SearchBot в robots.txt, помимо самой индексации

Таблица прокручивается вбок →

Отсюда практический вывод: страница, отлично видная в Google и Яндексе, может быть невидима для ChatGPT ровно по одной причине - её нет в индексе Bing или её закрыли именно от OAI-SearchBot. Это два разных мира с разными правилами входа, и настройка одного не гарантирует настройку другого

Частые ошибки новичка с ботами ChatGPT

Четыре вещи, которые путают чаще всего

  • Разрешили GPTBot и решили, что готово GPTBot собирает материал на обучение будущей модели, а не ищет ответ прямо сейчас - за живые ответы отвечает OAI-SearchBot, и разрешение нужно именно ему
  • Забыли про индекс Bing открытый robots.txt без индекса Bing не даёт цитаты - боту физически неоткуда взять твою страницу, если её нет в готовом каталоге
  • Слабый заголовок и пустое описание страницы модель сначала смотрит на три строчки (заголовок, описание, адрес) и только потом решает, открывать ли страницу целиком - неинформативные строчки режут шанс ещё на старте
  • Ждут результата за один день обновления robots.txt применяются поисковой системой не мгновенно, по независимым разборам документации счёт может идти на сутки - проверять эффект в тот же час бессмысленно

Что ещё почитать про настройку сайта под нейросети

Источники

Документация OpenAI и связанные официальные файлы открыты прямым запросом 4 сентября 2026 года; страница про трёх ботов и список адресов OAI-SearchBot дополнительно сняты живым браузером, собственный robots.txt проверен тем же днём

Памятка: проверка своего сайта под ChatGPT за 5 минут

Семь строк, которые закрывают базовую проверку

Сохрани себе

  • Открой твой-сайт/robots.txt в браузере - это обычная текстовая страница, читается без инструментов
  • Найди строку User-agent: OAI-SearchBot - именно этот бот ищет ответы в реальном времени
  • Убедись, что следующая строка Allow: /, а не Disallow: /
  • GPTBot и ChatGPT-User - другие роботы с другими задачами, их разрешение живых ответов не прибавляет
  • Без индекса Bing разрешённый robots.txt не спасает - проверь, знает ли Bing о твоём сайте вообще
  • Заголовок и описание страницы - первый фильтр модели, до чтения самого текста
  • Изменения в robots.txt применяются не мгновенно, по независимым разборам - счёт идёт на сутки

Порог входа

Три бота разобраны, свой сайт проверен - что дальше решаешь ты

Всё, что нужно для первой проверки сайта под ChatGPT, ты только что прочитал бесплатно: три бота, robots.txt, индекс Bing и первый фильтр по заголовку. Следующий шаг - три дня разбора и сборки рабочего порядка вокруг твоего же сайта - тоже стоит ровно ноль

Забрать путёвку в ИИ-Лагерь

Заявка в закрытый канал, одобряю сразу. Бот сам напишет первым и покажет, как забрать три дня Лагеря. Бесплатно

Частые вопросы

Чем GPTBot отличается от OAI-SearchBot?

GPTBot собирает тексты, чтобы на них ОБУЧАЛАСЬ будущая версия модели - это работа на будущее, к сегодняшним ответам отношения не имеет. OAI-SearchBot ищет ответ на конкретный вопрос прямо сейчас и решает, какую страницу процитировать в диалоге. Если тебе важны живые цитаты в ответах ChatGPT, разрешение нужно именно OAI-SearchBot

Что делает ChatGPT-User?

Выполняет прямую просьбу живого человека внутри диалога - когда сам пользователь просит открыть конкретную ссылку и пересказать содержимое, или пользуется встроенным помощником с доступом к сайту. Это разовое поручение по команде человека, а не самостоятельный обход интернета

Как проверить свой robots.txt на разрешение для ChatGPT?

Открой в браузере адрес твой-сайт/robots.txt - это обычная текстовая страница. Найди раздел User-agent: OAI-SearchBot и посмотри следующую строку: Allow: / значит доступ открыт, Disallow: / значит закрыт. У меня самого этот раздел открыт для всех трёх ботов OpenAI, проверено живым запросом 04.09.2026

Почему открытого robots.txt может быть недостаточно?

Потому что OAI-SearchBot не обходит весь интернет заново при каждом вопросе - он подглядывает в уже готовый список страниц, и этот список берётся из индекса Bing. Страница может быть полностью открыта для бота, но если её нет в индексе Bing, процитировать её всё равно не получится

Как быстро применяются изменения в robots.txt?

Мгновенно результат не появляется. По независимым разборам документации (не прямая цифра от OpenAI), обновления применяются поисковой системой не сразу - счёт может идти на сутки. Проверять эффект в тот же час смысла нет