У ChatGPT знайшли власний пошуковий індекс Labrador: як насправді працює пошук OpenAI
ChatGPT дедалі менше залежить від класичних пошуковиків. Дослідники Peec AI знайшли у внутрішніх server-side events ChatGPT систему під кодовою назвою Labrador — сімейство пошукових індексів OpenAI для вебсторінок, PDF, YouTube, новин, Wikipedia, локальних результатів, фінансів та інших типів контенту.
Це не означає, що OpenAI запустила окремий «Google всередині ChatGPT» або вже відмовилася від зовнішніх джерел. Компанія офіційно підтверджує наявність власного indexed і cached web content, але паралельно ChatGPT продовжує використовувати сторонню пошукову інфраструктуру. Microsoft, наприклад, прямо заявляє, що її Web IQ уже забезпечує grounding для ChatGPT.
Key Takeaways
- Назву Labrador та його структуру виявили незалежні дослідники Peec AI; OpenAI публічно не анонсувала продукт із такою назвою.
- У Labrador знайшли окремі індекси для web, PDF, YouTube, news, arXiv, Wikipedia, local, finance, legal, medical, shopping та images.
- OpenAI офіційно підтверджує, що ChatGPT може шукати у власному indexed і cached web content.
- При цьому ChatGPT не відмовився від зовнішніх джерел: OpenAI згадує сторонніх search/data providers, а Microsoft підтверджує використання Web IQ.
- Твердження, що кожна відповідь ChatGPT обов’язково збирається щонайменше з восьми провайдерів, не підтверджене.
- Для SEO це означає, що присутності лише в Bing або Google недостатньо: важливим стає також доступ OAI-Searchbot до сайту та потрапляння контенту у власний retrieval OpenAI.
Що таке Labrador
Labrador — внутрішня назва, яку дослідники Peec AI побачили в технічних подіях, що надходили від серверів ChatGPT до браузера.
За їхніми даними, з 21 травня до 21 липня 2026 року в цих events існувало поле result_source. Серед значень з’являлися Labrador, Bright, Oxylabs і SERP.
Подальший аналіз показав, що Labrador — не одна база з усім інтернетом, а набір спеціалізованих вертикальних індексів.
- general web;
- PDF;
- YouTube;
- news із окремими шарами за свіжістю;
- arXiv;
- Wikipedia;
- local;
- finance та окремий finance PDF;
- legal;
- medical;
- shopping;
- images.
За спостереженнями Peec AI, записи можуть містити повний контент сторінки, дату crawl та дату публікації — тобто за базовою логікою це вже схоже на класичний search index, а не просто список посилань, отриманих від Bing у момент запиту.
OpenAI офіційно підтвердила власний index і cache — але не назву Labrador
Саме тут важливо відділити reverse engineering від того, що підтверджує OpenAI.
У документації для ChatGPT Work компанія прямо описує Offline web search. У цьому режимі ChatGPT використовує OpenAI’s indexed and cached web content і може знаходити сторінки без live-запиту до зовнішнього пошукового провайдера.
Це сильне пряме підтвердження того, що OpenAI має власний шар індексації та кешування вебконтенту.
Додатковий сигнал дають вакансії OpenAI. Компанія шукає інженерів для власних indexing systems, retrieval pipelines і serving layers, а команда Online Data прямо описується як відповідальна за in-house database and indexing technology для production-продуктів, включно з ChatGPT.
Однак назва Labrador, перелік конкретних вертикалей і внутрішня схема routing походять із дослідження Peec AI, а не з офіційного продуктового анонсу OpenAI.
Навіщо ChatGPT власний пошуковий індекс
Головна причина — контроль над retrieval. Якщо ChatGPT повністю залежить від API іншого пошуковика, OpenAI залежить і від його coverage, ranking, latency, ціни та правил доступу.
Власний index дозволяє OpenAI заздалегідь crawl’ити сторінки, зберігати контент, будувати embeddings, відфільтровувати низькоякісні результати та адаптувати ranking не під традиційну SERP, а під потреби LLM.
У судових матеріалах антимонопольної справи Google також є свідчення керівника ChatGPT Ніка Терлі про те, що OpenAI роками намагається збільшити частку запитів, які може обслуговувати за допомогою власної пошукової інфраструктури.
Втім повна незалежність від великих search providers поки не виглядає близькою. Навіть OpenAI у документації ChatGPT Search прямо пише, що сервіс іноді взаємодіє з іншими пошуковими системами.
Bing нікуди не зник: Microsoft Web IQ досі працює з ChatGPT
Наявність Labrador не означає розрив із Microsoft.
У червні 2026 року Microsoft представила Web IQ — новий grounding layer для AI-агентів. Компанія прямо називає ChatGPT серед продуктів, які вже використовують цю інфраструктуру.
Web IQ побудований на багаторічній пошуковій інфраструктурі Bing, але відрізняється від класичного Bing Search API: він повертає LLM не просто SERP, а структурований citation-ready контекст із web, news, images, video та інших джерел.
Тобто сучасний пошук ChatGPT краще уявляти не як «OpenAI замінила Bing власним індексом», а як систему, яка може комбінувати кілька retrieval layers залежно від запиту.
А що з Google
Тут доказова база слабша.
Peec AI повідомляє про експерименти, у яких запити ChatGPT корелювали з появою активності в Google Search Console, а у внутрішніх подіях дослідники знайшли канали, пов’язані з отриманням Google SERP і Google Maps data через сторонніх постачальників.
Але це не те саме, що офіційна заява «ChatGPT використовує Google Search API». OpenAI такої схеми публічно не підтверджувала.
Водночас в актуальному ChatGPT Search є окрема команда !g, яка дозволяє явно виконати пошук у Google. Це ще один приклад того, що Google може бути частиною search experience, але не доводить, що кожен звичайний запит ChatGPT проходить через нього.
Yelp, TripAdvisor та спеціалізовані джерела теж входять у retrieval stack
Для локальних, комерційних та інших спеціалізованих запитів ChatGPT може підключати окремі data providers замість того, щоб намагатися отримати все з одного загального web index.
Peec AI зафіксувала Yelp і TripAdvisor, а також кілька спеціалізованих внутрішніх pipelines для business websites та local results.
Сама OpenAI офіційно підтверджує загальний принцип: ChatGPT Search використовує third-party search providers і спеціалізованих data providers, а для локальних результатів може враховувати приблизне місцезнаходження користувача.
«Мінімум вісім провайдерів на одну відповідь» — неправильне трактування
Саме цю частину початкової новини варто виправити.
Дослідження Peec AI говорить, що в retrieval stack ChatGPT вдалося ідентифікувати щонайменше кілька зовнішніх провайдерів та окремих каналів отримання даних. Це не означає, що кожна відповідь одночасно звертається до восьми сервісів.
Конкретний маршрут залежить від задачі. Запит про ресторан може потребувати local data, свіжа новина — news retrieval, питання про наукову роботу — arXiv або PDF, а стабільна інформація може бути доступна без live search із власного cache OpenAI.
Тому коректніше говорити про багатоджерельну пошукову архітектуру, а не про фіксований набір із восьми джерел для кожної відповіді.
OpenAI також сама сканує сайти через OAI-Searchbot
Для SEO тут є ще одна важлива деталь. OpenAI має власного crawler — OAI-Searchbot.
В офіційній довідці компанія прямо рекомендує дозволити OAI-Searchbot сканувати сайт, якщо власник хоче, щоб сторінки могли з’являтися в результатах ChatGPT Search.
Це добре узгоджується з архітектурою власного index: OpenAI вже не обов’язково має чекати, поки сторінку знайде Bing або інший зовнішній пошуковик.
Що Labrador змінює для SEO та GEO
Для власників сайтів головний висновок — стратегія «є в Google і Bing, значить автоматично є в ChatGPT» стає менш надійною.
По-перше, сайт має бути доступним для OAI-Searchbot. По-друге, важливо, щоб сторінки можна було нормально crawl’ити та витягувати з них основний контент. По-третє, ChatGPT може використовувати різні вертикальні джерела залежно від intent.
UAGEEK раніше пояснював, як потрапити в пошук ChatGPT у 2026 році. Поява доказів власного index робить технічну доступність сайту для OpenAI ще важливішою частиною цієї роботи.
Це також додає контекст до розвитку GEO — оптимізації контенту під генеративні системи. AI-пошук дедалі менше схожий на класичну десятку синіх посилань: модель спочатку збирає candidate sources із різних систем, а вже потім використовує частину з них для формування відповіді.
ChatGPT уже має частину інфраструктури справжнього пошуковика
Називати Labrador «новим пошуковиком OpenAI» можна лише з уточненням. Користувач не отримав окремий сайт Labrador із класичною SERP, а сама OpenAI навіть не анонсувала цю назву.
Але за інфраструктурою межа справді стирається. OpenAI має crawler, власний index і cache, окремі vertical retrieval systems, ranking pipelines і одночасно підключає зовнішні search та data providers.
Тобто ChatGPT поступово будує власний search stack — просто результатом його роботи є не список десяти посилань, а готова відповідь із вибраними джерелами.
Усі найгарячіші теми в афілейт-індустрії – тільки в ҐікNews!
Джерела для перевірки
Джерела для перевірки
Peec AI. Незалежне дослідження, яке виявило внутрішню назву Labrador, вертикальні індекси, result_source та кілька зовнішніх retrieval providers у server-side events ChatGPT.
Дослідження пошукового індексу Labrador
OpenAI Help Center. OpenAI офіційно підтверджує використання власного indexed і cached web content у режимі Offline web search.
Offline web search у ChatGPT
OpenAI Help Center. Актуальна документація ChatGPT Search підтверджує використання сторонніх search providers, роботу OAI-Searchbot та можливість окремо виконувати Google-пошук через !g.
Як працює ChatGPT Search
OpenAI Careers. Вакансія Online Data Systems прямо описує власні database та indexing technologies, які підтримують production-продукти OpenAI, включно з ChatGPT.
Власна indexing infrastructure OpenAI
Microsoft. Microsoft прямо підтверджує, що Web IQ використовується для grounding ChatGPT; сервіс побудований на пошуковій інфраструктурі Microsoft і працює з web, news, images та video.
Як Web IQ забезпечує retrieval для ChatGPT


