ChatGPT тепер сканує в 3,6 раза більше, ніж Googlebot

ChatGPT тепер сканує в 3,6 раза більше, ніж Googlebot


Ця публікація була спонсорована Alli AI. Думки, висловлені в цій статті, належать спонсору.

Усі вважають, що робот Googlebot є домінуючим сканером, який відвідує їхні веб-сайти. Тепер це припущення помилкове.

Ми проаналізували 24 411 048 проксі-запитів на понад 78 000 сторінках на 69 веб-сайтах клієнтів на платформі підтримки сканера Alli AI протягом 55-денного періоду (з січня по березень 2026 року). Веб-сканер OpenAI ChatGPT-User зробив у 3,6 рази більше запитів, ніж Googlebot, у нашій вибірці даних. І це навіть не враховуючи GPTBot, окремий навчальний сканер OpenAI.

Примітка щодо методології: Ідентифікація сканера використовувала відповідність рядка агента користувача, перевірену за опублікованими діапазонами IP-адрес. Показники запитів вимірюються на рівні проксі/CDN. Набір даних охоплює 69 веб-сайтів у різних галузях і розмірах, переважно на основі WordPress. Повна методологія детально описана в кінці.

Висновок 1: сканери зі штучним інтелектом тепер випереджають Google 3.6x, а ChatGPT лідирує в групі

Зображення створено Alli AI, квітень 2026 р.

Коли ми ранжували кожен ідентифікований сканер за обсягом запитів, результати були однозначними:

ранг Гусеничний Запити Категорія
1 Користувач ChatGPT (OpenAI) 133,361 AI Пошук
2 Googlebot 37,426 Традиційний пошук
3 Amazonbot 35,728 ШІ / електронна комерція
4 Bingbot 18 280 Традиційний пошук
5 ClaudeBot (Антропік) 13 918 AI Пошук
6 MetaBot 10,756 Соціальний
7 GPTBot (OpenAI) 8,864 Навчання ШІ
8 Applebot 6,794 AI Пошук
9 Bytespider (ByteDance) 6,644 Навчання ШІ
10 PerplexityBot 5,731 AI Пошук

ChatGPT-User зробив більше запитів, ніж Googlebot, Amazonbot і Bingbot комбіновані.

Зображення створено Alli AI, квітень 2026 р.

Згруповані за призначенням сканери, пов’язані зі штучним інтелектом (ChatGPT-User, GPTBot, ClaudeBot, Amazonbot, Applebot, Bytespider, PerplexityBot, CCBot), створені 213 477 запитів проти 59,353 для традиційних пошукових роботів (Googlebot, Bingbot, YandexBot). Штучні сканери зараз роблять у 3,6 рази більше запитів, ніж традиційні пошукові сканери в нашій мережі.

Висновок 2: OpenAI використовує 2 сканери (і більшість сайтів не знають різниці)

Зображення створено Alli AI, квітень 2026 р.

OpenAI працює з двома різними сканерами з дуже різними цілями.

Користувач ChatGPT є сканером пошуку. Він отримує сторінки в режимі реального часу, коли користувачі задають запитання ChatGPT, які потребують актуальної веб-інформації. Це визначає, чи буде ваш вміст у відповідях ChatGPT.

GPTBot це навчальний сканер. Він збирає дані для вдосконалення моделей OpenAI. Багато сайтів блокують GPTBot через robots.txt, але не через ChatGPT-User або навпаки, не розуміючи чітких наслідків кожного з них.

Разом сканери OpenAI зробили 142 225 запитів: 3,8-кратний обсяг Googlebot.

Директиви robots.txt окремі:

User-agent: GPTBot      # Training crawler — feeds OpenAI's models
User-agent: ChatGPT-User # Retrieval crawler — fetches pages for ChatGPT answers

Висновок 3: ШІ-сканери швидші та надійніші, але їхній обсяг збільшується

Зображення створено Alli AI, квітень 2026 р.

Штучні сканери значно ефективніші за запит:

Гусеничний Середній час відповіді 200 коефіцієнт успішності
PerplexityBot 8 мс 100%
Користувач ChatGPT 11 мс 99,99%
GPTBot 12 мс 99,9%
ClaudeBot 21 мс 99,9%
Bingbot 42 мс 98,4%
Googlebot 84 мс 96,3%

Дві ймовірні причини. По-перше, пошукові роботи штучного інтелекту вибирають конкретні сторінки у відповідь на запити користувачів, а не вичерпно виявляють архітектуру сайту. Вони знають, чого хочуть, хапають це і йдуть. По-друге, хоча всі веб-сканери в нашій інфраструктурі отримують попередньо відображені відповіді, ширший шаблон сканування Googlebot означає, що він запитує ширший діапазон URL-адрес, включаючи застарілі шляхи з карт сайту та власний застарілий індекс, що додає затримку від ланцюжків перенаправлення та обробки помилок, яких сканери пошуку повністю уникають.

Але є одна заковика: хоча кожен окремий запит невеликий, сам обсяг означає, що сукупне навантаження на сервер є значним. ChatGPT-User із розміром 11 мс × 133 361 запитів — це все ще реальна вартість інфраструктури, яка просто розподіляється інакше, ніж менша кількість запитів Googlebot.

Висновок 4: Googlebot бачить іншу (гіршу) версію вашого сайту

Зображення створено Alli AI, квітень 2026 р.

Рівень успіху Googlebot у 96,3% порівняно з майже ідеальними показниками для сканерів AI виявляє важливу структурну різницю.

Робот Googlebot отримав 624 заблокованих відповіді (403) і 480 помилок «не знайдено» (404), що становить 3% запитів. Тим часом ChatGPT-User досяг 99,99% успіху. PerplexityBot досяг ідеальних 100%.

Зображення створено Alli AI, квітень 2026 р.

Чому розрив? Найбільш імовірним поясненням є вік індексу та поведінка сканування, а не неправильна конфігурація сайту.

Робот Googlebot підтримує масивний застарілий індекс, створений протягом багатьох років безперервного сканування. Він регулярно повторно запитує URL-адреси, про які йому вже відомо, включаючи сторінки, які згодом було видалено (404s) або реструктуризовано (403s). Це нормальна поведінка для пошукової системи, яка підтримує індекс такого масштабу, але це означає, що значний відсоток запитів Googlebot спрямовано на URL-адреси, які більше не існують.

Штучні сканери не несуть такого багажу. ChatGPT-User отримує конкретні сторінки у відповідь на запити користувачів у реальному часі, орієнтуючись на актуальний на даний момент вміст і посилання. Це структурна перевага, яка забезпечує майже ідеальні показники успіху.

Галузеві звіти підтверджують, що сканування ШІ зросло в 15 разів у 2025 році

Ці висновки узгоджуються з ширшими галузевими тенденціями. Аналіз Cloudflare за 2025 рік повідомив, що запити ChatGPT-User зросли на 2825% порівняно з аналогічним періодом минулого року, а сканування «дій користувача» ШІ зросло більш ніж у 15 разів протягом 2025 року. Akamai визначила OpenAI як найбільшого оператора ботів ШІ, на частку якого припадає 42,4% усіх запитів ботів ШІ. Аналіз сайту nextjs.org, проведений Vercel, підтвердив, що наразі жоден із основних сканерів ШІ не відтворює JavaScript.

Наші дані свідчать про те, що це перехрещення може вже відбуватися на рівні сайту для ресурсів, які активно дають доступ сканеру AI.

Ваша нова стратегія SEO: як проводити аудит, очищення та оптимізацію для сканерів AI

1. Перевірте файл robots.txt на пошуки ШІ сьогодні

Більшість файлів robots.txt були написані для Googlebot-first world. Майте як мінімум чіткі директиви для ChatGPT-User, GPTBot, ClaudeBot, Amazonbot, PerplexityBot, Applebot, Bytespider, CCBot і Google-Extended.

Наша рекомендація: Більшість компаній виграють від дозволу обох сканерів пошуку (ChatGPT-User, PerplexityBot, ClaudeBot) і навчальні сканери (GPTBot, CCBot, Bytespider), навчальні дані – це те, що навчає ці моделі про ваш бренд, продукти та досвід. Блокування навчальних сканерів сьогодні означає, що завтра моделі штучного інтелекту менше дізнаються про вас, що зменшує ваші шанси бути цитованими у відповідях, згенерованих штучним інтелектом.

Виняток: якщо у вас є вміст, який потрібно захистити від навчання моделі (власне дослідження, закритий вміст), використовуйте гранульований Заборонити правила для цих шляхів, а не загальні блоки.

2. Очистіть застарілі URL-адреси в Google Search Console

Наші дані показують, що Googlebot досягає 3% помилок, в основному 403 і 404, тоді як ШІ-сканери досягають майже ідеальних показників успіху. Ця прогалина, ймовірно, відображає повторне сканування Googlebot застарілих URL-адрес, яких більше не існує. Але ці невдалі запити все одно витрачають бюджет сканування.

Перевірте свою статистику сканування GSC для повторюваних 404 і 403. Налаштуйте належне переспрямування для реструктурованих URL-адрес і надішліть оновлені карти сайту.

3. Розглядайте доступність AI-сканера як окремий канал SEO

Рейтинг у відповідях ChatGPT, результатах Perplexity та відповідях Клода стає окремим каналом видимості. Якщо ваш вміст недоступний для цих сканерів, особливо якщо ви використовуєте фреймворки з інтенсивним використанням JavaScript, ви невидимі в пошуку AI.

Ми опублікували a жива інформаційна панель показує, як трафік ШІ-сканера розбиває на реальний сайт: які платформи відвідують, як часто та їх частка в загальному трафіку; якщо ви хочете побачити, як це виглядає на практиці.

4. Плануйте обсяг, а не лише вагу окремого запиту

Штучні сканери надсилають легкі, швидкі запити, але вони надсилають багато з них. Лише ChatGPT-User нарахував понад 133 000 запитів за 55 днів. Сукупне навантаження на сервер від веб-сканерів ШІ тепер, імовірно, перевищує навантаження вашого робота Googlebot. Переконайтеся, що ваш хостинг і CDN можуть це впоратися. Низький час відповіді на запит у наших даних відображає той факт, що Alli AI обслуговує попередньо відрендерений статичний HTML із краю CDN, що є саме тією архітектурою, яка поглинає цей обсяг, не обкладаючи податку на вихідний сервер.

Методологія

Цей аналіз базується на 24 411 048 запитах HTTP-проксі, оброблених через платформу підтримки сканера Alli AI у період з 14 січня по 9 березня 2026 року, що охоплює 69 веб-сайтів клієнтів.

Ідентифікація сканера використовувала відповідність рядка агента користувача, перевірену за опублікованими діапазонами IP-адрес. Зокрема, для сканерів OpenAI кожен запит порівнювався з опублікованими діапазонами CIDR OpenAI. Це підтвердило, що 100% запитів GPTBot і 99,76% запитів ChatGPT-User надходять з інфраструктури OpenAI. Решта 0,24% (запити від підроблених агентів користувачів) були виключені.

Обмеження: Набір даних доступний для клієнтів Alli AI, які ввімкнули сканер. Сканери, які не ідентифікуються за допомогою агента користувача, не захоплюються. Вимірювання часу відповіді здійснюється на рівні проксі, а не на вихідному сервері.

Про Alli AI

Alli AI надає серверну інфраструктуру візуалізації для ШІ та пошукових систем. Цей аналіз було проведено з використанням даних із нашої проксі-інфраструктури, щоб допомогти спільноті SEO краще зрозуміти ландшафт сканера, що розвивається.

Хочете побачити ці дані в дії? Подивіться розбивку з перших вуст, відвідавши нашу панель видимості AI.


Автори зображень

Рекомендоване зображення: зображення Alli AI. Використовується з дозволу.

Зображення в публікації: зображення від Alli AI. Використовується з дозволу.



Source link

Postagens Similares

  • De zilveren jubileumgeest (1977)

    Tijdens het zilveren jubileum van de koningin in 1977 werd een spookachtig figuur opgemerkt door gealarmeerde kijkers in een BBC-uitzending. Het spook leek naast de koningin in haar rijtuig te zitten. De identiteit van de verschijning blijft onbekend, hoewel sommigen beweren dat het Herbert Empire, inwoner van Scarfolk, is. Empire, een trotse eigenaar van een…

  • “நான் புகைபிடித்ததில்லை” இல் பாப் ஒலிகளை பகுப்பாய்வு செய்தல்

    இசை விமர்சனம்: “நான் ஒருபோதும் புகைபிடித்ததில்லை, ஏக்கம் சமகால உணர்திறனை சந்திக்கும் இடத்தில், எளிதான குறிப்புகளில் சிக்கிக் கொள்ளாமல், குரல் உயரும், ஒரு நிலத்தடி போஹேமியன் ஆற்றலைச் சுமந்து, பாதையை உயிரோடும், கணிக்க முடியாதபடியும் வைத்திருக்கும். மெல்லிசை நினைவகம் மெதுவாகத் திரும்புகிறது. ரொமாண்டிக் ராஸ்டன் மற்றும் சேனலிங் ஆற்றல் ஒரு உச்சக்கட்டமாக மட்டும் செயல்படவில்லை, ஆனால் ஒரு உணர்ச்சி வினையூக்கியாக செயல்படுகிறது, உள்நோக்கத்தை உணர்ச்சியாக மாற்றுகிறது மற்றும் ஒரு கசப்பான பதற்றத்தை விட்டுச்செல்கிறது.” -நாகமாக்.காம் ப்ளேவை அழுத்தி,…

  • GoogleはAI検索のクリック損失を隠すためにソーシャルメディアシグナルを使用している

    すでにご存知かもしれませんが、Google は最近 Search Console を更新し、ブランドが検索結果でソーシャル メディアやビデオ投稿のパフォーマンスを追跡できるようにしました。 ほとんどのマーケティング担当者は、このアップデートを有益な贈り物とみなしています。彼らは、Google が TikTok、YouTube、X 全体で強力な足跡を築いたブランドに報酬を与えたいと考えていると信じています。そして、ガラスが半分埋まっていることを望んでいないので、これが Google が望んでいたポジティブな光学系だと思います。 公式発表を無視して見ると、別の状況に焦点が当てられます。このアップデートは巧妙な罠です。これは、クリエイターが Google の AI モデルをさらにトレーニングできるようにしながら、人工知能によって引き起こされるトラフィック損失を隠すための盾として機能します。 クリックロスの時代における成功の再定義 この戦略を理解するには、Google がウェブ パブリッシャーに対して直面している危機に目を向ける必要があります。 生成的な検索エクスペリエンスと AI サマリーにより、検索ページでユーザーの質問に直接回答します。この設定により、ユーザーは外部のウェブサイトに誘導されるのではなく、Google に留まります。 企業 Web サイトへのオーガニック トラフィックはマーケティングの成功を測る主な尺度であり、予算が正当であるかどうかについて、業界として私たちが何年もの間、宣伝文句として掲げてきました。 Google は Search Console 内でソーシャル メディアの閲覧数を追跡することで、成功の定義を変えようとしています。ウェブサイトのトラフィックが 3 分の 1 に減少すると、Google はソーシャル メディア データを指摘する可能性があります。あなたの TikTok 動画が検索ページで何千ものインプレッションを受けたことを示すことができます。実際のクリックが得られなくても、まだ勝っていると信じてもらいたいのです。 これにより、マーケティング担当者は、Google が自社 Web サイトへの訪問者を送信しなくなったとしても、引き続き可視性を提供しているため、Google をすべての可視性の中央制御室とみなすことになります。 検索グラフをクリエイターに外注する このアップデートは、Google の人工知能をトレーニングし、生成検索を強化するためのツールとしても機能します。Google は現実世界を理解する必要があります。 このエンジンは、人、ブランド、トピック間の関係をマッピングします。このプロセスはエンティティ解決と呼ばれます。 Google…

  • এই পোস্টটি লাইক করুন 2026-07-26 00:20:04.517898+02

    Flutterby™! : এই পোস্টটি লাইক করুন 2026-07-26 00:20:04.517898+02 এই পোস্ট লাইক 2026-07-26 00:20:04.517898+02 ড্যান লাইকের দ্বারা 0 মন্তব্য এই পোস্টের মত, এর খোলা কনফিগারেশনে, বোতাম টিপুন। (সম্পর্কিত বিষয়: ফটোগ্রাফি) আরোহী কালানুক্রমিক ক্রমে মন্তব্য (বিপরীত): মন্তব্য নীতি আমরা আপনার মন্তব্য সম্পাদনা করব না. যাইহোক, আমরা আপনার মন্তব্যগুলি মুছে ফেলতে পারি, অথবা সেগুলিকে অন্য লিঙ্কের পিছনে লুকিয়ে…

  • Aggiornamenti sulla guida alle risorse e sulla pianificazione degli annunci di Google, aspetti negativi di Microsoft – PPC Pulse

    Benvenuti nella recensione settimanale delle notizie di PPC Pulse. L’attenzione di questa settimana include indicazioni sugli asset, pacing del budget e controlli di ricerca su Google e Microsoft Ads. Google ha rafforzato l’importanza della varietà delle risorse man mano che le esperienze di ricerca si evolvono. Ha inoltre confermato gli aggiornamenti sul funzionamento del pacing…

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *