
TL;DR: Ми проаналізували 24 035 цитувань, які ШІ-асистенти додали до 2 314 відповідей у період з 4 червня до 10 серпня 2026 року. 79,7% усього, що цитують ШІ-моделі, — це сторінки, якими цитована компанія володіє і які може відредагувати вже сьогодні: 62,5% — звичайні сайти компаній, ще 17,2% — блоги та ресурсні сторінки вендорів. На Reddit припадає 3,5% цитувань, на YouTube — 3,4%. Стандартна порада «йдіть на Reddit» оптимізує канал, приблизно у двадцять разів менший за той, який ви вже контролюєте.
Дані
Кожне число нижче походить із нашого власного пайплайна відстеження: ми ставимо ШІ-асистентам запитання, які ставлять покупці («найкращі X для Y», «A чи B», «що таке Z»), збираємо відповіді з живим пошуком і фіксуємо кожне джерело, яке цитує модель.
- 24 035 цитувань у 2 314 проаналізованих відповідях, 4 червня – 10 серпня 2026
- 1 626 різних запитів на 197 сайтах — SaaS, e-commerce, агенції, інструменти для розробників, медіа; усі відстежені через наш власний онбординг у межах QA, без даних клієнтів
- 5 770 різних процитованих хостів
- Відповідь у середньому містить 10,4 цитування; 14,3% відповідей не цитують нічого
- Частки нижче супроводжуються 95% довірчими інтервалами Вілсона там, де ми робимо порівняльне твердження
Це не випадкова вибірка реальних запитів користувачів — запити згенерував наш пайплайн для фіксованого набору брендів. Ми кажемо це одразу, бо більшість досліджень у цій ніші цього не роблять.
Висновок 1 — відповіді ШІ будуються на сторінках, які контролюють вендори
Розподіл цитувань за типом джерела:
| Тип джерела | Частка з 24 035 цитувань |
|---|---|
| Сайти компаній (продукт, ціни, функції) | 62,5% |
| Блоги та ресурсні сторінки вендорів | 17,2% |
| Власний сайт відстежуваного бренду | 3,8% |
| Форуми та спільноти (96% цього — Reddit) | 3,5% |
| Відео (повністю YouTube) | 3,4% |
| Блог-платформи (Medium, Dev.to, Substack) | 2,9% |
| Каталоги та сайти відгуків (G2, Capterra, Clutch) | 2,7% |
| Новинні медіа | 2,4% |
| Пошуковики, репозиторії коду, документація | 1,5% разом |
Додайте перші два рядки — і картина перевертає більшість порад із GEO: ~80% того, що цитують ШІ-моделі, — це поверхня під контролем вендорів. Не гілки Reddit, не агрегатори відгуків, не преса — звичайні сторінки, які хтось опублікував і може переписати сьогодні по обіді.
Практичний висновок: перш ніж інвестувати в посів у спільнотах чи цифровий PR, зробіть цитованими сторінки, якими ви вже володієте, — відповідь у першому абзаці, порівняльні таблиці, видимі дати, структуровані дані. Наскільки цитованою є конкретна сторінка, можна виміряти нашим безкоштовним Citation Probability Checker.
Висновок 2 — Reddit і YouTube — різні інструменти
Два найгучніші імені в порадах із GEO очолюють таблицю хостів, але поводяться по-різному:
| Хост | Цитувань | Відповідей із ним |
|---|---|---|
| reddit.com | 813 | 487 (21% відповідей) |
| youtube.com | 811 | 767 (33% відповідей) |
Майже однакова кількість цитувань — дуже різне охоплення. Reddit цитується кілька разів усередині однієї відповіді; YouTube — по одному разу, але в більшій кількості відповідей. Будь-який рейтинг «топ-джерел» за сирою кількістю цитувань мовчки занижує YouTube на третину.
Висновок 3 — плутанина брендів концентрується в порівняльних запитах
Ми позначаємо відповідь як плутанину бренду, коли модель називає бренд, але її цитування вказують на іншу сутність — домен-двійник або тезку. Частки за типами запитів:
| Тип запиту | Частка плутанини | 95% ДІ | n |
|---|---|---|---|
| Органічний («найкращі інструменти для…») | 1,2% | 0,7–1,9% | 1 446 |
| Порівняльний («A чи B») | 10,9% | 8,4–13,9% | 496 |
| Брендовий («чи хороший X?») | 12,6% | 9,6–16,4% | 364 |
Порівняльні та брендові запитання плутають моделі приблизно вдесятеро частіше за органічні, і інтервали проти органічних не перетинаються. (Порівняльні проти брендових у наших даних статистично нероздільні, тому ми не стверджуємо, який із двох гірший.)
Механізм інтуїтивний: органічне запитання дозволяє моделі говорити про кого завгодно; запитання, що називає ваш бренд, змушує її розв'язати вашу ідентичність — і саме тут домени-двійники й тезки перехоплюють цитування. Якщо ваш бренд ділить назву з будь-чим, це ваша поверхня ризику. Наш безкоштовний Entity Confusion Checker проводить саме цей тест для будь-якого бренду.
Що ми відмовилися публікувати
Три зрізи цих даних не пройшли нашу власну планку, і сказати про це, на нашу думку, важливіше, ніж подовжити список висновків:
- Порівняння платформ між собою. На зіставленому наборі запитів, на які відповіли чотири і більше платформ, усі десять попарних порівнянь часток плутанини мають довірчі інтервали, що перетинаються. Твердження на кшталт «модель X плутає бренди вдвічі частіше за модель Y» наші дані не витримують — вибірки поза Gemini становлять ~37 відповідей кожна.
- Частки по окремих сайтах. 184 зі 197 сайтів не досягають нашого мінімуму в 30 відповідей. Частка плутанини, порахована на 12 відповідях, — це підкидання монети, а не висновок.
- Тренди місяць до місяця. Склад відстежуваних брендів різко змінювався між місяцями, тож видимий тренд — артефакт вибірки, доки його не виміряно на стабільній панелі.
Що це означає для вашої GEO-стратегії
- Ваші власні сторінки — головна поверхня цитування. ~80% цитувань ведуть на сторінки під контролем вендорів. Порівняльні сторінки, чесні таблиці функцій, датовані оновлення та schema-розмітка на вашому домені — робота з найбільшим важелем: на ті самі сторінки спирається й Google, і це можна перевіряти запит за запитом, дивлячись, чи повертає пошук AI Overview і чиї домени він цитує.
- Спільноти реальні, але малі. 3,5% Reddit варті уваги — але не варті того, щоб бути вашою стратегією.
- Якщо ваша назва неоднозначна, ви програєте саме на порівняльних запитах. Десятикратна концентрація плутанини в запитах, що називають бренд, означає: розплутування сутності (консистентні дані про бренд, сторінка «про нас», llms.txt) захищає саме ті запити, де покупці вас порівнюють.
- Очікуйте ~10 цитувань на відповідь. Ви змагаєтеся за одне з десяти місць, а не за єдине — бути другорядним джерелом у багатьох відповідях краще, ніж бути відсутнім у всіх.
Примітки до методології
Відповіді зібрано через ШІ-асистентів із увімкненим пошуком у живому вебі; цитування — це URL, які моделі самі додали до своїх відповідей. Типи джерел призначав класифікатор на правилах за реєстрованим доменом і шляхом (шляхи блогів вендорів рахувалися окремо від продуктових сторінок). «Власний сайт відстежуваного бренду» — цитування, що вказують на сайт бренду, про який було запитання. Усі бренди в корпусі відстежено через наші власні сервісні акаунти; даних клієнтів немає. Частки — від загальної кількості цитувань, якщо не сказано інше; порівняльні твердження супроводжуються 95% інтервалами Вілсона на знаменниках рівня відповідей.
Ми повторимо це дослідження на стабільній щоденній панелі; якщо числа зміняться, оновлення про це скаже.


