Автор: GetCited.me

Опубліковано: 10.08.2026

Кого насправді цитують ШІ-моделі? Висновки з 24 035 цитувань

Кого насправді цитують ШІ-моделі? Висновки з 24 035 цитувань
Фото Luke Chesser на Unsplash

TL;DR: Ми проаналізували 24 035 цитувань, які ШІ-асистенти додали до 2 314 відповідей у період з 4 червня до 10 серпня 2026 року. 79,7% усього, що цитують ШІ-моделі, — це сторінки, якими цитована компанія володіє і які може відредагувати вже сьогодні: 62,5% — звичайні сайти компаній, ще 17,2% — блоги та ресурсні сторінки вендорів. На Reddit припадає 3,5% цитувань, на YouTube — 3,4%. Стандартна порада «йдіть на Reddit» оптимізує канал, приблизно у двадцять разів менший за той, який ви вже контролюєте.

Дані

Кожне число нижче походить із нашого власного пайплайна відстеження: ми ставимо ШІ-асистентам запитання, які ставлять покупці («найкращі X для Y», «A чи B», «що таке Z»), збираємо відповіді з живим пошуком і фіксуємо кожне джерело, яке цитує модель.

  • 24 035 цитувань у 2 314 проаналізованих відповідях, 4 червня – 10 серпня 2026
  • 1 626 різних запитів на 197 сайтах — SaaS, e-commerce, агенції, інструменти для розробників, медіа; усі відстежені через наш власний онбординг у межах QA, без даних клієнтів
  • 5 770 різних процитованих хостів
  • Відповідь у середньому містить 10,4 цитування; 14,3% відповідей не цитують нічого
  • Частки нижче супроводжуються 95% довірчими інтервалами Вілсона там, де ми робимо порівняльне твердження

Це не випадкова вибірка реальних запитів користувачів — запити згенерував наш пайплайн для фіксованого набору брендів. Ми кажемо це одразу, бо більшість досліджень у цій ніші цього не роблять.

Висновок 1 — відповіді ШІ будуються на сторінках, які контролюють вендори

Розподіл цитувань за типом джерела:

Тип джерела Частка з 24 035 цитувань
Сайти компаній (продукт, ціни, функції) 62,5%
Блоги та ресурсні сторінки вендорів 17,2%
Власний сайт відстежуваного бренду 3,8%
Форуми та спільноти (96% цього — Reddit) 3,5%
Відео (повністю YouTube) 3,4%
Блог-платформи (Medium, Dev.to, Substack) 2,9%
Каталоги та сайти відгуків (G2, Capterra, Clutch) 2,7%
Новинні медіа 2,4%
Пошуковики, репозиторії коду, документація 1,5% разом

Додайте перші два рядки — і картина перевертає більшість порад із GEO: ~80% того, що цитують ШІ-моделі, — це поверхня під контролем вендорів. Не гілки Reddit, не агрегатори відгуків, не преса — звичайні сторінки, які хтось опублікував і може переписати сьогодні по обіді.

Практичний висновок: перш ніж інвестувати в посів у спільнотах чи цифровий PR, зробіть цитованими сторінки, якими ви вже володієте, — відповідь у першому абзаці, порівняльні таблиці, видимі дати, структуровані дані. Наскільки цитованою є конкретна сторінка, можна виміряти нашим безкоштовним Citation Probability Checker.

Висновок 2 — Reddit і YouTube — різні інструменти

Два найгучніші імені в порадах із GEO очолюють таблицю хостів, але поводяться по-різному:

Хост Цитувань Відповідей із ним
reddit.com 813 487 (21% відповідей)
youtube.com 811 767 (33% відповідей)

Майже однакова кількість цитувань — дуже різне охоплення. Reddit цитується кілька разів усередині однієї відповіді; YouTube — по одному разу, але в більшій кількості відповідей. Будь-який рейтинг «топ-джерел» за сирою кількістю цитувань мовчки занижує YouTube на третину.

Висновок 3 — плутанина брендів концентрується в порівняльних запитах

Ми позначаємо відповідь як плутанину бренду, коли модель називає бренд, але її цитування вказують на іншу сутність — домен-двійник або тезку. Частки за типами запитів:

Тип запиту Частка плутанини 95% ДІ n
Органічний («найкращі інструменти для…») 1,2% 0,7–1,9% 1 446
Порівняльний («A чи B») 10,9% 8,4–13,9% 496
Брендовий («чи хороший X?») 12,6% 9,6–16,4% 364

Порівняльні та брендові запитання плутають моделі приблизно вдесятеро частіше за органічні, і інтервали проти органічних не перетинаються. (Порівняльні проти брендових у наших даних статистично нероздільні, тому ми не стверджуємо, який із двох гірший.)

Механізм інтуїтивний: органічне запитання дозволяє моделі говорити про кого завгодно; запитання, що називає ваш бренд, змушує її розв'язати вашу ідентичність — і саме тут домени-двійники й тезки перехоплюють цитування. Якщо ваш бренд ділить назву з будь-чим, це ваша поверхня ризику. Наш безкоштовний Entity Confusion Checker проводить саме цей тест для будь-якого бренду.

Що ми відмовилися публікувати

Три зрізи цих даних не пройшли нашу власну планку, і сказати про це, на нашу думку, важливіше, ніж подовжити список висновків:

  • Порівняння платформ між собою. На зіставленому наборі запитів, на які відповіли чотири і більше платформ, усі десять попарних порівнянь часток плутанини мають довірчі інтервали, що перетинаються. Твердження на кшталт «модель X плутає бренди вдвічі частіше за модель Y» наші дані не витримують — вибірки поза Gemini становлять ~37 відповідей кожна.
  • Частки по окремих сайтах. 184 зі 197 сайтів не досягають нашого мінімуму в 30 відповідей. Частка плутанини, порахована на 12 відповідях, — це підкидання монети, а не висновок.
  • Тренди місяць до місяця. Склад відстежуваних брендів різко змінювався між місяцями, тож видимий тренд — артефакт вибірки, доки його не виміряно на стабільній панелі.

Що це означає для вашої GEO-стратегії

  1. Ваші власні сторінки — головна поверхня цитування. ~80% цитувань ведуть на сторінки під контролем вендорів. Порівняльні сторінки, чесні таблиці функцій, датовані оновлення та schema-розмітка на вашому домені — робота з найбільшим важелем: на ті самі сторінки спирається й Google, і це можна перевіряти запит за запитом, дивлячись, чи повертає пошук AI Overview і чиї домени він цитує.
  2. Спільноти реальні, але малі. 3,5% Reddit варті уваги — але не варті того, щоб бути вашою стратегією.
  3. Якщо ваша назва неоднозначна, ви програєте саме на порівняльних запитах. Десятикратна концентрація плутанини в запитах, що називають бренд, означає: розплутування сутності (консистентні дані про бренд, сторінка «про нас», llms.txt) захищає саме ті запити, де покупці вас порівнюють.
  4. Очікуйте ~10 цитувань на відповідь. Ви змагаєтеся за одне з десяти місць, а не за єдине — бути другорядним джерелом у багатьох відповідях краще, ніж бути відсутнім у всіх.

Примітки до методології

Відповіді зібрано через ШІ-асистентів із увімкненим пошуком у живому вебі; цитування — це URL, які моделі самі додали до своїх відповідей. Типи джерел призначав класифікатор на правилах за реєстрованим доменом і шляхом (шляхи блогів вендорів рахувалися окремо від продуктових сторінок). «Власний сайт відстежуваного бренду» — цитування, що вказують на сайт бренду, про який було запитання. Усі бренди в корпусі відстежено через наші власні сервісні акаунти; даних клієнтів немає. Частки — від загальної кількості цитувань, якщо не сказано інше; порівняльні твердження супроводжуються 95% інтервалами Вілсона на знаменниках рівня відповідей.

Ми повторимо це дослідження на стабільній щоденній панелі; якщо числа зміняться, оновлення про це скаже.