RecoSignal

Як ми вимірюємо AI-видимість: повна методологія

Оновлено 17 липня 2026 р. · команда RecoSignal

Головне зі статті

  • Ми вимірюємо частоту, а не ранг: у 30 клієнтських запитах на кожен рушій — як часто асистент називає ваш бізнес? Позицію всередині відповіді ми записуємо, але її вага в оцінці нульова, бо порядок назв у відповідях AI нестабільний.
  • Один аудит — це 138 замірів: 30 запитів на кожному з ChatGPT, Gemini і Perplexity, причому 8 запитів із найвищим наміром ставляться тричі — 46 замірів на рушій.
  • Ваги рушіїв (ChatGPT 0.45, Gemini 0.30, Perplexity 0.25) і межі вердикту (≥40 — видимий, 10–39 — слабкий, <10 — невидимий) — це судження, а не вимірювання. Ми публікуємо їх, щоб ви могли з ними не погодитися і перерахувати.
  • Чого оцінка не може: передбачати, гарантувати чи доводити причинність. Це знімок того, як три рушії відповідали одного дня; запуск в інший день зрушить число.
  • Кожна сира відповідь зберігається. Будь-яку цифру у звіті RecoSignal можна простежити до тексту реальної відповіді AI — і це єдина причина вірити бодай чомусь із цього.

Навіщо ця сторінка існує

Галузь, яка продає «оцінки AI-видимості», не публікуючи, як їх рахують, заслуговує на ту недовіру, яку отримує. Оцінку з таємним методом не можна ні перевірити, ні оскаржити, ні відтворити — а це робить її невідрізнюваною від числа, вигаданого заради продажу підписки.

Тож ось метод повністю: запити, рушії, арифметика, порогові значення і конкретні речі, яких це число не доводить. Там, де вибір є судженням, а не вимірюванням, він так і позначений. Там, де метод має обмеження не на нашу користь, воно назване тут, а не залишене конкурентові для знахідки.

Ця сторінка йде слідом за кодом. Якщо змінюється вимірювання — разом із ним змінюються ця сторінка і версія методології.

Що ми вимірюємо: частоту, а не ранг

Головне питання просте: у багатьох реалістичних, клієнтських запитаннях — як часто асистент називає ваш бізнес? Кожен замір бінарний. Названо у відповіді — 1. Не названо — 0. Більше в оцінку не входить нічого.

Ми справді записуємо, у якому місці відповіді з’явилася ваша назва, але цей ранг зберігається як діагностика і має нульову вагу. Причина в тому, що порядок назв усередині відповіді AI недостатньо стабільний, щоб будувати на ньому метрику: поставте те саме запитання двічі — і ті самі бізнеси можуть повернутися в іншому порядку. Постачальник, який звітує про ваш «ранг у ChatGPT», звітує про шум із десятковою комою. Усередині цих систем немає впорядкованого списку, у якому можна було б займати місце.

Тому оцінка рушія — це відсоток: 100 × (заміри, де вас названо ÷ успішні заміри на цьому рушії). Якщо вас назвали у 12 з 46 успішних замірів на ChatGPT, ваша оцінка ChatGPT — 26.1.

Запитання: 30 запитів на рушій, п’ять намірів

Запити генеруються під ваш бізнес і ваше місто, і написані вони так, як пишуть клієнти, а не як пишуть маркетологи. Тридцять на рушій, розподілені між п’ятьма намірами, і кожен намір з’являється у двох варіантах: в одному місто назване прямо, інший сформульовано як «поруч зі мною», а локацію передано параметром API замість того, щоб вписувати її в запитання.

  • best_of — «Хто найкращий стоматолог-імплантолог у [city]?»
  • near_me — «Хороше медспа поруч зі мною», де локація передається рушієві структурованим параметром, якщо він його підтримує, а не вписується в саме запитання.
  • attribute — запитання, що фільтрує за конкретним фактом: яку страховку приймають, яким апаратом працюють, яку послугу надають, яка ціна.
  • comparison — «X чи Y у [city]: хто робить і те, і те, і скільки це коштує?»
  • urgency — запитання «на сьогодні»: відколотий зуб сьогодні ввечері, прорвана труба, терміновий прийом.

138 замірів на аудит — і чому те саме запитання ставиться тричі

Вісім запитів із найвищим наміром — ті, де клієнт найближчий до запису, — ставляться тричі, а не один раз. Це перетворює 30 запитів на 46 замірів на рушій, а на трьох рушіях аудит — це 138 живих звернень до ChatGPT, Gemini і Perplexity.

Повтори — це не наповнювач; саме вони роблять результат бодай чогось вартим. Ці системи недетерміновані: те саме запитання, поставлене двічі, може дати різні назви бізнесів. Одна відповідь — це анекдот. Ставити найважливіші запитання тричі — це спосіб відрізнити випадкову згадку від бізнесу, який рушій називає стабільно.

Це ж задає чесну стелю точності. За 46 замірів на рушій одна згадка зрушує оцінку цього рушія приблизно на 2.2 пункти. Різниця в один пункт між двома бізнесами — не знахідка, і ми її такою не подаємо.

Рушії, яких ми питаємо, — і обмеження, яке ми не ховатимемо

Ми вимірюємо три рушії: ChatGPT, Google Gemini і Perplexity. До кожного звертаємося через його офіційний API з увімкненим вебпошуком, у конфігурації, опублікованій у нашому коді.

Ось обмеження, сказане прямо: ми звертаємося до API-моделей, а не до споживчих застосунків. Відповідь, яку пацієнт отримує в застосунку ChatGPT на своєму телефоні — з його історією чатів, його пам’яттю, його акаунтом, його рівнем підписки і тією версією, яку OpenAI викотила того ранку, — не гарантовано збігається з відповіддю, яку отримав наш замір. Жоден постачальник у цій галузі не може вимірювати споживчий застосунок у масштабі, бо для цього просто немає інтерфейсу; хто натякає на протилежне — продає вам скриншот.

Чим наш замір є точно: великою, повторюваною, відтворюваною вибіркою того, як базові моделі відповідають на запитання про локальні рекомендації з живим вебпошуком, у вашому місті. Чим він не є: прослуховуванням телефонів ваших клієнтів. Ми вважаємо, що перше варте грошей, а другого просто не існує. Ви маєте знати, що саме купуєте.

Географія: як рушіям повідомляють, де перебуває клієнт

Локальна рекомендація повністю залежить від того, де стоїть клієнт, і три рушії сприймають цей факт по-різному.

ChatGPT і Perplexity приймають структуровану локацію — місто, регіон, країну — передану поруч із запитанням, тому наші запити «поруч зі мною» можуть звучати рівно так, як їх формулює клієнт, без вписаного в текст міста.

Gemini, за нашими тестами, на передану таким чином локацію не реагував. Тож для Gemini ми повертаємося до називання міста всередині самого тексту запитання. Це справжня асиметрія між рушіями, вона задана прапорцем у нашому коді, а не схована в чорній скриньці, і вона означає, що результати «поруч зі мною» у Gemini відповідають на дещо інше запитання, ніж у ChatGPT. Ми краще скажемо вам це, ніж вдаватимемо, що всі три рушії питали однаково.

Як три оцінки рушіїв стають одним числом

Підсумковий AI Visibility Score — це зважене середнє трьох оцінок рушіїв: ChatGPT 0.45, Gemini 0.30, Perplexity 0.25.

Ці ваги — судження, а не вимірювання. Це наша оцінка того, яку частку публіки, що користується асистентами, справді охоплює кожен рушій, і тримаємося ми за них не міцно. Публікуємо їх саме тому: ви можете взяти оцінки по рушіях зі свого звіту, застосувати власні ваги й отримати власне число. Усередині середнього нічого не сховано.

Одне механічне правило захищає середнє від сміття. Якщо рушій повертає придатні відповіді менш ніж для половини своїх замірів — збій, обмеження частоти, модель відмовляється відповідати — цей рушій повністю виключається з оцінки, а ваги решти перенормовуються, замість того щоб зламаний рушій тягнув число вниз і видавав це за невидимість. Якщо цю планку не проходить жоден рушій, аудит повідомляє про відсутність оцінки, а не вигадує її.

Межі вердикту — і той факт, що це судження

Оцінка 40 і вище читається як «видимий». Від 10 до 39 — як «слабкий». Нижче 10 — включно з бізнесом, якого не назвали жодного разу, — як «невидимий».

За цими двома точками зрізу немає жодної науки. Це межі, які ми обрали, щоб зробити число зрозумілим власникові бізнесу, і саме ця частина методології найбільше відкрита для обґрунтованої незгоди. Чим вони точно не є, так це прихованим важелем: ваші сирі відсотки по рушіях є у звіті, і якщо ви вважаєте, що межа між «слабким» і «видимим» має бути на 35 або на 50, ви можете провести її там самі.

Для масштабу, з реального ринку: у нашому липневому бенчмарку стоматологій Далласа 2026 року клініка з найвищою оцінкою в усій агломерації набрала 27.0 зі 100 (бенчмарк). Планку видимості на тому ринку не подолав ніхто. Оцінка 40 — це висока планка, і такою вона й задумана.

Як згадки стають числом: від назви в реченні до цифри

Кожна згадка розбирається з тексту реальної відповіді. Назви бізнесів нормалізуються (регістр, пунктуація, суфікси на кшталт «LLC» чи «DDS»). Два різні написання рахуються як один бізнес лише тоді, коли щось у даних показує, що це той самий бізнес: ідентичне написання після зняття діакритики та пунктуації, та сама назва іншою абеткою або обидва написання поруч із цитуванням того самого корпоративного сайту. Написання, які трапляються в одній і тій самій відповіді як два окремі пункти, не об’єднуються ніколи — асистент, перелічуючи варіанти, не називає той самий бізнес двічі, тож це свідчення двох бізнесів, а не одного. Те саме правило діє і для вашого бізнесу, і для кожного конкурента, а написання, яке ми не можемо ні з чим пов’язати, лишається окремим рядком, а не згортається всередину на здогад. Це навмисно: таблиця лідерів, що розділяє один бізнес надвоє, шумна, а та, що зливає два бізнеси в один, просто хибна.

Щоб потрапити в таблицю лідерів конкурентів, бізнесові потрібно щонайменше дві незалежні згадки. Одна побіжна згадка лежить усередині шумового порогу недетермінованої системи, а таблиця лідерів із самих одноразових згадок була б таблицею випадковостей. Два винятки зроблено навмисно: ваш власний бізнес присутній завжди, зокрема й тоді, коли чесна відповідь — нуль; нуль, про який ви попросили, — це знахідка, і тихо викинути його означало б збрехати мовчанням. Конкуренти, яких ви назвали самі, обходять поріг двох згадок з однією згадкою. Конкурент, якого ви назвали і якого жоден рушій не згадав жодного разу, поки що не з’являється в таблиці лідерів нульовим рядком; це обмеження поточної збірки, а не судження, що цей факт неважливий, і воно є в списку на виправлення.

Share of Voice використовує ширший знаменник, ніж таблиця лідерів. Він рахує кожну окрему канонічну згадку бізнесу в кожній успішній відповіді, включно з бізнесами, згаданими лише раз. Той самий бізнес може зарахуватися щонайбільше один раз на відповідь, навіть якщо модель повторює його назву чи вживає кілька варіантів написання. Ваш Share of Voice — це 100 × (пари «відповідь–бізнес», що належать вам ÷ усі пари «відповідь–бізнес»). Це частка спостережених згадок у цьому аудиті, а не частка ринку і не пошуковий трафік.

Ми також записуємо кожен домен-джерело, який цитували рушії. Саме це дало найнезручнішу знахідку з опублікованих нами: на трьох ринках Далласа, які ми виміряли в липні 2026 року, від 73% до 79% джерел за рекомендаціями AI були власними сайтами самих бізнесів, а не каталогами — результат, який суперечить значній частині того, що продає ця галузь, і значній частині того, що ми самі раніше писали. Розбивки по ринках опубліковані на сторінках бенчмарків.

Чого ця оцінка не може

Вона не може передбачати. Оцінка описує, як рушії відповідали протягом вікна вимірювання. Це не прогноз на наступний місяць, і оновлення моделі може її зрушити без жодних змін у вашому бізнесі.

Вона не може гарантувати. Ніхто не може пообіцяти, що ChatGPT рекомендуватиме вас, бо тут немає позиції, яку можна купити, і немає впорядкованого списку, куди можна ввійти. Хто продає гарантоване #1 у відповіді AI, продає місце, якого не існує.

Вона не може довести причинність. Ми можемо показати, що бізнеси, які рушій називає, зазвичай є тими, чиї факти викладені читабельним текстом і послідовно повторені всюди, куди рушій зазирає. Ми не проводили контрольованого експерименту, який довів би, що закриття конкретного розриву піднімає вашу оцінку, — його не проводив ніхто, і постачальник, який називає тут причинне число, здогадується. Що ми можемо — це виміряти вас до, виміряти ще раз після і чесно сказати, що зрушилося.

Це один день. Бенчмарк Далласа — це знімок від 7 липня 2026 року. Поставте ті самі запитання в жовтні — і назви зміняться. Це аргумент за перезамір, а не за те, щоб вважати єдиний замір істиною в останній інстанції — включно з нашим.

Відтворюваність

Кожна сира відповідь AI, зібрана під час аудиту, зберігається разом із запитом, який її породив, рушієм, що відповів, часовою міткою і процитованими доменами-джерелами. Кожне число у звіті RecoSignal простежується до цього тексту.

Це та частина, що відрізняє вимірювання від маркетингової заяви, і це стандарт, за яким ми хотіли б, щоб оцінювали решту галузі, — зокрема й тими, хто читає цю сторінку з відкритим звітом конкурента в сусідній вкладці. Якщо якесь число у вашому звіті виглядає хибним, попросіть у нас відповіді, що стоять за ним. Вони існують.

Ця сторінка описує версію методології 1.2. Коли метод змінюється, змінюється версія, і звіти вказують, яка версія їх створила.

Подивіться, як це працює на вашому бізнесі

Найшвидший спосіб оцінити методологію — побачити, як вона видає результат, який можна перевірити. Безкоштовний AI Visibility Snapshot запускає описане вище вимірювання на вашому бізнесі й повідомляє вашу оцінку, вашу частку рекомендацій проти конкурентів і ваш найбільший розрив — разом із сирими відповідями за ними. Якщо число вас здивує, є відповіді, з якими можна сперечатися.

Поширені запитання

Чому вимірюють частоту, а не мій ранг у ChatGPT?
Тому що рангу немає. AI-асистенти не ведуть упорядкованого списку бізнесів; вони генерують відповідь, і порядок назв усередині неї зсувається між запусками того самого запитання. Позицію ми записуємо як діагностику й даємо їй нульову вагу в оцінці. Постачальник, який продає вам «ранг у ChatGPT», ставить десяткову кому на шумі.
Чи вимірюєте ви той застосунок ChatGPT, яким користуються мої клієнти?
Ні, і ніхто інший теж. Ми звертаємося до моделей через їхні офіційні API з увімкненим вебпошуком. Споживчий застосунок додає історію чатів, пам’ять акаунта, рівень підписки і зміни на боці застосунку, яких ми не бачимо і не можемо відтворити, тож відповідь на телефоні клієнта може відрізнятися від нашої. Те, що ми виробляємо, — велика, повторювана й доступна для перевірки вибірка того, як базові моделі відповідають на запитання про локальні рекомендації у вашому місті, а не запис екранів ваших клієнтів.
Звідки беруться ваги рушіїв?
З нашого судження про те, яку частку публіки, що користується асистентами, охоплює кожен рушій: ChatGPT 0.45, Gemini 0.30, Perplexity 0.25. Це не вимірювання, і ми публікуємо їх саме для того, щоб ви могли їх відкинути. У вашому звіті є сирі оцінки по кожному рушію; застосуйте власні ваги й порахуйте власне число, якщо наші не збігаються з вашим ринком.
Чому саме 40 — межа «видимого»?
Тому що ми провели її там. Межі (≥40 — видимий, 10–39 — слабкий, <10 — невидимий) існують, щоб зробити число зрозумілим власникові, а не тому, що якесь дослідження встановило ці точки зрізу. Для контексту: найкраща стоматологічна клініка в усьому бенчмарку агломерації Далласа набрала 27.0 зі 100 — на тому ринку планку не подолав ніхто.
Скільки замірів в одному аудиті?
138 живих звернень: 30 клієнтських запитів на кожному рушії — ChatGPT, Gemini і Perplexity, причому 8 запитів із найвищим наміром ставляться тричі — 46 замірів на рушій. Повтори існують тому, що ці системи недетерміновані, а одна відповідь — це анекдот, а не вимірювання.
Якщо я закрию розриви зі свого звіту, чи зросте моя оцінка?
Це має підвищити ймовірність того, що вас назвуть, і вдавати, що ми знаємо більше, ми не будемо. Жодне контрольоване дослідження не довело, що конкретне виправлення спричиняє конкретне зростання оцінки, — ні наше, ні чиєсь конкурентське. Що ми можемо — виміряти ще раз після змін і сказати, що насправді зрушилося, і саме тому перезамір важить більше за будь-яке окреме число.

Дізнайтеся, чи рекомендує AI ваш бізнес

Безкоштовний Snapshot покаже ваш AI Visibility Score і тих, кого ChatGPT, Gemini і Perplexity рекомендують замість вас.

Запустити безкоштовний AI Visibility Snapshot