Звіти
Що Читає Штучний Інтелект? Всередині Прихованих Механік Генеративних Цитат

Як штучний інтелект змінює цифровий ландшафт, виникає нове питання в центрі створення та відкриття контенту: Що саме читає штучний інтелект? Проривне дослідження під назвою Що читає штучний інтелект від Generative Pulse компанії Muck Rack проаналізувало понад 1 мільйон цитат з великих систем штучного інтелекту, включаючи ChatGPT (4o і 4o-mini) від OpenAI, Gemini (Flash і Pro) від Google та Claude (Sonnet і Haiku) від Anthropic, щоб розкрити приховані динаміки за посиланнями, які ці моделі використовують при генерації відповідей.
Результати не тільки відкривають нові горизонти, але й трансформують усе для тих, хто займається журналістикою, корпоративними комунікаціями, SEO або брендовою стратегією.
Цитати Не Просто Додатки — Вони Зміняють Поведінку Штучного Інтелекту
Як зрозуміло кожному, хто занурений у світ штучного інтелекту, просте увімкнення або вимкнення функції цитування змінює самі відповіді. Коли цитати вимкнені, штучний інтелект більше спирається на статичні навчальні дані. Але коли цитати увімкнені, моделі генерують суттєво різні виходи, безпосередньо сформовані реальними джерелами, які вони витягують.
Ключовий Приклад: Запит про найгіршу команду Головної ліги бейсболу, штучний інтелект без цитат згадував команду 1962 року Mets. Але з увімкненими цитатами він оновив відповідь, включивши 2024 Чикаго Вайт Сокс з рекордним сезоном 41–121, явно цитуючи CBS Sports.
Домінування Заробленого Медіа
Більше 95% усіх цитованих джерел походять з безоплатних медіа. Це включає:
- 27% журналістського контенту (наприклад, Reuters, AP, Financial Times)
- 18% сайтів уряду/НУО
- 13% академічних або дослідницьких джерел
- 10% агрегаторів/енциклопедичних платформ, таких як Вікіпедія або Visual Capitalist
Натомість платний або рекламний контент складає менше 5% цитат, що робить очевидним, що моделі штучного інтелекту систематично налаштовані проти маркетингового контенту.
Помилка Свежості: Чому Новый Контент Перемагає
Свіжість має значення — особливо для моделей OpenAI. У журналістському контенті 56% цитат, зроблених ChatGPT, були опубліковані впродовж останніх 12 місяців, порівняно з 36% для Claude. Ця тенденція, відома як помилка свіжості, відноситься до переваги нових, недавно опублікованих джерел над старими, навіть якщо старі джерела можуть бути все ще точними або актуальними.
У контексті генеративного штучного інтелекту помилка свіжості означає, що мовні моделі — особливо ті, які підключені до реального часу, — частіше посилаються на та довіряють недавно опублікованому матеріалу, особливо при відповідях на запити, пов’язані з поточними подіями, новими технологіями або змінами політики. Для часочутливих запитів, таких як «останні досягнення в амбулаторному лікуванні» або «недавні інновації в звукозаписі», модель сильно вагомить контент, опублікований за останні кілька місяців, припускаючи, що він несе більш актуальні чи оновлені знання.
Це критичний висновок для творців контенту та брендових стратегів: якщо ваш матеріал застарів — навіть на рік, — він значно менше ймовірно буде видимим у відповідях, згенерованих штучним інтелектом. Утримання вашого контенту в свіжому стані не тільки добре для SEO, — це життєво важливо для видимості у віці штучного інтелекту.
Різні Запити Спричиняють Різні Джерела
Моделі штучного інтелекту не цитують джерела випадково — вони вибирають на основі типу запиту. Різні стилі запитів призводять до різних типів джерел, на які посилаються:
- Пошуки фактів і енциклопедичні запити схильні витягувати з статичних довідкових сайтів, таких як Вікіпедія і Британська енциклопедія, спираючись на добре встановлену, але часто застарілі інформацію.
- Запити про недавні події зазвичай спричиняють цитування з великих інформаційних агентств, таких як AP, Reuters або Axios, де швидкість і свіжість мають ключове значення.
- Запити щодо порад або пошуків думок змушують модель перейти до більш динамічних і розмовних джерел, таких як блоги, форуми або платформи, як Reddit або Medium.
- Академічні або дослідницькі завдання ведуть штучний інтелект до цитування з журналів, серверів попередніх публікацій, таких як arXiv, або урядових репозиторіїв, таких як PubMed або NCBI.
- Креативні запити або інструкції крок за кроком часто призводять до появи контенту, створеного користувачами, неформальних інструкцій або обговорень спільноти на платформах, таких як Quora або спеціалізованих технічних форумах.
Ця варіація означає, що спосіб формулювання питання може мати прямий вплив на те, які домени піднімаються — і які залишаються позаду.
Наприклад, Claude значно менше схильний цитувати великі видання, такі як Reuters, ніж ChatGPT або Gemini, цитуючи Reuters 50 разів менше часто, ніж ChatGPT.
Авторитет і Домен Матеріють — Але Не Однорідно
Хоча високої авторитетності видання домінують, вони не єдині гравці. Лише 15% найцитованіших джерел з’являються у першій десятці по кількох галузях. Це означає, що нішевий контент відзначається. Наприклад:
- У фінансах джерела, такі як Bankrate і NerdWallet , віддаються перевагу.
- У охороні здоров’я урядові джерела, такі як CDC.gov і NIH.gov, домінують.
- У технологіях навчальні платформи, такі як Udemy, Coursera і Medium, піднімаються на вершину.
На сторінці 15 візуальна карта тепла показує, що Claude демонструє найбільш різноманітну галузеву різноманітність, часто вибираючи унікальні для галузі джерела, тоді як ChatGPT і Gemini схильні більше спиратися на загальні медіа.
Галузеві Інсайти: Що Цитує Штучний Інтелект за Сектором
Фінанси та Страхування
- Журналістика складає 37% цитат, більше, ніж будь-яка інша галузь.
- Перші десять джерел Claude 90% унікальні, вказуючи на глибше дослідження ніш.
Охорона Здоров’я
- Урядові та НУО-сайти цитуються 18% часу, що в два рази більше середнього показника по галузям.
- Gemini лідирує у різноманітності джерел цієї галузі.
Подорожі/Авіакомпанії
- Дивно, академічні цитати майже відсутні (лише 0,7%).
- Джерела, такі як FAA.gov і IATA.org, домінують, з меншою залежністю від інформаційних агентств.
Роздрібна Торгівля та Електронна Комерція
- Агрегатори, такі як Вікіпедія, цитуються менше тут, ніж у інших галузях (36% проти 28%).
- Claude цитує найбільш нішевий контент.
Медіа/Розваги
-
Журналістика знову лідирує на 37%, з нішевими платформами, такими як TVTechnology і Radioking, часто цитованими Claude.
Технології
- Практично немає жодних енциклопедичних або академічних джерел.
- Платформи, такі як Medium, Coursera і SproutSocial, з’являються на передньому плані, відображаючи нахил до знань практиків.
Вплив на Комунікації та Команди SEO
Результати цього звіту показують, що Генеративна Оптимізація Двигуна (GEO) стає такою ж важливою, як і традиційна SEO. Штучний інтелект не просто підсумовує статичні бази даних — він активно посилається на джерела в реальному часі. І ці посилання впливаються на:
- Свіжість: Оновлюйте свій контент регулярно.
- Авторитет Домена: Будуйте зворотні посилання та довіру.
- Нішевий Релевантність: Створюйте контент, орієнтований на вашу галузь, а не просто загальні теми.
- Тип Контенту: Зосереджуйтеся на заробленому медіа та інформативному контенті, а не просто на маркетингових сторінках.
Це змінює розрахунок для маркетологів контенту, фахівців зі зв’язків з громадськістю та видавців. Якщо ваша мета — з’явитися в результатах, згенерованих штучним інтелектом, вам потрібно створити контент, який штучний інтелект вважає цінним — не тільки користувачі або Google.
Висновок: Наслідки Бути Прочитаним (або Ігнорованим) Штучним Інтелектом
Цей звіт підкреслює фундаментальну зміну в тому, як інформація представляється в Інтернеті: моделі штучного інтелекту не просто витягують контент — вони вибірково курирують його. І ця кураторія переозначає видимість у цифрову добу.
Для видавців, дослідників та брендів бути процитованим штучним інтелектом означає бути частиною наступного покоління пошуку. Це ставить ваш контент перед користувачами, які можуть ніколи не відвідувати ваш сайт, але довіряють моделі, яка його цитує. Джерела, які цитуються, посилюються. Ті, які не цитуються, — незалежно від якості, — ризикують бути виключені з розмови повністю.
Ця зміна створює нових переможців і переможених. Видання високої авторитетності та своєчасне зароблене медіа віддаються перевагу. Тим часом платний контент, слабо оновлені блоги чи менш усталені голоси часто залишаються непрочитаними — не тільки людьми, але й системами, які формують те, що люди бачать.
Як генеративний штучний інтелект продовжує відігравати центральну роль у доставці знань, ключове питання стає менш важливим для того, як посісти місце у пошуку, і більш важливим для того, як стати частиною того, що штучний інтелект вважає гідним цитування?












