Дослідження: 10% вебсторінок мають ознаки авторства ШІ

Аналітики Pew Research Center з'ясували, що кожна десята англомовна вебсторінка містить текст, створений або відредагований штучним інтелектом. Тенденція посилилася після запуску ChatGPT у 2022 році.
Штучний інтелект стає дедалі помітнішим автором контенту в інтернеті. Дослідження Pew Research Center, опубліковане 20 серпня 2026 року, показало, що 10% проаналізованих англомовних вебсторінок мають значні ознаки генеративного ШІ. Аналіз охопив майже пів мільйона сторінок з архіву Common Crawl за останні п'ять років — період, що включає як час до появи ChatGPT, так і етап стрімкого поширення AI-інструментів.
Для виявлення AI-текстів дослідники використали інструмент OpenPangram, який аналізує характерні слова, фрази та мовні конструкції. Окремо було досліджено 10 000 сторінок, опублікованих у липні 2026 року. У Pew Research Center застерігають, що детектори не є безпомилковими: вони можуть як помилково приписати людині авторство ШІ, так і не розпізнати справді згенерований текст. Реальна частка AI-контенту може бути вищою, оскільки у випадкову вибірку потрапляють старі сторінки, які фізично не могли бути написані сучасними моделями.
Помітне зростання AI-авторства почалося у 2022 році — приблизно в момент запуску ChatGPT. Після цього генеративні системи, зокрема Claude від Anthropic та Gemini від Google, стали доступні широкому загалу. Компанії та приватні автори використовують ШІ для написання статей, описів товарів та інформаційних матеріалів, що поступово змінює характер вебу: дедалі більше нового контенту проходить через AI-моделі ще до публікації.
Розподіл AI-текстів нерівномірний за доменними зонами. Найбільше таких матеріалів серед сайтів .com — близько 10% сторінок. На .org частка нижча — 4,6%, а на .edu та .gov — лише близько 1%. Комерційний сегмент інтернету демонструє значно вищу присутність AI-контенту.
Дослідники також виявили мовні маркери, які допомагають відрізняти AI-тексти від людських. У згенерованих матеріалах удвічі частіше зустрічається довге тире, а оксфордська кома — на 63% частіше. Серед характерних слів — англійські "delve" та "interplay". Сучасні детектори аналізують складніші статистичні закономірності у виборі слів і структурі речень, а також звертають увагу на надмірне повторення ключових фраз і шаблонний стиль.
Результати дослідження частково підтверджують ідеї теорії "мертвого інтернету", популярної з початку 2020-х років, але не доводять її повністю. 10% сторінок із ознаками AI-авторства не означають, що кожна десята публікація гарантовано написана ботом — це результат роботи алгоритму, який може помилятися. Водночас проблема ускладнюється тим, що AI-тексти можуть цитуватися іншими сайтами, поширюючись мережею. У підсумку користувачі, які намагаються перевірити відповіді чат-ботів через інші джерела, ризикують натрапити на контент, що також був створений штучним інтелектом.
Дані Pew Research Center свідчать не про "смерть" інтернету, а про поступову зміну його інформаційного середовища. ШІ дедалі частіше стає не лише інструментом пошуку, а й безпосереднім виробником нового контенту, що матиме наслідки для медіа, маркетингу та довіри до онлайн-інформації.
Читайте також
Ще в розділі «Штучний інтелект»
- ChatGPT для Mac отримав доступ до iMessage: нові функції та ризики
- Британія та Google тестують нові маршрути літаків проти кліматичних слідів
- Meta: геній придбань і ціна дорогих ставок Цукерберга
- Ера нульових кліків: як бізнесу вижити в новому пошуку Google
- Stanford AI Index 2026: ШІ стає питанням державного суверенітету






