22 серпня, 21:00
6

"Мертвий інтернет" може стати реальністю – що показало нове дослідження

Теорія "мертвого інтернету" роками залишалася популярною конспірологічною ідеєю. Тепер нове дослідження показало, що одна з її головних тез частково наближається до реальності.

Штучний інтелект поступово стає помітним автором вебконтенту. Про це свідчить дослідження Pew Research Center, опубліковане 20 серпня 2026 року. 

Наскільки багато текстів в інтернеті створює ШІ?

Дослідники проаналізували майже пів мільйона англомовних вебсторінок, використовуючи архів Common Crawl. До вибірки потрапили матеріали за останні п'ять років, тобто період, який охоплює як час до появи ChatGPT, так і стрімке поширення генеративного ШІ.

Для аналізу дослідники застосували інструмент OpenPangram, який намагається визначити, чи створювався або редагувався текст за допомогою штучного інтелекту. Окремо було проаналізовано 10 000 сторінок, опублікованих у липні 2026 року. Алгоритм шукав характерні слова, фрази та мовні конструкції, які трапляються у текстах, створених ШІ, частіше, ніж у матеріалах людей.

Результат виявився показовим: 10% проаналізованих сторінок мали значні ознаки авторства ШІ.

Водночас Pew Research Center застерігає від надто буквального трактування цього показника. Системи виявлення штучного інтелекту не є безпомилковими. Вони можуть визначити текст, написаний людиною, як створений ШІ, а іноді, навпаки, не розпізнати матеріал, який справді генерувався машиною.

Дослідники також зазначають, що загальна частка у 10% може навіть недооцінювати реальний масштаб явища. У випадковій вибірці є старі сторінки, які фізично не могли бути написані сучасними AI-моделями.

Одна з десяти вебсторінок станом на липень 2026 року може здатися помірним показником. Але інтернет складається із суміші нового та старого матеріалу. Значна частина сторінок у цих випадкових вибірках не могла бути написана ШІ, – зазначають автори дослідження.

Якщо ж виключити старі матеріали та залишити тільки сторінки, опубліковані після запуску ChatGPT, тенденція стає ще помітнішою.

Коли інтернет почав заповнюватися AI-текстами?

За даними дослідників, помітне зростання AI-авторства почалося у 2022 році – приблизно в період запуску ChatGPT.

Після появи популярного чат-бота генеративний ШІ почав швидко поширюватися серед користувачів, компаній та авторів контенту. Згодом на ринку з'явилися інші потужні системи, зокрема Claude від Anthropic та Gemini від Google. У результаті генерація тексту стала доступною практично будь-кому. Вебсайти можуть використовувати ШІ для написання статей, описів товарів, інформаційних матеріалів та інших типів контенту.

Це поступово змінює сам характер інтернету. Якщо раніше пошукові системи переважно індексували матеріали, створені людьми, тепер частина нового контенту проходить через AI-моделі ще до того, як потрапляє у відкритий доступ.

Де AI-контент зустрічається найчастіше?

Розподіл AI-текстів виявився нерівномірним залежно від доменної зони.

Найбільше таких матеріалів дослідники виявили серед сайтів із доменом .com. Приблизно одна з десяти проаналізованих сторінок у цій категорії мала значні ознаки AI-авторства. На сайтах із доменом .org частка була нижчою – близько 4,6%. Ще менше AI-текстів виявили серед сторінок із доменами .edu та .gov – приблизно 1%.

Це означає, що поширення AI-контенту суттєво залежить від типу сайту та його призначення. Комерційний сегмент інтернету вже демонструє значно вищу присутність текстів із характерними ознаками генеративного ШІ.

Як можна розпізнати текст, написаний ШІ?

Pew Research Center також проаналізував мовні особливості, які допомагають відрізняти AI-тексти від матеріалів, написаних людьми.

Дослідники звернули увагу на пунктуацію, окремі слова та характерні мовні конструкції. Наприклад, у текстах, які система визначає як створені ШІ, частіше зустрічається довге тире, а також кома перед останнім елементом у переліку – так звана оксфордська кома. За результатами аналізу, довге тире використовується приблизно вдвічі частіше, а оксфордська кома – на 63% частіше, ніж у текстах, написаних людьми.

ШІ також частіше використовує певні слова. Серед прикладів дослідники назвали англійські "delve" та "interplay".

Втім, справа не лише в окремих словах або розділових знаках. Сучасні AI-детектори аналізують складніші статистичні характеристики тексту.

Вони також навчаються розпізнавати більш тонкі статистичні закономірності у виборі слів і структурі речень, які допомагають визначити, чи був конкретний текст, ймовірно, створений ШІ, – пояснюють дослідники.

Серед інших характерних ознак AI-тексту можуть бути надмірне повторення ключових слів із запиту користувача, однакові пояснення кількома способами та неприродно шаблонний стиль.

Чи справді "мертвий інтернет" стає реальністю?

Теорія "мертвого інтернету" виникла ще на початку 2020-х років і набула популярності приблизно у 2021 році. Її прихильники стверджують, що інтернет нібито вже значною мірою перестав бути простором, де люди спілкуються та створюють контент, а значну частину активності генерують боти. Однією з популярних версій цієї теорії є твердження, що інтернет фактично "помер" ще у 2016 році, а значна частина того, що користувачі бачать сьогодні, створюється автоматизованими системами.

Pew Research Center не підтверджує цю теорію як таку. Дослідження лише показує, що одна з її центральних ідей – збільшення частки автоматично створеного контенту – справді має під собою певні підстави.

Однак навіть 10% сторінок із ознаками AI-авторства не означають, що кожна десята публікація в інтернеті гарантовано написана ботом. Це результат роботи алгоритму, який сам по собі може помилятися.

Проблема стає ще складнішою через те, що AI-тексти можуть використовуватися для створення нових матеріалів, які згодом цитують інші сайти. Таким чином, контент, походження якого пов'язане зі штучним інтелектом, може поширюватися мережею дедалі далі. У підсумку виникає парадокс: користувачі можуть намагатися перевірити відповідь AI-чат-бота через інші джерела в інтернеті, але ці джерела самі можуть містити матеріали, створені штучним інтелектом.

Саме тому результати Pew Research Center важливі не стільки як доказ того, що інтернет уже став "мертвим", скільки як свідчення поступової зміни його інформаційного середовища. ШІ дедалі частіше стає не лише інструментом пошуку та обробки інформації, а й безпосереднім виробником нового контенту.

Пов'язані теми: