Искусственный интеллект постепенно становится заметным автором веб-контента. Об этом свидетельствует исследование Pew Research Center, опубликованное 20 августа 2026 года.

Насколько много текстов в интернете создает ИИ?

Исследователи проанализировали почти полмиллиона англоязычных веб-страниц, используя архив Common Crawl. В выборку вошли материалы за последние пять лет, то есть период, охватывающий как время до появления ChatGPT, так и стремительное распространение генеративного ИИ.

Для анализа исследователи использовали инструмент OpenPangram, который пытается определить, был ли текст создан или отредактирован с помощью искусственного интеллекта. Отдельно были проанализированы 10 000 страниц, опубликованных в июле 2026 года. Алгоритм искал характерные слова, фразы и языковые конструкции, которые встречаются в текстах, созданных ИИ, чаще, чем в материалах, написанных людьми.

Результат оказался показательным: 10 % проанализированных страниц имели явные признаки авторства ИИ.

Средние цены в сети АЗС «Amic Energy» по состоянию на 

В то же время Pew Research Center предостерегает от слишком буквальной интерпретации этого показателя. Системы обнаружения искусственного интеллекта не являются безошибочными. Они могут определить текст, написанный человеком, как созданный ИИ, а иногда, наоборот, не распознать материал, который действительно был сгенерирован машиной.

Исследователи также отмечают, что общая доля в 10% может даже занижать реальный масштаб явления. В случайной выборке есть старые страницы, которые физически не могли быть написаны современными ИИ-моделями.

Одна из десяти веб-страниц по состоянию на июль 2026 года может показаться умеренным показателем. Но интернет состоит из смеси нового и старого материала. Значительная часть страниц в этих случайных выборках не могла быть написана ИИ, – отмечают авторы исследования.

Если же исключить старые материалы и оставить только страницы, опубликованные после запуска ChatGPT, тенденция становится еще более заметной.

Когда интернет начал наполняться текстами, созданными ИИ?

По данным исследователей, заметный рост ИИ-авторства начался в 2022 году – примерно в период запуска ChatGPT.

После появления популярного чат-бота генеративный ИИ начал быстро распространяться среди пользователей, компаний и авторов контента. Впоследствии на рынке появились другие мощные системы, в частности Claude от Anthropic и Gemini от Google. В результате генерация текста стала доступна практически любому. Веб-сайты могут использовать ИИ для написания статей, описаний товаров, информационных материалов и других типов контента.

Это постепенно меняет сам характер интернета. Если раньше поисковые системы преимущественно индексировали материалы, созданные людьми, то теперь часть нового контента проходит через AI-модели еще до того, как попадает в открытый доступ.

Где ИИ-контент встречается чаще всего?

Распределение текстов, созданных с помощью ИИ, оказалось неравномерным в зависимости от доменной зоны.

Больше всего таких материалов исследователи обнаружили среди сайтов с доменом .com. Примерно одна из десяти проанализированных страниц в этой категории имела значительные признаки AI-авторства. На сайтах с доменом .org доля была ниже – около 4,6%. Еще меньше текстов, созданных ИИ, обнаружили среди страниц с доменами .edu и .gov – примерно 1%.

Это означает, что распространение контента, созданного ИИ, существенно зависит от типа сайта и его назначения. Коммерческий сегмент интернета уже демонстрирует значительно более высокую долю текстов с характерными признаками генеративного ИИ.

Как можно распознать текст, написанный ИИ?

Pew Research Center также проанализировал языковые особенности, которые помогают отличать тексты, созданные ИИ, от материалов, написанных людьми.

Исследователи обратили внимание на пунктуацию, отдельные слова и характерные языковые конструкции. Например, в текстах, которые система определяет как созданные ИИ, чаще встречается длинное тире, а также запятая перед последним элементом в перечне – так называемая оксфордская запятая. По результатам анализа, длинное тире используется примерно в два раза чаще, а оксфордская запятая – на 63% чаще, чем в текстах, написанных людьми.

ИИ также чаще использует определенные слова. Среди примеров исследователи назвали английские "delve" и "interplay".

Впрочем, дело не только в отдельных словах или знаках препинания. Современные AI-детекторы анализируют более сложные статистические характеристики текста.

Они также учатся распознавать более тонкие статистические закономерности в выборе слов и структуре предложений, которые помогают определить, был ли конкретный текст, вероятно, создан ИИ, – объясняют исследователи.

Среди других характерных признаков текста, созданного ИИ, могут быть чрезмерное повторение ключевых слов из запроса пользователя, одинаковые объяснения несколькими способами и неестественно шаблонный стиль.

Действительно ли "мертвый интернет" становится реальностью?

Теория "мертвого интернета" возникла еще в начале 2020-х годов и приобрела популярность примерно в 2021 году. Ее сторонники утверждают, что интернет якобы уже в значительной степени перестал быть пространством, где люди общаются и создают контент, а значительную часть активности генерируют боты. Одной из популярных версий этой теории является утверждение, что интернет фактически "умер" еще в 2016 году, а значительная часть того, что пользователи видят сегодня, создается автоматизированными системами.

Pew Research Center не подтверждает эту теорию как таковую. Исследование лишь показывает, что одна из ее центральных идей – увеличение доли автоматически созданного контента – действительно имеет под собой определенные основания.

Однако даже 10 % страниц с признаками AI-авторства не означают, что каждая десятая публикация в интернете гарантированно написана ботом. Это результат работы алгоритма, который сам по себе может ошибаться.

Проблема усложняется еще больше из-за того, что тексты, созданные ИИ, могут использоваться для создания новых материалов, которые впоследствии цитируют другие сайты. Таким образом, контент, происхождение которого связано с искусственным интеллектом, может распространяться по сети все дальше и дальше. В итоге возникает парадокс: пользователи могут пытаться проверить ответ AI-чат-бота через другие источники в интернете, но эти источники сами могут содержать материалы, созданные искусственным интеллектом.

Именно поэтому результаты Pew Research Center важны не столько как доказательство того, что интернет уже стал "мертвым", сколько как свидетельство постепенного изменения его информационной среды. ИИ все чаще становится не только инструментом поиска и обработки информации, но и непосредственным производителем нового контента.