Треть веб-контента после запуска ChatGPT создана нейросетями: отчет Pew Research

Исследовательский центр Pew опубликовал результаты масштабного анализа современного интернета, согласно которым более трети веб-страниц, появившихся после релиза ChatGPT, имеют явные признаки использования технологий искусственного интеллекта. Исследование подчеркивает стремительную трансформацию цифровой среды и растущее влияние генеративных моделей на производство текстового контента в глобальной сети.

Масштабы экспансии ИИ в вебе

В ходе исследования, проведенного в июле 2026 года, эксперты проанализировали случайную выборку из 10 000 веб-страниц. Общий срез показал, что около 10% всего сетевого контента содержит «значительные признаки создания с помощью ИИ». Однако наиболее впечатляющие цифры были получены при сегментации данных по времени публикации.

  • Среди страниц, созданных до конца 2022 года, процент автоматизированного контента минимален.
  • Для страниц, опубликованных после запуска ChatGPT, доля генеративного контента достигает 35%.
  • Доменная зона .com демонстрирует признаки использования нейросетей в 10 раз чаще, чем государственные или образовательные ресурсы.

Разрыв между коммерческими и официальными ресурсами

Аналитики отмечают существенную разницу в методах наполнения сайтов в зависимости от их назначения. В то время как коммерческий сектор активно внедряет автоматизацию для оптимизации расходов и ускорения публикации материалов, академические и правительственные порталы сохраняют консервативный подход.

Разница в частоте использования ИИ между доменами.com и сегментами.edu или.gov свидетельствует о более строгих редакционных стандартах и требованиях к верификации данных в последних.

Последствия для цифровой экосистемы

Столь высокая концентрация синтетического контента ставит новые вызовы перед поисковыми системами и рядовыми пользователями. Основной проблемой становится идентификация авторства и обеспечение достоверности информации. Эксперты выражают обеспокоенность тем, что лавинообразный рост генерации текстов может привести к снижению общей уникальности сетевых ресурсов.

Результаты исследования указывают на фундаментальный сдвиг в том, как создается и потребляется информация в интернете, где граница между человеческим и машинным трудом становится все более размытой.

В долгосрочной перспективе доминирование алгоритмического контента может потребовать изменения алгоритмов ранжирования. Если тенденция сохранится, к концу десятилетия большая часть доступной в сети информации будет иметь синтетическое происхождение, что потребует внедрения новых систем маркировки и проверки фактов на государственном уровне.

Материал соответствует редакционной политике Techimo Все публикации проходят проверку фактов и соответствуют стандартам независимой журналистики.
Подробнее

Techimo в Telegram

Самые свежие новости технологий, инсайды и обзоры гаджетов раньше, чем на сайте. Без спама.

Подписаться на канал