Исследовательский центр Pew опубликовал результаты масштабного анализа современного интернета, согласно которым более трети веб-страниц, появившихся после релиза ChatGPT, имеют явные признаки использования технологий искусственного интеллекта. Исследование подчеркивает стремительную трансформацию цифровой среды и растущее влияние генеративных моделей на производство текстового контента в глобальной сети.
Масштабы экспансии ИИ в вебе
В ходе исследования, проведенного в июле 2026 года, эксперты проанализировали случайную выборку из 10 000 веб-страниц. Общий срез показал, что около 10% всего сетевого контента содержит «значительные признаки создания с помощью ИИ». Однако наиболее впечатляющие цифры были получены при сегментации данных по времени публикации.
- Среди страниц, созданных до конца 2022 года, процент автоматизированного контента минимален.
- Для страниц, опубликованных после запуска ChatGPT, доля генеративного контента достигает 35%.
- Доменная зона .com демонстрирует признаки использования нейросетей в 10 раз чаще, чем государственные или образовательные ресурсы.
Разрыв между коммерческими и официальными ресурсами
Аналитики отмечают существенную разницу в методах наполнения сайтов в зависимости от их назначения. В то время как коммерческий сектор активно внедряет автоматизацию для оптимизации расходов и ускорения публикации материалов, академические и правительственные порталы сохраняют консервативный подход.
Разница в частоте использования ИИ между доменами.com и сегментами.edu или.gov свидетельствует о более строгих редакционных стандартах и требованиях к верификации данных в последних.
Последствия для цифровой экосистемы
Столь высокая концентрация синтетического контента ставит новые вызовы перед поисковыми системами и рядовыми пользователями. Основной проблемой становится идентификация авторства и обеспечение достоверности информации. Эксперты выражают обеспокоенность тем, что лавинообразный рост генерации текстов может привести к снижению общей уникальности сетевых ресурсов.
Результаты исследования указывают на фундаментальный сдвиг в том, как создается и потребляется информация в интернете, где граница между человеческим и машинным трудом становится все более размытой.
В долгосрочной перспективе доминирование алгоритмического контента может потребовать изменения алгоритмов ранжирования. Если тенденция сохранится, к концу десятилетия большая часть доступной в сети информации будет иметь синтетическое происхождение, что потребует внедрения новых систем маркировки и проверки фактов на государственном уровне.