
Около 10% веб-страниц в интернете содержат признаки текста, созданного или существенно отредактированного искусственным интеллектом. Среди материалов, опубликованных после выхода ChatGPT, эта доля превышает 33%, выяснили исследователи Pew Research Center.
Для исследования эксперты проанализировали случайную выборку из 10 000 англоязычных страниц, собранных в июле 2026 года через Common Crawl. Авторство определялось с помощью модели машинного обучения, искавшей языковые паттерны, характерные для генеративных нейросетей. Общий показатель в 10% может казаться невысоким, но в выборку попало множество старых материалов, созданных до появления современных ИИ-моделей.
Если рассматривать только страницы, опубликованные после ноября 2022 года, картина резко меняется: признаки ИИ-авторства обнаруживаются более чем на 33% таких сайтов. Это указывает на быстрый рост доли синтетического контента по мере популяризации ChatGPT, Claude, Gemini и других инструментов.
Распределение ИИ-текстов по доменным зонам оказалось неравномерным. В 2026 году признаки генерации выявлены примерно на 10% страниц в зоне .com, что в 2 раза выше показателя зоны .org (4,6%). На образовательных и государственных сайтах доля ИИ-контента составила около 1%, что в 10 раз ниже, чем у коммерческих площадок. Исследователи связывают это с тем, что бизнес чаще автоматизирует создание больших объемов текстов: описаний товаров, SEO-статей и справочных материалов.
В Pew Research Center сделали важную оговорку: исследование оценивает вероятность ИИ-авторства по языковым признакам, а не проверяет фактическую историю создания каждой страницы. Кроме того, в категорию попал контент, который был существенно отредактирован нейросетью, тогда как мелкие правки не учитывались. В качестве отраслевого контекста отмечается, что в августе компания Anthropic внедрила глобальную маркировку для материалов, созданных моделями Claude.
