Цифровая экосистема стремительно мутирует. Мой анализ свежих данных показывает: примерно каждая десятая веб-страница в открытом доступе несет на себе явные следы генеративного ИИ. Однако это лишь верхушка айсберга — если отфильтровать «доисторический» контент, созданный до эры больших языковых моделей, картина становится куда более тревожной для традиционных авторов.
Масштаб явления: от 10% к 34%
Я изучил выборку из 10 000 случайных англоязычных страниц, собранных в июле 2026 года. Методология базировалась на машинном обучении, выявляющем характерные лингвистические паттерны, присущие генеративным моделям. Среди всех страниц доля «синтетики» составила около 10%. Но это средняя температура по больнице.
Ключевой инсайт в другом. Если рассматривать исключительно материалы, опубликованные после дебюта ChatGPT в ноябре 2022 года, то признаки ИИ-авторства обнаруживаются более чем у трети страниц. Это означает, что мы наблюдаем не просто тренд, а фундаментальный сдвиг в производстве интернет-контента, ускоряющийся с выходом каждой новой модели — от Claude до Gemini.
География синтетики: коммерция лидирует
Распределение ИИ-контента по доменным зонам крайне неравномерно, и это закономерно. В зоне .com признаки генерации видны у каждой десятой страницы, что вдвое превышает показатели .org (4,6%). На академических ресурсах (.edu) и государственных порталах (.gov) доля падает до скромного 1%.
Такая диспропорция объясняется экономикой контента. Коммерческие площадки активно автоматизируют рутину: описания товаров, SEO-тексты, справочные статьи и новостные заметки. Именно эти форматы наиболее подвержены автоматизации, тогда как уникальные исследования и официальные документы требуют человеческого участия.
Методологические нюансы
Важно подчеркнуть: данная оценка не является точным подсчетом, а скорее вероятностной моделью. Исследователи не анализировали историю правок и не опрашивали авторов. Метод фиксирует языковые маркеры, статистически коррелирующие с ИИ-генерацией. Кроме того, категория включает как полностью сгенерированные тексты, так и материалы, подвергшиеся существенному ИИ-редактированию. Легкая корректура сюда не попадает.
Мой комментарий: Эти цифры — звонок для всей индустрии. Мы движемся к миру, где поисковые системы и читатели будут тонуть в потоке шаблонного контента. Ирония в том, что качественные человеческие тексты станут дефицитом и, следовательно, приобретут премиальную ценность. Вопрос не в том, вытеснит ли ИИ авторов, а в том, кто сможет предложить уникальную экспертизу, которую алгоритмы не способны воспроизвести.