Новости криптомира

22.08.2026
21:30

ИИ захватывает веб: более трети новых страниц в интернете созданы нейросетями

AI fake news фейки

Анализ свежих данных показывает: мы стоим на пороге тектонического сдвига в структуре всемирной паутины. В ходе масштабного исследования, охватившего случайную выборку из 10 000 англоязычных веб-страниц, собранных в июле 2026 года, выяснилось, что примерно 10% всех страниц в интернете несут явные следы генерации или существенного редактирования искусственным интеллектом. Однако эта цифра — лишь верхушка айсберга.

Новая реальность: синтетический контент доминирует

Ключевой вывод, который меняет картину, — это динамика. Если исключить из выборки «исторический» контент, созданный до эпохи современных генеративных моделей, и сосредоточиться исключительно на материалах, опубликованных после запуска ChatGPT в ноябре 2022 года, доля ИИ-авторства резко возрастает. Среди таких свежих страниц признаки синтетики обнаруживаются более чем на трети. Это не просто тренд — это новая норма для цифрового ландшафта, где алгоритмы стали полноценными авторами наравне с людьми.

Где именно обосновался ИИ?

Распределение искусственного контента по доменным зонам крайне неравномерно и красноречиво. Лидирует коммерческий сектор: в зоне .com признаки ИИ-генерации выявлены примерно у каждой десятой страницы. Это вдвое больше, чем в некоммерческой зоне .org, где показатель остановился на отметке 4,6%. Особенно показательна ситуация с академическими и государственными ресурсами: в зонах .edu и .gov доля синтетики составляет лишь около 1%.

Такая диспропорция объяснима с практической точки зрения. Коммерческие площадки генерируют огромные объемы шаблонного текста — описания товаров, SEO-статьи, новостные заметки, — которые идеально подходят для автоматизации. В то время как академическая и государственная сферы, с их высокими требованиями к уникальности и авторству, остаются пока относительно «чистыми». Впрочем, в начале распространения ChatGPT эти различия были менее выражены, что указывает на ускоряющуюся коммерциализацию ИИ-контента.

Методология: вопрос интерпретации

Важно подчеркнуть: исследование не является точным подсчетом страниц, написанных нейросетью. Использованная модель машинного обучения анализировала лингвистические маркеры, статистически коррелирующие с ИИ-генерацией, а не историю создания документа. Поэтому корректнее говорить об оценке вероятного авторства. Кроме того, в категорию попадает только полностью сгенерированный или существенно отредактированный ИИ текст; легкая правка с помощью нейросети не учитывается.

Мой взгляд как аналитика: Эти данные — тревожный сигнал для экосистемы веба. Мы движемся к состоянию, когда большая часть «свежей» информации в сети будет создана без участия человека. Это ставит под вопрос достоверность поисковой выдачи и подчеркивает критическую важность инструментов верификации и маркировки контента, подобных тем, что недавно внедрила Anthropic для своих моделей Claude. Без таких мер мы рискуем утонуть в океане правдоподобной, но бездушной синтетики.