Новости криптомира

22.08.2026
22:45

Более трети новых веб-страниц созданы ИИ: масштабное исследование обнажает тревожную тенденцию

AI fake news фейки

Мои последние аналитические выкладки, основанные на данных масштабного исследования, рисуют довольно показательную картину: около 10% всех веб-страниц в интернете несут на себе явные следы генеративного ИИ. Однако если отфильтровать «допотопный» контент, созданный до эры ChatGPT, цифра приобретает поистине пугающие масштабы — более трети всех новых материалов в сети уже написаны или существенно отредактированы нейросетями.

Методология и ключевые цифры

В ходе исследования была проанализирована репрезентативная выборка из 10 000 англоязычных страниц, собранных в июле 2026 года. Для идентификации использовалась ML-модель, выявляющая характерные лингвистические паттерны генеративного ИИ. Тот факт, что в общий пул попали архивы старого веба, объясняет сравнительно скромные 10% в общей статистике.

Когда я исключил материалы, опубликованные до ноября 2022 года, картина радикально изменилась. Среди «свежих» страниц доля синтетики превысила 33%. Это прямое следствие повсеместного распространения ChatGPT, Claude, Gemini и их конкурентов, которые стремительно превратили создание текста в рутинную автоматизированную операцию.

Неравномерное распределение по доменным зонам

Особый интерес представляет сегментация по доменам. В зоне .com признаки ИИ-генерации обнаруживаются у каждой десятой страницы, что вдвое превышает показатели .org (4,6%). При этом академический .edu и правительственный .gov демонстрируют лишь около 1% — в десять раз ниже. Такая диспропорция объясняется природой контента: коммерческие площадки активно автоматизируют описание товаров, SEO-тексты и новостные ленты, тогда как строгие редакционные стандарты в образовательной и государственной сферах сдерживают внедрение «сырых» генеративных моделей.

Важные оговорки методологии

Стоит подчеркнуть, что исследование не утверждает стопроцентную точность. Речь идет о вероятностной оценке авторства, основанной на статистических языковых маркерах, а не о верификации каждого конкретного случая. Незначительная правка текста нейросетью также может не попадать в категорию «существенного редактирования». Тем не менее, тренд очевиден: синтетический контент стремительно вытесняет органический веб-контент.

Мой экспертный комментарий: Рынок уже столкнулся с инфляцией контента, где SEO-оптимизированные пустышки забивают поисковую выдачу. В ближайшие годы мы увидим либо ужесточение алгоритмов ранжирования, направленных на деприоритизацию ИИ-текста, либо полную трансформацию веба в синтетическую среду, где доверие станет дефицитным активом. Инвесторам стоит присмотреться к проектам, развивающим верификацию контента и цифровые подписи.