Цифровой ландшафт стремительно меняется, и мои последние данные проливают свет на масштаб проникновения генеративных моделей в веб-контент. Анализ случайной выборки из 10 000 англоязычных страниц, собранных в июле 2026 года, показывает: около 10% всех веб-страниц в интернете несут явные признаки текста, созданного или существенно отредактированного искусственным интеллектом. Однако это лишь верхушка айсберга.

Тотальное доминирование ИИ в новом контенте

Ключевой вывод моего исследования — взрывной рост синтетики среди свежих материалов. Если рассматривать только страницы, опубликованные после запуска ChatGPT в ноябре 2022 года, картина радикально меняется: признаки ИИ-авторства обнаруживаются более чем на трети таких страниц. Это означает, что генеративные модели — ChatGPT, Claude, Gemini и их конкуренты — стали основным инструментом производства текстов для значительной части веб-публикаций. Старые страницы, созданные до эры современных LLM, разбавляют общую статистику, маскируя реальную интенсивность процесса.

Коммерческие зоны — главный полигон для ИИ

Распределение ИИ-контента по доменным зонам демонстрирует четкую закономерность. В зоне .com признаки генерации выявлены примерно у каждой десятой страницы — это вдвое больше, чем в .org (4,6%). Академические (.edu) и правительственные (.gov) ресурсы оказались наиболее устойчивыми: там доля синтетики составляет лишь около 1%. Такая диспропорция объяснима: коммерческие площадки активно используют ИИ для автоматизации рутинных задач — от описаний товаров до SEO-статей и новостных заметок, где скорость и объем важнее уникальности авторского голоса. В начале распространения ChatGPT эти различия были менее выражены, что указывает на ускоряющуюся адаптацию технологии именно в коммерческом секторе.

Важные оговорки методологии

Стоит подчеркнуть, что мой анализ не является тотальной проверкой истории создания каждой страницы. Я использовал модель машинного обучения, которая выявляет статистически значимые языковые паттерны, характерные для генеративных сетей. Поэтому результаты — это оценка вероятного авторства, а не точный подсчет. Кроме того, категория «написанного или существенно отредактированного» ИИ-контентом исключает случаи мелкой правки текста нейросетью, что означает: реальное влияние ИИ может быть даже шире, чем показывают цифры.

Экспертный комментарий: Рост доли синтетического контента — это не просто статистический курьез, а фундаментальный сдвиг в экономике внимания. Рынок уже сталкивается с девальвацией традиционных SEO-стратегий и обесцениванием информационного шума. В ближайшие годы ключевым активом станет не объем, а верифицируемое качество и доверие аудитории, что неизбежно приведет к ужесточению требований к прозрачности происхождения контента. Инвесторам и аналитикам стоит внимательно следить за развитием систем маркировки, подобных той, что уже внедряет Anthropic для своих моделей Claude.