Мой анализ показывает, что Amazon ведет скрытую операцию по массовой оцифровке печатных изданий, которая шокирует даже видавших виды букинистов. Речь идет не просто о сканировании — книги физически уничтожаются после обработки. Это системный подход, который раскрывает аппетит tech-гигантов к уникальным данным для обучения нейросетей.

Как вскрылась схема

Все началось с аномальных заказов у продавцов редких книг. Анонимные покупатели скупали сотни изданий разного возраста и тематики, включая уникальные экземпляры. В июле один из букинистических магазинов получил заказ на тысячу книг через площадку Biblio. Продавец, заподозрив неладное, согласился проследить за судьбой партии, спрятав в один из томов GPS-трекер Apple AirTag.

Устройство привело к объекту Amazon в Северном Лас-Вегасе. Там располагается подразделение VGT3, которое, как выяснилось, занимается обработкой печатных книг. Изучив публикации сотрудников и пообщавшись с бывшими работниками, я восстановил полную картину происходящего.

Конвейер по уничтожению знаний

Процесс выглядит следующим образом. Сначала сотрудники регистрируют каждое издание и сканируют штрихкоды или ISBN. Затем — самое варварское: с книг срезают переплеты, превращая их в стопки отдельных листов. Эти листы загружаются в высокоскоростные сканеры. Такой подход максимально ускоряет оцифровку, но делает восстановление физической книги невозможным.

По словам работников, сканирование — основная функция VGT3. Есть и косвенные подтверждения масштабов: в начале 2026 года на площадке даже наблюдались перебои с поставками — настолько велик был спрос на новые партии книг для переработки.

Официальная позиция и реальность

Amazon, комментируя ситуацию, подтвердил, что закупает печатные издания через коммерческие каналы. Корпорация заявила, что книги используются для «разработки и улучшения продуктов и сервисов». Однако компания упорно умалчивает о масштабах закупок, сроках программы и конкретных продуктах, для которых готовятся данные.

Это молчание красноречивее любых слов. Очевидно, что Amazon строит собственный пул обучающих данных, предпочитая физические архивы цифровым, — вероятно, из-за проблем с авторскими правами и качеством существующих датасетов.

Мой вердикт: Мы наблюдаем новую гонку вооружений в ИИ-индустрии. Покупка и уничтожение редких книг — это не просто способ получить текст, а стратегический шаг по созданию эксклюзивного контента для обучения. Пока регуляторы спорят о цифровом пиратстве, корпорации осваивают куда более агрессивные методы сбора данных, которые остаются вне правового поля. Вопрос лишь в том, когда общественность осознает цену, которую мы платим за прогресс алгоритмов.