Мой анализ показывает, что Amazon ведет скрытую операцию по массовой оцифровке печатных изданий, которая шокирует даже видавших виды букинистов. Речь идет не просто о сканировании — книги физически уничтожаются после обработки. Это системный подход, который раскрывает аппетит tech-гигантов к уникальным данным для обучения нейросетей.
Как вскрылась схема
Все началось с аномальных заказов у продавцов редких книг. Анонимные покупатели скупали сотни изданий разного возраста и тематики, включая уникальные экземпляры. В июле один из букинистических магазинов получил заказ на тысячу книг через площадку Biblio. Продавец, заподозрив неладное, согласился проследить за судьбой партии, спрятав в один из томов GPS-трекер Apple AirTag.
Устройство привело к объекту Amazon в Северном Лас-Вегасе. Там располагается подразделение VGT3, которое, как выяснилось, занимается обработкой печатных книг. Изучив публикации сотрудников и пообщавшись с бывшими работниками, я восстановил полную картину происходящего.
Конвейер по уничтожению знаний
Процесс выглядит следующим образом. Сначала сотрудники регистрируют каждое издание и сканируют штрихкоды или ISBN. Затем — самое варварское: с книг срезают переплеты, превращая их в стопки отдельных листов. Эти листы загружаются в высокоскоростные сканеры. Такой подход максимально ускоряет оцифровку, но делает восстановление физической книги невозможным.
По словам работников, сканирование — основная функция VGT3. Есть и косвенные подтверждения масштабов: в начале 2026 года на площадке даже наблюдались перебои с поставками — настолько велик был спрос на новые партии книг для переработки.
Официальная позиция и реальность
Amazon, комментируя ситуацию, подтвердил, что закупает печатные издания через коммерческие каналы. Корпорация заявила, что книги используются для «разработки и улучшения продуктов и сервисов». Однако компания упорно умалчивает о масштабах закупок, сроках программы и конкретных продуктах, для которых готовятся данные.
Это молчание красноречивее любых слов. Очевидно, что Amazon строит собственный пул обучающих данных, предпочитая физические архивы цифровым, — вероятно, из-за проблем с авторскими правами и качеством существующих датасетов.
Мой вердикт: Мы наблюдаем новую гонку вооружений в ИИ-индустрии. Покупка и уничтожение редких книг — это не просто способ получить текст, а стратегический шаг по созданию эксклюзивного контента для обучения. Пока регуляторы спорят о цифровом пиратстве, корпорации осваивают куда более агрессивные методы сбора данных, которые остаются вне правового поля. Вопрос лишь в том, когда общественность осознает цену, которую мы платим за прогресс алгоритмов.