Мій аналіз показує, що Amazon веде приховану операцію з масової оцифровки друкованих видань, яка шокує навіть бувалих букіністів. Йдеться не просто про сканування — книги фізично знищуються після обробки. Це системний підхід, який розкриває апетит tech-гігантів до унікальних даних для навчання нейромереж.

Як розкрилася схема

Усе почалося з аномальних замовлень у продавців рідкісних книг. Анонімні покупці скуповували сотні видань різного віку та тематики, включно з унікальними екземплярами. У липні один із букіністичних магазинів отримав замовлення на тисячу книг через платформу Biblio. Продавець, запідозривши недобре, погодився простежити за долею партії, сховавши в один із томів GPS-трекер Apple AirTag.

Пристрій привів до об'єкта Amazon у Північному Лас-Вегасі. Там розташований підрозділ VGT3, який, як з'ясувалося, займається обробкою друкованих книг. Вивчивши публікації співробітників і поспілкувавшись із колишніми працівниками, я відновив повну картину того, що відбувається.

Конвеєр зі знищення знань

Процес виглядає наступним чином. Спочатку співробітники реєструють кожне видання та сканують штрихкоди або ISBN. Потім — найварварськіше: з книг зрізають палітурки, перетворюючи їх на стоси окремих аркушів. Ці аркуші завантажуються у високошвидкісні сканери. Такий підхід максимально прискорює оцифровку, але робить відновлення фізичної книги неможливим.

За словами працівників, сканування — основна функція VGT3. Є й непрямі підтвердження масштабів: на початку 2026 року на платформі навіть спостерігалися перебої з поставками — настільки великим був попит на нові партії книг для переробки.

Офіційна позиція та реальність

Amazon, коментуючи ситуацію, підтвердив, що закуповує друковані видання через комерційні канали. Корпорація заявила, що книги використовуються для «розробки та покращення продуктів і сервісів». Однак компанія вперто замовчує масштаби закупівель, терміни програми та конкретні продукти, для яких готуються дані.

Це мовчання красномовніше за будь-які слова. Очевидно, що Amazon будує власний пул навчальних даних, віддаючи перевагу фізичним архівам перед цифровими, — ймовірно, через проблеми з авторськими правами та якістю існуючих датасетів.

Мій вердикт: Ми спостерігаємо нову гонку озброєнь в ІІ-індустрії. Покупка та знищення рідкісних книг — це не просто спосіб отримати текст, а стратегічний крок зі створення ексклюзивного контенту для навчання. Поки регулятори сперечаються про цифрове піратство, корпорації освоюють куди агресивніші методи збору даних, які залишаються поза правовим полем. Питання лише в тому, коли громадськість усвідомить ціну, яку ми платимо за прогрес алгоритмів.