В июле 2026 года антикварный книготорговец из Харлема Питер де Врис открыл письмо от некой Натальи из компании «2077AI». К письму прилагалась таблица с 3001 ISBN-номером – академические издания Elsevier, Wiley, Routledge, Oxford University Press, тематика от медицины до публичной политики. Просьба: подобрать книги, составить смету, рассчитать доставку в Китай. Де Врис не дочитал до конца. Решил – спам или фишинг, закрыл и забыл. Спустя несколько недель ему позвонил журналист, расследующий именно такие запросы. Тут-то букинист и узнал, что именно он чуть не проигнорировал.
Де Врис был не единственным. Несколько других нидерландских антикварных торговцев получили идентичное письмо – и точно так же сочли его мошенничеством. Это понятно: рынок старых и редких книг работает иначе. «Я занимаюсь старинными и редкими книгами,» – пояснил де Врис. – «По электронной почте заказы приходят редко, и максимум – одна книга. Эти книги дорогие и эксклюзивные. Оптовой торговлей я не занимаюсь». Запрос на три тысячи томов – это из другого мира.
Но этот «другой мир» существует. AI-компании давно вышли за пределы открытого интернета в поисках высококачественных текстовых данных для обучения языковых моделей. Открытые веб-данные – это один ресурс. Книги – совсем другой: структурированные, редактированные, насыщенные специализированными знаниями. И за доступом к ним выстраивается целая цепочка поставок, о которой публика почти ничего не знала до прошлого года.

Процесс называется destructive scanning – деструктивное сканирование. Схема простая и жёсткая: у книги срезается корешок, страницы прогоняются через высокоскоростной сканер, после чего физический экземпляр выбрасывается. Никакого возврата на полку. Именно так, по материалам судебных дел, действовала компания Anthropic в рамках внутреннего проекта под названием «Project Panama». Об этом в своё время написала The Washington Post: Anthropic скупила миллионы физических книг, сняла переплёты, отсканировала и утилизировала оригиналы – всё ради создания цифровой библиотеки для обучения своих моделей Claude.
Федеральный суд США рассмотрел дело и признал использование легально купленных книг для обучения AI добросовестным использованием (fair use). Отдельные претензии, связанные с загрузкой книг из онлайн-библиотек LibGen и PiLiMi, были урегулированы мировым соглашением. Anthropic в комментарии для Fortune уточнила: модели Claude обучаются на публичных веб-данных, коммерчески приобретённых датасетах и внутренне сгенерированных данных; ни одна из программ не приобретает и не уничтожает редкие или антикварные книги.
Скупка книг для AI – явление, которое суд легализовал. Но это не делает его менее странным с точки зрения здравого смысла: покупаешь книгу, ломаешь её и выбрасываешь. Издательская индустрия смотрит на это с нескрываемым беспокойством.
Судебные материалы показали, что происходит с книгами после покупки. Как именно компании закупают миллионы томов – оставалось за кадром. Этот пробел начали заполнять журналисты из 404 Media в начале 2026 года. Они обнаружили, что ISBNdb – компания, известная прежде как база метаданных для ISBN-номеров – начала рекламировать услуги по организации массовых закупок печатных книг для AI-лабораторий. На сайте значилось: сервис рассчитан на «нужды обучения LLM» и «доставляет в масштабах, которых требует AI», объёмы – от 1000 до миллиона книг. Страницы с этим предложением впоследствии удалили. ISBNdb заявила Fortune, что сервис так и не был запущен, а страницы отражали «исследовательскую концепцию», а не реальный бизнес.
Похожие истории всплыли в Германии и Швейцарии. Местные СМИ сообщали о букинистах, получавших необычные оптовые заказы на узкоспециализированные книги – явно не для перепродажи коллекционерам. Канадская компания Zoom Books, упомянутая в ряде репортажей, отвергла обвинения и объяснила закупки своей обычной бизнес-моделью переработки и торговли.
Запрос в Harlem – лишь один узел в этой сети. Компания 2077AI на запросы Fortune не ответила. Для чего предназначались 3001 книга – официально неизвестно.
Казалось бы, история про букиниста из Харлема – далеко от повседневных задач маркетолога или владельца бизнеса. Но связь прямая. Языковые модели, которые сегодня генерируют тексты, пишут посты и отвечают на вопросы клиентов, обучались в том числе на этих книгах. Академические издательства Emerald, Elsevier, Wiley – это не художественная литература. Это структурированные знания: бизнес, медицина, инженерия, публичная политика. Именно такие данные делают модели полезными в профессиональных контекстах.
Понимание того, на чём именно обучены инструменты, которыми вы пользуетесь, меняет угол зрения. Автоматический блог с ИИ или контент-завод на ИИ работают на моделях, которые «читали» миллионы книг – буквально. В этом смысле скупка книг для AI – не абстрактный юридический вопрос, а часть технического фундамента под инструментами, которые уже внедряют в бизнес-процессы.

Антикварная торговля почти не пострадала – де Врис сам признал, что для его бизнеса инцидент прошёл незаметно. Другое дело – продавцы подержанных книг, работающие с большими объёмами. Для них подобный спрос теоретически мог бы быть существенным – если бы запросы не выглядели так подозрительно.
Более широкая картина такова: AI-индустрия создаёт физическую цепочку поставок данных. Это не метафора. Книги покупаются, режутся, сканируются и выбрасываются – в промышленных масштабах. Суд сказал, что это законно. Этическая дискуссия о том, что происходит с культурными объектами и авторскими правами в эпоху foundation model, только начинается.
Издательский рынок следит за этим пристально. Ряд авторов и издательств уже судится с AI-компаниями по другим основаниям. Решение по делу Anthropic создало прецедент, но не закрыло вопрос навсегда – законодательство в этой области нигде не устоялось.
История Питера де Вриса хороша тем, что делает абстрактное конкретным. «Обучающие данные» – это не облако где-то в серверной. Это 3001 книга в таблице Excel, отправленная на адрес букиниста в Харлеме с просьбой рассчитать доставку в Китай. Где-то – аналогичные таблицы с тысячами других ISBN, другие бухгалтеры, другие склады.
Те, кто строит бизнес на AI-инструментах, – в маркетинге, контенте, аналитике – работают с результатами этого процесса каждый день. Кейс авто-блога на Claude показывает, как это выглядит на практике: модель, обученная на огромных массивах текста (включая, по всей видимости, академические издания из таких вот списков), генерирует SEO-статьи для нишевого бизнеса. Цепочка от срезанного корешка до опубликованного поста длиннее, чем кажется.
Скупка книг для AI – это не конспирология и не паника. Это просто бизнес-процесс, который только сейчас становится видимым. Букинисты в Нидерландах, Германии и Швейцарии случайно стали свидетелями того, как именно устроена «кухня» языковых моделей на уровне физических поставок. Полезно об этом знать – хотя бы для того, чтобы понимать, что покупаешь, когда подключаешь ИИ-автоматизацию к своему контенту.
