Новости
Цифровой Левиафан: как AI-корпорации пожирают книжное наследие человечества

Центральным звеном скандала стала компания ISBNdb, владеющая базой данных более чем 111 миллионов книг. Долгое время она помогала библиотекам и книготорговцам, но с бумом генеративного ИИ переориентировалась на новую аудиторию. Сегодня ISBNdb предлагает AI-лабораториям услуги по анонимной оптовой закупке печатных книг — от 1000 до 1 миллиона экземпляров за один заказ.
На своём сайте компания прямо заявляет: «Лучшие в мире данные для обучения ИИ пылятся на полке». В рекламных материалах поясняется: печатные книги, изданные до 2022 года, гарантированно не содержат сгенерированного AI-текста («AI slop») и не подвержены «отравлению данных» (data poisoning). При этом ISBNdb признаёт: «Проблема имиджа реальна. Заголовок "AI-компания уничтожает два миллиона книг" не вызывает сочувствия». Каждый заказ сопровождается строгим соглашением о неразглашении (NDA), скрывающим личность покупателя.
«Проект Панама»: как Anthropic добывала книги
Наиболее задокументированный случай связан с компанией Anthropic, разработчиком модели Claude. В рамках так называемого «Проекта Панама» (Project Panama) компания потратила десятки миллионов долларов на закупку физических книг. По данным The Washington Post, основанным на анализе более 4000 страниц судебных документов, Anthropic закупала книги у Better World Books и других букинистов.
Один из внутренних документов компании содержал формулировку: «"Проект Панама" — это наша попытка деструктивно отсканировать все книги в мире». В том же документе отмечалось: «Мы не хотим, чтобы стало известно, что мы работаем над этим». Внутренняя переписка Anthropic, вскрытая в ходе судебного разбирательства, свидетельствует, что в компании осознавали репутационные риски и обсуждали, как преподнести эту информацию публике.
Процесс выглядел следующим образом: гидравлическая машина срезала корешки книг, после чего страницы прогонялись через промышленные скоростные сканеры, а физические оригиналы отправлялись в переработку. Один из букинистов, опрошенных 404 Media, опасается, что книги, пережившие войны, пожары и века обращения, теперь уничтожаются в ходе «деструктивного сканирования».
Юридический парадокс: fair use и 1,5 миллиарда
В июне 2025 года судья Уильям Алсуп вынес решение по делу Bartz v. Anthropic, которое стало поворотным для всей индустрии. Судья постановил, что использование законно приобретённыхкниг для деструктивного сканирования и обучения LLM является добросовестным использованием (fair use). Алсуп назвал это «одним из самых трансформативных видов использования, которые мы увидим за свою жизнь».
Однако одновременно судья отклонил защиту Anthropic в отношении пиратских копий. Суд установил, что Anthropic загрузила более 7 миллионов пиратских книг из теневых библиотек LibGen и PiLiMi, создав «центральную библиотеку», которая не обязательно использовалась для обучения AI. Пиратство, по словам судьи, является «по своей сути, безнадёжно нарушающим авторские права».
В июле 2026 года судья Арасели Мартинес-Ольгин утвердила класс-акшн урегулирование на 1,5 миллиарда долларов — крупнейшее известное урегулирование по авторскому праву в истории США. Соглашение покрывает около 491 000 произведений, выплачивая авторам и издателям примерно по 3000 долларов за книгу. Более 91% авторов и издателей, охваченных соглашением, уже заявили о своих правах на выплату.
Anthropic отрицает какую-либо неправомерность. Заместитель генерального юрисконсульта компании Апарна Шридхар заявила: «Мы достигли этого урегулирования в 2025 году, после знакового решения суда о том, что обучение AI на книгах является добросовестным использованием в соответствии с авторским правом — и это остаётся законом сегодня».
Таким образом, сложилась парадоксальная ситуация: покупать и деструктивно сканировать — законно (fair use); воровать — платить 1,5 миллиарда.
Масштаб бедствия: европейский фронт
Расследование 404 Media выявило системный характер явления, выходящий далеко за пределы США. Немецкие букинисты сообщают о заказах на суммы от 10 000 до 50 000 евро. Заказы поступают в основном от канадской компании Zoom Books, которая, по данным СМИ, фокусируется на нехудожественной и академической литературе, изданной в 1970-х годах.
Однако Zoom Books категорически отрицает свою причастность к уничтожению книг для обучения AI. В официальном заявлении компания подчеркнула: «Чтобы быть абсолютно ясными: Zoom Books не оцифровывает и не уничтожает подержанные или новые книги с целью обучения AI-моделей и не делает этого для каких-либо других целей».
Томас Кох, пресс-секретарь Немецкой ассоциации книгоиздателей и книготорговцев, назвал происходящее «очевидным и серьёзным нарушением авторских прав». Однако он признал, что «такие нарушения трудно доказать, поскольку не существует требований прозрачности, которые обязывали бы указывать источники для ввода данных в AI».
В Европейском союзе действует иной правовой режим. Директива о цифровом едином рынке (2019) разрешает текстовый и data mining (статья 4), но предоставляет правообладателям механизм opt-out — возможность зарезервировать свои права и запретить использование произведений для обучения AI. В июле 2026 года Европейская комиссия опубликовала исследование о создании общеевропейского реестра для таких отказов. Как отметил Кох, «решения судов сами по себе не могут разрешить растущий конфликт между издательской индустрией и AI-разработчиками».
Реакция Маска: контрастный удар
На фоне разгорающегося скандала Илон Маск публично дистанцировался от практики уничтожения книг. В ответ на пост пользователя Hedgie он написал в X: «Я попросил команду SpaceXAI сохранять любые редкие книги в библиотеке и сканировать их старомодным способом, а не просто срезать корешки и сканировать».
Маск подтвердил, что SpaceXAI будет использовать неразрушающие методы сканирования(планшетные и V-образные сканеры), даже если это требует больше времени и средств. Пользователь Hedgie в ответ заметил, что дополнительные расходы на щадящее сканирование — «копейки» на фоне миллиардных бюджетов, и если SpaceXAI выполнит обещание, это станет стандартом, которому должна следовать вся индустрия.
Экспертные опасения: редкие книги под угрозой
Особую тревогу вызывает судьба редких и малотиражных изданий. Петиция на платформе Change.org, адресованная ISBNdb, предупреждает: «Многие из этих книг существуют всего в нескольких сотнях экземпляров по всему миру. Некоторые — в нескольких десятках. Монография регионального издательства, самиздатовская местная история, переведённое техническое руководство от обанкротившегося издателя: как только уцелевшие экземпляры разрезаны, объект исчезает навсегда».
Петиция требует от ISBNdb:
прекратить брокерскую продажу редких, малотиражных и вышедших из печати книг в «деструктивные сканерные конвейеры»;
проверять тиражи по реестрам WorldCat/OCLC перед выполнением массовых заказов;
требовать условия о неразрушающем сканировании для каждой оптовой продажи.
Авторы петиции подчёркивают: «Оцифровка не равно сохранению. Цифровые суррогаты, хранящиеся в частном порядке, — это не архив. Это корпоративный актив с ограниченным сроком годности».
Важно отметить: судебные документы не подтверждают целенаправленное уничтожение именно редких или уникальных экземпляров. Опасения экспертов обоснованны, но на данный момент остаются гипотезой, а не доказанным фактом. Расследование 404 Media показывает, что AI-компании скупают книги массово и оптом, но нет свидетельств целенаправленной охоты на антиквариат.
Заключение
То, что происходит сегодня, — это не просто технологический спор. Это фундаментальный этический конфликт между утилитарной логикой технокорпораций и обязанностью сохранять культурное наследие. Юридическая легитимность «деструктивного сканирования» не отменяет его моральной несостоятельности.
Когда гидравлический пресс срезает корешок последнего экземпляра редкой книги, исчезает не просто бумажный носитель — исчезает гарантия того, что эти тексты, эти мысли, эта память продолжат существовать в мире. Оцифровка в закрытый корпус данных — это не сохранение. Как справедливо отмечают авторы петиции: «Санированные резюме (в лучшем случае) — это не книга. Они не сохраняют маргиналии, провенанс, переплёты, бумагу, варианты печати, вложенные эфемеры или физические свидетельства, на которые полагаются книжные историки, библиографы и реставраторы».
Юристы говорят, что это законно. Акционеры — что это эффективно. Инженеры — что это неизбежно. А историки и библиотекари молчат — потому что книги, которые они хранили веками, превращаются в бинарный код и исчезают в облаках частных корпораций. Рэй Брэдбери ошибался: книги сжигают не пожарные, их перерабатывают на макулатуру во имя прогресса, и мы аплодируем GPT-ответам, не замечая, как исчезает наша память.
Список использованных источников
404 Media. AI Companies Are Buying Tons of Old Books Because They're Free of AI Slop. URL: https://www.404media.co/ai-companies-are-buying-tons-of-old-books-because-theyre-free-of-ai-slop/ (дата обращения: 29.07.2026).
Reuters. US judge approves Anthropic's $1.5 billion settlement of copyright lawsuit. URL: https://www.reuters.com/world/us-judge-approves-anthropics-15-billion-settlement-copyright-lawsuit-2026-07-20/ (дата обращения: 29.07.2026).
Associated Press. Judge approves a $1.5B Anthropic settlement over pirated books used to train the Claude chatbot. URL: https://apnews.com/article/ai-anthropic-copyright-settlement-claude-books-bartz-74b140444023898aeba8579b6e9f0d63 (дата обращения: 29.07.2026).
Ropes & Gray LLP. Anthropic's Landmark Copyright Settlement: Implications for AI Developers and Enterprise Users. URL: https://www.ropesgray.com/en/insights/alerts/2025/09/anthropics-landmark-copyright-settlement-implications-for-ai-developers-and-enterprise-users (дата обращения: 29.07.2026).
The Boston Globe. Inside a tech company's secretive plan to destroy millions of books. URL: https://www.bostonglobe.com/2026/01/27/nation/silicon-valley-plan-destroy-books/ (дата обращения: 29.07.2026).
NZZ. Kaufen, scannen, vernichten: warum KI-Firmen gebrauchte Bücher aufkaufen. URL: https://www.nzz.ch/feuilleton/buecher/kaufen-scannen-vernichten-ki-firmen-fuettern-ihre-sprachmodelle-mit-gebrauchten-buechern-ld.10017272 (дата обращения: 29.07.2026).
Anadolu Ajansı. 'Clear and serious violation': Europe's book market caught in AI copyright battle. URL: https://mobil.aa.com.tr/en/europe/-clear-and-serious-violation-europes-book-market-caught-in-ai-copyright-battle/4004630 (дата обращения: 29.07.2026).
Publishers Lunch. Zoom Books Responds To Accusations of Selling Books For AI Scraping. URL: https://lunch.publishersmarketplace.com/2026/05/zoom-books-responds-to-accusations-of-selling-books-for-ai-scraping/ (дата обращения: 29.07.2026).
European Commission. New feasibility study for introducing an EU-level registry of Text and Data Mining opt-out. URL: https://digital-strategy.ec.europa.eu/en/library/new-feasibility-study-introducing-eu-level-registry-text-and-data-mining-opt-out (дата обращения: 29.07.2026).
Change.org. ISBNdb: Save the Archive and Stop Feeding Rare and Out-of-Print Books Into the Shredder. URL: https://www.change.org/p/isbndb-save-the-archive-and-stop-feeding-rare-and-out-of-print-books-into-the-shredder (дата обращения: 29.07.2026).
INSIDE. 快沒存本的絕版書也照碎!AI 公司大買舊書掃完就毀. URL: https://www.inside.com.tw/article/41951-anthropic-destroyed-books-for-ai-training (дата обращения: 29.07.2026).
IT之家. AI 公司被曝大量收购旧书,以获取“纯净”训练素材. URL: https://www.ithome.com/0/982/742.htm (дата обращения: 29.07.2026).