アマゾン、希少書籍を破壊してAIトレーニングデータを獲得

要約

アマゾンがAIトレーニングのために希少な書籍を破壊しているという報道がありました。アマゾンは、大量の希少本を購入し、その背表紙を切り取ってスキャンすることによって、AIモデルの訓練データを集めています。このプロセスは、404 Mediaによって追跡された希少本がアマゾンのラスベガスの施設に到着したことから明らかになりました。

アマゾンは、顧客が利用する製品やサービスを向上させるために商業ルートを通じて書籍を購入していると述べています。しかし、希少本は特に価値が高く、インターネット上に存在しないか絶版のために手に入らないテキストを提供するため、AIモデルの訓練には有用です。特に、2022年以前に出版されたテキストは、AI生成ではないため、信頼性の高いデータソースとなります。

AIモデルがAI生成テキストを訓練に使用することは「モデル崩壊」を引き起こすリスクがあるため、アマゾンが希少本を利用することは、質の高い訓練データを確保する上で重要です。この動きは、AI技術の進化においてデータの収集方法が変化していることを示しています。


元記事: https://techcrunch.com/2026/08/17/amazon-once-an-online-bookseller-is-destroying-rare-books-to-train-ai-models/

公開日: Mon, 17 Aug 2026 16:38:44 +0000


この記事はAIアシスト編集により作成されています。

📰 元記事: 元記事を読む

コメントする