書店に「3000冊の発注」、AI企業が古書を買いあさる? Anthropicも数百万冊をスキャン・破棄 実態明らかに
記事のポイント
📰ニュース
AI企業が学習データ収集のため、古書を大量に購入・スキャンし、その後破棄している実態が判明しました。
🔍注目ポイント
AIモデルの性能向上には膨大なテキストデータが必要であり、その確保のために古書が活用されています。
🔮これからどうなる
AI学習データの需要増大により、古書市場や著作権のあり方に新たな課題が生じる可能性があります。
オランダの古書店に中国のAI企業から3000冊の注文が入った事例や、Anthropicが数百万冊をスキャン後に破棄していることが報じられました。
これは、AIモデルの学習に利用できる公開データが不足し、企業が独自にデータを収集している現状を示しています。
これは、AIモデルの学習に利用できる公開データが不足し、企業が独自にデータを収集している現状を示しています。
AIの進化には大量のデータが必要で、古書がその源になっているんですね。著作権や環境への配慮が今後の課題になりそうです。私たちの読書体験にも影響があるかもしれませんね。