日販がAIに本を大量販売。SEOの次に始まる「AIの知識を買い取る競争」と、見えない情報操作
先日、日本の出版取次大手・日本出版販売(日販)が、生成AI「Claude」を開発する米アンソロピックに大量の書籍を販売していたことが判明し、大きな注目を集めた。紙の書籍をデータへ変換し、モデル学習に利用することをめぐっては、著作権上の議論が続いている。もちろん、それ自体が重要な問題だ。だが、そのさらに先には別の問題がある。
◆SEOの次に来るもの
インターネットには、検索エンジンの登場とともにSEOという巨大な産業が生まれた。自社の商品やサービスを検索結果の上位に表示させるため、企業は文章を書き換え、サイトを作り、外部からリンクを集めてきた。
生成AIでも、すでに同じ競争が始まっている。2023年に公開され、2024年の国際会議KDDで発表された、プリンストン大学などの研究者による論文は、この新しい最適化を「Generative Engine Optimization(GEO)」と名付けた。引用の追加や統計データの提示といった手法により、AI回答内での可視性を最大40%程度高められると報告している。
日本では「LLMO(Large Language Model Optimization)」という呼称も使われている。ChatGPTやClaudeなどが、自社や自社の商品、情報をどう認識し、引用し、推薦するかを最適化しようという発想だ。呼称自体はGEO・AEO・LLMOと乱立しており、業界内でもまだ統一されていないが、狙いはどれも同じ場所に集まっている。検索順位ではなく、AIが返す「答え」の中身そのものだ。
SEOが「検索結果のどこに出るか」を争い、LLMOが「AIの回答にどう取り上げられるか」を争うものだとすれば、そのさらに上流には「AIがそもそも何を知識として取り込むか」という段階がある。検索順位を取り合う時代から、回答を取り合う時代へ。その先に、その先に、AIの「知識の仕入れ」をめぐる競争まで生まれるのだろうか。
現時点で、企業が日販のような取次を通じて意図的に学習データを操作しているという証拠はない。しかし、書籍を大量に調達してAIに読み込ませる市場がすでに現実になった一方で、AIの回答に自社の情報を入り込ませようとする競争もすでに始まっている。この二つが接近したとき、何が起こるのか。
