ROMSEN

2chで話題になったニュースを
短時間で読める まとめサイト

アンソロピック、日本から57.8トン・11万5000冊分の古本を輸入してAIに無断学習、出版社「AI学習は許諾必要」 ★2


【古本 ナゾの大量注文】日本各地で異変…外国人から? 奇妙な動き…AI学習“資源”に? 行方は…『バンキシャ!』

画像




今年7月ごろから、全国で「古本」の大量注文が相次いでいて、日本からアメリカの企業に50トン以上の本が輸出された記録もありました。バンキシャ!が取材すると、海外の企業が“AIに学ばせるため”日本の古本を買い集めている可能性が──。【真相報道バンキシャ!】

■古書の大量注文相次ぐ

26日、バンキシャは長崎県へ向かった。話を聞いたのは30年以上、古書店を営むという男性。今月中旬、都内の企業からメールで古本の注文リストが送られてきたという。

古書店・店主
「最初リストにあったのが153冊でした。結局、お届けしたのが116冊」

──そんな大規模な発注はいままであった?

古書店・店主
「いままでない。初めてです」

注文されたという書籍は、「日本の歴史」や「がんを治すチカラ」「富士山の秘密がわかる本」など、ジャンルはバラバラだ。だが注文にはある“条件”があった。

古書店・店主
「汚くてもいいし、汚れててもいい。ただ資料的な欠損があるものはダメだと。破れてたり、そういうのはダメ」

この店では今年6月以降、こうした大量注文が相次いでいるという。
(略)

アンソロピックは、世界中から集めたとみられる大量の本を、AIに学習させるため裁断してスキャン。
その後、廃棄していたとされる。
このアンソロピックの計画に関わったとされる企業に対し、日本からどれくらいの量の本が輸出されたのか。
輸出入データを分析するツールで調べると……。

バンキシャ!
「57.8トンになります」

すべての本を1冊500グラムだと仮定すると、これはおよそ11万5000冊分になる。
大量の本が日本からアメリカに向けて送られていた。
(略)
また、著作物を無断でAIの学習に使うことに対し、去年、日本漫画家協会や出版社などは、「権利者に必要な許諾を得る」などの対応を求める声明を出している。
https://news.ntv.co.jp/category/society/3cb215d0bc264d4db7a5d2393e3cda71?p=2

「なんで?」3か月で180冊以上…全国各地の古書店で古本の大量注文相次ぐ 海外企業がAI学習に利用か
(前略)
実際、AIに活用するため、本を大量に集めていた企業もありました。
アメリカのAI開発企業・アンソロピック。

これは、アンソロピックが世界中から集めたとみられる大量の本。
これらをAIに学習させるため、裁断してスキャン。その後、廃棄していたとされています。
店主
「裁断されるというのは、本がかわいそうな気がする」
2026/10/1
https://news.ntv.co.jp/n/ytv/category/society/yt25f2f43681504d3db43b8988073ff31d

ネット民のコメント

  • https://video.fc2.com/ja/content/20220228U77Wdv4z

  • ずっと前から『星新一』のショートショートみたいなやつにして。で通じたしちゃんと濃いショートショートつくれたぞ。

  • 日本国内でそんなこと言っても無駄。AI学習のために人類が先に進むために無駄な権利主張で邪魔をするなよ。そういう足枷はいらんのだ

  • これってどうやって読ませてんですか?人間が1ページずつめくって見せてるのかそれ用の機械でもあるのか

  • * 「完全に破滅してはいないけれど、確実に蝕まれている」というこの中途半端な延命状態こそが、人々を「まあ、まだ生きていけるか……」と現状維持の妥協に留まらせる最大の防壁になっています。

  • スキャンするために平気で裁断して、終わったら廃棄するとか、物に対する敬意ってのがないのがよくわかる。

  • いや何ていうか手法は古典のままってのが滑稽というか読み取ってデジタルデータ化みたいな装置の進化はしないんだな…と

  • ほかの世界中の本も買いあさっているのは確実だし 世界で問題になってないなら 止めようがないだろう

  • ちょっと待って、スキャンしているのはアメリカの企業だけど、学習してできる成果の獲得を依頼していたのは日本かもしれない

  • 青空より Anna'sやZ-libに上げてもらうほうが便利かもね。日本語の本のラインナップは酷いもんだし。

  • 何百年も前に誰かが生み出した遺物をAIが効率的にコピーandミックスすることが調査や創作活動と呼ばれるようになるのかなぁ

  • 57.8トン海越して輸入して質量なくして重力から解き放ってOCR日本語テキスト画像情報にしてしまってAIメモリに組み込まれて英訳されて天下取るのだ

  • こりゃー世界中から本が消えて最後の一冊を持ってるキリスト教徒の元ウォルマートの店員のおじさんが聖地を目指して無双していく流れだな

  • いろんなデータ混ざりまくるから無断でやっても学習させたかさせてないかなんて言わなかったらわかりようがないわな

  • それを維持する電力やデータセンターが100年200年先も存続し続けるかと言ったら、かなり怪しいと思うのだが

  • 企業の情報流出はAIの能力の一端な訳で古本の収集がどのように活かされるのか想像付かない所が恐ろしいわ

  • 本の情報には歴史的価値はあるかも知れないけど最新情報じゃないからAIが本を読んで賢くなったかとは言えないよね

  • 人間の小説家とか文筆家とかが本を買ったら学習する可能性があるから許諾が必要だって言った方がいいと思う

  • じゃあ台湾/アメリカ製NVIDIAチップやめて北海道ラピダス製tenstorrentチップで国内データセンター作ってオープンモデルでAIやれば国外に金はいかないよ

  • 実は非破壊スキャンはできるけど裁判所が禁止したから破棄は必須だぞ、実物を残すと本が増える結果になるかりな

  • 前も書いた気がするがこうなると現物の価値は上がる 必要とされる本の数は印刷される本のうちのごく一部だとしても

  • ソニーがATRACやCCCDなどに拘っている間にAppleに負けたように、今度は出版物でムーブメントが

  • 有名どころは警察官の天下りが作った警察向け情報誌や葉梨なんかが関わった本も収蔵されてなかったはず

  • だが今のAIは人間と違ってパクリとオマージュを自分で判断できないので著作権の学習自体を禁じるのが現実的かな

  • そんなことはありません。AIは著作権情報もきっちり管理して法律の範囲内で正確に引用します。あなたの言い方なら膨大な知識を過去に出版された本から得た学者が講演会や教鞭をとって報酬を得るのもグレーですか?

転載元:http://itest.2ch.sc/test/read.cgi/newsplus/1791207156/