多机构联名敦促FTC彻查AI企业书籍数据获取方式

据BlockBeats援引Axios报道,8月22日,超过十家非政府组织共同致函美国联邦贸易委员会,呼吁对主要人工智能企业采购、扫描并销毁纸质书籍以用于模型训练的做法展开正式调查。这些组织将相关操作定性为具有破坏性的数据采集手段。

头部企业被指涉嫌系统性版权侵权

法院文件显示,Anthropic曾投入数百万美元购入大量图书,通过拆解书脊、逐页扫描的方式完成数字化处理,用于提升Claude模型的语义理解能力。与此同时,Google、Microsoft及OpenAI亦面临类似集体诉讼,指控其在未获授权情况下大规模使用受版权保护的内容进行训练。

担忧永久损毁文献遗产并加剧技术垄断

相关组织强调,此类行为不仅可能造成稀有或绝版书籍的物理消失,更会形成由少数科技巨头主导的数据壁垒,使新进入者难以获得同等质量的训练资源,从而扭曲市场竞争格局。