7月28日,多家AI公司通过中间商大规模收购二手图书,以获取高质量训练数据用于训练AI模型。这些公司寻求的主要是2022年之前出版的纸质书籍,因为这些内容更有可能是原创作品,尚未受到AI生成内容的污染。AI公司利用纸质图书训练模型已有先例,如Anthropic曾投入数百万美元购买大量纸质图书,用于提取内容训练ClaudeAI模型,随后再将这些图书销毁。
近期,一个出版商联盟已对
谷歌提起诉讼,指控其未经授权使用数百万本受版权保护的图书训练GeminiAI模型。随着AI行业迅速发展,拥有超过1.11亿本图书目录信息的在线数据库ISBNdb也开始调整业务方向,推出专门面向AI企业的大规模图书采购服务。相关订单规模从一次采购1000本到一次采购100万本不等。一位不愿透露姓名的职业书商表示,今年4月以来,图书销量出现了前所未有的增长。
这种做法也引发了越来越多的伦理争议。批评者认为,目前尚不清楚AI公司在数字化过程中,是否会区分普通图书与珍贵图书、绝版图书。如果这些稀有书籍被拆毁,它们可能将永久退出流通。另一个更大的问题在于,这些扫描后的内容最终都会进入AI公司的私有数据库,仅用于训练AI,而普通公众无法访问。这意味着,人们或许能够获得更加智能的AI,但代价可能是,人类积累的大量知识资源将不再以公开、可获取的形式留给未来世代。
来源:一电快讯
返回第一电动网首页 >
以上内容由AI创作,如有问题请联系admin#d1ev.com(#替换成@)沟通,AI创作内容并不代表第一电动网(www.d1ev.com)立场。
文中图片源自互联网或AI创作,如有侵权请联系邮件删除。