🐟 (@stevessr) 在 AI 公司正在购买古籍,扫描,然后毁掉 中发帖
[!quote]+
对于构建大型语言模型的人来说,书籍不过是被大量吞噬后像鱼骨一样吐出的饲料。他们通常乐于使用数字书籍——或者更好的是盗版数字书籍,正如Meta被指控的那样,Anthropic也被迫向作者支付15亿美元赔偿金。
但包括Anthropic在内的许多公司,已经转向购买实体书,他们可以以低价购买无数二手书。根据和解诉讼,Anthropic使用液压驱动切割机整齐地从图书经销商处采购书籍的页面,然后用工业级成像设备扫描。换句话说,它实际上是在剽窃作者的书籍来训练它的人工智能。
这一过程利用了一种被称为首次销售原则的法律概念,该原则允许买家在未经原版权持有人同意的情况下随意处理购买。由于Anthropic将原始实体文本转化为数字文本,而非重新分发为新副本,法官认定此举具有“变革性”,因此受合理使用保护。
正如*404 Media*报道的,如今这种做法已经普遍存在,甚至连知...