【核心提要】
【正文报道】
近日,媒体机构 404 Media 发布了一项令人关注的调查报告,揭露了亚马逊(Amazon)在为人工智能模型获取训练数据过程中采取的极端手段。调查显示,亚马逊正在大规模采购纸质书籍,并在将其内容数字化后对原书进行物理销毁。
为了查明真相,404 Media 的调查人员在一部疑似会被 AI 公司收购作为训练数据的珍稀书籍中放入了 Apple AirTag 追踪设备。随着定位信号的移动,该书最终被追踪到位于内华达州拉斯维加斯(Las Vegas)的一个亚马逊仓库。
据现场工作人员透露,该仓库专门负责处理大量印刷出版物。其核心工作流程包括:接收大批量的纸质书籍、拆开书脊并快速扫描每一页内容。在完成数字化扫描后,这些实体书籍会被立即销毁。这一过程表明,亚马逊的目标并非流通或收藏这些书籍,而是将其作为获取高质量训练语料的“原材料”。
该处理环节由一个名为“VGT3”的特定团队负责。据报道,该团队拥有一个独特的标识:一只张开嘴巴、手里拿着一本书的恐龙图案。这一高度组织化的操作模式反映出亚马逊在构建 AI 模型时,对高质量人类创作内容的渴求之大,以至于不惜采取这种破坏性手段来获取数据。
此举引发了关于版权保护与文化遗产保存的广泛讨论。随着生成式人工智能(Generative AI)的快速发展,科技巨头为了喂养模型,正不断寻找新的数据源。然而,通过大规模购买并摧毁实体书籍来获取内容,不仅涉及复杂的知识产权问题,也引发了公众对于文化遗产被“工业化榨取”的担忧。
【小编观点】 此次调查揭示了当前 AI 竞赛中一种残酷的现实:在数据饥渴的时代,物理世界的文化载体正被视为可消耗的数字原材料。亚马逊这种“扫描即销毁”的做法,反映出科技巨头在追求技术突破时,往往会将版权保护与内容完整性置于次要地位。这不仅是技术的博弈,更是关于人类知识产权如何被新技术重塑的法律与伦理挑战。
背景链接:
暂无回复,快来抢沙发吧!
本次需消耗银元:
100
当前账户余额: 0 银元
【核心提要】
【正文报道】
近日,媒体机构 404 Media 发布了一项令人关注的调查报告,揭露了亚马逊(Amazon)在为人工智能模型获取训练数据过程中采取的极端手段。调查显示,亚马逊正在大规模采购纸质书籍,并在将其内容数字化后对原书进行物理销毁。
为了查明真相,404 Media 的调查人员在一部疑似会被 AI 公司收购作为训练数据的珍稀书籍中放入了 Apple AirTag 追踪设备。随着定位信号的移动,该书最终被追踪到位于内华达州拉斯维加斯(Las Vegas)的一个亚马逊仓库。
据现场工作人员透露,该仓库专门负责处理大量印刷出版物。其核心工作流程包括:接收大批量的纸质书籍、拆开书脊并快速扫描每一页内容。在完成数字化扫描后,这些实体书籍会被立即销毁。这一过程表明,亚马逊的目标并非流通或收藏这些书籍,而是将其作为获取高质量训练语料的“原材料”。
该处理环节由一个名为“VGT3”的特定团队负责。据报道,该团队拥有一个独特的标识:一只张开嘴巴、手里拿着一本书的恐龙图案。这一高度组织化的操作模式反映出亚马逊在构建 AI 模型时,对高质量人类创作内容的渴求之大,以至于不惜采取这种破坏性手段来获取数据。
此举引发了关于版权保护与文化遗产保存的广泛讨论。随着生成式人工智能(Generative AI)的快速发展,科技巨头为了喂养模型,正不断寻找新的数据源。然而,通过大规模购买并摧毁实体书籍来获取内容,不仅涉及复杂的知识产权问题,也引发了公众对于文化遗产被“工业化榨取”的担忧。
【小编观点】
此次调查揭示了当前 AI 竞赛中一种残酷的现实:在数据饥渴的时代,物理世界的文化载体正被视为可消耗的数字原材料。亚马逊这种“扫描即销毁”的做法,反映出科技巨头在追求技术突破时,往往会将版权保护与内容完整性置于次要地位。这不仅是技术的博弈,更是关于人类知识产权如何被新技术重塑的法律与伦理挑战。
背景链接: