据 TechCrunch 报道,最新公开的未删节法庭文件显示,一名微软高管曾将 AI 抓取描述为"人类历史上最大的劳动窃取"。该表述在早先版本的文件中处于被遮盖状态,随着未删节版本披露才进入公众视野。
这一说法值得关注,原因主要有两点。
其一,它出自一家正在大规模推进 AI 业务的科技巨头内部。长期以来,内容创作者、出版商、开发者与开源社区批评 AI 公司未经授权抓取作品用于模型训练,而企业方通常以"合理使用""公开可获取"等框架回应。内部出现"最大规模的劳动窃取"这样直接的定性,说明相关张力并非只存在于外部批评者之中。
其二,在诉讼语境下,企业内部沟通的措辞常被当作"主观认知"证据使用。若企业自身文件显示其对数据获取方式的争议有清楚认识,原告方往往会据此主张对方并非无意侵权。这也是未删节文件公开后迅速引发讨论的直接原因。
对 AI 从业者而言,这一事件再次提示:训练数据的来源合规、授权链条与内部沟通记录,正在成为实质性风险点。随着相关法律程序推进,企业在数据采集与模型训练环节的文档留存和合规审查,可能面临更严格的审视。
目前尚不清楚该表述的具体语境与所指对象,TechCrunch 的报道基于新公开的法庭文件内容。
