Policy2026-09-18
TechCrunch AI
微软高管内部吐槽:AI抓取是“人类史上最大规模劳动盗窃”
刚解封的一批法庭文件显示,微软一位高管在私下交流中,把AI抓取内容形容为“人类历史上最大规模的劳动盗窃”。文件据称还记录了微软与OpenAI抓取《纽约时报》付费墙内容、用它搭建数据集的过程,并且内部曾警告说,这种做法可能会把出版商彻底掏空。这些材料难得地让人看到:公开场合谈合作、谈创新,私下里对数据来源的担忧却是另一回事。
这场纠纷只是更大一轮法律战的一部分——争议焦点是,用受版权保护的材料训练AI模型,究竟属于合理使用,还是侵权。出版方的说法是,AI公司未经许可、也没有付费,就复制了价值不菲的新闻内容,再拿这些内容去打造有竞争关系的产品。AI公司通常则主张,用公开可得的文本做训练具有“转换性”、也合法;但什么叫“公开可得”,恰恰是双方拉锯的关键点。
微软这位高管的说法,暗示至少行业内部有人清楚这会对创作者造成多大冲击。如果文件内容属实,原告一方就更有理由主张:这些公司明知内容在付费墙后面、也明知可能造成经济损失,还是照用不误。案件顺带还抛出一串问题:AI数据集到底是怎么攒起来的、怎么留档、怎么授权。
即便法院最终允许某些形式的训练,来自舆论和监管的压力,也可能把公司推向更透明的数据交易。对新闻机构来说,结果会决定它们能不能谈出补偿,还是只能靠打官司。对AI开发者来说,这决定着开放网络上还有多少内容能免费拿来训练。这批解封文件,为一场牵涉劳动、版权、竞争和信息未来的争论又加了一层——也提醒人们,乐观的公开表态背后,私下的对话往往对“谁来买单”有着复杂得多的判断。