【核心提要】
【正文报道】
近日,一份流出的微软内部文件引发了科技界对人工智能(AI)数据获取伦理的广泛讨论。微软应用科学总监 Brent Hecht 在文件中发出严厉警告,称抓取新闻内容来训练 AI 模型是一场“规模空前的盗窃”,甚至可能被视为人类历史上最大规模的“劳动盗窃”。Hecht 明确表示,这种做法并非符合“合理使用”(Fair Use)原则,而是对该法律概念的公然嘲弄。
内部文件进一步指出,这种掠夺式的数据抓取正形成一种“恶性循环”,不仅损害了 AI 模型本身的质量,更在破坏整个互联网生态。随着 ChatGPT 等产品的普及,新闻出版商的经济基础正面临严峻威胁。微软掌握的数据支持这一预测:部分新闻机构网站的点击率(CTR)出现了断崖式下跌,降幅高达 83% 至 93%;而在其他受影响的新闻机构中,点击率下降幅度也在 51% 到 94% 之间。
Hecht 在内部沟通中坦言:“几乎没有人希望自己创作的内容以这种方式被使用,更没有人因此获得报酬。”这一观点反映了内容创作者与 AI 技术巨头之间日益尖锐的矛盾。
然而,在合作关系紧密的微软与 OpenAI 之间,似乎存在着立场上的微妙差异。微软首席执行官纳德拉(Satya Nadella)在公开作证时明确表示,AI 公司不应通过绕过付费墙(Paywall)的方式违反新闻网站的使用条款。与之形成鲜明对比的是,OpenAI 的内部信息显示,当一名员工通知公司总裁 Greg Brockman 时,他们发现爬虫程序成功找到了绕过《纽约时报》(The New York Times)付费墙的漏洞。面对这一情况,Brockman 当时的反应却是“非常好”。
【背景链接】 https://arstechnica.com/tec...
【小编观点】 此次爆出的内部文件揭示了当前 AI 行业一个极其尴尬的现状:技术巨头在享受高质量人类创作内容带来的“数据红利”时,往往在法律和道德边界上游走。微软高层的警告反映了企业在面对版权诉讼风险时的谨慎,而 OpenAI 的内部反应则暴露了技术驱动型公司在追求模型能力时对规则的某种“实用主义”态度。随着监管机构对 AI 训练数据的合法性审查日益严格,这种“拿来的数据”模式迟早会面临严峻的法律挑战。
暂无回复,快来抢沙发吧!
本次需消耗银元:
100
当前账户余额: 0 银元
【核心提要】
【正文报道】
近日,一份流出的微软内部文件引发了科技界对人工智能(AI)数据获取伦理的广泛讨论。微软应用科学总监 Brent Hecht 在文件中发出严厉警告,称抓取新闻内容来训练 AI 模型是一场“规模空前的盗窃”,甚至可能被视为人类历史上最大规模的“劳动盗窃”。Hecht 明确表示,这种做法并非符合“合理使用”(Fair Use)原则,而是对该法律概念的公然嘲弄。
内部文件进一步指出,这种掠夺式的数据抓取正形成一种“恶性循环”,不仅损害了 AI 模型本身的质量,更在破坏整个互联网生态。随着 ChatGPT 等产品的普及,新闻出版商的经济基础正面临严峻威胁。微软掌握的数据支持这一预测:部分新闻机构网站的点击率(CTR)出现了断崖式下跌,降幅高达 83% 至 93%;而在其他受影响的新闻机构中,点击率下降幅度也在 51% 到 94% 之间。
Hecht 在内部沟通中坦言:“几乎没有人希望自己创作的内容以这种方式被使用,更没有人因此获得报酬。”这一观点反映了内容创作者与 AI 技术巨头之间日益尖锐的矛盾。
然而,在合作关系紧密的微软与 OpenAI 之间,似乎存在着立场上的微妙差异。微软首席执行官纳德拉(Satya Nadella)在公开作证时明确表示,AI 公司不应通过绕过付费墙(Paywall)的方式违反新闻网站的使用条款。与之形成鲜明对比的是,OpenAI 的内部信息显示,当一名员工通知公司总裁 Greg Brockman 时,他们发现爬虫程序成功找到了绕过《纽约时报》(The New York Times)付费墙的漏洞。面对这一情况,Brockman 当时的反应却是“非常好”。
【背景链接】
https://arstechnica.com/tec...
【小编观点】
此次爆出的内部文件揭示了当前 AI 行业一个极其尴尬的现状:技术巨头在享受高质量人类创作内容带来的“数据红利”时,往往在法律和道德边界上游走。微软高层的警告反映了企业在面对版权诉讼风险时的谨慎,而 OpenAI 的内部反应则暴露了技术驱动型公司在追求模型能力时对规则的某种“实用主义”态度。随着监管机构对 AI 训练数据的合法性审查日益严格,这种“拿来的数据”模式迟早会面临严峻的法律挑战。