快讯 23:58无问芯穹与华环电子签署战略合作,共同探索国产异构算力AI基础设施新方向23:48日本游戏业AI渗透率飙升至85.8%,超六成开发者每日使用23:28特斯拉Optimus量产审厂启动 供应链企业回应进展 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期六 · 09-19 00:11 约 1 分钟读完

微软内部文件曝光:AI训练数据被指人类史上最大规模劳动盗窃

摘要

微软应用科学总监Brent Hecht在内部文件中警告,抓取新闻内容训练AI可能是人类历史上最大规模的劳动盗窃,不属合理使用。数据显示部分新闻出版商网站点击率下降高达93%,OpenAI爬虫还被曝绕过《纽约时报》付费墙。

微软内部文件披露,该公司应用科学总监Brent Hecht对当前AI训练数据的获取方式提出了严厉批评。他指出,抓取新闻内容用于训练AI模型的行为,可能构成了人类历史上规模最大的劳动盗窃。Hecht明确表示,这种做法并不属于合理使用范畴,而是对合理使用理念的彻底嘲弄。

微软的另一份内部文件进一步分析了这种做法的潜在后果,认为它会形成一个“恶性循环”,对AI模型和整个Web生态同时造成伤害。文件特别提到,OpenAI的产品如ChatGPT可能会危及新闻出版商的经济基础。这一预测已得到OpenAI和微软双方数据的印证。

数据层面,微软的统计显示,部分新闻出版商网站的点击率下降了83%至93%,而其他新闻机构的点击率降幅也在51%至94%之间。Hecht在文件中承认,“几乎没有人希望自己创作的内容被以这种方式使用,也没有人因此获得报酬。”

值得注意的是,微软CEO萨提亚·纳德拉在作证时曾表示,AI公司不应通过绕过付费墙来违反新闻网站的使用条款。然而,OpenAI的内部信息显示,当一名员工向总裁Greg Brockman报告OpenAI爬虫找到了绕过《纽约时报》付费墙的漏洞时,Brockman的回应是“好极了”。

微软OpenAIAI训练数据新闻版权
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
41
企业落地案例
5
完整版提示词