#人工智能 纽约时报展示的法庭文件显示,微软高管称 OpenAI 爬虫造成人类历史上最大规模的劳动力盗窃,而且可能造成恶性循环。OpenAI 抓取海量内容但不向出版社付费,这会导致出版社没有足够的资金继续撰写高质量内容。ChatGPT 负责人也称抓取行为对出版商构成生存威胁,而 OpenAI 总裁布罗克曼明知道员工使用技术手段绕过付费墙抓取内容,但还采取鼓励的态度。查看全文:https://ourl.co/126960
纽约时报日前发布报道揭示微软对 OpenAI 非法获取内容训练人工智能技术的担忧,微软高管称 OpenAI 的数据爬虫造成人类历史上最大规模的劳动力盗窃,这种行为还可能会引起恶性循环,即出版商 (网站和作家等) 无法获得足够的资金用于继续撰写高质量内容。
纽约时报引用的内容并非采访而是微软高管在法庭文件中的说明,这些法庭文件属于纽约时报起诉微软和 OpenAI 的侵权案件。目前仅部分法庭文件内容被公布,暂时没有文件全文以及其他必要的背景信息(即不知道微软高管在什么情况下说出这种话的,考虑到纽约时报的名声,可能得综合文件全文来看微软高管想要表达的意思)。
在法庭文件中微软应用科学总监布伦特・赫克特博士称,OpenAI 抓取数据的工作类似于人类历史上最大规模的劳动力盗窃,这种行为可能会造成恶性循环。而 OpenAI 副总裁兼 ChatGPT 领导尼克・特利则表示,抓取行为对出版商构成生存威胁。
纽约时报和其他作者、出版商认为大型科技公司未经许可或支付任何费用就从互联网上抓取海量数据用来训练模型,这违反版权法以及给出版商造成生存危机,因为出版商无法获得足够的资金支持持续运营。
OpenAI 不知道版权问题?当然知道,还绕过付费墙:
法庭文件还提到 OpenAI 及其合作伙伴明知道侵权但仍然继续获取数据,例如 OpenAI 使用技术手段绕过网站设置的付费墙并抓取内容,抓取的付费内容还会被清洗包括删除版权声明来构建超大规模的训练数据集。
OpenAI 高管不仅知道这是侵权行为,而且对员工绕过付费墙抓取数据采取鼓励措施:格雷格・布罗克曼是 OpenAI 联合创始人兼总裁,有员工发邮件告诉布罗克曼称自己找到新的付费墙攻击方式时,布洛克曼回复称啊不错。
另外 OpenAI 也知道在 AI 回答里添加来源链接也没人点击,OpenAI 某软件工程师在 2023 年告诉同事:无论我们如何醒目地展示链接用户都不会点击。尼克・特利则称人工智能产品在很大程度上可以替代新闻业。






