9月18日消息,据《纽约时报》报道,新解封的法庭文件显示,微软及其紧密合作伙伴 OpenAI 内部,对于利用数百万篇新闻文章训练人工智能系统一事存在相当大的担忧。
就在 OpenAI 大力推进相关工作之际,微软员工展开辩论:OpenAI 此举是否构成“人类历史上最大规模的劳动窃取”,还会不会形成一个“死亡循环”,最终反噬他们正在搭建的大语言模型本身。
一份 2023 年微软内部文件写道:“全球数百万人很快就会认为,大模型把所有人的创作成果一股脑搜刮走,这是一场前所未有的惊人盗窃。”
在 OpenAI 内部同样存有顾虑:ChatGPT 聊天机器人有可能让用户不再去阅读原版新闻。2023 年 6 月,ChatGPT 项目负责人尼克・特利在一份备忘录中提出,人工智能对新闻出版商构成了“生存层面的威胁”。2024 年 2 月,他又写道,AI 产品 “性能越强,替代性就越强”。
这些内部讨论片段于周四对外公开,源于一桩备受关注的诉讼:《纽约时报》于 2023 年末起诉 OpenAI 与微软,另有 11 家出版商后续加入诉讼。美国纽约南区联邦地区法院法官西德尼・斯坦正在审议双方提出的简易判决动议。随着法官审阅动议材料,案件相关文件正逐步解封。
出版商一方主张,科技企业未经许可、不支付报酬,从互联网及各类数据库抓取数以百万计新闻稿件文本用于训练高级 AI 系统,此举违反版权法。
微软与 OpenAI 则抗辩,他们的行为属于版权材料受法律保护的“合理使用”范畴。两家企业表示,AI 已经对新闻文本做充分转化,生成了全新内容,并非会损害原作价值的替代品。
微软发言人亚历克斯・豪瑞克发表声明称,这份由微软应用科学总监布伦特・赫奇特撰写的内部备忘录,并不代表公司立场。
谈及微软 AI 助手 Copilot,他表示:“微软立场已经写进法庭文书当中,文书阐明这类转化性使用符合版权法律,Copilot 并不会替代新闻出版商的新闻作品。”
OpenAI 方面没有回应置评请求。
另一份诉讼材料提到,赫奇特同时是西北大学的科研学者,并非企业决策人员;微软聘用他,目的就是“提供多元化、非同质化视角”。
代理《纽约每日新闻》等八家报社参与本案的律师史蒂文・利伯曼表示:“这些文件让世人看清,OpenAI 和微软内心究竟如何看待自身行为是否公平。”《纽约时报》拒绝发表评论。
新闻企业还指出,OpenAI 专门开发工具绕过出版商设置的付费墙。文件披露,一名员工致信 OpenAI 总裁格雷格・布罗克曼,告知自己正在开发一个“绕过纽约时报付费墙的破解手段”,布罗克曼回复:“哇,不错。”
微软首席执行官萨提亚・纳德拉在律师取证笔录中称:“任何设置付费墙的内容,如果要使用就应当获得授权许可。”他还说,如果当时知晓 OpenAI 抓取付费墙内内容用于模型训练,微软本可以行使权利,要求 OpenAI 重新训练模型。
微软发言人豪瑞克解释,纳德拉这番表述只是谈及宏观原则,以及当下人们获取、消费信息正在发生的变化。
文件揭示,两家公司内部都担忧:如果新闻作品被随意取用,整个新闻行业或将难以为继。赫奇特写道,大 AI 模型 “是一款正在摧毁自身供应链的产品”。
解封文件显示,OpenAI 内部也有人对拷贝新闻稿件心存疑虑。2020 年,时任 OpenAI 政策主管杰克・克拉克向布罗克曼以及首席执行官山姆・奥特曼提交备忘录。克拉克后来离职并联合创立 Anthropic,他在备忘录中警告,这家初创公司所做的工作 “会越来越多地造出各类系统,替代那些塑造社会文化的从业者劳动成果”。
克拉克警示:“OpenAI 或将成为一个符号,代表硅谷鲁莽闯入其他行业,留下一地烂摊子。”(Anthropic 将媒体置评请求转交 OpenAI 处理)
文件还披露,ChatGPT 并不会引导用户去阅读出版商的原文报道。2023 年 2 月,一名 OpenAI 软件工程师给同事写道:“无论我们把链接放得多么醒目,用户都不会点开。”
OpenAI 员工特利直言:AI 产品本质上就是具备替代性,仅此而已。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.