智能工具库

纽约时报起诉OpenAI:高管承认AI抓取是‘史上最大盗窃’

纽约时报起诉OpenAI:高管承认AI抓取是‘史上最大盗窃’

在纽约时报诉OpenAI和微软的版权案中,内部文件揭露了双方高管的矛盾言论。微软称AI抓取为‘史上最大盗窃’,OpenAI称其为‘生存威胁’。本文解析这些证据如何动摇AI行业的‘公平使用’辩护,并为开发者提供合规建议。

2026-09-20 0来源:Hacker News (AI)

纽约时报起诉OpenAI:高管承认AI抓取是“史上最大盗窃”

2023年底,纽约时报起诉OpenAI和微软侵犯版权,这场官司至今仍在持续。近日,该案件出现重大进展,纽约时报请求法院对案件作出简易判决,并援引了被告方的一些内部文件。这些文件内容耐人寻味,不仅揭示了OpenAI和微软高层在公开场合与私下言论上的巨大反差,更可能直接动摇了AI行业目前赖以生存的“公平使用”法律辩护。

微软高管的“自曝”:从“繁荣”到“盗窃”

根据《404媒体》报道,纽约时报的诉状中引用了微软应用科学总监布伦特·赫希特(Brent Hecht)的一份内部备忘录。这份日期为2023年1月的文件显得尤为沉重,赫希特在其中直言不讳地指出:

“全世界数百万的人很快会认为,大模型‘吸尘器’般地搜集所有人类工作成果,是一种前所未有规模的惊人盗窃行为。”

他甚至将这种行为定性为**“人类历史上最大的劳动力盗窃”**。

这种说法与微软在宣传中强调的“赋能”形成了鲜明对比。赫希特还提到了一个令人担忧的“死亡循环”效应:AI工具不仅会损害出版商的流量,最终也会反噬大模型自身的性能和整个互联网生态。他警告说:“一种终端产品威胁其关键供应商的经济基础,这非常罕见,但我们正是这种局面——即我们的LLM业务与其‘内容供应链’之间的关系。”

OpenAI的“生存威胁”论调

与微软的担忧类似,OpenAI内部也并非铁板一块。OpenAI聊天GPT负责人尼克·特利(Nick Turley)在内部通信中直言不讳地表示,ChatGPT对出版商而言是一个**“生存威胁”**。

特利认为,AI聊天机器人本质上是一种**“替代性”**产品。随着模型能力的提升,这种替代性会越来越强。更有趣(也更具讽刺意味)的是,另一位OpenAI研究员尼克·赖德(Nick Ryder)在内部聊天中透露自己找到了“绕过纽约时报付费墙的方法”,而公司总裁格雷格·布罗克曼(Greg Brockman)对此回复了“啊,不错”。这一细节在法庭文件中被公开,无疑给OpenAI的辩护理由蒙上了一层阴影。

“公平使用”辩护面临崩塌风险

AI公司目前的辩护核心在于“公平使用”。他们主张从互联网抓取受版权保护的内容用于训练模型,属于“批评、评论、新闻报道、教学、研究”等范畴。法院在判断是否构成公平使用时,通常会考察四个因素:

  1. 使用目的和性质(是否为商业用途);
  2. 受版权作品的性质(创造性作品 vs. 事实性作品);
  3. 使用数量和实质性(使用了多少核心内容);
  4. 使用对潜在市场的影响。

纽约时报的这份诉状中披露的内部备忘录和聊天记录,恰恰直接攻击了第四个因素。既然高管们已经承认这种行为会**“损害出版商的市场价值”并造成“前所未有规模的盗窃”**,那么“公平使用”的辩护逻辑就显得苍白无力。

给开发者的实用启示:合规与伦理

对于广大开发者和AI使用者来说,这一事件不仅是法律新闻,更是技术实践的警钟。虽然我们不能直接引用这些未公开的内部文件作为辩护依据,但我们可以从中吸取经验,优化自己的AI应用开发流程:

  • 警惕“黑盒”抓取:在构建RAG(检索增强生成)应用或训练自定义模型时,应避免大规模、无授权地抓取受版权保护的内容。优先使用合法的数据集(如公共领域数据)或购买授权的数据API。
  • 理解商业逻辑:开发AI产品时,需考虑其对内容创作者的生态影响。如果AI工具直接替代了搜索或付费阅读,必须设计合理的补偿机制或流量引导机制,避免陷入“死亡循环”。
  • 关注法律风向:随着纽约时报案的进展,各国对AI版权的监管将更加严格。开发者应持续关注相关判例,确保产品在合规的框架内运行。

Tags: #人工智能 #版权争议 #OpenAI #微软 #数据抓取

AI

Microsoft data center in Mount Pleasant, Wisconsin

Google Preferred Source

Jowi Morales

本文基于 Hacker News (AI) 的公开内容,由 AI 辅助整理改写后发布。

原标题:Microsoft director: AI scraping 'the largest theft of labor in human history'

阅读原文