📰較早收集於 10m

紐約時報擴大對 OpenAI 與 Microsoft 的訴訟

PostLinkedIn
📰閱讀原文: New York Times Technology
#copyright#legal-risk#data-governanceopenai-apiopenaimicrosoftthe new york times

💡一項具里程碑意義的法律轉變,可能重新定義 AI 公司獲取訓練數據及管理版權風險的方式。

⚡ 30-Second TL;DR

有什麼變化

紐約時報指控 Microsoft 積極鼓勵 OpenAI 的數據抓取行為

為什麼重要

此案可能為 AI 公司獲取訓練數據的方式建立法律先例,並可能迫使業界轉向使用授權數據集。

下一步行動

審查您的數據導入流程,並確保您擁有所有訓練語料庫的明確授權或使用權。

誰應關注:Founders & Product Leaders

關鍵要點

  • 紐約時報指控 Microsoft 積極鼓勵 OpenAI 的數據抓取行為
  • 訴訟重點在於未經授權使用受版權保護的文章進行 AI 訓練
  • 法律戰凸顯了訓練數據來源的關鍵問題

🧠 深度解析

本篇為 AI 生成分析,非原文內容。

🔑 增強重點摘要

  • 紐約時報在修正後的訴狀中,特別引用了 Microsoft 的『Bing 搜尋索引』技術,指控其被用於規避版權保護機制並大規模抓取內容。
  • 訴訟內容擴展至針對 Microsoft 的『Copilot』產品,指控其在生成回應時直接複製了紐約時報的付費牆內容,損害了其訂閱業務模式。
  • 法律團隊指出 Microsoft 在 OpenAI 的董事會席位與投資關係,使其在法律責任上不僅是技術提供者,更是共同侵權的參與者。
  • 此案涉及『合理使用』(Fair Use)原則的法律邊界,法院的裁決將直接影響未來生成式 AI 訓練數據的授權成本與商業模式。
  • 紐約時報要求法院下令銷毀所有包含其受版權保護內容的 AI 模型權重與訓練數據集,這對 OpenAI 的技術架構構成重大威脅。

🛠️ 技術深入

  • 數據抓取機制:涉及利用 Microsoft Bing Crawler 繞過 robots.txt 協議,將受版權保護的內容納入訓練語料庫。
  • 模型訓練依賴:指控 OpenAI 的 GPT-4 等模型在訓練階段未經授權處理了數百萬篇紐約時報的文章,並透過權重調整將這些數據內化。
  • 輸出機制:Copilot 與 ChatGPT 被指控在特定查詢下,會逐字輸出紐約時報的付費文章內容,顯示模型存在記憶效應(Memorization Effect)。

🔮 前景展望AI analysis grounded in cited sources

AI 企業將被迫轉向授權數據市場
若法院判決紐約時報勝訴,AI 公司將無法再依賴『合理使用』作為大規模抓取數據的法律護身符,必須支付高額授權費。
模型訓練數據的透明度要求將大幅提升
法律壓力將迫使 AI 開發商公開訓練數據來源,以證明其數據集符合版權法規,否則將面臨持續的訴訟風險。

時間線

2023-12
紐約時報正式對 OpenAI 與 Microsoft 提起版權侵權訴訟。
2024-02
OpenAI 請求法院駁回部分訴訟,指控紐約時報『駭入』ChatGPT 以製造侵權證據。
2024-05
法院裁定駁回 OpenAI 的部分駁回請求,允許訴訟繼續進行,並聚焦於版權使用範圍。
2026-06
紐約時報提交修正後訴狀,進一步強化對 Microsoft 參與數據抓取與侵權的指控。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: New York Times Technology

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。