← 返回 Siami 首頁

微軟高層內部文件曝光:AI 抓取新聞是「人類史上最大規模的勞動竊盜」

▲ 343 💬 245
微軟高層內部文件曝光:AI 抓取新聞是「人類史上最大規模的勞動竊盜」

編按:本文綜合整理自 Ars TechnicaThe New York Times華爾街日報TechCrunchBloomberg Law,並加入 Siami 編輯部觀點與分析。

紐約時訴微軟 OpenAI 案:密封文件意外公開

紐約時報為首的新聞媒體聯盟與微軟、OpenAI 的著作權官司出現戲劇性進展。週四解密的一份「即決判決動議」(motion for summary judgment)讓外界首次看見微軟與 OpenAI 內部對 AI 訓練新聞內容的真實看法——而這些看法與兩家公司目前對外主張的「合理使用」(fair use)論點幾乎完全相反。

這份動議由紐約時報帶領的多家原告媒體提出,引用了大量微軟與 OpenAI 內部信件、簡報與 Slack 對話紀錄。這些文件原本應該保密,卻在法官裁定後正式公開,瞬間成為 AI 產業最具爆炸性的內部自白之一。

「人類史上最大規模的勞動竊盜」

最震撼的一段話來自微軟應用科學總監 Brent Hecht。他在 2024 年 1 月的內部簡報中,反覆用極為嚴厲的字眼描述大規模抓取新聞內容訓練 AI 的行為:

  • 「令人震驚、前所未見規模的竊盜」
  • 可能是**「人類史上最大規模的勞動竊盜」**
  • 對「合理使用」這個概念是「徹底的嘲弄」(a complete mockery)

更矛盾的是,Hecht 自己也承認,內容創作者「幾乎沒有人同意自己的內容被這樣使用,也沒有人因此獲得任何補償」。但微軟最終仍把這些內容塞進 Copilot 與 ChatGPT 的訓練資料集。

OpenAI 內部也示警:「沒有理由點進原始新聞」

在 OpenAI 內部,ChatGPT 業務負責人 Nick Turley 早在產品上線前就在內部通訊中警告,新聞出版業將面臨**「存亡威脅」(existential threat)**——商業化的聊天機器人可以直接取代新聞網站本身。

一位 OpenAI 工程師在內部訊息中直言:「不管我們把連結放得多顯眼,使用者都不會點。」Turley 也同意,使用者「沒有理由點進去」,因為聊天機器人已經把資訊直接搬到他們眼前。

更值得玩味的是,OpenAI 總裁 Greg Brockman 的回應。當員工 Nick Ryder 回報「找到一個方法可以繞過紐約時報的付費牆」時,Brockman 只回了兩個字:「讚喔。」(Ah, nice.)


為什麼這件事重要

這份文件之所以震撼,不是因為內容驚奇,而是因為它直接戳破了 AI 產業最大的公關神話:當微軟、OpenAI 在法庭與媒體上高喊「AI 訓練屬於合理使用」時,他們自家最了解技術的高階主管,早就在內部把同樣的行為定性為「勞動竊盜」。

這正是新聞原告律師團隊在動議中強調的核心論點:被告不能一方面在內部承認自己對新聞業造成「毀滅性迴圈」,一方面又對外主張自己的行為是「轉化性使用」(transformative use)。這種內外不一的論述,在美國著作權法的合理使用四要素檢驗中(特別是「使用目的與性質」與「對原作品的市場影響」兩項),對微軟、OpenAI 極為不利。

更廣義地看,這個案子將成為 AI 訓練是否構成合理使用的指標性判決。如果媒體聯盟勝訴,整個生成式 AI 產業的訓練成本結構將被徹底改寫;如果微軟、OpenAI 勝訴,「合理使用」的適用範圍將被大幅擴張,幾乎所有以網路內容訓練的 AI 公司都將受惠。無論結果為何,這個判決的影響力都將遠遠超出新聞業本身。

「毀滅性迴圈」:新聞流量暴跌 83% 至 94%

內部文件還揭露了微軟自己統計的數據:在聊天機器人開始提供新聞摘要後,部分原告媒體的點擊率暴跌 83% 到 93%,其他媒體則是 51% 到 94%。換言之,當 AI 直接在對話框裡「報完」新聞,使用者就再也沒有理由點進原始來源。

微軟的內部簡報甚至用一張漫畫來描述這個問題:LLM 一邊吞噬新聞內容養大自己,一邊讓新聞業無力再產出新內容,最終連 AI 自己也會因為「原料」枯竭而崩潰。這正是新聞原告口中那個**「會同時毀掉我們的模型跟整個網路的毀滅性迴圈」**(doom loop)的真實面貌。

微軟自己的說法是「Hecht 的言論是個人意見,不代表公司立場」。但法庭上要解釋為什麼自家的應用科學總監會在正式內部簡報裡用「人類史上最大規模的勞動竊盜」這種字眼,顯然不是一件容易的事。


數據解讀與質疑

這份文件公開後,AI 產業的論述出現了明顯的分裂。

支持媒體端的一方認為,微軟、OpenAI 的「合理使用」辯護在這份內部文件曝光後已經實質崩塌。Hecht 的發言不是私下抱怨,而是 2024 年 1 月的正式內部簡報;Turley 的「存亡威脅」也不是個人猜測,而是 OpenAI ChatGPT 業務負責人對自家產品商業影響的評估。當自家最懂技術的人都把這件事定性為「勞動竊盜」,就很難再對外主張這是無害的「轉化性使用」。

支持 AI 公司的一方則反駁,內部文件中確實存在對法律風險的「極端表述」,但這不等於最終法律結論。合理使用的判斷本來就有灰色地帶,微軟事後也強調 Hecht 的言論是個人觀點,不代表公司當時的法律策略。同時,這次解密的文件屬於「即決判決動議」,意即原告希望法院在不必進入正式審判的情況下就認定合理使用抗辯無效——但是否成立,仍需法官認定。

最後還有一個常被忽略的層面:這場官司已經不只是兩家公司的戰爭。原告端除了紐約時報,還包括紐約每日新聞、芝加哥論壇報等多家媒體,背後代表的是全美 550 家以上因 AI 而流量下滑的地方新聞業。如果判決結果不利於媒體端,等同於是告訴所有科技公司:「抓新聞訓練 AI 是合法的,反正新聞業會自己死掉。」


資料來源彙整:

網友熱門留言 (6)

#1 jacquesm (Hacker News) ▲ 89
「把整個文化偷走再高價賣回給我們,這是人類史上最大的罪行之一。」
#2 juvvel (Hacker News) ▲ 67
問題不是 AI 用別人的成果,而是大科技公司把所有好處拿走、把應該屬於所有人的東西變成自己的商品。現在連思考和知識都被私有化了。
#3 47282847 (Hacker News) ▲ 23
「資訊本就該是自由的。」嚴格來說這不是「勞動的竊盜」——是「智慧財產」的盜用。我們每個人都站在前人的肩膀上,創造力本就是流動的。
#4 AdamN (Hacker News) ▲ 45
真正的解法應該是在 AI 回應裡內建權利金機制,按合理價格回饋給智慧財產的原作者。如果 IP 已經沒人擁有,就可以自由使用。非營利或政府 AI 可以有例外。
#5 sajithdilshan (Hacker News) ▲ 12
如果有人問「人類史上最大的勞動竊盜是什麼」,我會回答是奴隸制度。
#6 tom2026hn (Hacker News) ▲ 8
問題不只是「偷走人類勞動的果實」,還包括把人類技能的價值壓低,甚至搶走人類的工作。