美國法院近期解封一批原本被遮蔽的訴訟文件,揭露微軟內部對於人工智慧訓練資料來源的真實看法。文件顯示,微軟一名高階主管在私下溝通中,將AI業者大規模抓取網路內容的行為形容為人類史上規模最龐大的勞動成果竊取,措辭遠比該公司對外公開立場強硬。
這批文件同時指出,微軟與OpenAI雙方都曾取用《紐約時報》設有付費牆的報導內容,並以這些素材建立訓練資料集。內部討論中,有人以竊取一詞描述OpenAI的資料處理方式,顯示企業內部對相關做法的正當性早有疑慮。
更值得注意的是,文件中還記錄了內部示警,提醒這類做法可能對新聞產業造成實質衝擊,削弱媒體既有的營運基礎。這些內容成為《紐約時報》對微軟與OpenAI提起訴訟的重要依據,該案聚焦於生成式AI在未取得授權的情況下使用受版權保護作品是否構成侵權。
隨著更多內部往來紀錄曝光,科技業與新聞業之間關於AI訓練資料授權與補償機制的爭議料將持續升溫,也可能牽動未來相關規範的走向。
