AI 資料、私隱與版權
10 分鐘閱讀
生成式 AI 訓練資料與輸出:私隱及版權清單
從來源到輸出審查個資、法律依據、網頁擷取、權利保留、訓練紀錄、人工創作及第三方主張。
內容概覽
從來源到輸出審查個資、法律依據、網頁擷取、權利保留、訓練紀錄、人工創作及第三方主張。
審查清單
- 為授權、公開、客戶、合成、員工及擷取資料建立來源登記,記錄來源、條款、目的、法域、保存及用途。
- 個資須識別控制者/處理者及法律依據,評估必要性、合理預期、權利、透明度、資安、DPIA 及跨境轉移。
- 不可假設模型已匿名;EDPB 要求逐案評估識別與提取風險並保存技術證據。
- 記錄版權、授權、文字與資料探勘權利保留、排除、下架,以及適用的 GPAI 版權政策與訓練摘要。
- 保存提示、來源、人工選擇、編排、修改及批准;美國版權局重視充分人工創作而非僅有提示。
- 測試記憶、洩漏、相似性、歸屬、數位替身及有害輸出,建立升級、刪除、再訓練、過濾及索賠程序。
下一步
私隱、版權、合約、肖像、保密、消費者及行業規則可能同時適用但答案不同。須同時審查開發與部署;輸出所有權亦不等於沒有侵權風險。
官方來源與延伸閱讀
- Opinion 28/2024 on personal data in the context of AI models — European Data Protection Board
- Copyright and Artificial Intelligence report — U.S. Copyright Office
- Guidelines on obligations for General-Purpose AI providers — European Commission
- Artificial Intelligence Risk Management Framework: Generative AI Profile — National Institute of Standards and Technology
本文僅提供一般教育資訊,不構成法律意見。規則與結果取決於具體事實及司法管轄區,採取行動前請諮詢合資格的當地專業人士。