微軟最近發表了一篇技術論文,透露其新 AI 模型 MAI 部分使用未經授權的網路數據進行訓練,包括 Common Crawl 等來源。這違反了微軟之前的承諾,聲稱其 AI 模型只使用「企業級、乾淨和商業授權的數據」。這個發現引發了對 AI 訓練數據來源的質疑和關注。微軟可能依靠合理使用原則來使用這些數據,但這仍然引發了對 AI 數據來源的倫理和法律問題的關注。
微軟最近發表了一篇技術論文,透露其新 AI 模型 MAI 部分使用未經授權的網路數據進行訓練,包括 Common Crawl 等來源。這違反了微軟之前的承諾,聲稱其 AI 模型只使用「企業級、乾淨和商業授權的數據」。這個發現引發了對 AI 訓練數據來源的質疑和關注。微軟可能依靠合理使用原則來使用這些數據,但這仍然引發了對 AI 數據來源的倫理和法律問題的關注。