Microsoft探索了信用AI數據貢獻者

微軟正展開一項新研究項目,旨在了解特定訓練範例如何影響生成式AI模型的輸出,例如文字、圖像和其他媒體。此計劃在一則12月的招聘啟事中被提及,該啟事最近在LinkedIn上重新浮現,徵求研究實習生加入此努力。
該項目的目標是開發一種方法來訓練模型,以便能「高效且實用地估計」特定數據(如照片和書籍)對其輸出的影響。招聘啟事指出,當前的神經網絡架構在追溯輸出來源方面缺乏透明度,且有充分理由解決此問題。其中一個理由是為向未來AI模型貢獻有價值數據的個人提供激勵、認可甚至補償的潛力。
此研究的背景是AI公司(包括微軟)在知識產權方面的持續法律爭議。AI模型通常在從公共網站抓取的龐大數據集上進行訓練,這些數據集可能包含受版權保護的材料。雖然AI公司常以合理使用原則尋求保護,但各領域的創作者——藝術家、程序員、作家——對此立場提出爭議。
微軟目前正面臨法律挑戰,包括《紐約時報》提起的訴訟,指控微軟和OpenAI使用其文章訓練模型,侵犯了版權。此外,多名軟件開發者就微軟的GitHub Copilot AI編碼助手提起訴訟,稱其使用他們的受版權保護的代碼進行訓練。
該研究項目被稱為「訓練時來源追蹤」,涉及微軟研究部門的著名技術專家Jaron Lanier。Lanier此前曾撰文探討「數據尊嚴」,主張建立一個系統,將數位內容與其創作者連繫起來,並可能為他們對AI輸出的貢獻提供補償。
雖然微軟的項目仍處於早期階段,但其他公司如Bria、Adobe和Shutterstock已在試驗根據數據擁有者對AI模型的貢獻進行補償。然而,大型AI實驗室通常尚未建立個人貢獻者支付計劃,而是選擇許可協議或版權持有者的退出機制,這些機制可能繁瑣且範圍有限。
微軟的此舉可能僅停留在概念驗證階段,類似於OpenAI尚未發布的創作者控制其作品如何用於訓練數據的工具。也有推測認為,微軟可能試圖「道德清洗」其AI實踐或預先應對監管和法律挑戰。
鑒於其他AI實驗室(如Google和OpenAI)最近呼籲美國政府放寬AI開發的版權保護,微軟的此舉尤為引人注目。微軟尚未回應有關此項目的評論請求。
相關文章
內部細節曝光:下一代 Gemini 算力緊張,內部團隊在開發優先順序和資源分配上存在分歧
報告顯示,谷歌備受期待的下一代 Gemini 模型釋出已被推遲。由於內部在開發優先順序和資源分配上存在分歧,加上計算能力有限以及複雜的審批流程,導致釋出時間延後了兩個月。儘管谷歌擁有定製的 TPU 晶片,但由於模型訓練、Google Cloud 服務以及眾多消費和企業級 AI 應用對計算資源的需求相互競爭,谷歌仍面臨計算資源短缺的問題。目前,高層管理人員正透過組織結構調整來解決這些部門間的衝突。與此同時,領導層也發生了變化,聯合創始人謝爾蓋·布林越來越多地參與到核心模型訓練中,並倡導將資源專門用於
OpenAI 否認增長放緩擔憂,稱多個業務部門加速發展
針對外界對其銷售增長放緩及未達內部基準的質疑,人工智慧領域的領軍企業 OpenAI 於 4 月 28 日(星期二)發表了一份信心十足的宣告。該公司澄清稱,其消費產品和企業服務正在快速推進,直接駁斥了近期關於業務放緩的猜測。針對該公司“未達成多項內部目標”的說法,OpenAI 將這些報道斥為“典型的標題黨”。公司強調了企業對 AI 整合的強勁需求,並指出其廣告業務早期增長前景良好。據 OpenAI 內部人士透露,公司內部情緒依然樂觀。儘管市場競爭日益激烈,但公司正在向投資者傳遞信心,聲稱其商業
阿里巴巴超級盃:Qwen3.8-Max 重磅登場,程式碼與辦公工具能力全面升級
阿里巴巴正式釋出了Qwen3.8-Max,這是一款擁有2.4萬億引數的下一代基礎大模型。這一重大AI進展在編碼和專業辦公任務等核心領域帶來了顯著的效能提升,展現了強大的技術能力。在權威的Arena大模型排名中,Qwen3.8-Max取得了令人矚目的成績,僅次於Anthropic的Claude系列,位居行業前列。這一里程碑標誌著國內大模型在處理複雜任務方面取得了快速進展,為開發者和企業使用者提供了先進的智慧工具。該模型的API現已在Qwen AI平臺上上線,並整合到新推出的“Qwen Offic
相關專題推薦
評論 (37)
0/500
Interesante proyecto, pero lo que realmente necesito es que alguien en la IA me explique por qué mi asistente virtual aún no puede organizarme el escritorio 😅. ¿Esto de la atribución podría cambiar cómo las empresas comparten datos? Me preocupa un poco la transparencia de todo el proceso. Ojalá no sea solo un gesto de relaciones públicas.
Lo de Microsoft parece interesante pero, ¿y la privacidad de los datos? 🤔 A veces siento que con toda esta exploración de IA, estamos perdiendo el control de lo que se usa para entrenar los modelos. ¿Habrá una compensación justa para quienes contribuyeron? No quiero que esto se convierta en otro caso de 'big tech' aprovechándose de 'datos gratis'...
이런 연구는 AI 데이터 기여자들에게 공정한 보상을 제공하는 데 중요한 단계가 될 수 있겠네요. 😊 근데 MS가 과연 저작권 문제를 해결할 수 있을지 의문이 드네요. 데이터 소싱 방식이 좀 더 투명해져야 할 시점인 것 같아요!
This is super intriguing! Microsoft's diving into how AI training data shapes outputs—mind-blowing stuff. Wonder how they'll credit contributors fairly? 🤔
This Microsoft AI project sounds intriguing! Crediting data contributors could reshape how we value creative input in AI. Curious to see if it'll spark ethical debates or just be a tech flex. 🤔

微軟正展開一項新研究項目,旨在了解特定訓練範例如何影響生成式AI模型的輸出,例如文字、圖像和其他媒體。此計劃在一則12月的招聘啟事中被提及,該啟事最近在LinkedIn上重新浮現,徵求研究實習生加入此努力。
該項目的目標是開發一種方法來訓練模型,以便能「高效且實用地估計」特定數據(如照片和書籍)對其輸出的影響。招聘啟事指出,當前的神經網絡架構在追溯輸出來源方面缺乏透明度,且有充分理由解決此問題。其中一個理由是為向未來AI模型貢獻有價值數據的個人提供激勵、認可甚至補償的潛力。
此研究的背景是AI公司(包括微軟)在知識產權方面的持續法律爭議。AI模型通常在從公共網站抓取的龐大數據集上進行訓練,這些數據集可能包含受版權保護的材料。雖然AI公司常以合理使用原則尋求保護,但各領域的創作者——藝術家、程序員、作家——對此立場提出爭議。
微軟目前正面臨法律挑戰,包括《紐約時報》提起的訴訟,指控微軟和OpenAI使用其文章訓練模型,侵犯了版權。此外,多名軟件開發者就微軟的GitHub Copilot AI編碼助手提起訴訟,稱其使用他們的受版權保護的代碼進行訓練。
該研究項目被稱為「訓練時來源追蹤」,涉及微軟研究部門的著名技術專家Jaron Lanier。Lanier此前曾撰文探討「數據尊嚴」,主張建立一個系統,將數位內容與其創作者連繫起來,並可能為他們對AI輸出的貢獻提供補償。
雖然微軟的項目仍處於早期階段,但其他公司如Bria、Adobe和Shutterstock已在試驗根據數據擁有者對AI模型的貢獻進行補償。然而,大型AI實驗室通常尚未建立個人貢獻者支付計劃,而是選擇許可協議或版權持有者的退出機制,這些機制可能繁瑣且範圍有限。
微軟的此舉可能僅停留在概念驗證階段,類似於OpenAI尚未發布的創作者控制其作品如何用於訓練數據的工具。也有推測認為,微軟可能試圖「道德清洗」其AI實踐或預先應對監管和法律挑戰。
鑒於其他AI實驗室(如Google和OpenAI)最近呼籲美國政府放寬AI開發的版權保護,微軟的此舉尤為引人注目。微軟尚未回應有關此項目的評論請求。
內部細節曝光:下一代 Gemini 算力緊張,內部團隊在開發優先順序和資源分配上存在分歧
報告顯示,谷歌備受期待的下一代 Gemini 模型釋出已被推遲。由於內部在開發優先順序和資源分配上存在分歧,加上計算能力有限以及複雜的審批流程,導致釋出時間延後了兩個月。儘管谷歌擁有定製的 TPU 晶片,但由於模型訓練、Google Cloud 服務以及眾多消費和企業級 AI 應用對計算資源的需求相互競爭,谷歌仍面臨計算資源短缺的問題。目前,高層管理人員正透過組織結構調整來解決這些部門間的衝突。與此同時,領導層也發生了變化,聯合創始人謝爾蓋·布林越來越多地參與到核心模型訓練中,並倡導將資源專門用於
OpenAI 否認增長放緩擔憂,稱多個業務部門加速發展
針對外界對其銷售增長放緩及未達內部基準的質疑,人工智慧領域的領軍企業 OpenAI 於 4 月 28 日(星期二)發表了一份信心十足的宣告。該公司澄清稱,其消費產品和企業服務正在快速推進,直接駁斥了近期關於業務放緩的猜測。針對該公司“未達成多項內部目標”的說法,OpenAI 將這些報道斥為“典型的標題黨”。公司強調了企業對 AI 整合的強勁需求,並指出其廣告業務早期增長前景良好。據 OpenAI 內部人士透露,公司內部情緒依然樂觀。儘管市場競爭日益激烈,但公司正在向投資者傳遞信心,聲稱其商業
阿里巴巴超級盃:Qwen3.8-Max 重磅登場,程式碼與辦公工具能力全面升級
阿里巴巴正式釋出了Qwen3.8-Max,這是一款擁有2.4萬億引數的下一代基礎大模型。這一重大AI進展在編碼和專業辦公任務等核心領域帶來了顯著的效能提升,展現了強大的技術能力。在權威的Arena大模型排名中,Qwen3.8-Max取得了令人矚目的成績,僅次於Anthropic的Claude系列,位居行業前列。這一里程碑標誌著國內大模型在處理複雜任務方面取得了快速進展,為開發者和企業使用者提供了先進的智慧工具。該模型的API現已在Qwen AI平臺上上線,並整合到新推出的“Qwen Offic
Interesante proyecto, pero lo que realmente necesito es que alguien en la IA me explique por qué mi asistente virtual aún no puede organizarme el escritorio 😅. ¿Esto de la atribución podría cambiar cómo las empresas comparten datos? Me preocupa un poco la transparencia de todo el proceso. Ojalá no sea solo un gesto de relaciones públicas.
Lo de Microsoft parece interesante pero, ¿y la privacidad de los datos? 🤔 A veces siento que con toda esta exploración de IA, estamos perdiendo el control de lo que se usa para entrenar los modelos. ¿Habrá una compensación justa para quienes contribuyeron? No quiero que esto se convierta en otro caso de 'big tech' aprovechándose de 'datos gratis'...
이런 연구는 AI 데이터 기여자들에게 공정한 보상을 제공하는 데 중요한 단계가 될 수 있겠네요. 😊 근데 MS가 과연 저작권 문제를 해결할 수 있을지 의문이 드네요. 데이터 소싱 방식이 좀 더 투명해져야 할 시점인 것 같아요!
This is super intriguing! Microsoft's diving into how AI training data shapes outputs—mind-blowing stuff. Wonder how they'll credit contributors fairly? 🤔
This Microsoft AI project sounds intriguing! Crediting data contributors could reshape how we value creative input in AI. Curious to see if it'll spark ethical debates or just be a tech flex. 🤔





首頁






