Microsoft探索了信用AI數據貢獻者

微軟正展開一項新研究項目,旨在了解特定訓練範例如何影響生成式AI模型的輸出,例如文字、圖像和其他媒體。此計劃在一則12月的招聘啟事中被提及,該啟事最近在LinkedIn上重新浮現,徵求研究實習生加入此努力。
該項目的目標是開發一種方法來訓練模型,以便能「高效且實用地估計」特定數據(如照片和書籍)對其輸出的影響。招聘啟事指出,當前的神經網絡架構在追溯輸出來源方面缺乏透明度,且有充分理由解決此問題。其中一個理由是為向未來AI模型貢獻有價值數據的個人提供激勵、認可甚至補償的潛力。
此研究的背景是AI公司(包括微軟)在知識產權方面的持續法律爭議。AI模型通常在從公共網站抓取的龐大數據集上進行訓練,這些數據集可能包含受版權保護的材料。雖然AI公司常以合理使用原則尋求保護,但各領域的創作者——藝術家、程序員、作家——對此立場提出爭議。
微軟目前正面臨法律挑戰,包括《紐約時報》提起的訴訟,指控微軟和OpenAI使用其文章訓練模型,侵犯了版權。此外,多名軟件開發者就微軟的GitHub Copilot AI編碼助手提起訴訟,稱其使用他們的受版權保護的代碼進行訓練。
該研究項目被稱為「訓練時來源追蹤」,涉及微軟研究部門的著名技術專家Jaron Lanier。Lanier此前曾撰文探討「數據尊嚴」,主張建立一個系統,將數位內容與其創作者連繫起來,並可能為他們對AI輸出的貢獻提供補償。
雖然微軟的項目仍處於早期階段,但其他公司如Bria、Adobe和Shutterstock已在試驗根據數據擁有者對AI模型的貢獻進行補償。然而,大型AI實驗室通常尚未建立個人貢獻者支付計劃,而是選擇許可協議或版權持有者的退出機制,這些機制可能繁瑣且範圍有限。
微軟的此舉可能僅停留在概念驗證階段,類似於OpenAI尚未發布的創作者控制其作品如何用於訓練數據的工具。也有推測認為,微軟可能試圖「道德清洗」其AI實踐或預先應對監管和法律挑戰。
鑒於其他AI實驗室(如Google和OpenAI)最近呼籲美國政府放寬AI開發的版權保護,微軟的此舉尤為引人注目。微軟尚未回應有關此項目的評論請求。
相關文章
韓國啟動國家人工智慧計算中心建設,投資2.5萬億韓元,目標2028年完成
韓國媒體EtNews報道,韓國AI計算中心(KOACC)的奠基儀式於8月3日在全羅南道順天市的Solar City資料中心園區舉行。該專案總投資額為2.5萬億韓元(約合118.38億元人民幣),計劃於2028年投入運營,成為迄今為止韓國在AI基礎設施領域規模最大的國家投資之一。該專案的股權分佈凸顯了深化政企合作的戰略意圖。三星SDS作為最大股東持有30%的股份,而包括科學技術資訊通訊部、金融監督院和國家成長基金在內的公共實體合計持有29%的股份。NAVER Cloud緊隨其後,持股26.1%,
六大科技巨頭向 Linux 基金會捐贈 1250 萬美元,以應對人工智慧漏洞噪音
為應對由人工智慧自動化工具產生的大量低質量安全報告,六家主要科技公司——Anthropic、亞馬遜(AWS)、GitHub、Google、Microsoft 和 OpenAI——共同向 Linux 基金會專案提供了 1250 萬美元 的資金支援。這項投資旨在減輕開源軟體(FOSS)維護者手動篩選的工作負擔,使他們能夠專注於真正的安全威脅。隨著人工智慧技術降低了漏洞發現的門檻,開源社羣正面臨前所未有的挑戰:無效報告:自動生成的 AI 報告使維護者應接不暇。雖然數量龐大,但這些提交往往缺乏深度,
馬斯克曾考慮將OpenAI留給他的孩子,而奧特曼正在作證
今早,OpenAI 執行長山姆·阿爾特曼出庭作證,回應前聯合創始人埃隆·馬斯克針對該公司企業結構提起的訴訟。當被問及馬斯克聲稱其他聯合創始人透過成立一家以營利為目的的子公司來推廣基於人工智慧的產品,從而“竊取了一家慈善機構”的說法時,阿爾特曼表現出明顯的猶豫。“這種說法甚至讓人難以理解,”阿爾特曼在停頓後說道,“我們成立的是全球最大的慈善機構之一。該基金會正在開展令人難以置信的工作,並將繼續做更多事情。”馬斯克的律師團隊指出,OpenAI 基金會目前持有的資產價值約為 2000 億美元
相關專題推薦
評論 (37)
0/500
Interesante proyecto, pero lo que realmente necesito es que alguien en la IA me explique por qué mi asistente virtual aún no puede organizarme el escritorio 😅. ¿Esto de la atribución podría cambiar cómo las empresas comparten datos? Me preocupa un poco la transparencia de todo el proceso. Ojalá no sea solo un gesto de relaciones públicas.
Lo de Microsoft parece interesante pero, ¿y la privacidad de los datos? 🤔 A veces siento que con toda esta exploración de IA, estamos perdiendo el control de lo que se usa para entrenar los modelos. ¿Habrá una compensación justa para quienes contribuyeron? No quiero que esto se convierta en otro caso de 'big tech' aprovechándose de 'datos gratis'...
이런 연구는 AI 데이터 기여자들에게 공정한 보상을 제공하는 데 중요한 단계가 될 수 있겠네요. 😊 근데 MS가 과연 저작권 문제를 해결할 수 있을지 의문이 드네요. 데이터 소싱 방식이 좀 더 투명해져야 할 시점인 것 같아요!
This is super intriguing! Microsoft's diving into how AI training data shapes outputs—mind-blowing stuff. Wonder how they'll credit contributors fairly? 🤔
This Microsoft AI project sounds intriguing! Crediting data contributors could reshape how we value creative input in AI. Curious to see if it'll spark ethical debates or just be a tech flex. 🤔

微軟正展開一項新研究項目,旨在了解特定訓練範例如何影響生成式AI模型的輸出,例如文字、圖像和其他媒體。此計劃在一則12月的招聘啟事中被提及,該啟事最近在LinkedIn上重新浮現,徵求研究實習生加入此努力。
該項目的目標是開發一種方法來訓練模型,以便能「高效且實用地估計」特定數據(如照片和書籍)對其輸出的影響。招聘啟事指出,當前的神經網絡架構在追溯輸出來源方面缺乏透明度,且有充分理由解決此問題。其中一個理由是為向未來AI模型貢獻有價值數據的個人提供激勵、認可甚至補償的潛力。
此研究的背景是AI公司(包括微軟)在知識產權方面的持續法律爭議。AI模型通常在從公共網站抓取的龐大數據集上進行訓練,這些數據集可能包含受版權保護的材料。雖然AI公司常以合理使用原則尋求保護,但各領域的創作者——藝術家、程序員、作家——對此立場提出爭議。
微軟目前正面臨法律挑戰,包括《紐約時報》提起的訴訟,指控微軟和OpenAI使用其文章訓練模型,侵犯了版權。此外,多名軟件開發者就微軟的GitHub Copilot AI編碼助手提起訴訟,稱其使用他們的受版權保護的代碼進行訓練。
該研究項目被稱為「訓練時來源追蹤」,涉及微軟研究部門的著名技術專家Jaron Lanier。Lanier此前曾撰文探討「數據尊嚴」,主張建立一個系統,將數位內容與其創作者連繫起來,並可能為他們對AI輸出的貢獻提供補償。
雖然微軟的項目仍處於早期階段,但其他公司如Bria、Adobe和Shutterstock已在試驗根據數據擁有者對AI模型的貢獻進行補償。然而,大型AI實驗室通常尚未建立個人貢獻者支付計劃,而是選擇許可協議或版權持有者的退出機制,這些機制可能繁瑣且範圍有限。
微軟的此舉可能僅停留在概念驗證階段,類似於OpenAI尚未發布的創作者控制其作品如何用於訓練數據的工具。也有推測認為,微軟可能試圖「道德清洗」其AI實踐或預先應對監管和法律挑戰。
鑒於其他AI實驗室(如Google和OpenAI)最近呼籲美國政府放寬AI開發的版權保護,微軟的此舉尤為引人注目。微軟尚未回應有關此項目的評論請求。
韓國啟動國家人工智慧計算中心建設,投資2.5萬億韓元,目標2028年完成
韓國媒體EtNews報道,韓國AI計算中心(KOACC)的奠基儀式於8月3日在全羅南道順天市的Solar City資料中心園區舉行。該專案總投資額為2.5萬億韓元(約合118.38億元人民幣),計劃於2028年投入運營,成為迄今為止韓國在AI基礎設施領域規模最大的國家投資之一。該專案的股權分佈凸顯了深化政企合作的戰略意圖。三星SDS作為最大股東持有30%的股份,而包括科學技術資訊通訊部、金融監督院和國家成長基金在內的公共實體合計持有29%的股份。NAVER Cloud緊隨其後,持股26.1%,
六大科技巨頭向 Linux 基金會捐贈 1250 萬美元,以應對人工智慧漏洞噪音
為應對由人工智慧自動化工具產生的大量低質量安全報告,六家主要科技公司——Anthropic、亞馬遜(AWS)、GitHub、Google、Microsoft 和 OpenAI——共同向 Linux 基金會專案提供了 1250 萬美元 的資金支援。這項投資旨在減輕開源軟體(FOSS)維護者手動篩選的工作負擔,使他們能夠專注於真正的安全威脅。隨著人工智慧技術降低了漏洞發現的門檻,開源社羣正面臨前所未有的挑戰:無效報告:自動生成的 AI 報告使維護者應接不暇。雖然數量龐大,但這些提交往往缺乏深度,
馬斯克曾考慮將OpenAI留給他的孩子,而奧特曼正在作證
今早,OpenAI 執行長山姆·阿爾特曼出庭作證,回應前聯合創始人埃隆·馬斯克針對該公司企業結構提起的訴訟。當被問及馬斯克聲稱其他聯合創始人透過成立一家以營利為目的的子公司來推廣基於人工智慧的產品,從而“竊取了一家慈善機構”的說法時,阿爾特曼表現出明顯的猶豫。“這種說法甚至讓人難以理解,”阿爾特曼在停頓後說道,“我們成立的是全球最大的慈善機構之一。該基金會正在開展令人難以置信的工作,並將繼續做更多事情。”馬斯克的律師團隊指出,OpenAI 基金會目前持有的資產價值約為 2000 億美元
Interesante proyecto, pero lo que realmente necesito es que alguien en la IA me explique por qué mi asistente virtual aún no puede organizarme el escritorio 😅. ¿Esto de la atribución podría cambiar cómo las empresas comparten datos? Me preocupa un poco la transparencia de todo el proceso. Ojalá no sea solo un gesto de relaciones públicas.
Lo de Microsoft parece interesante pero, ¿y la privacidad de los datos? 🤔 A veces siento que con toda esta exploración de IA, estamos perdiendo el control de lo que se usa para entrenar los modelos. ¿Habrá una compensación justa para quienes contribuyeron? No quiero que esto se convierta en otro caso de 'big tech' aprovechándose de 'datos gratis'...
이런 연구는 AI 데이터 기여자들에게 공정한 보상을 제공하는 데 중요한 단계가 될 수 있겠네요. 😊 근데 MS가 과연 저작권 문제를 해결할 수 있을지 의문이 드네요. 데이터 소싱 방식이 좀 더 투명해져야 할 시점인 것 같아요!
This is super intriguing! Microsoft's diving into how AI training data shapes outputs—mind-blowing stuff. Wonder how they'll credit contributors fairly? 🤔
This Microsoft AI project sounds intriguing! Crediting data contributors could reshape how we value creative input in AI. Curious to see if it'll spark ethical debates or just be a tech flex. 🤔





首頁






