Microsoftは、AIデータ貢献者のクレジットを探ります

マイクロソフトは、特定のトレーニング例が生成AIモデルの出力(テキスト、画像、その他のメディアなど)にどのように影響するかを理解することを目的とした新しい研究プロジェクトに着手しています。この取り組みは、12月に掲載された求人広告が最近LinkedInで再浮上し、研究インターンを募集していることで注目されました。
プロジェクトの目標は、写真や本などの特定のデータの影響を「効率的かつ有用に推定」できるようにモデルを訓練する方法を開発することです。求人広告では、現在のニューラルネットワークアーキテクチャは出力の起源を追跡する透明性が欠けており、この問題に対処する説得力のある理由があると指摘しています。その理由の一つとして、将来のAIモデルに価値あるデータを貢献した個人に対してインセンティブ、認知、さらには報酬を提供する可能性が挙げられています。
この研究の背景には、マイクロソフトを含むAI企業が知的財産権をめぐる進行中の法的紛争があります。AIモデルは、著作権で保護された素材を含む公開ウェブサイトから収集された膨大なデータセットで訓練されることがよくあります。AI企業はしばしばフェアユースの原則に基づく保護を主張しますが、アーティスト、プログラマー、著者などさまざまな分野のクリエイターはこの立場に異議を唱えています。
マイクロソフトは現在、ニューヨーク・タイムズからの訴訟を含む法的挑戦に直面しており、同社とOpenAIがその記事をモデル訓練に使用することで著作権を侵害したと主張されています。さらに、複数のソフトウェア開発者が、マイクロソフトのGitHub Copilot AIコーディングアシスタントが彼らの著作権で保護されたコードで訓練されたとして訴訟を起こしています。
「トレーニング時の出所証明」と呼ばれるこの研究プロジェクトには、マイクロソフトリサーチの著名な技術者であるジャロン・ラニアーが関与しています。ラニアーは以前、「データ尊厳」について執筆し、デジタルコンテンツをそのクリエイターと結びつけ、AIの出力への貢献に対して報酬を支払うシステムを提唱しています。
マイクロソフトのプロジェクトはまだ初期段階ですが、Bria、Adobe、Shutterstockなどの他の企業はすでにAIモデルへの貢献に基づいてデータ所有者に報酬を支払う実験を行っています。しかし、大規模なAIラボは一般的に個人貢献者への支払いプログラムを確立しておらず、ライセンス契約や著作権保有者向けのオプトアウトメカニズムを選択しており、これらは煩雑で範囲が限定的です。
マイクロソフトの取り組みは、OpenAIのまだリリースされていないクリエイターがトレーニングデータでの作品の使用を制御できるツールと同様に、概念実証にとどまる可能性があります。また、マイクロソフトがAIの慣行を「倫理的に洗浄」しようとしている、または規制や法的な挑戦を先取りしようとしているとの憶測もあります。
このマイクロソフトの動きは、GoogleやOpenAIなどの他のAIラボが最近、AI開発のための著作権保護の緩和を米国政府に求めたことを考えると特に注目に値します。マイクロソフトはこのプロジェクトに関するコメントの依頼にまだ応じていません。
関連記事
アリババ・スーパーカップ:Qwen3.8-Max、強化されたコーディング機能とオフィスツールを搭載してデビュー
アリババは公式に、2.4兆パラメータを備えた次世代の基盤大規模モデル「Qwen3.8-Max」を発表しました。この重要なAIの進歩は、コーディングや専門的なオフィス業務といった中核領域において大幅なパフォーマンス向上をもたらし、堅牢な技術能力を示しています。権威あるArena大規模モデルランキングにおいて、Qwen3.8-Maxは目覚ましい結果を残し、AnthropicのClaudeシリーズに次ぐ順位で、業界リーダーの仲間入りを果たしました。このマイルストーンは、複雑なタスクの処理における国内
インドのテック億万長者がマイクロソフトOfficeの競合他社に3,000万ドルを投資
直営企業家であるBhavin Turakhiaは、自身の資金から3,000万ドルを投資しており、エンタープライズAI分野にはまだ新規参入者の余地があると見なしている。彼の最新スタートアップ「Neo」は、以下の核心的な信念に基づいて運営されている:既存の職場用ソフトウェアをチャットボットで単純に補完するだけでは不十分であり、完全なアーキテクチャの再設計が必要である。46歳のTurakhia氏は、野心のあるエンタープライズテック企業への支援の歴史を持つ。過去20年間、彼はDirecti、Radix
元OpenAIのチーフサイエンティストであるイリヤによるSSIが初のモデルを公開
AIは新たな主要なマイルストーンを達成した。OpenAIを去った後、元チーフサイエンティストのイリヤ・スツケルはSafe Superintelligence Inc.(SSI)を設立し、同社は最近、初代モデルに関する詳細を明らかにした。海外のソーシャルメディアからの報告によれば、チームはTTT(Testing While Training)を活用したコンパクトな推論エンジンを開発中であり、これは安全なスーパーインテリジェンス追求における重要な進展である。この新しいアーキテクチャは、モデルが「学
関連特集おすすめ
コメント (37)
0/500
Interesante proyecto, pero lo que realmente necesito es que alguien en la IA me explique por qué mi asistente virtual aún no puede organizarme el escritorio 😅. ¿Esto de la atribución podría cambiar cómo las empresas comparten datos? Me preocupa un poco la transparencia de todo el proceso. Ojalá no sea solo un gesto de relaciones públicas.
Lo de Microsoft parece interesante pero, ¿y la privacidad de los datos? 🤔 A veces siento que con toda esta exploración de IA, estamos perdiendo el control de lo que se usa para entrenar los modelos. ¿Habrá una compensación justa para quienes contribuyeron? No quiero que esto se convierta en otro caso de 'big tech' aprovechándose de 'datos gratis'...
이런 연구는 AI 데이터 기여자들에게 공정한 보상을 제공하는 데 중요한 단계가 될 수 있겠네요. 😊 근데 MS가 과연 저작권 문제를 해결할 수 있을지 의문이 드네요. 데이터 소싱 방식이 좀 더 투명해져야 할 시점인 것 같아요!
This is super intriguing! Microsoft's diving into how AI training data shapes outputs—mind-blowing stuff. Wonder how they'll credit contributors fairly? 🤔
This Microsoft AI project sounds intriguing! Crediting data contributors could reshape how we value creative input in AI. Curious to see if it'll spark ethical debates or just be a tech flex. 🤔

マイクロソフトは、特定のトレーニング例が生成AIモデルの出力(テキスト、画像、その他のメディアなど)にどのように影響するかを理解することを目的とした新しい研究プロジェクトに着手しています。この取り組みは、12月に掲載された求人広告が最近LinkedInで再浮上し、研究インターンを募集していることで注目されました。
プロジェクトの目標は、写真や本などの特定のデータの影響を「効率的かつ有用に推定」できるようにモデルを訓練する方法を開発することです。求人広告では、現在のニューラルネットワークアーキテクチャは出力の起源を追跡する透明性が欠けており、この問題に対処する説得力のある理由があると指摘しています。その理由の一つとして、将来のAIモデルに価値あるデータを貢献した個人に対してインセンティブ、認知、さらには報酬を提供する可能性が挙げられています。
この研究の背景には、マイクロソフトを含むAI企業が知的財産権をめぐる進行中の法的紛争があります。AIモデルは、著作権で保護された素材を含む公開ウェブサイトから収集された膨大なデータセットで訓練されることがよくあります。AI企業はしばしばフェアユースの原則に基づく保護を主張しますが、アーティスト、プログラマー、著者などさまざまな分野のクリエイターはこの立場に異議を唱えています。
マイクロソフトは現在、ニューヨーク・タイムズからの訴訟を含む法的挑戦に直面しており、同社とOpenAIがその記事をモデル訓練に使用することで著作権を侵害したと主張されています。さらに、複数のソフトウェア開発者が、マイクロソフトのGitHub Copilot AIコーディングアシスタントが彼らの著作権で保護されたコードで訓練されたとして訴訟を起こしています。
「トレーニング時の出所証明」と呼ばれるこの研究プロジェクトには、マイクロソフトリサーチの著名な技術者であるジャロン・ラニアーが関与しています。ラニアーは以前、「データ尊厳」について執筆し、デジタルコンテンツをそのクリエイターと結びつけ、AIの出力への貢献に対して報酬を支払うシステムを提唱しています。
マイクロソフトのプロジェクトはまだ初期段階ですが、Bria、Adobe、Shutterstockなどの他の企業はすでにAIモデルへの貢献に基づいてデータ所有者に報酬を支払う実験を行っています。しかし、大規模なAIラボは一般的に個人貢献者への支払いプログラムを確立しておらず、ライセンス契約や著作権保有者向けのオプトアウトメカニズムを選択しており、これらは煩雑で範囲が限定的です。
マイクロソフトの取り組みは、OpenAIのまだリリースされていないクリエイターがトレーニングデータでの作品の使用を制御できるツールと同様に、概念実証にとどまる可能性があります。また、マイクロソフトがAIの慣行を「倫理的に洗浄」しようとしている、または規制や法的な挑戦を先取りしようとしているとの憶測もあります。
このマイクロソフトの動きは、GoogleやOpenAIなどの他のAIラボが最近、AI開発のための著作権保護の緩和を米国政府に求めたことを考えると特に注目に値します。マイクロソフトはこのプロジェクトに関するコメントの依頼にまだ応じていません。
アリババ・スーパーカップ:Qwen3.8-Max、強化されたコーディング機能とオフィスツールを搭載してデビュー
アリババは公式に、2.4兆パラメータを備えた次世代の基盤大規模モデル「Qwen3.8-Max」を発表しました。この重要なAIの進歩は、コーディングや専門的なオフィス業務といった中核領域において大幅なパフォーマンス向上をもたらし、堅牢な技術能力を示しています。権威あるArena大規模モデルランキングにおいて、Qwen3.8-Maxは目覚ましい結果を残し、AnthropicのClaudeシリーズに次ぐ順位で、業界リーダーの仲間入りを果たしました。このマイルストーンは、複雑なタスクの処理における国内
インドのテック億万長者がマイクロソフトOfficeの競合他社に3,000万ドルを投資
直営企業家であるBhavin Turakhiaは、自身の資金から3,000万ドルを投資しており、エンタープライズAI分野にはまだ新規参入者の余地があると見なしている。彼の最新スタートアップ「Neo」は、以下の核心的な信念に基づいて運営されている:既存の職場用ソフトウェアをチャットボットで単純に補完するだけでは不十分であり、完全なアーキテクチャの再設計が必要である。46歳のTurakhia氏は、野心のあるエンタープライズテック企業への支援の歴史を持つ。過去20年間、彼はDirecti、Radix
元OpenAIのチーフサイエンティストであるイリヤによるSSIが初のモデルを公開
AIは新たな主要なマイルストーンを達成した。OpenAIを去った後、元チーフサイエンティストのイリヤ・スツケルはSafe Superintelligence Inc.(SSI)を設立し、同社は最近、初代モデルに関する詳細を明らかにした。海外のソーシャルメディアからの報告によれば、チームはTTT(Testing While Training)を活用したコンパクトな推論エンジンを開発中であり、これは安全なスーパーインテリジェンス追求における重要な進展である。この新しいアーキテクチャは、モデルが「学
Interesante proyecto, pero lo que realmente necesito es que alguien en la IA me explique por qué mi asistente virtual aún no puede organizarme el escritorio 😅. ¿Esto de la atribución podría cambiar cómo las empresas comparten datos? Me preocupa un poco la transparencia de todo el proceso. Ojalá no sea solo un gesto de relaciones públicas.
Lo de Microsoft parece interesante pero, ¿y la privacidad de los datos? 🤔 A veces siento que con toda esta exploración de IA, estamos perdiendo el control de lo que se usa para entrenar los modelos. ¿Habrá una compensación justa para quienes contribuyeron? No quiero que esto se convierta en otro caso de 'big tech' aprovechándose de 'datos gratis'...
이런 연구는 AI 데이터 기여자들에게 공정한 보상을 제공하는 데 중요한 단계가 될 수 있겠네요. 😊 근데 MS가 과연 저작권 문제를 해결할 수 있을지 의문이 드네요. 데이터 소싱 방식이 좀 더 투명해져야 할 시점인 것 같아요!
This is super intriguing! Microsoft's diving into how AI training data shapes outputs—mind-blowing stuff. Wonder how they'll credit contributors fairly? 🤔
This Microsoft AI project sounds intriguing! Crediting data contributors could reshape how we value creative input in AI. Curious to see if it'll spark ethical debates or just be a tech flex. 🤔





家






