Microsoft는 AI 데이터 기여자 학점을 탐색합니다

마이크로소프트는 텍스트, 이미지 및 기타 미디어와 같은 생성형 AI 모델의 출력에 특정 훈련 사례가 어떻게 영향을 미치는지 이해하는 것을 목표로 하는 새로운 연구 프로젝트를 시작하고 있습니다. 이 이니셔티브는 최근 LinkedIn에서 다시 등장한 12월의 채용 공고에서 강조되었으며, 이 노력에 동참할 연구 인턴을 모집하고 있습니다.
이 프로젝트의 목표는 사진과 책과 같은 특정 데이터가 모델 출력에 미치는 영향을 "효율적이고 유용하게 추정"할 수 있도록 모델을 훈련시키는 방법을 개발하는 것입니다. 채용 공고는 현재의 신경망 아키텍처가 출력의 기원을 추적하는 데 투명성이 부족하며, 이 문제를 해결해야 할 강력한 이유가 있다고 지적합니다. 언급된 이유 중 하나는 미래 AI 모델에 가치 있는 데이터를 기여한 개인에게 인센티브, 인정, 심지어 보상을 제공할 가능성입니다.
이 연구의 배경에는 지적 재산권을 둘러싼 AI 기업들, 포함하여 마이크로소프트가 관련된 지속적인 법적 분쟁이 있습니다. AI 모델은 종종 공공 웹사이트에서 수집된 방대한 데이터셋으로 훈련되며, 여기에는 저작권이 있는 자료가 포함될 수 있습니다. AI 기업들은 종종 공정 사용 원칙에 따라 보호를 주장하지만, 예술가, 프로그래머, 작가 등 다양한 분야의 창작자들은 이에 반대합니다.
마이크로소프트는 현재 뉴욕 타임즈로부터 소송을 당하고 있으며, 이 소송은 마이크로소프트와 OpenAI가 뉴욕 타임즈의 기사를 모델 훈련에 사용하여 저작권을 침해했다고 주장합니다. 또한, 여러 소프트웨어 개발자들이 마이크로소프트의 GitHub Copilot AI 코딩 어시스턴트가 그들의 저작권이 있는 코드를 훈련에 사용했다고 주장하며 소송을 제기했습니다.
"훈련 시간 출처"로 불리는 이 연구 프로젝트에는 마이크로소프트 연구소의 저명한 기술자 Jaron Lanier가 참여하고 있습니다. Lanier는 이전에 "데이터 존엄성"에 대해 글을 썼으며, 디지털 콘텐츠를 창작자와 연결하고 AI 출력에 대한 그들의 기여에 대해 잠재적으로 보상하는 시스템을 옹호했습니다.
마이크로소프트의 프로젝트는 아직 초기 단계에 있지만, Bria, Adobe, Shutterstock과 같은 다른 회사들은 이미 AI 모델에 대한 데이터 소유자의 기여에 따라 보상을 실험하고 있습니다. 그러나 대형 AI 연구소들은 일반적으로 개별 기여자에 대한 지급 프로그램을 설립하지 않고, 대신 라이선스 계약이나 저작권 소유자를 위한 옵트아웃 메커니즘을 선택하며, 이는 번거롭고 범위가 제한적일 수 있습니다.
마이크로소프트의 이니셔티브는 OpenAI의 아직 출시되지 않은 창작자가 자신의 작품이 훈련 데이터에 사용되는 방식을 제어할 수 있는 도구와 유사하게 개념 증명으로 남을 수 있습니다. 또한 마이크로소프트가 AI 관행을 "윤리적으로 세탁"하려 하거나 규제 및 법적 도전을 선제적으로 막으려는 시도일 가능성도 제기되고 있습니다.
이 마이크로소프트의 움직임은 Google과 OpenAI와 같은 다른 AI 연구소들이 최근 미국 정부에 AI 개발을 위한 저작권 보호 완화를 요청한 상황에서 특히 주목할 만합니다. 마이크로소프트는 이 프로젝트에 대한 논평 요청에 아직 응답하지 않았습니다.
관련 기사
딥마인드 CEO 하사비스: 하루 6시간 수면, 보통 오후 1시경에 활력을 느낍니다
Fortune는 최근 Google DeepMind의 CEO인 데미스 하사비스와의 인터뷰를 소개하며, 그의 비전통적인 휴식 및 생산성 접근 방식을 공개했다. 하사비스는 자신이 매우 적게 잠을 자며, 깨어 있는 시간을 두 개의 명확한 업무 블록으로 구조화한다고 밝혔다.그의 수면 습관에 대해 하사비스는 "6시간을 목표로 하지만, 제 습관은 비정형적입니다. 하루 종일 효과적으로 기능할 수 있습니다."라고 언급했다. 그는 6시간 미만의 수면이 뇌 건강
OpenAI와 Anthropic, 매출 부진 속에서도 시장 점유율 확보 경쟁
최근 OpenAI가 매출 목표를 달성하지 못했다는 보도가 나오면서 이번 주 화요일 기술주에 압박이 가해졌음에도 불구하고, 민간 AI 연구소 투자자들은 여전히 탄탄한 모습을 보이고 있다. 노련한 투자자들은 부정적인 언론 보도에도 불구하고 투자 규모를 줄이지 않을 것이라고 밝혔다.분석가들은 현재의 AI 경쟁이 초기 단계에 불과하다고 보고, “승자 독식” 식의
캘리포니아 자율주행차 규정 준수: 과태료, 지오펜스, 100만 마일의 새로운 시대
Guident는 남부 플로리다에서 AuveTech 셔틀을 운영하며, 자사의 원격 모니터링 기술을 활용해 웨스트 팜비치에서 4마일 구간과 보카 라톤에서 1마일 구간의 노선을 관리하고 있다. | 출처: Guident캘리포니아주는 자율주행차에 대한 규제 환경을 재정의하며, 기술 업계의 “빠르게 움직이고 실패를 감수하라(move fast and break thin
관련 특별 주제 추천
의견 (37)
0/500
Interesante proyecto, pero lo que realmente necesito es que alguien en la IA me explique por qué mi asistente virtual aún no puede organizarme el escritorio 😅. ¿Esto de la atribución podría cambiar cómo las empresas comparten datos? Me preocupa un poco la transparencia de todo el proceso. Ojalá no sea solo un gesto de relaciones públicas.
Lo de Microsoft parece interesante pero, ¿y la privacidad de los datos? 🤔 A veces siento que con toda esta exploración de IA, estamos perdiendo el control de lo que se usa para entrenar los modelos. ¿Habrá una compensación justa para quienes contribuyeron? No quiero que esto se convierta en otro caso de 'big tech' aprovechándose de 'datos gratis'...
이런 연구는 AI 데이터 기여자들에게 공정한 보상을 제공하는 데 중요한 단계가 될 수 있겠네요. 😊 근데 MS가 과연 저작권 문제를 해결할 수 있을지 의문이 드네요. 데이터 소싱 방식이 좀 더 투명해져야 할 시점인 것 같아요!
This is super intriguing! Microsoft's diving into how AI training data shapes outputs—mind-blowing stuff. Wonder how they'll credit contributors fairly? 🤔
This Microsoft AI project sounds intriguing! Crediting data contributors could reshape how we value creative input in AI. Curious to see if it'll spark ethical debates or just be a tech flex. 🤔

마이크로소프트는 텍스트, 이미지 및 기타 미디어와 같은 생성형 AI 모델의 출력에 특정 훈련 사례가 어떻게 영향을 미치는지 이해하는 것을 목표로 하는 새로운 연구 프로젝트를 시작하고 있습니다. 이 이니셔티브는 최근 LinkedIn에서 다시 등장한 12월의 채용 공고에서 강조되었으며, 이 노력에 동참할 연구 인턴을 모집하고 있습니다.
이 프로젝트의 목표는 사진과 책과 같은 특정 데이터가 모델 출력에 미치는 영향을 "효율적이고 유용하게 추정"할 수 있도록 모델을 훈련시키는 방법을 개발하는 것입니다. 채용 공고는 현재의 신경망 아키텍처가 출력의 기원을 추적하는 데 투명성이 부족하며, 이 문제를 해결해야 할 강력한 이유가 있다고 지적합니다. 언급된 이유 중 하나는 미래 AI 모델에 가치 있는 데이터를 기여한 개인에게 인센티브, 인정, 심지어 보상을 제공할 가능성입니다.
이 연구의 배경에는 지적 재산권을 둘러싼 AI 기업들, 포함하여 마이크로소프트가 관련된 지속적인 법적 분쟁이 있습니다. AI 모델은 종종 공공 웹사이트에서 수집된 방대한 데이터셋으로 훈련되며, 여기에는 저작권이 있는 자료가 포함될 수 있습니다. AI 기업들은 종종 공정 사용 원칙에 따라 보호를 주장하지만, 예술가, 프로그래머, 작가 등 다양한 분야의 창작자들은 이에 반대합니다.
마이크로소프트는 현재 뉴욕 타임즈로부터 소송을 당하고 있으며, 이 소송은 마이크로소프트와 OpenAI가 뉴욕 타임즈의 기사를 모델 훈련에 사용하여 저작권을 침해했다고 주장합니다. 또한, 여러 소프트웨어 개발자들이 마이크로소프트의 GitHub Copilot AI 코딩 어시스턴트가 그들의 저작권이 있는 코드를 훈련에 사용했다고 주장하며 소송을 제기했습니다.
"훈련 시간 출처"로 불리는 이 연구 프로젝트에는 마이크로소프트 연구소의 저명한 기술자 Jaron Lanier가 참여하고 있습니다. Lanier는 이전에 "데이터 존엄성"에 대해 글을 썼으며, 디지털 콘텐츠를 창작자와 연결하고 AI 출력에 대한 그들의 기여에 대해 잠재적으로 보상하는 시스템을 옹호했습니다.
마이크로소프트의 프로젝트는 아직 초기 단계에 있지만, Bria, Adobe, Shutterstock과 같은 다른 회사들은 이미 AI 모델에 대한 데이터 소유자의 기여에 따라 보상을 실험하고 있습니다. 그러나 대형 AI 연구소들은 일반적으로 개별 기여자에 대한 지급 프로그램을 설립하지 않고, 대신 라이선스 계약이나 저작권 소유자를 위한 옵트아웃 메커니즘을 선택하며, 이는 번거롭고 범위가 제한적일 수 있습니다.
마이크로소프트의 이니셔티브는 OpenAI의 아직 출시되지 않은 창작자가 자신의 작품이 훈련 데이터에 사용되는 방식을 제어할 수 있는 도구와 유사하게 개념 증명으로 남을 수 있습니다. 또한 마이크로소프트가 AI 관행을 "윤리적으로 세탁"하려 하거나 규제 및 법적 도전을 선제적으로 막으려는 시도일 가능성도 제기되고 있습니다.
이 마이크로소프트의 움직임은 Google과 OpenAI와 같은 다른 AI 연구소들이 최근 미국 정부에 AI 개발을 위한 저작권 보호 완화를 요청한 상황에서 특히 주목할 만합니다. 마이크로소프트는 이 프로젝트에 대한 논평 요청에 아직 응답하지 않았습니다.
딥마인드 CEO 하사비스: 하루 6시간 수면, 보통 오후 1시경에 활력을 느낍니다
Fortune는 최근 Google DeepMind의 CEO인 데미스 하사비스와의 인터뷰를 소개하며, 그의 비전통적인 휴식 및 생산성 접근 방식을 공개했다. 하사비스는 자신이 매우 적게 잠을 자며, 깨어 있는 시간을 두 개의 명확한 업무 블록으로 구조화한다고 밝혔다.그의 수면 습관에 대해 하사비스는 "6시간을 목표로 하지만, 제 습관은 비정형적입니다. 하루 종일 효과적으로 기능할 수 있습니다."라고 언급했다. 그는 6시간 미만의 수면이 뇌 건강
OpenAI와 Anthropic, 매출 부진 속에서도 시장 점유율 확보 경쟁
최근 OpenAI가 매출 목표를 달성하지 못했다는 보도가 나오면서 이번 주 화요일 기술주에 압박이 가해졌음에도 불구하고, 민간 AI 연구소 투자자들은 여전히 탄탄한 모습을 보이고 있다. 노련한 투자자들은 부정적인 언론 보도에도 불구하고 투자 규모를 줄이지 않을 것이라고 밝혔다.분석가들은 현재의 AI 경쟁이 초기 단계에 불과하다고 보고, “승자 독식” 식의
Interesante proyecto, pero lo que realmente necesito es que alguien en la IA me explique por qué mi asistente virtual aún no puede organizarme el escritorio 😅. ¿Esto de la atribución podría cambiar cómo las empresas comparten datos? Me preocupa un poco la transparencia de todo el proceso. Ojalá no sea solo un gesto de relaciones públicas.
Lo de Microsoft parece interesante pero, ¿y la privacidad de los datos? 🤔 A veces siento que con toda esta exploración de IA, estamos perdiendo el control de lo que se usa para entrenar los modelos. ¿Habrá una compensación justa para quienes contribuyeron? No quiero que esto se convierta en otro caso de 'big tech' aprovechándose de 'datos gratis'...
이런 연구는 AI 데이터 기여자들에게 공정한 보상을 제공하는 데 중요한 단계가 될 수 있겠네요. 😊 근데 MS가 과연 저작권 문제를 해결할 수 있을지 의문이 드네요. 데이터 소싱 방식이 좀 더 투명해져야 할 시점인 것 같아요!
This is super intriguing! Microsoft's diving into how AI training data shapes outputs—mind-blowing stuff. Wonder how they'll credit contributors fairly? 🤔
This Microsoft AI project sounds intriguing! Crediting data contributors could reshape how we value creative input in AI. Curious to see if it'll spark ethical debates or just be a tech flex. 🤔





집






