Microsoft исследует вкладчиков Clitring Ai Data Data

Microsoft приступает к новому исследовательскому проекту, направленному на изучение того, как конкретные примеры обучения влияют на результаты генеративных моделей ИИ, таких как текст, изображения и другие медиа. Эта инициатива была отмечена в объявлении о вакансии от декабря, которое недавно вновь появилось на LinkedIn, с предложением присоединиться к проекту в качестве стажера-исследователя.
Цель проекта — разработать метод обучения моделей, чтобы влияние конкретных данных, таких как фотографии и книги, на их результаты можно было «эффективно и полезно оценивать». В объявлении о вакансии указано, что текущие архитектуры нейронных сетей не обладают прозрачностью в отслеживании происхождения их результатов, и есть веские причины для решения этой проблемы. Одна из упомянутых причин — возможность предоставления стимулов, признания и даже компенсации людям, которые предоставляют ценные данные для будущих моделей ИИ.
На фоне этого исследования продолжаются судебные разбирательства с участием компаний, занимающихся ИИ, включая Microsoft, по вопросам прав интеллектуальной собственности. Модели ИИ часто обучаются на огромных наборах данных, собранных с публичных веб-сайтов, которые могут включать материалы, защищенные авторским правом. Хотя компании, занимающиеся ИИ, часто ссылаются на доктрину добросовестного использования, создатели из различных областей — художники, программисты, авторы — оспаривают эту позицию.
Microsoft в настоящее время сталкивается с юридическими проблемами, включая иск от The New York Times, в котором утверждается, что Microsoft и OpenAI нарушили авторские права, используя их статьи для обучения своих моделей. Кроме того, несколько разработчиков программного обеспечения подали в суд на Microsoft из-за их ИИ-ассистента для кодирования GitHub Copilot, утверждая, что он был обучен на их коде, защищенном авторским правом.
Исследовательский проект, названный «provenance во время обучения», включает в себя Джарона Ланира, известного технолога из Microsoft Research. Ланир ранее писал о «достоинстве данных», выступая за систему, которая связывает цифровой контент с его создателями и потенциально компенсирует их вклад в результаты ИИ.
Хотя проект Microsoft находится на ранней стадии, другие компании, такие как Bria, Adobe и Shutterstock, уже экспериментируют с компенсацией владельцам данных на основе их вклада в модели ИИ. Однако крупные лаборатории ИИ в целом не создали программ выплат для отдельных участников, предпочитая лицензионные соглашения или механизмы отказа для правообладателей, которые могут быть сложными и ограниченными по охвату.
Инициатива Microsoft может остаться на уровне доказательства концепции, подобно еще не выпущенному инструменту OpenAI для контроля создателями использования их работ в обучающих данных. Также есть предположения, что Microsoft, возможно, пытается «этически отмыть» свои практики в области ИИ или предвосхитить регуляторные и юридические вызовы.
Этот шаг Microsoft особенно примечателен на фоне недавних призывов других лабораторий ИИ, таких как Google и OpenAI, к правительству США ослабить защиту авторских прав для разработки ИИ. Microsoft пока не ответила на запросы о комментариях по этому проекту.
Связанная статья
Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи.
В недавнем интервью журналу Fortune генеральный директор Google DeepMind Демис Хаассабис раскрыл свой нестандартный подход к отдыху и продуктивности. Хаассабис признался, что спит очень мало, распределяя свои бодрствующие часы на два отдельных рабочи
OpenAI и Anthropic борются за долю рынка, несмотря на снижение выручки
Несмотря на недавние сообщения о том, что OpenAI не достигла целевых показателей по выручке, что во вторник оказало давление на акции технологических компаний, частные инвесторы, вкладывающие средства
Соблюдение требований к автономным транспортным средствам в Калифорнии: новая эра штрафов, геозоны и 1 млн миль
Компания Guident эксплуатирует шаттл AuveTech в Южной Флориде, обслуживая маршрут протяженностью четыре мили в Вест-Палм-Бич и маршрут протяженностью одну милю в Бока-Ратоне с использованием своей тех
Рекомендации по связанным специальным темам
Комментарии (37)
Interesante proyecto, pero lo que realmente necesito es que alguien en la IA me explique por qué mi asistente virtual aún no puede organizarme el escritorio 😅. ¿Esto de la atribución podría cambiar cómo las empresas comparten datos? Me preocupa un poco la transparencia de todo el proceso. Ojalá no sea solo un gesto de relaciones públicas.
Lo de Microsoft parece interesante pero, ¿y la privacidad de los datos? 🤔 A veces siento que con toda esta exploración de IA, estamos perdiendo el control de lo que se usa para entrenar los modelos. ¿Habrá una compensación justa para quienes contribuyeron? No quiero que esto se convierta en otro caso de 'big tech' aprovechándose de 'datos gratis'...
이런 연구는 AI 데이터 기여자들에게 공정한 보상을 제공하는 데 중요한 단계가 될 수 있겠네요. 😊 근데 MS가 과연 저작권 문제를 해결할 수 있을지 의문이 드네요. 데이터 소싱 방식이 좀 더 투명해져야 할 시점인 것 같아요!
This is super intriguing! Microsoft's diving into how AI training data shapes outputs—mind-blowing stuff. Wonder how they'll credit contributors fairly? 🤔
This Microsoft AI project sounds intriguing! Crediting data contributors could reshape how we value creative input in AI. Curious to see if it'll spark ethical debates or just be a tech flex. 🤔

Microsoft приступает к новому исследовательскому проекту, направленному на изучение того, как конкретные примеры обучения влияют на результаты генеративных моделей ИИ, таких как текст, изображения и другие медиа. Эта инициатива была отмечена в объявлении о вакансии от декабря, которое недавно вновь появилось на LinkedIn, с предложением присоединиться к проекту в качестве стажера-исследователя.
Цель проекта — разработать метод обучения моделей, чтобы влияние конкретных данных, таких как фотографии и книги, на их результаты можно было «эффективно и полезно оценивать». В объявлении о вакансии указано, что текущие архитектуры нейронных сетей не обладают прозрачностью в отслеживании происхождения их результатов, и есть веские причины для решения этой проблемы. Одна из упомянутых причин — возможность предоставления стимулов, признания и даже компенсации людям, которые предоставляют ценные данные для будущих моделей ИИ.
На фоне этого исследования продолжаются судебные разбирательства с участием компаний, занимающихся ИИ, включая Microsoft, по вопросам прав интеллектуальной собственности. Модели ИИ часто обучаются на огромных наборах данных, собранных с публичных веб-сайтов, которые могут включать материалы, защищенные авторским правом. Хотя компании, занимающиеся ИИ, часто ссылаются на доктрину добросовестного использования, создатели из различных областей — художники, программисты, авторы — оспаривают эту позицию.
Microsoft в настоящее время сталкивается с юридическими проблемами, включая иск от The New York Times, в котором утверждается, что Microsoft и OpenAI нарушили авторские права, используя их статьи для обучения своих моделей. Кроме того, несколько разработчиков программного обеспечения подали в суд на Microsoft из-за их ИИ-ассистента для кодирования GitHub Copilot, утверждая, что он был обучен на их коде, защищенном авторским правом.
Исследовательский проект, названный «provenance во время обучения», включает в себя Джарона Ланира, известного технолога из Microsoft Research. Ланир ранее писал о «достоинстве данных», выступая за систему, которая связывает цифровой контент с его создателями и потенциально компенсирует их вклад в результаты ИИ.
Хотя проект Microsoft находится на ранней стадии, другие компании, такие как Bria, Adobe и Shutterstock, уже экспериментируют с компенсацией владельцам данных на основе их вклада в модели ИИ. Однако крупные лаборатории ИИ в целом не создали программ выплат для отдельных участников, предпочитая лицензионные соглашения или механизмы отказа для правообладателей, которые могут быть сложными и ограниченными по охвату.
Инициатива Microsoft может остаться на уровне доказательства концепции, подобно еще не выпущенному инструменту OpenAI для контроля создателями использования их работ в обучающих данных. Также есть предположения, что Microsoft, возможно, пытается «этически отмыть» свои практики в области ИИ или предвосхитить регуляторные и юридические вызовы.
Этот шаг Microsoft особенно примечателен на фоне недавних призывов других лабораторий ИИ, таких как Google и OpenAI, к правительству США ослабить защиту авторских прав для разработки ИИ. Microsoft пока не ответила на запросы о комментариях по этому проекту.
Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи.
В недавнем интервью журналу Fortune генеральный директор Google DeepMind Демис Хаассабис раскрыл свой нестандартный подход к отдыху и продуктивности. Хаассабис признался, что спит очень мало, распределяя свои бодрствующие часы на два отдельных рабочи
OpenAI и Anthropic борются за долю рынка, несмотря на снижение выручки
Несмотря на недавние сообщения о том, что OpenAI не достигла целевых показателей по выручке, что во вторник оказало давление на акции технологических компаний, частные инвесторы, вкладывающие средства
Interesante proyecto, pero lo que realmente necesito es que alguien en la IA me explique por qué mi asistente virtual aún no puede organizarme el escritorio 😅. ¿Esto de la atribución podría cambiar cómo las empresas comparten datos? Me preocupa un poco la transparencia de todo el proceso. Ojalá no sea solo un gesto de relaciones públicas.
Lo de Microsoft parece interesante pero, ¿y la privacidad de los datos? 🤔 A veces siento que con toda esta exploración de IA, estamos perdiendo el control de lo que se usa para entrenar los modelos. ¿Habrá una compensación justa para quienes contribuyeron? No quiero que esto se convierta en otro caso de 'big tech' aprovechándose de 'datos gratis'...
이런 연구는 AI 데이터 기여자들에게 공정한 보상을 제공하는 데 중요한 단계가 될 수 있겠네요. 😊 근데 MS가 과연 저작권 문제를 해결할 수 있을지 의문이 드네요. 데이터 소싱 방식이 좀 더 투명해져야 할 시점인 것 같아요!
This is super intriguing! Microsoft's diving into how AI training data shapes outputs—mind-blowing stuff. Wonder how they'll credit contributors fairly? 🤔
This Microsoft AI project sounds intriguing! Crediting data contributors could reshape how we value creative input in AI. Curious to see if it'll spark ethical debates or just be a tech flex. 🤔





Дом






