堆栈溢出与Reddit和Twitter一起向AI公司收取培训数据

专注于人工智能的公司的财务需求正在上升,Stack Overflow 现在加入了 Reddit 和 Twitter 的行列,计划向人工智能公司收取使用其数据训练模型的费用。
人工智能技术,如驱动 ChatGPT、Google Bard 和 Bing Chat 的技术,极大地依赖于庞大的数据集进行训练。像 OpenAI 和 Google 这样的公司遍寻网络以收集数据,帮助训练其大型语言模型(LLM)。这些模型在众多参数上进行微调,以增强其有效处理自然语言的能力。
另见:这项新技术可能超越 GPT-4 及其类似技术
训练数据涵盖了广泛的主题,从全球历史到软件开发,这些都为人工智能的“智能”做出了贡献。它还包括语法、对话细微差别和各种风格,使人工智能能够生成模仿人类沟通的响应。
据《Wired》报道,Stack Overflow 计划于今年夏天开始向人工智能公司收费,以访问其超过5000万个问题和答案的庞大数据库,这些数据用于训练人工智能项目。
Stack Overflow 是程序员的重要中心,提供了一个协作空间,其社区主要是开发者,可以在这里寻求编码问题的解决方案并学习各种编程语言。拥有超过2000万用户,它是软件开发领域任何人的首选资源。
另见:最佳人工智能聊天机器人:ChatGPT 及其替代品值得一试
在公司网站上最近的一篇帖子中,Stack Overflow 的首席执行官 Prashanth Chandrasekar 表达了对允许人工智能模型在开发者贡献的大量数据上进行训练而不公开分享这些模型所获洞察的担忧。他警告说,这种做法可能导致“公地悲剧”。
去年秋天,该平台因禁止使用 ChatGPT 生成的文本创建帖子而成为头条新闻,理由是这可能对网站及其社区造成潜在危害。在另一份声明中,Chandrasekar 强调了将知识贡献回公共平台的重要性。他警告说,如果没有这样做,我们可能会面临知识集中在人工智能模型中的情景,仅通过付费服务才能访问。
相关文章
内部细节曝光:下一代 Gemini 算力紧张,内部团队在开发优先级和资源分配上存在分歧
报告显示,谷歌备受期待的下一代 Gemini 模型发布已被推迟。由于内部在开发优先级和资源分配上存在分歧,加上计算能力有限以及复杂的审批流程,导致发布时间延后了两个月。尽管谷歌拥有定制的 TPU 芯片,但由于模型训练、Google Cloud 服务以及众多消费和企业级 AI 应用对计算资源的需求相互竞争,谷歌仍面临计算资源短缺的问题。目前,高层管理人员正通过组织结构调整来解决这些部门间的冲突。与此同时,领导层也发生了变化,联合创始人谢尔盖·布林越来越多地参与到核心模型训练中,并倡导将资源专门用于
OpenAI 否认增长放缓担忧,称多个业务部门加速发展
针对外界对其销售增长放缓及未达内部基准的质疑,人工智能领域的领军企业 OpenAI 于 4 月 28 日(星期二)发表了一份信心十足的声明。该公司澄清称,其消费产品和企业服务正在快速推进,直接驳斥了近期关于业务放缓的猜测。针对该公司“未达成多项内部目标”的说法,OpenAI 将这些报道斥为“典型的标题党”。公司强调了企业对 AI 集成的强劲需求,并指出其广告业务早期增长前景良好。据 OpenAI 内部人士透露,公司内部情绪依然乐观。尽管市场竞争日益激烈,但公司正在向投资者传递信心,声称其商业
阿里巴巴超级杯:Qwen3.8-Max 重磅登场,代码与办公工具能力全面升级
阿里巴巴正式发布了Qwen3.8-Max,这是一款拥有2.4万亿参数的下一代基础大模型。这一重大AI进展在编码和专业办公任务等核心领域带来了显著的性能提升,展现了强大的技术能力。在权威的Arena大模型排名中,Qwen3.8-Max取得了令人瞩目的成绩,仅次于Anthropic的Claude系列,位居行业前列。这一里程碑标志着国内大模型在处理复杂任务方面取得了快速进展,为开发者和企业用户提供了先进的智能工具。该模型的API现已在Qwen AI平台上上线,并集成到新推出的“Qwen Offic
相关专题推荐
评论 (49)
0/500
Qué interesante cómo ahora todos quieren cobrar por sus datos 😅 Primero Reddit y Twitter, ahora Stack Overflow. Me pregunto si esto hará que los modelos de IA sean menos accesibles para desarrolladores pequeños o si simplemente pasarán el costo a los usuarios finales. Al final siempre pagamos nosotros...
It's wild that Stack Overflow is charging AI companies for data now! 🤯 I get why—training models is a goldmine, but it feels like the internet's becoming a paywall party. Will this make AI smarter or just pricier?
Cool to see Stack Overflow cashing in on AI training data! But is it fair to charge when developers share knowledge for free? 🤔 Makes me wonder if open-source vibes are fading in tech.
Interesting move by Stack Overflow! Charging AI companies for data access feels like a smart play, but I wonder if it'll push smaller AI startups out of the game. 🤔 Big players like ChatGPT can probably afford it, but what about the little guys?
¡Por fin, Stack Overflow está cobrando por sus datos! Ya era hora de que las empresas de IA empezaran a pagar por los recursos que utilizan. Ojalá lo hubieran hecho antes 🤔💸

专注于人工智能的公司的财务需求正在上升,Stack Overflow 现在加入了 Reddit 和 Twitter 的行列,计划向人工智能公司收取使用其数据训练模型的费用。
人工智能技术,如驱动 ChatGPT、Google Bard 和 Bing Chat 的技术,极大地依赖于庞大的数据集进行训练。像 OpenAI 和 Google 这样的公司遍寻网络以收集数据,帮助训练其大型语言模型(LLM)。这些模型在众多参数上进行微调,以增强其有效处理自然语言的能力。
另见:这项新技术可能超越 GPT-4 及其类似技术
训练数据涵盖了广泛的主题,从全球历史到软件开发,这些都为人工智能的“智能”做出了贡献。它还包括语法、对话细微差别和各种风格,使人工智能能够生成模仿人类沟通的响应。
据《Wired》报道,Stack Overflow 计划于今年夏天开始向人工智能公司收费,以访问其超过5000万个问题和答案的庞大数据库,这些数据用于训练人工智能项目。
Stack Overflow 是程序员的重要中心,提供了一个协作空间,其社区主要是开发者,可以在这里寻求编码问题的解决方案并学习各种编程语言。拥有超过2000万用户,它是软件开发领域任何人的首选资源。
另见:最佳人工智能聊天机器人:ChatGPT 及其替代品值得一试
在公司网站上最近的一篇帖子中,Stack Overflow 的首席执行官 Prashanth Chandrasekar 表达了对允许人工智能模型在开发者贡献的大量数据上进行训练而不公开分享这些模型所获洞察的担忧。他警告说,这种做法可能导致“公地悲剧”。
去年秋天,该平台因禁止使用 ChatGPT 生成的文本创建帖子而成为头条新闻,理由是这可能对网站及其社区造成潜在危害。在另一份声明中,Chandrasekar 强调了将知识贡献回公共平台的重要性。他警告说,如果没有这样做,我们可能会面临知识集中在人工智能模型中的情景,仅通过付费服务才能访问。
内部细节曝光:下一代 Gemini 算力紧张,内部团队在开发优先级和资源分配上存在分歧
报告显示,谷歌备受期待的下一代 Gemini 模型发布已被推迟。由于内部在开发优先级和资源分配上存在分歧,加上计算能力有限以及复杂的审批流程,导致发布时间延后了两个月。尽管谷歌拥有定制的 TPU 芯片,但由于模型训练、Google Cloud 服务以及众多消费和企业级 AI 应用对计算资源的需求相互竞争,谷歌仍面临计算资源短缺的问题。目前,高层管理人员正通过组织结构调整来解决这些部门间的冲突。与此同时,领导层也发生了变化,联合创始人谢尔盖·布林越来越多地参与到核心模型训练中,并倡导将资源专门用于
OpenAI 否认增长放缓担忧,称多个业务部门加速发展
针对外界对其销售增长放缓及未达内部基准的质疑,人工智能领域的领军企业 OpenAI 于 4 月 28 日(星期二)发表了一份信心十足的声明。该公司澄清称,其消费产品和企业服务正在快速推进,直接驳斥了近期关于业务放缓的猜测。针对该公司“未达成多项内部目标”的说法,OpenAI 将这些报道斥为“典型的标题党”。公司强调了企业对 AI 集成的强劲需求,并指出其广告业务早期增长前景良好。据 OpenAI 内部人士透露,公司内部情绪依然乐观。尽管市场竞争日益激烈,但公司正在向投资者传递信心,声称其商业
阿里巴巴超级杯:Qwen3.8-Max 重磅登场,代码与办公工具能力全面升级
阿里巴巴正式发布了Qwen3.8-Max,这是一款拥有2.4万亿参数的下一代基础大模型。这一重大AI进展在编码和专业办公任务等核心领域带来了显著的性能提升,展现了强大的技术能力。在权威的Arena大模型排名中,Qwen3.8-Max取得了令人瞩目的成绩,仅次于Anthropic的Claude系列,位居行业前列。这一里程碑标志着国内大模型在处理复杂任务方面取得了快速进展,为开发者和企业用户提供了先进的智能工具。该模型的API现已在Qwen AI平台上上线,并集成到新推出的“Qwen Offic
Qué interesante cómo ahora todos quieren cobrar por sus datos 😅 Primero Reddit y Twitter, ahora Stack Overflow. Me pregunto si esto hará que los modelos de IA sean menos accesibles para desarrolladores pequeños o si simplemente pasarán el costo a los usuarios finales. Al final siempre pagamos nosotros...
It's wild that Stack Overflow is charging AI companies for data now! 🤯 I get why—training models is a goldmine, but it feels like the internet's becoming a paywall party. Will this make AI smarter or just pricier?
Cool to see Stack Overflow cashing in on AI training data! But is it fair to charge when developers share knowledge for free? 🤔 Makes me wonder if open-source vibes are fading in tech.
Interesting move by Stack Overflow! Charging AI companies for data access feels like a smart play, but I wonder if it'll push smaller AI startups out of the game. 🤔 Big players like ChatGPT can probably afford it, but what about the little guys?
¡Por fin, Stack Overflow está cobrando por sus datos! Ya era hora de que las empresas de IA empezaran a pagar por los recursos que utilizan. Ojalá lo hubieran hecho antes 🤔💸





首页






