开放的小语言模型,用于负责任的,实用的AI
地缘政治对人工智能发展和使用的影
随着全球事件持续塑造世界,技术领域尤其是人工智能市场不可避免地受到影响。这种影响涉及人工智能的开发、方法论及在企业中的应用。当前人工智能领域充满兴奋与怀疑,一些人拥抱其潜力,另一些人因其早期发展阶段保持谨慎。
传统的闭环大型语言模型(LLMs),如知名供应商提供的模型,正面临来自更开放模型的竞争,如Llama、DeepSeek和百度的Ernie X1。相比之下,开源开发提供了透明度和社区贡献机会,符合“负责任人工智能”的理念。这种方法考虑了环境影响、使用伦理、学习数据来源以及数据主权、语言和政治相关问题。
以成功开源商业模式闻名的Red Hat,热衷于将协作和透明的方法应用于人工智能。在与Red Hat EMEA首席技术官Julio Guijarro的近期对话中,我们讨论了他们如何以负责任和可持续的方式利用生成式人工智能为企业增加价值的策略。
教育与透明度的需求
Julio强调了人工智能教育的重要性,指出其复杂性常使其对许多人来说是个“黑盒”。“人工智能的内在机制深深植根于复杂的科学和数学,很大程度上仍不为人知,”他说。“当人工智能在封闭环境中开发时,这种透明度不足问题更加严重。”
其他挑战包括某些语言的代表性不足、数据主权问题和信任问题。Julio指出:“数据是组织最宝贵的资产,企业必须意识到将敏感数据暴露给具有不同隐私政策的公共平台的风险。”
Red Hat的人工智能方法
Red Hat应对全球人工智能需求的方法,专注于为终端用户提供利益,同时解决与传统人工智能服务相关的疑虑和限制。Julio强调了小型语言模型(SLMs)的潜力。这些模型可在本地或混合云上运行,使用非专用硬件,并可访问本地业务数据。SLM高效且任务特定,所需资源比LLM少。
SLM的关键优势之一是能够跟上快速变化的业务数据。“大型语言模型可能很快过时,因为数据生成发生在大云之外,紧邻您的业务流程,”Julio解释说。
成本是另一个关键因素。“使用LLM的客户服务查询可能会产生显著的隐性成本,”Julio说。“在人工智能之前,数据查询的范围和成本是可预测的。使用LLM,每次交互都可能增加成本,因为它们基于迭代模型运行。本地运行模型可以更好地控制成本,因为它们与您的基础设施相关,而不是按查询收费。”
幸运的是,组织无需大量投资于GPU等专用硬件。Red Hat致力于优化模型以在标准硬件上运行,专注于企业所需的具体模型,而不是处理大型通用数据集的每次查询。
小型本地化模型的重要性
通过使用和引用本地数据,结果可定制以满足特定需求。Julio提到了阿拉伯语和葡萄牙语地区项目,这些地区未被以英语为中心的大型语言模型很好服务。
大型语言模型存在实际挑战,包括可能影响时间敏感或面向客户应用的延迟问题。将资源和结果保持在用户附近可缓解这些问题。
信任是负责任人工智能的另一个关键方面。Red Hat倡导开放平台、工具和模型,以提高透明度并允许更广泛的社区参与。“这对每个人都至关重要,”Julio说。“我们正在构建能力以民主化人工智能,不仅通过发布模型,还通过提供工具让用户复制、调整和提供服务。”
Red Hat最近收购Neural Magic,旨在帮助企业更轻松地扩展人工智能,提高推理性能,并通过vLLM项目提供更多构建和部署人工智能工作负载的选择。此外,Red Hat与IBM Research合作发布了InstructLab,将人工智能开发开放给具有宝贵业务知识的非数据科学家。
人工智能的未来
尽管对人工智能泡沫存在诸多猜测,Red Hat相信人工智能的未来将针对特定用例定制,并保持开源。这种方法将在经济上可行且对所有人可访问。正如Red Hat首席执行官Matt Hicks所说:“人工智能的未来是开放的。”
相关文章
内部细节曝光:下一代 Gemini 算力紧张,内部团队在开发优先级和资源分配上存在分歧
报告显示,谷歌备受期待的下一代 Gemini 模型发布已被推迟。由于内部在开发优先级和资源分配上存在分歧,加上计算能力有限以及复杂的审批流程,导致发布时间延后了两个月。尽管谷歌拥有定制的 TPU 芯片,但由于模型训练、Google Cloud 服务以及众多消费和企业级 AI 应用对计算资源的需求相互竞争,谷歌仍面临计算资源短缺的问题。目前,高层管理人员正通过组织结构调整来解决这些部门间的冲突。与此同时,领导层也发生了变化,联合创始人谢尔盖·布林越来越多地参与到核心模型训练中,并倡导将资源专门用于
OpenAI 否认增长放缓担忧,称多个业务部门加速发展
针对外界对其销售增长放缓及未达内部基准的质疑,人工智能领域的领军企业 OpenAI 于 4 月 28 日(星期二)发表了一份信心十足的声明。该公司澄清称,其消费产品和企业服务正在快速推进,直接驳斥了近期关于业务放缓的猜测。针对该公司“未达成多项内部目标”的说法,OpenAI 将这些报道斥为“典型的标题党”。公司强调了企业对 AI 集成的强劲需求,并指出其广告业务早期增长前景良好。据 OpenAI 内部人士透露,公司内部情绪依然乐观。尽管市场竞争日益激烈,但公司正在向投资者传递信心,声称其商业
阿里巴巴超级杯:Qwen3.8-Max 重磅登场,代码与办公工具能力全面升级
阿里巴巴正式发布了Qwen3.8-Max,这是一款拥有2.4万亿参数的下一代基础大模型。这一重大AI进展在编码和专业办公任务等核心领域带来了显著的性能提升,展现了强大的技术能力。在权威的Arena大模型排名中,Qwen3.8-Max取得了令人瞩目的成绩,仅次于Anthropic的Claude系列,位居行业前列。这一里程碑标志着国内大模型在处理复杂任务方面取得了快速进展,为开发者和企业用户提供了先进的智能工具。该模型的API现已在Qwen AI平台上上线,并集成到新推出的“Qwen Offic
相关专题推荐
评论 (14)
0/500
이 논의는 사실이네요. 실제로 우리 회사에서도 AI 배포 시 지역 규제 때문에 모델을 커스터마이징해야 했어요. 오픈소스 소형 언어 모델이 더 유연한 솔루션이 될 수 있을 것 같아요. 특히 데이터 프라이버시가 중요한 경우에는요. 레드햇의 접근 방식이 현실적인 문제에 잘 맞는 것 같아요 👍
This article on small language models is super intriguing! I love how it dives into geopolitics shaping AI—makes me wonder how global policies will steer practical AI use in businesses. 🤔
This article on small language models is super intriguing! I love how it dives into practical AI solutions. Makes me wonder how enterprises will balance efficiency and ethics in AI deployment. Anyone else thinking about the real-world impact? 😄
This article on small language models is super intriguing! 😄 I love how it dives into practical AI with a responsible twist. Makes me wonder if we'll see more companies adopt this approach to dodge ethical pitfalls.
Red Hat's focus on open, small language models is refreshing! It's great to see a company pushing for responsible AI. The practical applications are impressive, but I wish there were more examples to learn from. Still, it's a step in the right direction. Keep it up, Red Hat! 🌟
地缘政治对人工智能发展和使用的影
随着全球事件持续塑造世界,技术领域尤其是人工智能市场不可避免地受到影响。这种影响涉及人工智能的开发、方法论及在企业中的应用。当前人工智能领域充满兴奋与怀疑,一些人拥抱其潜力,另一些人因其早期发展阶段保持谨慎。
传统的闭环大型语言模型(LLMs),如知名供应商提供的模型,正面临来自更开放模型的竞争,如Llama、DeepSeek和百度的Ernie X1。相比之下,开源开发提供了透明度和社区贡献机会,符合“负责任人工智能”的理念。这种方法考虑了环境影响、使用伦理、学习数据来源以及数据主权、语言和政治相关问题。
以成功开源商业模式闻名的Red Hat,热衷于将协作和透明的方法应用于人工智能。在与Red Hat EMEA首席技术官Julio Guijarro的近期对话中,我们讨论了他们如何以负责任和可持续的方式利用生成式人工智能为企业增加价值的策略。
教育与透明度的需求
Julio强调了人工智能教育的重要性,指出其复杂性常使其对许多人来说是个“黑盒”。“人工智能的内在机制深深植根于复杂的科学和数学,很大程度上仍不为人知,”他说。“当人工智能在封闭环境中开发时,这种透明度不足问题更加严重。”
其他挑战包括某些语言的代表性不足、数据主权问题和信任问题。Julio指出:“数据是组织最宝贵的资产,企业必须意识到将敏感数据暴露给具有不同隐私政策的公共平台的风险。”
Red Hat的人工智能方法
Red Hat应对全球人工智能需求的方法,专注于为终端用户提供利益,同时解决与传统人工智能服务相关的疑虑和限制。Julio强调了小型语言模型(SLMs)的潜力。这些模型可在本地或混合云上运行,使用非专用硬件,并可访问本地业务数据。SLM高效且任务特定,所需资源比LLM少。
SLM的关键优势之一是能够跟上快速变化的业务数据。“大型语言模型可能很快过时,因为数据生成发生在大云之外,紧邻您的业务流程,”Julio解释说。
成本是另一个关键因素。“使用LLM的客户服务查询可能会产生显著的隐性成本,”Julio说。“在人工智能之前,数据查询的范围和成本是可预测的。使用LLM,每次交互都可能增加成本,因为它们基于迭代模型运行。本地运行模型可以更好地控制成本,因为它们与您的基础设施相关,而不是按查询收费。”
幸运的是,组织无需大量投资于GPU等专用硬件。Red Hat致力于优化模型以在标准硬件上运行,专注于企业所需的具体模型,而不是处理大型通用数据集的每次查询。
小型本地化模型的重要性
通过使用和引用本地数据,结果可定制以满足特定需求。Julio提到了阿拉伯语和葡萄牙语地区项目,这些地区未被以英语为中心的大型语言模型很好服务。
大型语言模型存在实际挑战,包括可能影响时间敏感或面向客户应用的延迟问题。将资源和结果保持在用户附近可缓解这些问题。
信任是负责任人工智能的另一个关键方面。Red Hat倡导开放平台、工具和模型,以提高透明度并允许更广泛的社区参与。“这对每个人都至关重要,”Julio说。“我们正在构建能力以民主化人工智能,不仅通过发布模型,还通过提供工具让用户复制、调整和提供服务。”
Red Hat最近收购Neural Magic,旨在帮助企业更轻松地扩展人工智能,提高推理性能,并通过vLLM项目提供更多构建和部署人工智能工作负载的选择。此外,Red Hat与IBM Research合作发布了InstructLab,将人工智能开发开放给具有宝贵业务知识的非数据科学家。
人工智能的未来
尽管对人工智能泡沫存在诸多猜测,Red Hat相信人工智能的未来将针对特定用例定制,并保持开源。这种方法将在经济上可行且对所有人可访问。正如Red Hat首席执行官Matt Hicks所说:“人工智能的未来是开放的。”
内部细节曝光:下一代 Gemini 算力紧张,内部团队在开发优先级和资源分配上存在分歧
报告显示,谷歌备受期待的下一代 Gemini 模型发布已被推迟。由于内部在开发优先级和资源分配上存在分歧,加上计算能力有限以及复杂的审批流程,导致发布时间延后了两个月。尽管谷歌拥有定制的 TPU 芯片,但由于模型训练、Google Cloud 服务以及众多消费和企业级 AI 应用对计算资源的需求相互竞争,谷歌仍面临计算资源短缺的问题。目前,高层管理人员正通过组织结构调整来解决这些部门间的冲突。与此同时,领导层也发生了变化,联合创始人谢尔盖·布林越来越多地参与到核心模型训练中,并倡导将资源专门用于
OpenAI 否认增长放缓担忧,称多个业务部门加速发展
针对外界对其销售增长放缓及未达内部基准的质疑,人工智能领域的领军企业 OpenAI 于 4 月 28 日(星期二)发表了一份信心十足的声明。该公司澄清称,其消费产品和企业服务正在快速推进,直接驳斥了近期关于业务放缓的猜测。针对该公司“未达成多项内部目标”的说法,OpenAI 将这些报道斥为“典型的标题党”。公司强调了企业对 AI 集成的强劲需求,并指出其广告业务早期增长前景良好。据 OpenAI 内部人士透露,公司内部情绪依然乐观。尽管市场竞争日益激烈,但公司正在向投资者传递信心,声称其商业
阿里巴巴超级杯:Qwen3.8-Max 重磅登场,代码与办公工具能力全面升级
阿里巴巴正式发布了Qwen3.8-Max,这是一款拥有2.4万亿参数的下一代基础大模型。这一重大AI进展在编码和专业办公任务等核心领域带来了显著的性能提升,展现了强大的技术能力。在权威的Arena大模型排名中,Qwen3.8-Max取得了令人瞩目的成绩,仅次于Anthropic的Claude系列,位居行业前列。这一里程碑标志着国内大模型在处理复杂任务方面取得了快速进展,为开发者和企业用户提供了先进的智能工具。该模型的API现已在Qwen AI平台上上线,并集成到新推出的“Qwen Offic
이 논의는 사실이네요. 실제로 우리 회사에서도 AI 배포 시 지역 규제 때문에 모델을 커스터마이징해야 했어요. 오픈소스 소형 언어 모델이 더 유연한 솔루션이 될 수 있을 것 같아요. 특히 데이터 프라이버시가 중요한 경우에는요. 레드햇의 접근 방식이 현실적인 문제에 잘 맞는 것 같아요 👍
This article on small language models is super intriguing! I love how it dives into geopolitics shaping AI—makes me wonder how global policies will steer practical AI use in businesses. 🤔
This article on small language models is super intriguing! I love how it dives into practical AI solutions. Makes me wonder how enterprises will balance efficiency and ethics in AI deployment. Anyone else thinking about the real-world impact? 😄
This article on small language models is super intriguing! 😄 I love how it dives into practical AI with a responsible twist. Makes me wonder if we'll see more companies adopt this approach to dodge ethical pitfalls.
Red Hat's focus on open, small language models is refreshing! It's great to see a company pushing for responsible AI. The practical applications are impressive, but I wish there were more examples to learn from. Still, it's a step in the right direction. Keep it up, Red Hat! 🌟





首页






