选项

发现高质量的人工智能工具

将全球领先的人工智能工具聚集在一起,以帮助提高工作效率

作者 RyanAdams

由RyanAdams发布的文章

共13篇文章
2026-09-17

Anthropic 首席执行官 Dario Amodei 提议在 AI 公司中嵌入独立的第三方安全评估机构,并赋予其接近内部的访问权限以发布调查结果,他以银行监管机构为范例。他警告称,目标不一致的智能体可能在六到十二个月内造成数千亿美元的损失。批评者认为该提案缺乏执行力,指出评估机构无权叫停模型训练或产品发布。专家质疑 METR 的独立性,称其存在利益冲突,属于“审计洗白”。尽管 Anthropic 坚持认为自我监管不足,但监管机构强调,真正的安全需要拥有叫停危险系统的权力,而不仅仅是进行调查。

Anthropic 首席执行官 Dario Amodei 提议在 AI 公司中嵌入独立的第三方安全评估机构,并赋予其接近内部的访问权限以发布调查结果,他以银行监管机构为范例。他警告称,目标不一致的智能体可能在六到十二个月内造成数千亿美元的损失。批评者认为该提案缺乏执行力,指出评估机构无权叫停模型训练或产品发布。专家质疑 METR 的独立性,称其存在利益冲突,属于“审计洗白”。尽管 Anthropic 坚持认为自我监管不足,但监管机构强调,真正的安全需要拥有叫停危险系统的权力,而不仅仅是进行调查。

Anthropic 首席执行官 Dario Amodei 提议在 AI 公司中嵌入独立的第三方安全评估机构,并赋予其接近内部的访问权限以发布调查结果,他以银行监管机构为范例。他警告称,目标不一致的智能体可能在六到十二个月内造成数千亿美元的损失。批评者认为该提案缺乏执行力,指出评估机构无权叫停模型训练或产品发布。专家质疑 METR 的独立性,称其存在利益冲突,属于“审计洗白”。尽管 Anthropic 坚持认为自我监管不足,但监管机构强调,真正的安全需要拥有叫停危险系统的权力,而不仅仅是进行调查。
2026-08-24

人工智能公司Anthropic宣布,将向公众全面开放其内部新员工入职培训平台“Claude Academy”。该平台提供289项学习资源,涵盖人工智能基础知识、Claude Code的使用、API调用、智能体开发以及生产环境部署。 用户只需注册一个免费的Claude账户即可访问这些学习资料,完成课程后还将获得可验证的结业徽章。与通常侧重操作技能的传统AI教程不同,该平台采用“AI流利度4D”框架,教导用户在处理复杂任务时,思维要领先于AI工具。 此举旨在扩大 Anthropic 技术的覆盖范围,并重塑学习方式,帮助专业人士跟上人工智能的迅猛发展。这一举措在网络上引发了褒贬不一的反应,有人称赞其实用性,也有人戏称其是在教用户如何更高效地被人工智能取代。

人工智能公司Anthropic宣布,将向公众全面开放其内部新员工入职培训平台“Claude Academy”。该平台提供289项学习资源,涵盖人工智能基础知识、Claude Code的使用、API调用、智能体开发以及生产环境部署。 用户只需注册一个免费的Claude账户即可访问这些学习资料,完成课程后还将获得可验证的结业徽章。与通常侧重操作技能的传统AI教程不同,该平台采用“AI流利度4D”框架,教导用户在处理复杂任务时,思维要领先于AI工具。 此举旨在扩大 Anthropic 技术的覆盖范围,并重塑学习方式,帮助专业人士跟上人工智能的迅猛发展。这一举措在网络上引发了褒贬不一的反应,有人称赞其实用性,也有人戏称其是在教用户如何更高效地被人工智能取代。

人工智能公司Anthropic宣布,将向公众全面开放其内部新员工入职培训平台“Claude Academy”。该平台提供289项学习资源,涵盖人工智能基础知识、Claude Code的使用、API调用、智能体开发以及生产环境部署。 用户只需注册一个免费的Claude账户即可访问这些学习资料,完成课程后还将获得可验证的结业徽章。与通常侧重操作技能的传统AI教程不同,该平台采用“AI流利度4D”框架,教导用户在处理复杂任务时,思维要领先于AI工具。 此举旨在扩大 Anthropic 技术的覆盖范围,并重塑学习方式,帮助专业人士跟上人工智能的迅猛发展。这一举措在网络上引发了褒贬不一的反应,有人称赞其实用性,也有人戏称其是在教用户如何更高效地被人工智能取代。
2026-07-07

Reddit 运用先进的大型语言模型与自动化技术来打击人工智能生成的垃圾信息。该系统每天可拦截 2300 万次垃圾信息浏览以及 25,000 条垃圾帖子/评论。它使整体垃圾信息曝光量减少了 20%,垃圾账号的可见度降低了 10%至15%。有害内容的检测时间缩短至 5 秒以内,相关处理效率提升了 200%,有害内容被用户看到的概率下降了 40%,同时误报率也降低了 40%。

Reddit 运用先进的大型语言模型与自动化技术来打击人工智能生成的垃圾信息。该系统每天可拦截 2300 万次垃圾信息浏览以及 25,000 条垃圾帖子/评论。它使整体垃圾信息曝光量减少了 20%,垃圾账号的可见度降低了 10%至15%。有害内容的检测时间缩短至 5 秒以内,相关处理效率提升了 200%,有害内容被用户看到的概率下降了 40%,同时误报率也降低了 40%。

Reddit 运用先进的大型语言模型与自动化技术来打击人工智能生成的垃圾信息。该系统每天可拦截 2300 万次垃圾信息浏览以及 25,000 条垃圾帖子/评论。它使整体垃圾信息曝光量减少了 20%,垃圾账号的可见度降低了 10%至15%。有害内容的检测时间缩短至 5 秒以内,相关处理效率提升了 200%,有害内容被用户看到的概率下降了 40%,同时误报率也降低了 40%。
2026-06-15

由上海交通大学领衔的国际研究团队推出了SWE-Explore基准测试,该测试通过将代码搜索与修复分离,揭示了人工智能编码代理在行级准确性方面的关键弱点。测试表明,代理的核心代码覆盖率降至14%-19%,且当相关上下文低于50%时,修复操作将失败。 该工具将评估重点从最终修复率转向搜索质量,推动研究从暴力生成转向精准检索。

由上海交通大学领衔的国际研究团队推出了SWE-Explore基准测试,该测试通过将代码搜索与修复分离,揭示了人工智能编码代理在行级准确性方面的关键弱点。测试表明,代理的核心代码覆盖率降至14%-19%,且当相关上下文低于50%时,修复操作将失败。 该工具将评估重点从最终修复率转向搜索质量,推动研究从暴力生成转向精准检索。

由上海交通大学领衔的国际研究团队推出了SWE-Explore基准测试,该测试通过将代码搜索与修复分离,揭示了人工智能编码代理在行级准确性方面的关键弱点。测试表明,代理的核心代码覆盖率降至14%-19%,且当相关上下文低于50%时,修复操作将失败。 该工具将评估重点从最终修复率转向搜索质量,推动研究从暴力生成转向精准检索。
2026-06-05

Ideogram 于 6 月 3 日发布了开放式重量级模型 Ideogram 4.0。该模型拥有 93 亿个参数,采用单流 DiT 架构,在文本渲染和版式控制方面表现卓越,在基准测试中超越了竞争对手。 该模型在DesignArena全球排名中位列第四,超越了Nano Banana Pro,在海报设计和品牌视觉设计领域展现出强劲潜力。

Ideogram 于 6 月 3 日发布了开放式重量级模型 Ideogram 4.0。该模型拥有 93 亿个参数,采用单流 DiT 架构,在文本渲染和版式控制方面表现卓越,在基准测试中超越了竞争对手。 该模型在DesignArena全球排名中位列第四,超越了Nano Banana Pro,在海报设计和品牌视觉设计领域展现出强劲潜力。

Ideogram 于 6 月 3 日发布了开放式重量级模型 Ideogram 4.0。该模型拥有 93 亿个参数,采用单流 DiT 架构,在文本渲染和版式控制方面表现卓越,在基准测试中超越了竞争对手。 该模型在DesignArena全球排名中位列第四,超越了Nano Banana Pro,在海报设计和品牌视觉设计领域展现出强劲潜力。
2026-05-27

包括字节跳动、抖音、腾讯、元宝和科大讯飞在内的中国主要人工智能平台,将在全国高考期间限制或暂停基于照片的解题和辅导服务。这一全行业举措旨在维护考试公平,延续了往年的相关做法。

包括字节跳动、抖音、腾讯、元宝和科大讯飞在内的中国主要人工智能平台,将在全国高考期间限制或暂停基于照片的解题和辅导服务。这一全行业举措旨在维护考试公平,延续了往年的相关做法。

包括字节跳动、抖音、腾讯、元宝和科大讯飞在内的中国主要人工智能平台,将在全国高考期间限制或暂停基于照片的解题和辅导服务。这一全行业举措旨在维护考试公平,延续了往年的相关做法。
2026-05-25

字节跳动Seed团队与香港科技大学的研究人员共同开发了MMProLong,这是一个基于Qwen2.5-VL的新型多模态AI模型。他们的研究发现,针对问答任务的专项训练在长文档处理方面远优于传统的OCR技术。MMProLong仅需极少的训练,便在长上下文基准测试中表现出色,并在视频理解等未经训练的任务中展现出强劲性能,为提升模型能力提供了除架构调整之外的数据优化方案。

字节跳动Seed团队与香港科技大学的研究人员共同开发了MMProLong,这是一个基于Qwen2.5-VL的新型多模态AI模型。他们的研究发现,针对问答任务的专项训练在长文档处理方面远优于传统的OCR技术。MMProLong仅需极少的训练,便在长上下文基准测试中表现出色,并在视频理解等未经训练的任务中展现出强劲性能,为提升模型能力提供了除架构调整之外的数据优化方案。

字节跳动Seed团队与香港科技大学的研究人员共同开发了MMProLong,这是一个基于Qwen2.5-VL的新型多模态AI模型。他们的研究发现,针对问答任务的专项训练在长文档处理方面远优于传统的OCR技术。MMProLong仅需极少的训练,便在长上下文基准测试中表现出色,并在视频理解等未经训练的任务中展现出强劲性能,为提升模型能力提供了除架构调整之外的数据优化方案。
2026-05-21

OpenAI的人工智能模型解决了已经存在80年的Erdős单位距离问题,这一难题在离散几何学领域一直备受关注。该模型独立运用数论理论生成了一种全新的、无需借助现有证明方法的论证方式,这一成果得到了顶尖数学家的验证。这一突破充分展现了人工智能在逻辑推理方面的强大能力,也标志着它已经从一种计算工具转变为能够进行原创性研究的科研伙伴。这一发现可能会对材料科学和通信技术等领域产生重要影响。相关证明已发表在arXiv平台上,并经过了同行评审。

OpenAI的人工智能模型解决了已经存在80年的Erdős单位距离问题,这一难题在离散几何学领域一直备受关注。该模型独立运用数论理论生成了一种全新的、无需借助现有证明方法的论证方式,这一成果得到了顶尖数学家的验证。这一突破充分展现了人工智能在逻辑推理方面的强大能力,也标志着它已经从一种计算工具转变为能够进行原创性研究的科研伙伴。这一发现可能会对材料科学和通信技术等领域产生重要影响。相关证明已发表在arXiv平台上,并经过了同行评审。

OpenAI的人工智能模型解决了已经存在80年的Erdős单位距离问题,这一难题在离散几何学领域一直备受关注。该模型独立运用数论理论生成了一种全新的、无需借助现有证明方法的论证方式,这一成果得到了顶尖数学家的验证。这一突破充分展现了人工智能在逻辑推理方面的强大能力,也标志着它已经从一种计算工具转变为能够进行原创性研究的科研伙伴。这一发现可能会对材料科学和通信技术等领域产生重要影响。相关证明已发表在arXiv平台上,并经过了同行评审。
2026-04-23

谷歌在云峰会上宣布了其 Workspace 套件的重大更新,这些更新由全新的 AI 系统“Workspace Intelligence”驱动。 此次更新为Sheets和Docs中的任务引入了AI驱动的自动化功能。在Sheets中,Gemini能够以最高九倍的速度创建和填写电子表格;而在Docs中,它不仅能生成和润色文档,甚至可以模仿用户的写作风格。Workspace Intelligence利用来自Gmail、日历和云存储的用户数据,同时允许用户控制数据访问权限。这些增强功能旨在减少办公人员的手动操作,从而提高工作效率。

谷歌在云峰会上宣布了其 Workspace 套件的重大更新,这些更新由全新的 AI 系统“Workspace Intelligence”驱动。 此次更新为Sheets和Docs中的任务引入了AI驱动的自动化功能。在Sheets中,Gemini能够以最高九倍的速度创建和填写电子表格;而在Docs中,它不仅能生成和润色文档,甚至可以模仿用户的写作风格。Workspace Intelligence利用来自Gmail、日历和云存储的用户数据,同时允许用户控制数据访问权限。这些增强功能旨在减少办公人员的手动操作,从而提高工作效率。

谷歌在云峰会上宣布了其 Workspace 套件的重大更新,这些更新由全新的 AI 系统“Workspace Intelligence”驱动。 此次更新为Sheets和Docs中的任务引入了AI驱动的自动化功能。在Sheets中,Gemini能够以最高九倍的速度创建和填写电子表格;而在Docs中,它不仅能生成和润色文档,甚至可以模仿用户的写作风格。Workspace Intelligence利用来自Gmail、日历和云存储的用户数据,同时允许用户控制数据访问权限。这些增强功能旨在减少办公人员的手动操作,从而提高工作效率。
2026-02-11

Facebook推出人工智能驱动功能以吸引Z世代用户,包括:- 通过Meta AI Restyle工具动态调整照片背景与风格的动态头像- 为文字帖子提供鲜活的动态背景此次升级旨在通过全面视觉与交互革新,为年轻用户群体重焕平台活力。

Facebook推出人工智能驱动功能以吸引Z世代用户,包括:- 通过Meta AI Restyle工具动态调整照片背景与风格的动态头像- 为文字帖子提供鲜活的动态背景此次升级旨在通过全面视觉与交互革新,为年轻用户群体重焕平台活力。

Facebook推出人工智能驱动功能以吸引Z世代用户,包括:- 通过Meta AI Restyle工具动态调整照片背景与风格的动态头像- 为文字帖子提供鲜活的动态背景此次升级旨在通过全面视觉与交互革新,为年轻用户群体重焕平台活力。
OR