Anthropic 利用人工智能为 Claude 提供动力,现已处理 25% 的研发任务

Anthropic 发布了其研发部门内人工智能驱动自动化的内部指标。到 8 月,Claude 已处理该公司 26% 的人工智能研究任务,较 2 月的不足 1% 大幅上升,凸显了快速采用的趋势。
六级自动化框架:超过 90% 达到人机协作水平,但尚无“完全自主”系统
Anthropic 采用六级自动化框架来评估人工智能的参与程度。第 4 级(AL4)被定义为“AI 主导”,即人类设定高层目标,AI 执行大部分工作流程,人类负责监督和审查输出。目前,超过 90% 的研发工作达到这一协作水平或更高,但没有任何任务实现完全自主(AL5),确保 AI 始终在人类监督下运行。
内部约有 30,000 个由 Claude 驱动的人工智能代理并行处理研究和工程项目。这些代理可以相互委托任务并交叉纠正错误,仅在 8 月一个月就产生了超过 10 亿次决策。
仓库内 80% 的代码由 Claude 生成,推动下一代模型自我改进
为降低风险,所有 AI 操作在执行前均经过在线安全检查,异常决策会被直接拦截。系统还会定期抽样对话日志,标记高风险案例供人工审查。
代码层面的变化尤为显著:目前,合并到仓库的超过 80% 的代码由 Claude 生成,使工程师的生产力提高了数倍。这些 AI 代理处理大量的底层研发工作,包括模型实验、编码、数据分析和结果验证,有助于下一代 Claude 模型的迭代——这一过程在行业内被称为递归自我改进。
相关文章
豆包发布技能、连接器与工作伙伴,将聊天助手转型为智能办公平台
豆包近期升级了任务模式,新增技能、连接器和协作伙伴三项功能,显著提升了其协同办公能力。目前平台已提供超过 200 种技能和连接器,同时赋能用户创建自定义技能,以实现工作流的标准化。技能有助于用户保存个性化工作流。例如,周报中使用的格式和内容标准可以保存为个人技能,实现一键复用,从而有效自动化成熟流程。连接器将豆包与各类办公工具集成;以飞书连接器为例,用户可直接在应用内搜索和管理任务,无需切换页面或手动上传文件。协作伙伴提供涵盖数据分析、内容策划、调研及财务等领域的专业 AI 智能体。用户可以组建
苹果 HomePod mini 2 套装将于秋季发布,搭载经过六年研发的定制 AI 芯片
自 Apple HomePod mini 发布以来,已近六年,如今更新终于指日可待。最近的报道表明,第二代机型可能于今年秋季推出,漫长的等待归因于下一代 Siri 成熟度的需求。这一模式不仅限于 HomePod mini;新款 Apple TV 4K、全尺寸 HomePod 以及智能显示屏的延期同样与 Apple 的人工智能开发进展密切相关。这凸显了人工智能能力已成为 Apple 硬件周期的关键瓶颈,软件就绪状态直接决定了发布时间表。当前的 HomePod mini 采用 S5 芯片,该芯片最
OpenAI 在早期 AI 模型开发中增加独立安全检查
随着对人工智能风险的担忧日益加剧,OpenAI 公布了新的安全治理措施。该公司计划超越传统的内部测试循环,在开发周期的早期阶段与独立的第三方机构合作,进行系统性的安全评估。为确保这些外部评估的有效性,OpenAI 定义了四项核心成功要素:建立强有力的独立运营框架、保持严格的科学严谨性、实施稳健的日常安全协议,以及明确所有利益相关方的安全责任。这一转变表明,随着人工智能模型迭代速度的加快,行业领导者正积极与公正的第三方合作,构建安全防护体系,以应对公众和监管机构对技术可控性的持续审查。
相关专题推荐
评论 (0)
0/500

Anthropic 发布了其研发部门内人工智能驱动自动化的内部指标。到 8 月,Claude 已处理该公司 26% 的人工智能研究任务,较 2 月的不足 1% 大幅上升,凸显了快速采用的趋势。
六级自动化框架:超过 90% 达到人机协作水平,但尚无“完全自主”系统
Anthropic 采用六级自动化框架来评估人工智能的参与程度。第 4 级(AL4)被定义为“AI 主导”,即人类设定高层目标,AI 执行大部分工作流程,人类负责监督和审查输出。目前,超过 90% 的研发工作达到这一协作水平或更高,但没有任何任务实现完全自主(AL5),确保 AI 始终在人类监督下运行。
内部约有 30,000 个由 Claude 驱动的人工智能代理并行处理研究和工程项目。这些代理可以相互委托任务并交叉纠正错误,仅在 8 月一个月就产生了超过 10 亿次决策。
仓库内 80% 的代码由 Claude 生成,推动下一代模型自我改进
为降低风险,所有 AI 操作在执行前均经过在线安全检查,异常决策会被直接拦截。系统还会定期抽样对话日志,标记高风险案例供人工审查。
代码层面的变化尤为显著:目前,合并到仓库的超过 80% 的代码由 Claude 生成,使工程师的生产力提高了数倍。这些 AI 代理处理大量的底层研发工作,包括模型实验、编码、数据分析和结果验证,有助于下一代 Claude 模型的迭代——这一过程在行业内被称为递归自我改进。
豆包发布技能、连接器与工作伙伴,将聊天助手转型为智能办公平台
豆包近期升级了任务模式,新增技能、连接器和协作伙伴三项功能,显著提升了其协同办公能力。目前平台已提供超过 200 种技能和连接器,同时赋能用户创建自定义技能,以实现工作流的标准化。技能有助于用户保存个性化工作流。例如,周报中使用的格式和内容标准可以保存为个人技能,实现一键复用,从而有效自动化成熟流程。连接器将豆包与各类办公工具集成;以飞书连接器为例,用户可直接在应用内搜索和管理任务,无需切换页面或手动上传文件。协作伙伴提供涵盖数据分析、内容策划、调研及财务等领域的专业 AI 智能体。用户可以组建
苹果 HomePod mini 2 套装将于秋季发布,搭载经过六年研发的定制 AI 芯片
自 Apple HomePod mini 发布以来,已近六年,如今更新终于指日可待。最近的报道表明,第二代机型可能于今年秋季推出,漫长的等待归因于下一代 Siri 成熟度的需求。这一模式不仅限于 HomePod mini;新款 Apple TV 4K、全尺寸 HomePod 以及智能显示屏的延期同样与 Apple 的人工智能开发进展密切相关。这凸显了人工智能能力已成为 Apple 硬件周期的关键瓶颈,软件就绪状态直接决定了发布时间表。当前的 HomePod mini 采用 S5 芯片,该芯片最
OpenAI 在早期 AI 模型开发中增加独立安全检查
随着对人工智能风险的担忧日益加剧,OpenAI 公布了新的安全治理措施。该公司计划超越传统的内部测试循环,在开发周期的早期阶段与独立的第三方机构合作,进行系统性的安全评估。为确保这些外部评估的有效性,OpenAI 定义了四项核心成功要素:建立强有力的独立运营框架、保持严格的科学严谨性、实施稳健的日常安全协议,以及明确所有利益相关方的安全责任。这一转变表明,随着人工智能模型迭代速度的加快,行业领导者正积极与公正的第三方合作,构建安全防护体系,以应对公众和监管机构对技术可控性的持续审查。





首页






