Anthropic 推出 Opus 4.8,新增动态工作流工具

Anthropic 于周四发布了 Opus 4.8,这是其旗舰公开模型的最新版本。该版本定价与前一版本相同,目前已在所有平台上开放使用。
距离 Opus 4.7 发布仅过去 41 天,Anthropic 显著加快了开发周期,远超近期 Sonnet 和 Haiku 版本三至七个月的发布间隔。此次快速更新很可能是对 Opus 4.7 反响平平的回应——该版本曾令许多用户感到失望。
与此同时,OpenAI的Codex和谷歌的Gemini Flash也推出了重大更新,这加剧了Anthropic在保持技术领先优势方面的竞争压力。
尽管 Opus 4.8 展现出一流的基准性能,但它特别强调了对模糊或有缺陷数据的处理能力。早期测试者指出,该模型现在更倾向于突出不确定性,且较少做出缺乏依据的断言。
Bridgewater Associates对此表示认同,并特别强调了该模型主动标记输入和输出异常的能力——这一功能往往被其他系统忽视,通常需要用户自行判断。
伴随该模型的发布,Anthropic 还推出了“动态工作流”(Dynamic Workflows),目前处于研究预览阶段。该功能使 Opus 等大型模型能够通过数百个并行子代理来协调复杂任务。
根据公告,将 Claude Code 与 Opus 4.8 结合使用,可实现涵盖数十万行代码的代码库级迁移,并由现有的测试套件从启动到合并全程进行验证。
鉴于上月预览期间引发的网络安全担忧,Anthropic 目前仍暂不发布其先进的 Mythos 模型。不过,该公司表示,一旦实施了适当的安全防护措施,Mythos 的预览阶段可能会很快结束。
“我们正在快速推进安全防护措施的开发,预计将在未来几周内向所有客户部署Mythos级别的模型,”该公司表示。
相关文章
Anthropic 进入 AI 法律科技市场,竞争日益激烈
Anthropic 于周二发布了一系列新的聊天机器人功能,旨在为法律实务提供自动化支持。这些增强功能在年初推出的特定律所平台 Claude for Legal 基础上进行了扩展,增加了针对不同法律领域的专用法律插件和 MCP 连接器。随着法律人工智能领域竞争的加剧,这些工具应运而生。今年三月,利用代理式人工智能简化法律工作流的 AI 法律初创公司 Harvey 以 110 亿美元的估值获得了 2 亿美元融资。上个月,竞争对手 Legora 完成了 6 亿美元的 D 轮融资,并启动了一场由裘德·
OpenAI 在企业用户中与 Anthropic 的差距缩小,新数据显示
在 OpenAI 和 Anthropic 距离预期的首次公开募股(IPO)以及详细财务报告的发布仍有距离的情况下,我们必须转向其他指标来评估它们的业务表现。企业信用卡和费用管理平台 Ramp 最近发布了令人信服的数据,显示 OpenAI 正在迅速缩小与美国企业用户中 Anthropic 的差距。OpenAI 此前在消费者和企业客户中都占据主导地位,但在今年 5 月,它失去了在 Ramp 付费企业用户中的领先地位。当时,Anthropic 占据了 41% 的市场份额,而 OpenAI 为 39%
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
相关专题推荐
评论 (0)
0/500

Anthropic 于周四发布了 Opus 4.8,这是其旗舰公开模型的最新版本。该版本定价与前一版本相同,目前已在所有平台上开放使用。
距离 Opus 4.7 发布仅过去 41 天,Anthropic 显著加快了开发周期,远超近期 Sonnet 和 Haiku 版本三至七个月的发布间隔。此次快速更新很可能是对 Opus 4.7 反响平平的回应——该版本曾令许多用户感到失望。
与此同时,OpenAI的Codex和谷歌的Gemini Flash也推出了重大更新,这加剧了Anthropic在保持技术领先优势方面的竞争压力。
尽管 Opus 4.8 展现出一流的基准性能,但它特别强调了对模糊或有缺陷数据的处理能力。早期测试者指出,该模型现在更倾向于突出不确定性,且较少做出缺乏依据的断言。
Bridgewater Associates对此表示认同,并特别强调了该模型主动标记输入和输出异常的能力——这一功能往往被其他系统忽视,通常需要用户自行判断。
伴随该模型的发布,Anthropic 还推出了“动态工作流”(Dynamic Workflows),目前处于研究预览阶段。该功能使 Opus 等大型模型能够通过数百个并行子代理来协调复杂任务。
根据公告,将 Claude Code 与 Opus 4.8 结合使用,可实现涵盖数十万行代码的代码库级迁移,并由现有的测试套件从启动到合并全程进行验证。
鉴于上月预览期间引发的网络安全担忧,Anthropic 目前仍暂不发布其先进的 Mythos 模型。不过,该公司表示,一旦实施了适当的安全防护措施,Mythos 的预览阶段可能会很快结束。
“我们正在快速推进安全防护措施的开发,预计将在未来几周内向所有客户部署Mythos级别的模型,”该公司表示。
Anthropic 进入 AI 法律科技市场,竞争日益激烈
Anthropic 于周二发布了一系列新的聊天机器人功能,旨在为法律实务提供自动化支持。这些增强功能在年初推出的特定律所平台 Claude for Legal 基础上进行了扩展,增加了针对不同法律领域的专用法律插件和 MCP 连接器。随着法律人工智能领域竞争的加剧,这些工具应运而生。今年三月,利用代理式人工智能简化法律工作流的 AI 法律初创公司 Harvey 以 110 亿美元的估值获得了 2 亿美元融资。上个月,竞争对手 Legora 完成了 6 亿美元的 D 轮融资,并启动了一场由裘德·
OpenAI 在企业用户中与 Anthropic 的差距缩小,新数据显示
在 OpenAI 和 Anthropic 距离预期的首次公开募股(IPO)以及详细财务报告的发布仍有距离的情况下,我们必须转向其他指标来评估它们的业务表现。企业信用卡和费用管理平台 Ramp 最近发布了令人信服的数据,显示 OpenAI 正在迅速缩小与美国企业用户中 Anthropic 的差距。OpenAI 此前在消费者和企业客户中都占据主导地位,但在今年 5 月,它失去了在 Ramp 付费企业用户中的领先地位。当时,Anthropic 占据了 41% 的市场份额,而 OpenAI 为 39%
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met





首页






