Anthropic 扩大了 Claude Code 的控制范围,但仍对其进行了限制

对于依赖人工智能的开发者而言,当前的“凭感觉编程”方法通常要么需要密切监控每一步操作,要么放任模型自由行动。Anthropic声称,其对Claude的最新更新消除了这一两难困境,允许人工智能在一定范围内自主决定哪些操作是安全的。
这一举措反映了更广泛的行业趋势:人工智能工具正被设计成无需在每个步骤都获得人类批准即可自主行动。关键挑战在于在速度与监管之间取得平衡:过多的安全措施会拖慢进度,而安全措施过少则可能导致不可预测且风险较高的行为。 Anthropic的新“自动模式”目前处于研究预览阶段——这意味着该功能可供测试,但尚未作为最终产品发布——这是该公司为寻求这一平衡所做的最新尝试。
自动模式利用 AI 安全防护机制在执行前审查每项操作,以排查未经请求的风险行为以及提示注入的迹象——这是一种攻击技术,即在处理内容中嵌入恶意指令,诱使 AI 执行非预期的操作。被判定为安全的操作将自动执行,而风险操作则会被阻止。
这本质上是 Claude Code 现有“dangerously-skip-permissions”命令的延伸,该命令将所有决策权委托给 AI,但在其基础上增加了额外的安全层。
该功能基于GitHub和OpenAI等公司近期涌现的自主编码工具,这些工具可以代表开发者执行任务。不过,它更进一步,将何时向用户请求权限的决定权交给了AI本身。
Anthropic尚未披露其安全层用于区分安全操作与高风险操作的具体标准——在广泛采用该功能之前,开发者很可能希望更清楚地了解这些细节。(TechCrunch已就此事宜联系该公司寻求进一步信息。)
“自动模式”的推出紧随Anthropic此前发布的“Claude Code Review”(一种能在代码进入代码库前捕获漏洞的自动代码审查工具)以及“Dispatch for Cowork”(该工具允许用户将任务分配给AI代理,由其代为处理工作)之后。
“自动模式”将在未来几天内向企业版和 API 用户推出。该公司表示,该功能目前仅支持 Claude Sonnet 4.6 和 Opus 4.6,并建议在“隔离环境”中使用此新功能——即与生产系统分离的沙箱环境,以在出现问题时将潜在损害降至最低。
相关文章
Google 测试 Remy AI 代理,以 Gemini 为重点转向用户控制
根据《商业内幕》的报道,谷歌正在测试 Remy,这是 Gemini 的一款全新 AI 个人代理工具。该工具旨在代表用户执行任务,从而简化专业工作流程和日常事务。目前,Remy 正在 Gemini 应用的内部员工专属版本中进行测试。该报告引用了一份内部文件以及对两位熟悉该项目的个人的采访。内部资料将 Remy 描述为“全天候个人代理”,将 Gemini 定位为能够代表用户行事的主动助手。接近该项目的消息人士证实,谷歌员工正在积极测试 Remy。谷歌发言人拒绝提供进一步评论。该报告未提及公开发布
Anthropic 进入 AI 法律科技市场,竞争日益激烈
Anthropic 于周二发布了一系列新的聊天机器人功能,旨在为法律实务提供自动化支持。这些增强功能在年初推出的特定律所平台 Claude for Legal 基础上进行了扩展,增加了针对不同法律领域的专用法律插件和 MCP 连接器。随着法律人工智能领域竞争的加剧,这些工具应运而生。今年三月,利用代理式人工智能简化法律工作流的 AI 法律初创公司 Harvey 以 110 亿美元的估值获得了 2 亿美元融资。上个月,竞争对手 Legora 完成了 6 亿美元的 D 轮融资,并启动了一场由裘德·
OpenAI 在企业用户中与 Anthropic 的差距缩小,新数据显示
在 OpenAI 和 Anthropic 距离预期的首次公开募股(IPO)以及详细财务报告的发布仍有距离的情况下,我们必须转向其他指标来评估它们的业务表现。企业信用卡和费用管理平台 Ramp 最近发布了令人信服的数据,显示 OpenAI 正在迅速缩小与美国企业用户中 Anthropic 的差距。OpenAI 此前在消费者和企业客户中都占据主导地位,但在今年 5 月,它失去了在 Ramp 付费企业用户中的领先地位。当时,Anthropic 占据了 41% 的市场份额,而 OpenAI 为 39%
相关专题推荐
评论 (0)
0/500

对于依赖人工智能的开发者而言,当前的“凭感觉编程”方法通常要么需要密切监控每一步操作,要么放任模型自由行动。Anthropic声称,其对Claude的最新更新消除了这一两难困境,允许人工智能在一定范围内自主决定哪些操作是安全的。
这一举措反映了更广泛的行业趋势:人工智能工具正被设计成无需在每个步骤都获得人类批准即可自主行动。关键挑战在于在速度与监管之间取得平衡:过多的安全措施会拖慢进度,而安全措施过少则可能导致不可预测且风险较高的行为。 Anthropic的新“自动模式”目前处于研究预览阶段——这意味着该功能可供测试,但尚未作为最终产品发布——这是该公司为寻求这一平衡所做的最新尝试。
自动模式利用 AI 安全防护机制在执行前审查每项操作,以排查未经请求的风险行为以及提示注入的迹象——这是一种攻击技术,即在处理内容中嵌入恶意指令,诱使 AI 执行非预期的操作。被判定为安全的操作将自动执行,而风险操作则会被阻止。
这本质上是 Claude Code 现有“dangerously-skip-permissions”命令的延伸,该命令将所有决策权委托给 AI,但在其基础上增加了额外的安全层。
该功能基于GitHub和OpenAI等公司近期涌现的自主编码工具,这些工具可以代表开发者执行任务。不过,它更进一步,将何时向用户请求权限的决定权交给了AI本身。
Anthropic尚未披露其安全层用于区分安全操作与高风险操作的具体标准——在广泛采用该功能之前,开发者很可能希望更清楚地了解这些细节。(TechCrunch已就此事宜联系该公司寻求进一步信息。)
“自动模式”的推出紧随Anthropic此前发布的“Claude Code Review”(一种能在代码进入代码库前捕获漏洞的自动代码审查工具)以及“Dispatch for Cowork”(该工具允许用户将任务分配给AI代理,由其代为处理工作)之后。
“自动模式”将在未来几天内向企业版和 API 用户推出。该公司表示,该功能目前仅支持 Claude Sonnet 4.6 和 Opus 4.6,并建议在“隔离环境”中使用此新功能——即与生产系统分离的沙箱环境,以在出现问题时将潜在损害降至最低。
Anthropic 进入 AI 法律科技市场,竞争日益激烈
Anthropic 于周二发布了一系列新的聊天机器人功能,旨在为法律实务提供自动化支持。这些增强功能在年初推出的特定律所平台 Claude for Legal 基础上进行了扩展,增加了针对不同法律领域的专用法律插件和 MCP 连接器。随着法律人工智能领域竞争的加剧,这些工具应运而生。今年三月,利用代理式人工智能简化法律工作流的 AI 法律初创公司 Harvey 以 110 亿美元的估值获得了 2 亿美元融资。上个月,竞争对手 Legora 完成了 6 亿美元的 D 轮融资,并启动了一场由裘德·
OpenAI 在企业用户中与 Anthropic 的差距缩小,新数据显示
在 OpenAI 和 Anthropic 距离预期的首次公开募股(IPO)以及详细财务报告的发布仍有距离的情况下,我们必须转向其他指标来评估它们的业务表现。企业信用卡和费用管理平台 Ramp 最近发布了令人信服的数据,显示 OpenAI 正在迅速缩小与美国企业用户中 Anthropic 的差距。OpenAI 此前在消费者和企业客户中都占据主导地位,但在今年 5 月,它失去了在 Ramp 付费企业用户中的领先地位。当时,Anthropic 占据了 41% 的市场份额,而 OpenAI 为 39%





首页






