选项
首页
新闻
拟人化的AI模型具有可自定义的思维持续时间

拟人化的AI模型具有可自定义的思维持续时间

2025-04-10
307

Anthropic的最新AI模型Claude 3.7 Sonnet正在AI领域掀起波澜。被称为业界首个“混合AI推理模型”,它旨在根据您的需求提供快速回答和更深思熟虑的响应。您甚至可以选择让Claude“思考”您的问题的时间长短——很酷,对吧?

Claude 3.7 Sonnet的设计理念是让AI使用更加简单。Anthropic希望一个模型就能处理所有任务,而不是让用户从众多不同模型中选择。从周一开始,每个人都可以体验Claude 3.7 Sonnet,但如果您想使用其高级推理功能,需要订阅Anthropic的优质计划。免费用户仍然可以使用一个强大的模型版本,Anthropic表示这比之前的Claude 3.5 Sonnet更出色。

现在来说说费用——Claude 3.7 Sonnet的定价为每百万输入令牌3美元,每百万输出令牌15美元。这比其他一些模型(如OpenAI的o3-mini和DeepSeek的R1)稍贵,但请记住,那些只是推理模型,而不是像Claude这样的混合模型。

Anthropic的新思考模式 图片来源:Anthropic
Claude 3.7 Sonnet是Anthropic首个具备“推理”能力的模型,这在AI领域意义重大。推理模型需要更多时间和计算能力来回答问题,会将问题分解为更小的步骤以获得更准确的答案。它并不完全等同于人类推理,但以此为模型。

Anthropic对Claude有宏大的计划。他们希望Claude最终能自行判断问题需要“思考”多长时间,而无需用户设置。Anthropic的产品与研究负责人Dianne Penn在接受TechCrunch采访时表示,他们认为推理只是前沿模型应具备的众多功能之一,全部整合在一个模型中。

使用Claude 3.7 Sonnet,您甚至可以通过“可见草稿板”看到它如何规划答案。大多数时候,您可以看到整个过程,但出于安全原因,Anthropic可能会对某些部分进行编辑。

Claude在claude应用中的思考过程 图片来源:Anthropic
Anthropic表示,他们已针对现实世界的任务(如复杂的编码问题或需要一定自主性的任务)优化了Claude的思考模式。如果您是使用Anthropic API的开发者,您甚至可以控制Claude的“思考”程度,在速度、成本和答案质量之间找到平衡。

在一些测试中,Claude 3.7 Sonnet表现出色。在SWE-Bench(一项针对现实世界编码任务的测试)中,它得分62.3%,超过了OpenAI的o3-mini(49.3%)。在TAU-Bench(衡量AI在零售环境中与模拟用户和外部API交互能力的测试)中,Claude 3.7 Sonnet得分81.2%,而OpenAI的o1模型得分为73.5%。

Anthropic还表示,Claude 3.7 Sonnet拒绝回答问题的可能性更低,能更细致地区分有害和无害的提示。与Claude 3.5 Sonnet相比,其不必要的拒绝率降低了45%。

与Claude 3.7 Sonnet一起,Anthropic还推出了一款名为Claude Code的新工具。这是一个研究预览版,允许开发者直接从终端通过Claude运行特定任务。在演示中,Anthropic展示了Claude Code如何通过简单的命令(如“解释这个项目结构”)分析编码项目。您甚至可以用普通英语修改代码库,Claude Code会在修改时描述其编辑内容,测试错误,并将项目推送到GitHub仓库。

Claude Code将以“先到先得”的方式向有限数量的用户开放。

Anthropic在AI实验室不断推出新模型的时刻发布了Claude 3.7 Sonnet。虽然Anthropic通常采取更为谨慎、以安全为重点的策略,但这次他们希望引领潮流。但他们能领先多久无人知晓——尤其是OpenAI的CEO Sam Altman表示,他们自己的混合AI模型将在“几个月”内推出。

相关文章
Anthropic 进入 AI 法律科技市场,竞争日益激烈 Anthropic 进入 AI 法律科技市场,竞争日益激烈 Anthropic 于周二发布了一系列新的聊天机器人功能,旨在为法律实务提供自动化支持。这些增强功能在年初推出的特定律所平台 Claude for Legal 基础上进行了扩展,增加了针对不同法律领域的专用法律插件和 MCP 连接器。随着法律人工智能领域竞争的加剧,这些工具应运而生。今年三月,利用代理式人工智能简化法律工作流的 AI 法律初创公司 Harvey 以 110 亿美元的估值获得了 2 亿美元融资。上个月,竞争对手 Legora 完成了 6 亿美元的 D 轮融资,并启动了一场由裘德·
Anthropic 推出 Opus 4.8,新增动态工作流工具 Anthropic 推出 Opus 4.8,新增动态工作流工具 Anthropic 于周四发布了 Opus 4.8,这是其旗舰公开模型的最新版本。该版本定价与前一版本相同,目前已在所有平台上开放使用。距离 Opus 4.7 发布仅过去 41 天,Anthropic 显著加快了开发周期,远超近期 Sonnet 和 Haiku 版本三至七个月的发布间隔。此次快速更新很可能是对 Opus 4.7 反响平平的回应——该版本曾令许多用户感到失望。与此同时,OpenAI的
Anthropic 正式推出 Claude Fable 5,这是 Mythos 的公开版本 Anthropic 正式推出 Claude Fable 5,这是 Mythos 的公开版本 Anthropic首次向公众开放其最强大的人工智能模型——但已采取相应的安全措施。本周二,该公司推出了 Claude Fable 5,这是其 Mythos 模型的首次公开发布。 据Anthropic介绍,Fable 5在软件工程、知识工作和视觉任务方面表现优异,但附带严格的安全限制。在网络安全、生物学、化学和蒸馏等高风险领域,该模型将拒绝回答问题,转而交由Claude Opus 4.8处理。M
相关专题推荐
写作 最适合撰写长篇SEO文章的AI大纲生成器
最适合撰写长篇SEO文章的AI大纲生成器

2026年最新、最受好评的AI大纲生成器,专为长篇SEO文章打造,由XIX.AI精心甄选。这些强大的工具在快速创建高质量内容方面提供了颠覆性的帮助,显著提升了写作效率。 获取免费版与付费版的对比分析,以及实际测试结果和详细排名,助您找到最适合自身需求、不容错过的理想选择。立即探索,解锁您的AI竞争优势。

8 个工具
xix.ai
教育与学习 用于作业和考试备考的AI学习工具
用于作业和考试备考的AI学习工具

2026年最新最佳AI学习工具,助您轻松完成作业和备考!XIX.AI精心筛选出一份广受好评的顶级工具清单,这些功能强大、颠覆传统的工具经过实际测试,能帮助学生提升效率、简化作业流程,并轻松通过考试。 获取免费版与付费版的对比分析、详细排名以及必试选项,释放你的AI优势。立即探索!

10 个工具
xix.ai
音乐创作 面向词曲创作者、旋律片段、主旋律及多语言草稿创作的AI人声演示工具
面向词曲创作者、旋律片段、主旋律及多语言草稿创作的AI人声演示工具

2026 年最新最佳 AI 人声演示工具,专为词曲创作者、旋律创作者和多语言内容团队打造!XIX.AI 精心整理了一份经过严格真实世界测试的高评分、变革性工具列表。您将找到详细的免费与付费对比数据、全面排名以及必试选项,帮助您提升创作效率并释放创意潜力。立即探索,发现满足您所有内容需求的完美工具!

9 个工具
xix.ai
商业 适合中小企业的最佳AI竞品分析工具
适合中小企业的最佳AI竞品分析工具

2026年最新最佳、评价最高的中小企业AI竞争研究工具!XIX.AI精心精选了一系列功能强大、颠覆行业格局的工具,每周都会根据严格的实际测试和详细排名进行更新。您可以查看全面的免费版与付费版对比,从而找到那些能提升工作效率、助您赢得竞争优势的必试工具。 立即探索,发现最适合您的工具!

9 个工具
xix.ai
图像编辑 用于电商服装、皮肤清洁和色彩一致性的 Photoshop AI 修图工具
用于电商服装、皮肤清洁和色彩一致性的 Photoshop AI 修图工具

2026 年最新最佳 Photoshop AI 修图工具,适用于电商服装、皮肤清洁和色彩一致性!这份顶级精选列表包含强大的变革性解决方案,可帮助您提升写作效率、简化内容创作并轻松实现完美的视觉效果。每个工具都经过实际测试,并通过每周更新的排名进行验证,同时提供免费与付费版本的详细对比。由 XIX.AI 支持,这是任何希望发挥 AI 优势的人必试指南。立即探索!

10 个工具
xix.ai
提示词 适用于 ChatGPT 工作流的最佳 AI 提示词库
适用于 ChatGPT 工作流的最佳 AI 提示词库

2026年最新、最受好评的AI提示词库,可优化各类ChatGPT工作流程。XIX.AI精心整理了一套功能强大、具有颠覆性的提示词库,均经过严格的实际测试,以确保最佳性能。 您可以查看详细的免费版与付费版对比分析以及专家排名,这些内容将帮助您挑选出必试的工具,从而提升工作效率并释放您的AI优势。立即探索!

11 个工具
xix.ai
评论 (54)
0/500
RaymondAdams
RaymondAdams 2025-08-11 13:00:59

This hybrid AI model sounds like a game-changer! Being able to tweak how long Claude thinks is super cool, like choosing between a quick coffee chat or a deep dive convo. Excited to see how this stacks up against other AI out there! 😎

ChristopherDavis
ChristopherDavis 2025-08-06 03:00:59

Claude 3.7 Sonnet a l'air incroyable ! Pouvoir choisir la durée de réflexion, c'est comme demander à un chef de cuisiner vite ou de prendre son temps pour un plat parfait. J'ai hâte de voir comment ça marche en pratique ! 😄

WillieAdams
WillieAdams 2025-08-01 14:08:50

Claude's customizable thinking duration sounds like a game-changer! I wonder how it balances speed and depth in real-world tasks. Excited to try it out! 😄

ScarlettWhite
ScarlettWhite 2025-07-23 12:59:47

Wow, Claude 3.7 sounds like a game-changer! Being able to tweak how long it thinks is such a cool feature. I’m curious how this will stack up against other AI models in real-world tasks. Anyone tried it yet? 😄

CharlesRoberts
CharlesRoberts 2025-04-23 22:11:54

O Claude 3.7 Sonnet é incrível! Adoro poder escolher a duração do pensamento. Às vezes preciso de respostas rápidas, outras vezes quero respostas mais pensadas. É como ter um amigo AI personalizável! Só desejo que fosse um pouco mais rápido às vezes. 😎

RyanAnderson
RyanAnderson 2025-04-22 22:04:41

Claude 3.7 Sonnet is a game-changer! I love how I can choose the thinking duration. Sometimes I need quick answers, and other times I want a more thoughtful response. It's like having a customizable AI buddy! Only wish it was a bit faster at times. 🤓

OR