首页 > 科技周边 > 人工智能

全球首个混合推理模型：Claude3.7Sonnet，代码能力吊打一切！

时间：2025-03-09 11:28:22 154浏览收藏

Anthropic发布全球首个混合推理模型Claude 3.7 Sonnet，其强大的编码能力超越现有对手。Sonnet具备标准和扩展两种思考模式，用户可通过API精确控制思考时间，平衡速度和答案质量。该模型在编码和前端Web开发方面表现出色，已在多个基准测试中取得领先成绩，并得到Cursor、Canva等多家合作伙伴验证。同时发布的Claude Code命令行工具进一步提升了代码协作效率，Sonnet现已通过Anthropic API、Amazon Bedrock和Google Cloud Vertex AI等平台提供服务。

Anthropic发布迄今为止最强大的AI模型：Claude 3.7 Sonnet

Anthropic于近日正式发布了其最新旗舰模型——Claude 3.7 Sonnet，这款混合推理模型被誉为目前市面上最智能的AI模型之一。 Sonnet具备两种思考模式：标准模式和扩展模式，前者提供近乎即时的响应，后者则允许模型进行更深入、逐步的思考，用户可通过API精确控制思考时间。

^{图源：https://x.com/btibor91/status/1893970824484581825{{TABLE_PLACEHOLDER_1}}}

除了Sonnet，Anthropic还同步推出了命令行编码工具Claude Code（目前为有限研究预览版），允许开发者直接通过终端将大量工程任务委托给Claude。此外，Claude.ai的GitHub集成现已全面开放，进一步增强了其代码协作能力。

凭借在编码和前端Web开发方面的显著改进，Claude 3.7 Sonnet成为Anthropic迄今为止最强大的编码模型。该模型已通过所有Claude计划（包括免费、专业版、团队版和企业版）以及Anthropic API、Amazon Bedrock和Google Cloud Vertex AI提供。收费方面，Sonnet与前代模型Claude 3.5 Sonnet定价相同，每百万输入token 3美元，每百万输出token 15美元（包含思考token）。

Claude 3.7 Sonnet：前沿推理的全新体验

Anthropic表示，Sonnet的设计理念与其他推理模型有所不同，它将快速反应和深度思考整合在一个模型中，旨在为用户提供更无缝的体验。 Sonnet的主要优势包括：

灵活的思考模式: 用户可以选择标准模式（快速响应）或扩展模式（深度思考），后者在数学、物理、指令遵循、编码等任务上表现更出色。
可控的思考预算: API用户可通过设置token数量来平衡速度和答案质量。
更贴近实际应用: Anthropic在模型训练中更注重实际应用场景，而非单纯的竞赛问题。

^{图源：https://x.com/kimmonismus/status/1894098443859079609{{TABLE_PLACEHOLDER_3}}}

基准测试结果显示，Claude 3.7 Sonnet在SWE-bench Verified和TAU-bench上均取得了领先的性能。虽然在某些方面仍不及OpenAI的某些模型，但其编码能力已得到多家合作伙伴的验证，例如Cursor、Cognition、Vercel、Replit和Canva等。

Claude Code：智能编码助手

Claude Code作为一款智能编码工具，能够协助开发者搜索、阅读、编辑代码，编写和运行测试，甚至提交代码到GitHub。早期测试表明，Claude Code能够显著缩短开发时间，提升效率。

负责任的AI发展与未来展望

Anthropic对Claude 3.7 Sonnet进行了严格的安全性和可靠性测试，并发布了详细的模型卡，阐述了其负责任的AI发展策略。 Anthropic展望未来，希望Claude能够在2025年成为能够独立工作数小时的专家级智能体，并在2027年解决更具挑战性的难题。

^{CoT 忠实度评估结果。}

^{博客地址：https://www.anthropic.com/news/claude-3-7-sonnet{{TABLE_PLACEHOLDER_7}}}

今天关于《全球首个混合推理模型：Claude3.7Sonnet，代码能力吊打一切！》的内容就介绍到这里了，是不是学起来一目了然！想要了解更多关于产业的内容请关注golang学习网公众号！

产业