Claude Sonnet 4.5 发布新闻和改进
- Aisha Washington

- 6月6日
- 讀畢需時 9 分鐘

Claude Sonnet 4.5 于 2025 年 9 月 9 日发布。它具有 ASL-3 安全级别。您现在可以使用 Code Interpreter。此工具可帮助您进行编码并自动执行任务。该模型可以自行运行长达 30 小时。这有助于处理更大的项目。您可以在 Amazon Bedrock 上使用它。您也可以在 GitHub Copilot 中尝试它。
Claude AI 拥有 3.9% of the total AI chatbot market。它占据企业 AI 市场的 29%。这表明许多企业都在使用它。
功能 | 对生产力的影响 |
加快编码速度并帮助自动执行任务。 | |
上下文处理 | 帮助您更快地做出决策并完成任务。 |
要点总结
Claude Sonnet 4.5 配备了新的 Code Interpreter。它可帮助您更快地编写代码并自动执行任务。这使其非常适合处理复杂项目。该模型现在可以自主运行超过 30 小时。您无需中断即可完成更大的工作。Claude Sonnet 4.5 具有 ASL-3 安全级别。它能够执行更复杂的任务,但您需要仔细监控其使用。
您可以在 many platforms 上使用 Claude Sonnet 4.5。这些平台包括 Amazon Bedrock 和 GitHub Copilot。这使其能够满足多种需求。此次更新显著提升了编码能力。它在测试中获得了更高分数。这有助于开发者更加信任它。
发布新闻
发布日期
您可以记录 Claude Sonnet 4.5 的发布日期。它于 September 29, 2025 发布。Anthropic 在其网站上分享了这一消息。他们在那里提供了完整介绍。此次更新包含多项您很快就会注意到的变化。
安全级别
了解此次更新的安全级别非常重要。Claude Sonnet 4.5 现已采用 ASL-3 安全级别。该级别允许模型执行更复杂的任务。它也需要更完善的安全措施。ASL-3 高于 ASL-2,后者主要关注安全操作。借助 ASL-3,您将获得更多选择和更强能力。使用模型时必须保持谨慎。
安全级别 | 描述 | 主要特点 |
ASL-2 | 更大、更复杂的 AI 模型需要更严格的安全规则,但总体上仍易于控制和预测。 | 更严格的安全规则,易于控制操作 |
ASL-3 | 显示出更高的操作风险,这些操作更难预测,因此需要智能安全措施。 | 处理复杂任务,误用风险更高 |
ASL-4 | 意味着模型自主决策的风险进一步增加。 | 需要先进理解方式,可能造成危害 |
提示: 在使用 ASL-3 或更高安全级别的模型时,务必检查设置并监控使用情况。
可用性
有多种方式可以使用 Claude Sonnet 4.5。您可以选择最适合自己的平台。
在 Amazon Bedrock 上,如果您构建代理,则可以使用 Claude Sonnet 4.5。该更新现已就绪。您无需额外批准。
如果您使用 GitHub Copilot,则可以在公开预览版中体验新功能。您需要 Copilot Pro、Pro+、Business 或 Enterprise 订阅。管理员必须在设置中启用 Claude Sonnet 4.5 策略。
您也可以在 Claude.ai 上使用该模型。它支持网页版、iOS 和 Android。您几乎可以在任何地方使用它。
平台 | 访问要求 |
GitHub Copilot | 适用于 Copilot Pro、Pro+、Business 和 Enterprise。管理员必须在设置中启用 Claude Sonnet 4.5 策略。 |
Amazon Bedrock | 已为希望构建代理的开发者准备就绪。未列出特殊访问步骤。 |
任何人都可以在网页版、iOS 和 Android 上使用它。 |
您会发现 Claude Sonnet 4.5 在 Amazon Bedrock 上具有特殊优势。该平台允许您使用新更新构建和测试代理。此次更新新增了 Code Interpreter 和更长的运行时间等功能。这些功能可帮助您更快完成任务并处理更复杂的项目。该模型可以自主运行长达 30 小时。您可以放心地将更大任务交给它。
功能 | 描述 |
速度 | Claude Sonnet 4.5 比旧版本快约 50% faster,因此您可以更快完成代码审查等任务。 |
性能 | 该模型非常适合长时间任务,例如生成文档和修复棘手错误。 |
Code Interpreter | 此新工具可帮助您轻松处理多个文件和编码任务。 |
扩展的自主操作 | 该模型能够出色且快速地执行代理任务,例如编码和生成文档。 |
注意: 在 Amazon Bedrock 上使用 Claude Sonnet 4.5 可让您提前体验新更新和功能。您可以立即开始构建更智能的代理。
Claude Sonnet 4.5 功能与主要改进

编码升级
您会注意到 Claude Sonnet 4.5 在编码方面带来了重大变化。新模型引入了 Code Interpreter,可帮助您更快地编写、测试和修复代码。许多用户表示,此次更新使编码更加流畅可靠。基准测试显示,Claude Sonnet 4.5 在数学、推理和代理构建方面处于领先地位。它在 OSWorld 基准测试中获得了 61.4% 的分数,比之前提高了近 20%。您现在可以更有信心地处理读取图表和分析财务数据等复杂任务。
Claude Sonnet 4.5 现已成为许多用户心目中最佳的编码模型。
它非常适合长时间编码会话和大型项目。
部分用户对新模型感到不确定,但大多数反馈是正面的。
您可以在 Amazon Bedrock 上使用这些编码升级,这使其能够轻松构建和测试您自己的代理。
提示:尝试使用 Code Interpreter 来完成需要仔细数学或逻辑的任务。您将看到更好的结果,尤其是在金融和网络安全领域。
Claude Sonnet 4.5 还能帮助您发现并修复代码中的安全问题。新模型可以修补漏洞并执行深入的财务检查。这意味着您可以放心地将它用于商业和个人项目。
自主操作

通过此次发布,您将获得更长的自主操作时间。Claude Sonnet 4.5 现在可以自行工作 over 30 hours。这比 Claude Opus 4 之前的 7 小时限制有了巨大提升。您可以让新模型处理大型任务,例如编写文档或审查代码,而无需中断。
功能 | Claude Sonnet 4.5 | Claude Opus 4 | 改进 |
最长自主持续时间 | Over 30 hours | 7 hours | 显著 |
OSWorld 分数 | 61.4% | 42.2% | 重大 |
SWE-bench Verified 分数 | 77.2% | N/A | 显著 |
您可以在 Amazon Bedrock 上使用此扩展操作。该平台支持长时间运行的代理,因此您无需频繁重启任务。这可帮助您以更少的精力完成更大的项目。新模型在代理任务(如编码、文档创建和数据分析)方面也表现出色。
使用限制
Claude Sonnet 4.5 为您提供更多每周使用时长。您可以清楚地查看使用限制,这有助于规划工作。新功能可让您根据需求选择最佳方案。以下是不同订阅计划的每周时长对比:
订阅计划 | Sonnet 4 每周时长 | Opus 4 每周时长 |
Pro($20/月) | 40 to 80 hours | N/A |
Max($100/月) | 140 to 280 hours | 15 to 35 hours |
Max($200/月) | 240 to 480 hours | 24 to 40 hours |
您可以在 Amazon Bedrock 上访问这些新功能。该平台允许您跟踪使用情况,并在需要更多时长时升级计划。此次更新使管理时间和资源变得更加容易。
注意:您可以在 Amazon Bedrock、GitHub Copilot 和其他平台上使用 Claude Sonnet 4.5。新模型带来的更新可帮助您更快、更安全地工作。
对比

Claude Sonnet 4.5 与之前版本的对比
当您将 Claude Sonnet 4.5 与旧模型进行比较时,会发现重大变化。新版本可让您更长时间地不间断工作。它获得了更高分数并拥有新工具。您可以执行更多代理任务并轻松重建网页应用。下表展示了主要功能的改进情况:
功能/指标 | Claude Sonnet 4.5 | 之前版本(例如 Sonnet 4) | 改进 |
自主持续时间 | 30 hours | 7 hours | 显著 |
OSWorld 基准成功率 | 61.4% | 43.9% | 重大飞跃 |
SWE-Bench Verified 分数 | 77.2% (82% with parallel compute) | N/A | 高分 |
上下文管理 | Improved | N/A | 增强 |
多代理支持 | Added | N/A | 新功能 |
重建网页应用能力 | Yes | No | 新能力 |
这些更新为您提供更多控制权和更好结果。您可以完成更难的工作,并信任该模型进行更长时间的工作。
Claude Sonnet 4.5 与竞争对手的对比
您可能想知道 Claude Sonnet 4.5 与其他 top AI models 相比如何。新版本拥有更大的上下文窗口和更新的知识。您可以一次处理更多信息,并从最新数据中获取答案。下表展示了主要差异:
功能 | GPT-4.5 | Claude Sonnet 4.5 |
输入上下文窗口 | 128K tokens | |
最大输出令牌数 | 16.4K tokens | 128K tokens |
知识截止日期 | October 2023 | April 2025 |
您还将获得强大的编码和推理能力。Gemini Pro 2.5 拥有巨大的上下文窗口,并与 Google 工具配合良好。GPT-4.5 适合聊天并拥有大量插件。Claude Sonnet 4.5 在代理支持和编码升级方面脱颖而出。
GPT-4.5:适合聊天,插件丰富,上下文窗口强大。
Claude Sonnet 4.5:上下文窗口最大,最适合代理任务,更新最新。
Gemini Pro 2.5:与 Google 配合,支持多种输入类型,上下文窗口非常大。
选择最适合您的模型。如果您需要更长时间的任务和更好的编码能力,Claude Sonnet 4.5 将为您提供更多选择。
测试显示,Claude Sonnet 4.5 在 SWE-bench 和 GPQA Diamond 上获得了高分。您将获得强大的编码和推理性能。您可以信任该模型用于商业和开发者工作。
使用场景
商业
Claude Sonnet 4.5 helps many businesses solve 实际问题。在酒店业,它加快了客人入住速度,并将反馈转化为有用见解。在能源领域,它能快速分析报告和安全文件。零售商使用它来匹配发票并更好地帮助客户。政府团队使用它来加快许可和福利处理。下表展示了不同行业如何使用该模型以及从中获得的好处:
行业 | 应用描述 | 报告结果 |
酒店业 | 即时客人入住,自动身份验证和预订确认 | 减少前台错误,更快的反馈分析 |
能源 | 处理现场报告、维护日志、安全文档 | 更快的合规,更低的审计风险,更短的计费周期 |
零售 | 自动供应商发票对账 | 更快的客户服务,实时洞察 |
公共部门 | 更快的许可和福利申请处理 | 更准确的税务处理,更轻的工作量 |
您可以使用 Amazon Bedrock 创建执行这些工作的代理,并实时查看进度。这有助于您跟踪工作、减少错误并选择更好的选项。
开发者
您可以获得大量帮助您更快更好地编写代码的工具。该模型可让您立即创建软件并在虚拟机中运行代码。您可以使用更好的内存和上下文处理长时间任务。团队可以通过多代理支持共同完成困难的项目。您还可以使用检查点撤消更改,从而减少错误。
开发者表示使用该模型编码更轻松、更准确。
您可以更轻松地修复代码、添加新功能和进行编辑。
即使长时间工作,该模型也能记住您的工作。
功能 | 开发者受益 |
性能指标 | 顶级编码性能,优于其他模型 |
访问虚拟机 | 安全地测试和运行代码 |
多代理支持 | 团队可以共同完成大型项目 |
检查点 | 轻松回滚更改 |
Claude Agent SDK | 根据您的需求构建自定义代理 |
增强的工具编排 | 同时使用多种工具以获得更好的工作流 |
您可以使用 Amazon Bedrock 获取这些工具并创建自己的编码代理。
集成
您可以使用 Amazon Bedrock 或 GitHub Copilot 将模型添加到您的工作中。在 Amazon Bedrock 上,选择模型并设置您的代理。您可以监控使用量、设置限制,并在需要时升级计划。对于 GitHub Copilot,如果您拥有符合条件的账户,请在管理设置中启用该模型。
平台 | 集成步骤 |
Amazon Bedrock | 选择模型、设置代理、监控使用情况并管理计划 |
GitHub Copilot | 在符合条件的账户的管理设置中启用,访问高级编码功能 |
提示:先使用 Amazon Bedrock 尝试新功能,并构建适合您的工作或编码需求的代理。
您还可以使用该模型帮助进行网络安全。它可帮助您完成困难的任务并保护您的数据安全。该模型适合财务规划和预测未来趋势,并有助于防止信息泄露。
使用 Claude Sonnet 4.5 您可以获得更多好处。新的终端界面可让您的工作更快。检查点可帮助您快速修复错误。更好的编码工具可保护您的工作安全。人们表示他们的代码现在更准确。代理更智能,错误更少。企业完成合同审查的速度更快。公司的网络安全更强。要开始使用,请更改您的模型名称。继续使用您当前的 API 调用。启用新功能,例如用于长时间运行代理的内存工具。
常见问题
如何在 GitHub Copilot 中启用 Claude Sonnet 4.5?
您需要符合条件的 Copilot 账户。转到管理设置。启用 Claude Sonnet 4.5 策略。您可以立即开始使用新的编码功能。
ASL-3 安全级别是什么?
ASL-3 可让您使用高级 AI 任务。您必须遵循安全步骤。该模型可以处理更难的工作,但您应密切监控其操作。
您可以将 Claude Sonnet 4.5 用于长期项目吗?
是的,您可以运行代理任务长达30 小时。这有助于您完成代码审查或文档创建等大型工作而无需中断。
您可以在哪里跟踪使用限制?
您可以在 Amazon Bedrock 上查看使用情况。仪表板会显示您的小时数,并在您需要更多时间时让您升级计划。


