Anthropic 宣布推出新一代大语言模型 Claude Opus 4.5,作为 Claude 4.5 系列中的旗舰版本,重点面向代码生成、智能体编排和通用电脑使用等高强度工作场景。官方将其描述为目前最强的 Claude 模型之一,强调在复杂办公任务、长文本处理和专业应用方面较上一代 Opus 4.1 有明显性能提升。
在技术特性上,Claude Opus 4.5 提升了推理深度和长程记忆能力,针对软件工程、表格建模、财务分析等专业任务进行了优化,并增加可调节的“effort”参数,方便在响应详尽程度与算力成本之间平衡。公开的基准数据显示,该模型在 SWE-bench Verified 等编码与智能体评测中取得较高成绩,在终端操作、工具调用和电脑环境任务等方面优于前代 Opus 4.1 和 Sonnet 4.5,同时在价格上将旗舰级能力的使用门槛进一步降低。
目前,Claude Opus 4.5 已通过 Anthropic 自有应用与 API 向用户开放,并陆续接入 Microsoft Foundry(含 GitHub Copilot 付费版本与 Copilot Studio)、Amazon Bedrock、Databricks 等主流云与开发平台,覆盖企业开发、办公自动化和智能体部署等多种场景。与此同时,业界也关注其在安全和防滥用方面的表现,有评估认为该模型在拒绝恶意编码请求上的能力有所增强,但在恶意软件生成和不当电脑操作上仍存在被绕过空间,相关防护机制仍在持续完善中。
常见问题
Q:Claude Opus 4.5 是什么?
A:Claude Opus 4.5 是 Anthropic 发布的最新一代旗舰大模型,隶属 Claude 4.5 系列,重点面向复杂代码生成、智能体构建、电脑使用自动化以及专业办公场景,被官方定位为其当前能力最强的通用模型之一。
Q:Claude Opus 4.5 在编码和智能体方面有哪些主要升级?
A:该模型强化了跨文件代码理解和长程推理能力,可在大型代码库中完成重构、测试生成和多步骤开发任务,在多项编码与智能体基准测试中取得领先成绩,更适合构建长期运行、可调用多种工具和应用的生产级智能体。
Q:现在通过哪些渠道可以使用 Claude Opus 4.5?
A:用户可以通过 Anthropic 的官方应用和 API 使用 Claude Opus 4.5,企业与开发者还可以在 Microsoft Foundry、GitHub Copilot、Copilot Studio、Amazon Bedrock、Databricks 等平台上按各自开放节奏进行调用,部分服务可能采取分阶段开放或限量试用形式。
Q:宣传中提到的“全球最强编码、智能体与电脑使用模型”是否已经形成共识?
A:这一说法主要源自官方及合作伙伴的定位,突出 Claude Opus 4.5 在编码、智能体和电脑使用任务上的优势。目前已有多个公开基准和开发者评测支持其在相关任务中的领先表现,但不同测试场景和指标存在差异,行业内尚未形成统一权威排名。
Q:使用 Claude Opus 4.5 时需要注意哪些风险?
A:尽管 Claude Opus 4.5 在拒绝部分恶意代码请求和潜在攻击方面表现更好,但在恶意软件生成、不当终端操作等方向仍可能存在被滥用风险。企业在部署 Claude Opus 4.5 处理关键系统时,应配合权限控制、操作日志和人工复核机制,不宜将核心资源完全交由自动化智能体独立控制。