我们已推出 Claude Opus 4.8(claude-opus-4-8),这是我们目前能力最强且广泛可用的模型。Claude Opus 4.8 在 Claude API、Amazon Bedrock、Google Cloud 和 Microsoft Foundry 上默认支持 100 万 token 的上下文窗口、12.8 万 token 的最大输出长度,以及与 Claude Opus 4.7 相同的工具集和平台功能。请参阅《Claude Opus 4.8 新特性》了解能力改进、新功能和迁移指南。

我们推出了对话中途系统消息功能。在 Claude Opus 4.8 上,你可以在用户轮次之后(需遵守放置规则)在消息数组中发送 role: "system" 消息,从而在长时间运行的会话中指令发生变化时保留提示缓存命中。无需 beta 标头。

拒绝响应中的 stop_details 字段现已公开文档化;它会返回一个类别(cyberbionull)以及人类可读的解释,以便你的应用程序将不同类别的拒绝路由到正确的下一步。无需 beta 标头。

在 Claude Opus 4.8 上,effort 参数在所有界面(包括 Claude Code 和 Messages API)中默认设为 high

在 Claude Opus 4.8 上,提示缓存的最小可缓存提示长度为 1024 个 token,低于 Claude Opus 4.7。

启用自适应思考后,Claude Opus 4.8 仅在需要时才触发推理,相比相同 effort 级别的 Claude Opus 4.7,减少了浪费的思考 token。

Claude Opus 4.8 支持高分辨率图像输入(长边最多 2576 像素),与 Claude Opus 4.7 相同。

任务预算现在支持 Claude Opus 4.8。

顾问工具现在支持 Claude Opus 4.8。

计算机使用现在支持 Claude Opus 4.8。

Claude Opus 4.8 的快速模式仅作为研究预览在 Claude API 上提供。

将采样参数 temperaturetop_ptop_k 设置为非默认值会在 Claude Opus 4.8 上返回 400 错误,与 Claude Opus 4.7 相同。详情请参阅迁移指南。

在 Claude Code 中,我们已将自动模式扩展到更多用户,用于长时间运行的任务。请参阅 Claude Code 文档。

在 Claude Code 中,Max 计划用户现在默认在 Claude Opus 4.8 上使用快速模式。请参阅 Claude Code 文档。

在 Claude Code 中,工作流作为研究预览提供,让你能够定义和运行多步骤的代理计划。请参阅 Claude Code 文档。

我们已弃用 Claude Opus 4.6 的快速模式,将在发布后约 30 天移除。请迁移到 Claude Opus 4.8 或 Claude Opus 4.7 的快速模式。更多信息请阅读《快速模式》。

关于本版本中 claude.ai、Cowork、Claude for Microsoft 365 及其他 Claude 应用的更新,请参阅《Claude 应用发布说明》。

本文内容采集自官方网站,排版和翻译可能与原页面存在差异。

阅读官方全文