Claude 4.5 有哪些新内容
Claude 4.5 推出三款面向不同场景的模型:
- Claude Opus 4.5:我们最智能的模型,兼具极致能力与实用性能。相比此前的 Opus 模型价格更友好。提供 200k token 上下文窗口。
- Claude Sonnet 4.5:我们用于复杂代理和编程的最佳模型,在多数任务上具备最高智能。提供 200k 和 1M(Beta)上下文窗口。
- Claude Haiku 4.5:我们最快、最智能的 Haiku 模型,性能接近前沿。提供 200k token 上下文窗口。
Opus 4.5 相比 Opus 4.1 的关键改进
极致智能
Claude Opus 4.5 是我们最智能的模型,将极致能力与实用性能结合在一起。它在推理、编程与复杂问题求解方面带来跃升式改进,同时保持 Opus 系列一贯的高质量输出。
effort 参数
Claude Opus 4.5 是唯一支持 [effort 参数] 的模型,可让你控制 Claude 在回应时使用多少 token。这使你能够在回应详尽度与 token 效率之间做权衡。
effort 参数会影响响应中的所有 token,包括文本回复、工具调用与 extended thinking。你可以在以下级别中选择:
- High effort:用于复杂分析与详细解释的最高详尽度
- Medium effort:适用于大多数生产用例的平衡方案
- Low effort:面向高吞吐自动化的最高 token 效率
电脑使用能力的提升
Claude Opus 4.5 引入[增强的 computer use 能力],新增缩放操作,可在全分辨率下对特定屏幕区域进行细致检查。这让 Claude 能够查看精细的 UI 元素、小字号文字和在常规截图中不清晰的视觉细节。
缩放能力特别适合:
- 检查细小的 UI 元素与控件
- 阅读小字或细节文本
- 分析信息密集的复杂界面
- 在执行操作前核对精确的视觉细节
实用性能
Claude Opus 4.5 以[更友好的价格]提供旗舰级智能,使高级 AI 能力可用于更广泛的应用场景与用例。
思考块保留
Claude Opus 4.5 会[自动保留所有之前的 thinking blocks],在多轮对话与工具使用过程中保持推理连续性。这确保 Claude 在处理复杂、长期任务时能有效利用完整的推理历史。
Sonnet 4.5 相比 Sonnet 4 的关键改进
卓越编程能力
Claude Sonnet 4.5 是我们迄今为止最强的编程模型,在整个开发生命周期上有显著提升:
- SWE-bench Verified 表现:在编程基准上达到先进水平
- 更强的规划与系统设计:更好的架构决策与代码组织
- 更好的安全工程:更稳健的安全实践与漏洞检测
- 更好的指令遵循:更精准地遵循编程规范与需求
当启用 extended thinking 时,Claude Sonnet 4.5 在编程任务上的表现会明显更好。extended thinking 默认关闭,但我们建议在复杂编程工作中开启。请注意,extended thinking 会影响 prompt caching efficiency。配置细节请参见 migration guide。
代理能力
Claude Sonnet 4.5 在代理能力方面有重大进步:
- 更长时间的自主运行:Sonnet 4.5 可独立工作数小时,保持清晰的目标与渐进式进展。模型会专注于少量任务稳步推进,而不是同时尝试全部任务,并提供基于事实的进度更新。
- 上下文感知:Claude 现在会在对话中跟踪 token 使用量,并在每次工具调用后收到更新。这种意识有助于避免任务过早中止,并提升长任务执行效率。技术细节请参见 [Context awareness],并参考 [prompting guidance]。
- 更强的工具使用:模型更有效地使用并行工具调用,在研究时同时发起多个探索性搜索,并一次性读取多个文件以更快建立上下文。对多工具与多信息源的协同提升,让其在 agentic 搜索与编程流程中更好地发挥能力。
- 更先进的上下文管理:Sonnet 4.5 在外部文件中保持出色的状态跟踪能力,在跨会话中维持目标导向。结合更有效的上下文窗口利用与新的上下文管理 API 功能,模型能在长时间会话中保持连贯性。
Context awareness 可用于 Claude Sonnet 4、Sonnet 4.5、Haiku 4.5、Opus 4、Opus 4.1 和 Opus 4.5。
沟通与交互风格
Claude Sonnet 4.5 的沟通风格更加简洁、直接、自然。它会提供基于事实的进度更新,并可能在工具调用后跳过冗长总结以保持工作流节奏(可通过提示调整)。
创意内容生成
Claude Sonnet 4.5 在创意内容方面表现出色:
- 演示文稿与动画:在制作幻灯片与视觉内容方面可媲美或超过 Claude Opus 4.1 和 Opus 4.5
- 创意表现:生成更精致、专业且具有良好指令遵循的输出
- 首轮质量:首次生成即可提供可用、设计良好的内容
Haiku 4.5 相比 Haiku 3.5 的关键改进
Claude Haiku 4.5 为 Haiku 系列带来变革性跃升,将前沿能力带到最快的模型级别:
接近前沿的智能与惊人的速度
Claude Haiku 4.5 以更低成本和更快速度提供接近 Sonnet 4 的性能:
- 接近前沿的智能:在推理、编程与复杂任务上匹配 Sonnet 4
- 速度提升:速度超过 Sonnet 4 的两倍,并针对输出 token/s (OTPS) 做了优化
- 成本性能最佳:以三分之一成本提供接近前沿的智能,适合高吞吐部署
扩展思考能力
Claude Haiku 4.5 是首个支持扩展思考的 Haiku 模型,将高级推理能力带入 Haiku 系列:
- 高速推理:访问 Claude 的内部推理过程以解决复杂问题
- 思考摘要:面向生产部署的思考摘要输出
- 交错思考:在工具调用之间思考,以支持更复杂的多步工作流
- 预算控制:配置思考 token 预算,在推理深度与速度之间取得平衡
必须在 API 请求中显式添加 thinking 参数以启用扩展思考。实现细节请参见 [Extended thinking documentation]。
当启用 extended thinking 时,Claude Haiku 4.5 在编程和推理任务上的表现会显著提升。extended thinking 默认关闭,但我们建议在复杂问题求解、编程工作和多步推理中开启。请注意,extended thinking 会影响 prompt caching efficiency。配置细节请参见 migration guide。
适用于 Claude Sonnet 3.7、Sonnet 4、Sonnet 4.5、Haiku 4.5、Opus 4、Opus 4.1 和 Opus 4.5。
上下文感知
Claude Haiku 4.5 具备上下文感知能力,能够在对话中跟踪剩余上下文窗口:
- Token 预算跟踪:Claude 在每次工具调用后收到剩余上下文容量的实时更新
- 更好的任务持续性:模型通过理解可用工作空间更有效地执行任务
- 多上下文窗口工作流:更好地处理跨长会话的状态切换
这是首个原生具备上下文感知能力的 Haiku 模型。提示策略请参见 [Claude 4 best practices]。
适用于 Claude Sonnet 4、Sonnet 4.5、Haiku 4.5、Opus 4、Opus 4.1 和 Opus 4.5。
强大的编程与工具使用
Claude Haiku 4.5 具备现代 Claude 模型应有的扎实编程能力:
- 编程能力:在代码生成、调 试与重构任务上表现强劲
- 完整工具支持:兼容所有 Claude 4 工具,包括 bash、代码执行、文本编辑器、web search 与 computer use
- 增强的电脑使用:针对自主桌面交互与浏览器自动化工作流进行优化
- 并行工具执行:对复杂流程进行高效的工具协同
Haiku 4.5 适用于既要求智能又要求效率的场景:
- 实时应用:交互式体验的快速响应
- 高吞吐处理:大规模部署的高性价比智能
- 免费层实现:在可负担成本下提供高品质模型能力
- 子代理架构:多代理系统中的快速、智能代理
- 规模化 computer use:高性价比的桌面与浏览器自动化
新的 API 功能
Programmatic tool calling(Beta)
[Programmatic tool calling] 允许 Claude 在代码执行容器内编写代码来程序化调用你的工具,而无需每次工具调用都往返模型。这显著降低了多工具工作流的延迟,并通过让 Claude 在结果进入上下文窗口前先过滤或处理数据来减少 token 消耗。
tools=[
{
"type": "code_execution_20250825",
"name": "code_execution"
},
{
"name": "query_database",
"description": "Execute a SQL query against the sales database. Returns a list of rows as JSON objects.",
"input_schema": {...},
"allowed_callers": ["code_execution_20250825"] # Enable programmatic calling
}
]
关键收益:
- 降低延迟:消除工具调用之间的模型往返
- Token 效率:在返回 Claude 之前先以程序方式处理和过滤工具结果
- 复杂工作流:支持循环、条件逻辑与批处理
适用于 Claude Opus 4.5 与 Claude Sonnet 4.5。需要 [beta header]:advanced-tool-use-2025-11-20
Tool search tool(Beta)
[tool search tool] 使 Claude 能够处理数百甚至数千个工具,通过按需发现和加载工具。它不会一次性把所有工具定义加载进上下文窗口,而是搜索你的工具目录并只加载所需工具。
提供两种搜索模式:
- Regex (
tool_search_tool_regex_20251119):Claude 构造正则表达式来搜索工具名、描述与参数 - BM25 (
tool_search_tool_bm25_20251119):Claude 使用自然语言查询来搜索工具
tools=[
{
"type": "tool_search_tool_regex_20251119",
"name": "tool_search_tool_regex"
},
{
"name": "get_weather",
"description": "Get the weather at a specific location",
"input_schema": {...},
"defer_loading": True # Load on-demand via search
}
]
这种方式解决了两个关键问题:
- 上下文效率:无需加载全部工具定义,节省 10-20K tokens
- 工具选择准确性:即使有 100+ 工具也能保持高准确率
适用于 Claude Opus 4.5 与 Claude Sonnet 4.5。需要 [beta header]:advanced-tool-use-2025-11-20
Effort parameter(Beta)
[effort parameter] 允许你控制 Claude 在回应时使用的 token 数量,以权衡回应详尽度与 token 效率:
response = client.beta.messages.create(
model="claude-opus-4-5-20251101",
betas=["effort-2025-11-24"],
max_tokens=4096,
messages=[{"role": "user", "content": "..."}],
output_config={
"effort": "medium" # "low", "medium", or "high"
}
)
effort 参数会影响响应中的所有 token,包括文本回复、工具调用与 extended thinking。低 effort 更简洁,高 effort 提供更详细的推理与更全面的回答。
仅适用于 Claude Opus 4.5。需要 [beta header]:effort-2025-11-24
Tool use examples(Beta)
[Tool use examples] 允许你提供有效工具输入的具体示例,帮 助 Claude 更好地理解如何使用你的工具。这对包含嵌套对象、可选参数或格式敏感输入的复杂工具尤其有帮助。
tools=[
{
"name": "get_weather",
"description": "Get the current weather in a given location",
"input_schema": {...},
"input_examples": [
{
"location": "San Francisco, CA",
"unit": "fahrenheit"
},
{
"location": "Tokyo, Japan",
"unit": "celsius"
},
{
"location": "New York, NY" # Demonstrates optional 'unit' parameter
}
]
}
]
示例会与工具 schema 一起被包含在 prompt 中,向 Claude 展示规范的工具调用模式。每个示例都必须符合工具的 input_schema。
适用于 Claude Sonnet 4.5、Haiku 4.5、Opus 4.5、Opus 4.1 和 Opus 4。需要 [beta header]:advanced-tool-use-2025-11-20。
Memory tool(Beta)
新的 [memory tool] 允许 Claude 在上下文窗口之外存取信息:
tools=[
{
"type": "memory_20250818",
"name": "memory"
}
]
这可以用于:
- 构建长期知识库
- 跨会话保持项目状态
- 通过文件存储实现近乎无限的上下文
适用于 Claude Sonnet 4、Sonnet 4.5、Haiku 4.5、Opus 4、Opus 4.1 和 Opus 4.5。需要 [beta header]:context-management-2025-06-27
Context editing
使用 [context editing],或通过自动清理工具调用实现智能上下文管理:
response = client.beta.messages.create(
betas=["context-management-2025-06-27"],
model="claude-sonnet-4-5", # or claude-haiku-4-5
max_tokens=4096,
messages=[{"role": "user", "content": "..."}],
context_management={
"edits": [
{
"type": "clear_tool_uses_20250919",
"trigger": {"type": "input_tokens", "value": 500},
"keep": {"type": "tool_uses", "value": 2},
"clear_at_least": {"type": "input_tokens", "value": 100}
}
]
},
tools=[...]
)
该功能会在接近 token 上限时自动移除较旧的工具调用及其结果,帮助在长时间 agent 会话中管理上下文。
适用于 Claude Sonnet 4、Sonnet 4.5、Haiku 4.5、Opus 4、Opus 4.1 和 Opus 4.5。需要 [beta header]:context-management-2025-06-27
增强的 stop reason
Claude 4.5 模型引入新的 model_context_window_exceeded stop reason,用于明确指出生成因达到上下文窗口上限而停止,而非因请求的 max_tokens 限制 停止。这使得在应用逻辑中处理上下文上限更容易。
{
"stop_reason": "model_context_window_exceeded",
"usage": {
"input_tokens": 150000,
"output_tokens": 49950
}
}
工具参数处理改进
Claude 4.5 模型修复了工具调用字符串参数中格式被错误截断的问题。此前,字符串参数的末尾换行有时会被误删。修复后,需精确格式的工具(如文本编辑器)将按预期收到参数。
这是后台改进,无需 API 变更。不过,带字符串参数的工具现在可能收到此前被去掉的末尾换行。
示例:
// Before: Final newline accidentally stripped
{
"type": "tool_use",
"id": "toolu_01A09q90qw90lq917835lq9",
"name": "edit_todo",
"input": {
"file": "todo.txt",
"contents": "1. Chop onions.\n2. ???\n3. Profit"
}
}
// After: Trailing newline preserved as intended
{
"type": "tool_use",
"id": "toolu_01A09q90qw90lq917835lq9",
"name": "edit_todo",
"input": {
"file": "todo.txt",
"contents": "1. Chop onions.\n2. ???\n3. Profit\n"
}
}
Token 计数优化
Claude 4.5 模型包含自动优化以提升模型性能。这些优化可能会增加少量 token,但 这些系统添加的 token 不计费。
Claude 4 中引入的功能
以下功能在 Claude 4 中引入,并在所有 Claude 4 模型中可用,包括 Claude Sonnet 4.5 与 Claude Haiku 4.5。
新的 refusal stop reason
Claude 4 模型为安全原因拒绝生成的内容引入新的 refusal stop reason:
{
"id": "msg_014XEDjypDjFzgKVWdFUXxZP",
"type": "message",
"role": "assistant",
"model": "claude-sonnet-4-5",
"content": [{"type": "text", "text": "I would be happy to assist you. You can "}],
"stop_reason": "refusal",
"stop_sequence": null,
"usage": {
"input_tokens": 564,
"cache_creation_input_tokens": 0,
"cache_read_input_tokens": 0,
"output_tokens": 22
}
}
当使用 Claude 4 模型时,你应该更新应用以 [handle refusal stop reasons]。
Summarized thinking
启用 extended thinking 后,Claude 4 的 Messages API 会返回 Claude 完整思考过程的摘要。Summarized thinking 既保留了 extended thinking 的智能收益,也能防止滥用。
尽管 Claude 3.7 与 4 的 API 保持一致,但 extended thinking 的流式响应可能呈现“块状”输出,事件之间可能存在延迟。
摘要由与你请求目标模型不同的模型处理。thinking 模型不会看到摘要输出。
更多信息请参见 [Extended thinking documentation]。
Interleaved thinking
Claude 4 模型支持 interleaved thinking,使工具调用与响应可以与普通消息交错,更自然。
Interleaved thinking 处于 Beta 状态。要启用该功能,请在 API 请求中添加 beta header interleaved-thinking-2025-05-14。
更多信息请参见 [Extended thinking documentation]。
行为差异
Claude 4 模型存在一些行为差异,可能影响你的 prompt 写法:
沟通风格变化
- 更简洁直接:以更高效率沟通,减少冗长解释
- 更自然的语气:回答更具对话感,机器味更少
- 效率优先:完成动作后可能跳过详细总结以保持节奏(需要时可提示)
指令遵循
Claude 4 模型在指令遵循上更加严格,需要更明确的指示:
- 明确行动:如果希望 Claude 采取行动,请使用“执行这些修改”或“实现该功能”这类明确表达,而不是“能否建议修改”
- 清晰说明期望行为:Claude 会严格遵循指令,清晰具体能带来更好结果
关于这些模型的完整指南,请参见 [Claude 4 prompt engineering best practices]。
文本编辑器工具更新
文本编辑器工具在 Claude 4 模型上有如下更新:
- 工具类型:
text_editor_20250728 - 工具名称:
str_replace_based_edit_tool - 不再支持
undo_edit命令
Claude Sonnet 3.7 仍使用 str_replace_editor 文本编辑器工具。
如果你从 Claude Sonnet 3.7 迁移并使用文本编辑器工具:
# Claude Sonnet 3.7
tools=[
{
"type": "text_editor_20250124",
"name": "str_replace_editor"
}
]
# Claude 4 models
tools=[
{
"type": "text_editor_20250728",
"name": "str_replace_based_edit_tool"
}
]
代码执行工具更新
如果你在使用代码执行工具,请确保使用最新版本 code_execution_20250825,该版本新增了 Bash 命令与文件操作能力。
旧版 code_execution_20250522(仅 Python)仍可用,但不推荐用于新实现。
价格与可用性
价格
Claude 4.5 模型保持有竞争力的定价:
| Model | Input | Output |
|---|---|---|
| Claude Opus 4.5 | $5 / 百万 token | $25 / 百万 token |
| Claude Sonnet 4.5 | $3 / 百万 token | $15 / 百万 token |
| Claude Haiku 4.5 | $1 / 百万 token | $5 / 百万 token |
第三方平台定价
从 Claude 4.5 模型(Opus 4.5、Sonnet 4.5、Haiku 4.5)开始,AWS Bedrock 与 Google Vertex AI 提供两类端点:
- 全球端点:动态路由,确保最大可用性
- 区域端点:保证数据经过指定地域路由,加收 10% 费用
该区域定价适用于所有 Claude 4.5 模型:Opus 4.5、Sonnet 4.5、Haiku 4.5。
Claude API(1P)默认是全球端点,不受该变更影响。 Claude API 仅提供全球端点(与其他平台的全球端点与价格等价)。
可用性
Claude 4.5 模型可用于:
| Model | Claude API | Amazon Bedrock | Google Cloud Vertex AI |
|---|---|---|---|
| Claude Opus 4.5 | claude-opus-4-5-20251101 | anthropic.claude-opus-4-5-20251101-v1:0 | claude-opus-4-5@20251101 |
| Claude Sonnet 4.5 | claude-sonnet-4-5-20250929 | anthropic.claude-sonnet-4-5-20250929-v1:0 | claude-sonnet-4-5@20250929 |
| Claude Haiku 4.5 | claude-haiku-4-5-20251001 | anthropic.claude-haiku-4-5-20251001-v1:0 | claude-haiku-4-5@20251001 |
Claude.ai 与 Claude Code 也可使用。