本文涵盖了 Claude Opus 4.7 中推理控制的两个关键变化,以及 AIHubmix 原生 API 和 Chat 统一接口的完整使用说明。另请参见:Anthropic 官方公告 和 模型变更日志。
1. 新的推理控制功能
✦ 新的 xhigh 推理努力级别
新的 xhigh 级别位于 high 和 max 之间,专为 编码和代理任务 设计,在能力和效率之间取得了更好的平衡。
low ── medium ── high ── xhigh ★NEW ── max
✦ 默认情况下隐藏思维内容
在流式响应中,思维过程默认不再显示。要接收推理摘要,请在请求中显式传递 display 字段:
| 显示值 | Opus 4.7 | Opus 4.6 | 行为 |
|---|---|---|---|
| ”省略” | 默认 | 非默认 | 思维块内容为空 |
| ”总结” | 必须手动设置 | 默认 | 返回思维摘要文本 |
"reasoning": {
"effort": "xhigh",
"display": "summarized"
}
图: Opus 4.7 新的 xhigh 级别 — 代理编码性能比较(来源:Anthropic 官方)

2. Claude 原生 API 参考
Anthropic 原生 API 的 effort 值与官方规范一致:
| 努力值 | 支持的模型 | 描述 | 推荐用例 |
|---|---|---|---|
| low | 所有支持的模型 | 显著节省令牌,能力适度折衷 | 简单任务,高并发请求,子代理 |
| medium | 所有支持的模型 | 平衡模式,适度节省令牌 | 一般代理任务 |
| high | 所有支持的模型 | 默认;高能力性能 | 复杂推理、编码、代理任务 |
| xhigh (新) | 仅限 Opus 4.7 | 在 high 和 max 之间扩展能力;擅长长时间任务 | 推荐用于编码和代理任务的起始点 |
| max | Opus 系列 | 最大能力 | 前沿研究问题 |
AIHubmix Claude 原生 API — Opus 4.7 示例
from anthropic import Anthropic
client = Anthropic(
api_key="<AIHUBMIX_API_KEY>",
base_url="https://aihubmix.com"
)
response = client.messages.create(
model="claude-opus-4-7",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "xhigh"}, # 选项:low / medium / high / xhigh / max
messages=[
{
"role": "user",
"content": "一只蜗牛在一个10米深的井底。它每天爬升3米,但每晚滑回2米。它需要多少天才能到达井口?"
}
]
)
print(response.content[-1].text)
3. AIHubmix Chat 统一接口中的推理努力支持
AIHubMix Chat 统一接口与 OpenAI 规范一致,通过 reasoning.effort 控制推理强度。不同的 Claude 模型会自动映射到相应的努力级别:
reasoning_effort (Claude 模型的推理强度控制)
| 努力值 | Opus >=4.7(新) | Opus 4.6 / 4.5 | Sonnet 4.6 |
|---|---|---|---|
| minimal | low | low | low |
| medium | medium | medium | medium |
| high | high | high | high |
| xhigh | xhigh | max | high |
| max | max | max | high |
注意:xhigh 仅在 Opus 4.7 中原生支持。其他 Opus 模型会自动回退到 max,而 Sonnet 系列会回退到 high。
Chat 统一接口 — Opus 4.7 示例
from openai import OpenAI
client = OpenAI(
base_url="https://aihubmix.com/v1",
api_key="<AIHUBMIX_API_KEY>",
)
completion = client.chat.completions.create(
model="claude-opus-4-7",
# max_tokens=10000, # 默认是 4096;启用以获得更长的输出
messages=[
{
"role": "user",
"content": "一只蜗牛在一个10米深的井底。它每天爬升3米,但每晚滑回2米。它需要多少天才能到达井口?"
}
],
extra_body={
"reasoning": {"effort": "xhigh"}
}
)
print(completion.choices[0].message.content)
4. 控制 Chat 统一接口中的思维内容
在与 OpenAI 兼容的接口中,reasoning 支持一个 display 字段来控制是否返回思维摘要。Claude Opus 4.7 默认不返回思维内容。设置 "display": "summarized" 以启用它。
| 字段 | 值 | 描述 |
|---|---|---|
display | (省略) | 思维内容未返回(默认) |
display | "summarized" | 返回思维摘要 |
Opus 4.7 — 思维摘要示例
from openai import OpenAI
client = OpenAI(
base_url="https://aihubmix.com/v1",
api_key="<AIHUBMIX_API_KEY>",
)
completion = client.chat.completions.create(
model="claude-opus-4-7",
messages=[
{
"role": "user",
"content": "一只蜗牛在一个10米深的井底。它每天爬升3米,但每晚滑回2米。它需要多少天才能到达井口?"
}
],
extra_body={
"reasoning": {"effort": "xhigh", "display": "summarized"}
}
)
print(completion.choices[0].message.content)
有关更多详细信息,请参阅 AIHubmix 文档 或 Anthropic 官方文档。
最后更新:2026-06-01