이 문서에서는 Claude Opus 4.7의 추론 제어에 대한 두 가지 주요 변경 사항과 함께 Claude Opus 4.7에 대한 AIHubmix 네이티브 API 및 Chat 통합 인터페이스에 대한 완전한 사용 지침을 다룹니다. 또한 Anthropic 공식 발표 및 모델 변경 로그를 참조하십시오.
1. 새로운 추론 제어 기능
✦ 새로운 xhigh 추론 노력 수준
새로운 xhigh 수준은 high 와 max 사이에 위치하며, 코딩 및 에이전트 작업을 위해 특별히 설계되어 능력과 효율성 간의 더 나은 균형을 제공합니다.
low ── medium ── high ── xhigh ★NEW ── max
✦ 기본적으로 숨겨진 사고 내용
스트리밍 응답에서 사고 과정은 기본적으로 더 이상 표시되지 않습니다. 추론 요약을 받으려면 요청에 display 필드를 명시적으로 전달하십시오:
| display value | Opus 4.7 | Opus 4.6 | Behavior |
|---|---|---|---|
| ”생략됨” | 기본값 | 비기본값 | 사고 블록 내용이 비어 있음 |
| ”요약됨” | 수동으로 설정해야 함 | 기본값 | 사고 요약 텍스트 반환 |
"reasoning": {
"effort": "xhigh",
"display": "summarized"
}
그림: Opus 4.7 새로운 xhigh 수준 — 에이전트 코딩 성능 비교 (출처: Anthropic 공식)

2. Claude 네이티브 API 참조
Anthropic 네이티브 API의 effort 값은 공식 사양과 일치합니다:
| effort value | 지원되는 모델 | 설명 | 추천 사용 사례 |
|---|---|---|---|
| low | 모든 지원 모델 | 상당한 토큰 절약과 중간 능력 절충 | 간단한 작업, 높은 동시 요청, 하위 에이전트 |
| medium | 모든 지원 모델 | 중간 토큰 절약과 균형 잡힌 모드 | 일반적인 에이전트 작업 |
| high | 모든 지원 모델 | 기본값; 높은 능력 성능 | 복잡한 추론, 코딩, 에이전트 작업 |
| xhigh (새로운) | Opus 4.7 전용 | high와 max 사이의 확장된 능력; 장기 작업에서 뛰어남 | 코딩 및 에이전트 작업을 위한 추천 시작점 |
| max | Opus 시리즈 | 최대 능력 | 최전선 연구 문제 |
AIHubmix Claude 네이티브 API — Opus 4.7 예제
from anthropic import Anthropic
client = Anthropic(
api_key="<AIHUBMIX_API_KEY>",
base_url="https://aihubmix.com"
)
response = client.messages.create(
model="claude-opus-4-7",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "xhigh"}, # 옵션: low / medium / high / xhigh / max
messages=[
{
"role": "user",
"content": "달팽이가 10미터 깊이의 우물 바닥에 있습니다. 매일 3미터 올라가지만 매일 밤 2미터 미끄러집니다. 꼭대기에 도달하는 데 며칠이 걸릴까요?"
}
]
)
print(response.content[-1].text)
3. AIHubmix Chat 통합 인터페이스에서의 추론 노력 지원
AIHubMix Chat 통합 인터페이스는 OpenAI 사양과 일치하며 reasoning.effort 를 통해 추론 강도를 제어합니다. 다른 Claude 모델은 자동으로 해당 노력 수준에 매핑됩니다:
reasoning_effort (Claude 모델을 위한 추론 강도 제어)
| effort value | Opus >=4.7 (새로운) | Opus 4.6 / 4.5 | Sonnet 4.6 |
|---|---|---|---|
| minimal | low | low | low |
| medium | medium | medium | medium |
| high | high | high | high |
| xhigh | xhigh | max | high |
| max | max | max | high |
참고: xhigh 는 Opus 4.7에서만 기본적으로 지원됩니다. 다른 Opus 모델은 자동으로 max 로 대체되며, Sonnet 시리즈는 high 로 대체됩니다.
Chat 통합 인터페이스 — Opus 4.7 예제
from openai import OpenAI
client = OpenAI(
base_url="https://aihubmix.com/v1",
api_key="<AIHUBMIX_API_KEY>",
)
completion = client.chat.completions.create(
model="claude-opus-4-7",
# max_tokens=10000, # 기본값은 4096; 더 긴 출력을 위해 활성화
messages=[
{
"role": "user",
"content": "달팽이가 10미터 깊이의 우물 바닥에 있습니다. 매일 3미터 올라가지만 매일 밤 2미터 미끄러집니다. 꼭대기에 도달하는 데 며칠이 걸릴까요?"
}
],
extra_body={
"reasoning": {"effort": "xhigh"}
}
)
print(completion.choices[0].message.content)
4. Chat 통합 인터페이스에서 사고 내용 제어
OpenAI 호환 인터페이스에서 reasoning 는 사고 요약이 반환되는지 여부를 제어하는 display 필드를 지원합니다.Claude Opus 4.7은 기본적으로 사고 내용을 반환하지 않습니다. 이를 활성화하려면 "display": "summarized" 로 설정하십시오.
| 필드 | 값 | 설명 |
|---|---|---|
display | (생략됨) | 사고 내용이 반환되지 않음 (기본값) |
display | "summarized" | 사고 요약을 반환 |
Opus 4.7 — 사고 요약 예제
from openai import OpenAI
client = OpenAI(
base_url="https://aihubmix.com/v1",
api_key="<AIHUBMIX_API_KEY>",
)
completion = client.chat.completions.create(
model="claude-opus-4-7",
messages=[
{
"role": "user",
"content": "달팽이가 10미터 깊이의 우물 바닥에 있습니다. 매일 3미터 올라가지만 매일 밤 2미터 미끄러집니다. 꼭대기에 도달하는 데 며칠이 걸릴까요?"
}
],
extra_body={
"reasoning": {"effort": "xhigh", "display": "summarized"}
}
)
print(completion.choices[0].message.content)
자세한 내용은 AIHubmix 문서 또는 Anthropic 공식 문서를 참조하십시오.
마지막 업데이트: 2026-06-01