Este artigo aborda duas mudanças principais no controle de raciocínio no Claude Opus 4.7, juntamente com instruções completas de uso para a API nativa do AIHubmix e a interface unificada do Chat. Veja também: anúncio oficial da Anthropic e registro de alterações do modelo.
1. Novos Recursos de Controle de Raciocínio
✦ Novo xhigh Nível de Esforço de Raciocínio
O novo xhigh nível fica entre high e max, projetado especificamente para tarefas de codificação e agentes, equilibrando melhor capacidade e eficiência.
baixo ── médio ── alto ── xhigh ★NOVO ── max
✦ Conteúdo de Pensamento Escondido por Padrão
Nas respostas de streaming, o processo de pensamento é não exibido por padrão. Para receber um resumo do raciocínio, passe explicitamente o campo display na sua solicitação:
| valor de exibição | Opus 4.7 | Opus 4.6 | Comportamento |
|---|---|---|---|
| ”omitido” | Padrão | Não padrão | Conteúdo do bloco de pensamento está vazio |
| ”resumido” | Deve ser definido manualmente | Padrão | Retorna texto de resumo do pensamento |
"reasoning": {
"effort": "xhigh",
"display": "summarized"
}
Figura: Novo nível xhigh do Opus 4.7 — Comparação de desempenho de codificação agentic (Fonte: Anthropic oficial)

2. Referência da API Nativa do Claude
Os valores de esforço para a API nativa da Anthropic são consistentes com a especificação oficial:
| valor de esforço | Modelos Suportados | Descrição | Caso de Uso Recomendado |
|---|---|---|---|
| baixo | Todos os modelos suportados | Economia significativa de tokens com troca moderada de capacidade | Tarefas simples, solicitações de alta concorrência, sub-agentes |
| médio | Todos os modelos suportados | Modo equilibrado com economia moderada de tokens | Tarefas agentic gerais |
| alto | Todos os modelos suportados | Padrão; desempenho de alta capacidade | Raciocínio complexo, codificação, tarefas agentic |
| xhigh (novo) | Apenas Opus 4.7 | Capacidade estendida entre alta e máxima; se destaca em tarefas de longo prazo | Ponto de partida recomendado para tarefas de codificação e agentic |
| max | Série Opus | Capacidade máxima | Problemas de pesquisa de fronteira |
API Nativa do AIHubmix Claude — Exemplo do Opus 4.7
from anthropic import Anthropic
client = Anthropic(
api_key="<AIHUBMIX_API_KEY>",
base_url="https://aihubmix.com"
)
response = client.messages.create(
model="claude-opus-4-7",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "xhigh"}, # Opções: baixo / médio / alto / xhigh / max
messages=[
{
"role": "user",
"content": "Um caracol está no fundo de um poço de 10 metros. A cada dia, ele sobe 3 metros, mas a cada noite, ele escorrega de volta 2 metros. Quantos dias leva para chegar ao topo?"
}
]
)
print(response.content[-1].text)
3. Suporte a Esforço de Raciocínio na Interface Unificada do Chat AIHubmix
A interface unificada do AIHubMix Chat está alinhada com a especificação do OpenAI e controla a intensidade do raciocínio via reasoning.effort. Diferentes modelos Claude são automaticamente mapeados para o nível de esforço correspondente:
reasoning_effort (Controle de Intensidade do Raciocínio) para Modelos Claude
| valor de esforço | Opus >=4.7 (novo) | Opus 4.6 / 4.5 | Sonnet 4.6 |
|---|---|---|---|
| mínimo | baixo | baixo | baixo |
| médio | médio | médio | médio |
| alto | alto | alto | alto |
| xhigh | xhigh | max | alto |
| max | max | max | alto |
Nota: xhigh é suportado nativamente apenas no Opus 4.7. Outros modelos Opus automaticamente retornam para max, e a série Sonnet retorna para high.
Interface Unificada do Chat — Exemplo do Opus 4.7
from openai import OpenAI
client = OpenAI(
base_url="https://aihubmix.com/v1",
api_key="<AIHUBMIX_API_KEY>",
)
completion = client.chat.completions.create(
model="claude-opus-4-7",
# max_tokens=10000, # O padrão é 4096; habilite para saídas mais longas
messages=[
{
"role": "user",
"content": "Um caracol está no fundo de um poço de 10 metros. A cada dia, ele sobe 3 metros, mas a cada noite, ele escorrega de volta 2 metros. Quantos dias leva para chegar ao topo?"
}
],
extra_body={
"reasoning": {"effort": "xhigh"}
}
)
print(completion.choices[0].message.content)
4. Controlando o Conteúdo de Pensamento na Interface Unificada do Chat
Na interface compatível com OpenAI, reasoning suporta um campo display para controlar se os resumos de pensamento são retornados.O Claude Opus 4.7 não retorna conteúdo de pensamento por padrão. Defina "display": "summarized" para habilitá-lo.
| Campo | Valor | Descrição |
|---|---|---|
display | (omitido) | Conteúdo de pensamento não retornado (padrão) |
display | "resumido" | Retorna um resumo do pensamento |
Opus 4.7 — Exemplo de Resumo de Pensamento
from openai import OpenAI
client = OpenAI(
base_url="https://aihubmix.com/v1",
api_key="<AIHUBMIX_API_KEY>",
)
completion = client.chat.completions.create(
model="claude-opus-4-7",
messages=[
{
"role": "user",
"content": "Um caracol está no fundo de um poço de 10 metros. A cada dia, ele sobe 3 metros, mas a cada noite, ele escorrega de volta 2 metros. Quantos dias leva para chegar ao topo?"
}
],
extra_body={
"reasoning": {"effort": "xhigh", "display": "summarized"}
}
)
print(completion.choices[0].message.content)
Para mais detalhes, consulte a documentação do AIHubmix ou os documentos oficiais da Anthropic.
Última atualização: 2026-06-01