Изменение claude-haiku-4-5 на claude-haiku-5-5 — это самая незначительная часть этой миграции. Пять шаблонов запросов, которые работали на Haiku 4.5, теперь возвращают ошибку 400, а несколько других изменений не вызывают ошибок, но изменяют то, что вы получаете в ответ, сколько это стоит или как модель ведет себя внутри агента.
Anthropic утверждает, что существующие подсказки Haiku 4.5 должны хорошо работать на Haiku 5.5 без изменений. Код запроса вокруг этих подсказок — это другая история. В этом посте перечислены все проблемы, с которыми вы столкнетесь: что вы увидите, почему это происходит и как это исправить, за которым следует контрольный список. Авторитетная ссылка — это руководство по миграции Haiku 5.5 от Anthropic.
Триаж: сопоставьте симптом
| Что вы видите | Причина | Исправление |
|---|---|---|
| 400 при запросе с бюджетом на размышления | Удалено ручное размышление | Адаптивное размышление плюс усилия |
| 400 с temperature, top_p или top_k | Параметры выборки заблокированы | Удалите их |
| 400, когда сообщения заканчиваются на ходе помощника | Удален предзаполнение | Закончите на ходе пользователя |
| 400 при использовании компьютера | Старый инструмент компьютера отклонен | Перейдите к набору инструментов компьютера |
| 400 после редактирования предыдущих ходов | Размышление связано с историей | Сохраняйте историю только для добавления |
| Парсер возвращает пустой или неправильный текст | Блок размышлений идет первым | Выбирайте блоки по типу |
| Ответ обрывается или отсутствует | Размышления учитываются в лимите | Увеличьте max_tokens или уменьшите усилия |
| Количество токенов и счета увеличивается примерно на 30% | Новый токенизатор | Пересчитайте на новой модели |
| Ответ с причиной остановки отказа | Новые классификаторы безопасности | Обработайте это в вашем клиенте |
Первые пять ошибок проявляются громко. Остальные ошибки проявляются тихо, что делает их более дорогими для поиска.
Пять громких ошибок
1. Ручные бюджеты на размышления
Что вы увидите: ошибка 400 на любом запросе, который отправляет thinking: {"type": "enabled", "budget_tokens": N}.
Почему: Haiku 4.5 поддерживала только ручное расширенное размышление с бюджетом токенов. Haiku 5.5 поддерживает только адаптивное размышление и контролирует глубину с помощью effort.
Исправление: отправьте {"type": "adaptive"} или оставьте thinking пустым и выберите уровень усилий. Если старый бюджет был мал, чтобы сэкономить токены, выберите низкий уровень.
# До: Haiku 4.5
thinking={"type": "enabled", "budget_tokens": 8000}
# После: Haiku 5.5
thinking={"type": "adaptive"},
output_config={"effort": "medium"},
2. Параметры выборки
Что вы увидите: ошибка 400, когда запрос устанавливает temperature, top_p или top_k.
Почему: Haiku 5.5 принимает только значения по умолчанию: temperature равное 1 и top_p равное 0.99. Любое другое значение для любого из них, любое top_k или отправка как temperature, так и top_p возвращает ошибку 400, независимо от того, используется ли размышление. Значение top_p равное 1 также отклоняется.
Исправление: удалите все три. Общий случай — это temperature=0 на классификаторе, используемом для получения стабильных меток. Замените это на структурированный вывод или инструмент, входящий в перечисление, чтобы набор меток обеспечивался схемой, а не выборкой. Также проверьте обертки SDK и шлюзы, которые добавляют значения выборки по умолчанию от вашего имени.
3. Предзаполнение помощника
Что вы увидите: ошибка 400, когда последний элемент в messages — это ход помощника, даже если размышление отключено.
Почему: предзаполнение не поддерживается в Haiku 5.5, что соответствует остальной части текущей линейки Claude.
Исправление: закончите messages ходом пользователя и замените предзаполнение тем, для чего оно было. Контроль формата становится структурированным выводом (output_config.format). Предзаполненное введение становится инструкцией системного запроса отвечать напрямую. Продолжение прерванного ответа переходит в сообщение пользователя: "Ваш предыдущий ответ закончился на [текст]. Продолжите с этого места."
4. Использование компьютера
Что вы увидите: ошибка 400 на API Claude или Google Cloud, когда запрос объявляет инструмент computer_20250124.
Почему: на этих платформах Haiku 5.5 поддерживает использование компьютера только через новый набор инструментов, computer_toolset_20260801.
Исправление: уберите заголовок бета computer-use-2025-01-24, замените запись инструмента на {"type": "computer_toolset_20260801"} и обновите цикл агента: распределяйте по каждому блоку tool_use по name и toolset_name, а не по input.action, обрабатывайте каждый такой блок в ходе и повторяйте toolset_name в результатах. Увеличение по умолчанию включено; если ваша среда этого не реализует, отключите его в конфигурации набора инструментов. На Amazon Bedrock проверьте примечания о совместимости инструмента использования компьютера перед выбором версии. Тот же набор инструментов также включает использование браузера, которого никогда не было в Haiku 4.5.
5. Редактирование предыдущих ходов
Что вы увидите: ошибка 400, когда запрос отправляет блок размышлений после того, как что-то до него изменилось: системный запрос, список инструментов или предыдущее сообщение.
Почему: блок размышлений Haiku 5.5 остается действительным только пока все, что отправлено до него, не изменилось. Проверка применяется по умолчанию для аккаунтов, созданных 31 августа 2026 года или позже, и на старых аккаунтах только когда запрос выбирает это.
Исправление: сохраняйте разговоры только для добавления. Общими виновниками являются системный запрос с временной меткой, список инструментов, который растет, когда подключается плагин, обрезка на стороне клиента и напоминания, внедренные в историю и удаленные на следующем ходе. Для инструкций на каждый ход Haiku 5.5 поддерживает системные сообщения внутри messages, без заголовка бета, которые добавляют контекст без редактирования того, что было ранее.
Тихие ошибки
Блоки размышлений идут первыми. Размышление включено по умолчанию, поэтому ответ может начинаться с одного или нескольких thinking блоков. Код, который читает response.content[0].text как ответ, ломается или возвращает пустой текст. Выбирайте блоки по type.
Текст размышлений по умолчанию пуст. Haiku 4.5 возвращала обобщенные размышления. Haiku 5.5 возвращает thinking блоки с пустым текстовым полем и только подписью. Если ваш интерфейс показывал резюме рассуждений, установите thinking: {"type": "adaptive", "display": "summarized"}. В любом случае, передавайте блоки размышлений обратно без изменений с результатами инструмента; сериализатор, который удаляет пустые блоки, убирает их.
max_tokens теперь должен покрывать размышления. Лимит, рассчитанный на короткий ответ, может быть исчерпан размышлениями, заканчивая ответ с stop_reason: "max_tokens" до любого текста. Увеличьте лимит или уменьшите усилия.
Тот же текст теперь на 30% больше токенов. Новый токенизатор изменяет поля usage, результаты count_tokens, бюджеты контекста и любые max_tokens, настроенные для Haiku 4.5. Он также перемещает линию цены в 100K токенов до примерно 77K токенов, как это считалось в Haiku 4.5. Пересчитайте реальные подсказки с моделью, установленной на claude-haiku-5-5, прежде чем доверять панели затрат.
Уровень усилий по умолчанию — средний. Haiku 4.5 не имела настройки усилий. Haiku 5.5 по умолчанию устанавливает medium, что может быть больше размышлений, чем требуется для простого маршрута. Установите его явно.
Блоки размышлений остаются с аккаунтом, который их создал. Если ваша служба воспроизводит сохраненные разговоры через другой API-аккаунт, блоки размышлений Haiku 5.5 тихо удаляются, и запрос выполняется без этого рассуждения. Воспроизводите каждый разговор через аккаунт, который его создал.
Приоритетный уровень не переносится. Haiku 5.5 не поддерживает Приоритетный уровень, поэтому планируйте емкость отдельно, если вы полагаетесь на него для Haiku 4.5.
Списки шлюзов могут отличаться. Страница Haiku 5.5 на AIHubMix в настоящее время указывает длину контекста 200K, в то время как Anthropic указывает 1M. Подтвердите лимит на маршруте, который вы используете, прежде чем мигрировать рабочие нагрузки с длинными подсказками.
Изменения поведения, которые важны для агентов с реальными разрешениями
Отказы новые, и ничего не ловит их за вас. Haiku 5.5 запускает классификаторы безопасности в четырех категориях: кибер, био, фронтирная разработка LLM и общие вреды. Отказ возвращается как обычный HTTP 200 с stop_reason: "refusal" и категорией в stop_details. В отличие от Sonnet 5.5 и Opus 5.5, Haiku 5.5 не имеет резервного варианта на стороне сервера: список моделей резервного копирования возвращает ошибку 400, а режим резервного копирования по умолчанию оставляет запрос отклоненным. Проверьте stop_reason перед чтением content и решите в своем коде, следует ли переформулировать, эскалировать на более крупную модель или остановиться. Согласно посту о запуске, киберзащиты позволяют более широкий спектр защитной работы, чем Sonnet 5.5, но блокируют тестирование на проникновение.
Текст пользователя внутри результатов инструмента может быть проигнорирован. Haiku 5.5 обучена сопротивляться инъекциям подсказок через результаты инструмента. Если ваш интерфейс передает сообщение, которое пользователь ввел во время задачи, внутри блока tool_result, модель может считать его недоверенным и проигнорировать. Поместите ввод пользователя в текстовый блок после последнего результата инструмента и сохраняйте уведомления интерфейса в отдельном системном сообщении.
При низких усилиях агенты могут остановиться раньше или пропустить проверки. С длинным системным запросом для кодирующего агента на low Haiku 5.5 иногда возвращает задачу раньше, чем она завершена, а на low и medium иногда сообщает об изменении кода как о завершенном, не запуская тест. Руководство по подсказкам Haiku 5.5 от Anthropic содержит краткие инструкции для обоих случаев. Для агента, который может записывать файлы или выполнять команды, неподтвержденный "завершено" является более опасным из двух.
Принуждение инструмента пропускает размышления. Принудительный tool_choice по-прежнему принимается, но модель затем вызывает инструмент без предварительных размышлений. Для инструментов с побочными эффектами auto плюс четкая инструкция позволяет модели размышлять перед действием.
Поисковые инструменты нуждаются в сегодняшней дате. Когда Haiku 5.5 имеет поисковый инструмент, дайте ему текущую дату в системном запросе или описании инструмента. В тестировании Anthropic это привело к более точным ответам на основе недавних результатов.
Мигрированный запрос через AIHubMix
Классификатор Haiku 4.5, который использовал temperature=0, бюджет размышлений и предзаполнение { для JSON, переписанный для Haiku 5.5 на AIHubMix Claude native endpoint:
import os
import anthropic
client = anthropic.Anthropic(
api_key=os.environ["AIHUBMIX_API_KEY"],
base_url="https://aihubmix.com",
)
r = client.messages.create(
model="claude-haiku-5-5",
max_tokens=2000, # место для размышлений плюс JSON
output_config={
"effort": "low", # заменяет старый бюджет размышлений
"format": { # заменяет предзаполнение и temperature=0
"type": "json_schema",
"schema": {
"type": "object",
"properties": {
"label": {"type": "string", "enum": ["billing", "bug", "other"]}
},
"required": ["label"],
"additionalProperties": False,
},
},
},
messages=[{"role": "user", "content": "Тикет: 'Меня дважды взимали плату за октябрь.'"}],
)
if r.stop_reason == "refusal":
raise RuntimeError(f"отказано: {r.stop_details}")
text = next(b.text for b in r.content if b.type == "text")
print(text)
Стоит подтвердить, передает ли шлюз поля output_config и новые заголовки бета без изменений на вашем первом тестовом запуске. Когда мигрированный маршрут проходит ваши оценки, список моделей AIHubMix облегчает указание того же кода на Sonnet 5.5 для любого типа задачи, которая продолжает давать сбой на Haiku.
Контрольный список миграции
- Измените идентификатор модели на claude-haiku-5-5, без суффикса даты.
- Замените каждый бюджет размышлений на адаптивное размышление и явный уровень усилий.
- Удалите temperature, top_p и top_k, включая значения по умолчанию, добавленные обертками.
- Замените предзаполнения помощника на структурированный вывод, системные инструкции или продолжения ходов пользователя.
- Переместите использование компьютера в набор инструментов компьютера и обновите цикл агента.
- Сделайте историю разговоров только для добавления, если блоки размышлений воспроизводятся.
- Чтите содержимое ответа по типу блока и сохраняйте пустые блоки размышлений при воспроизведении.
- Увеличьте max_tokens на маршрутах с короткими ответами или уменьшите усилия.
- Обрабатывайте причину остановки отказа перед чтением содержимого; не настраивайте резервные варианты на стороне сервера.
- Пересчитайте токены подсказки на новой модели и пересмотрите панели затрат.
- Проверьте, какие подсказки теперь превышают 100K токенов, и обрежьте или разделите их.
- Установите отображение на обобщенное, если пользователи видели резюме рассуждений.
- Передавайте ввод пользователя в середине хода вне результатов инструмента.
- Дайте агентам с поиском сегодняшнюю дату.
- Проверьте лимиты частоты, потребности в Приоритетном уровне и лимит контекста вашего шлюза перед перемещением объема.
Часто задаваемые вопросы
Будут ли мои подсказки Haiku 4.5 работать на Haiku 5.5?
Anthropic утверждает, что существующие подсказки должны хорошо работать без изменений. Параметры запроса вокруг них — это то, что ломает: бюджеты размышлений, настройки выборки, предзаполнения и старый инструмент использования компьютера все возвращают ошибки.
Почему мой классификатор теперь дает сбой, когда я убрал temperature 0?
Он не должен давать сбой, но метки могут варьироваться больше. Используйте структурированный вывод или инструмент с полем перечисления, чтобы разрешенные метки обеспечивались схемой. Это более надежно, чем когда-либо было temperature 0.
Могу ли я все еще отключить размышления?
Да, на низком, среднем и высоком усилии. На xhigh и max отключение размышлений возвращает ошибку. Anthropic рекомендует вместо этого более низкий уровень усилий, потому что модель может пропустить размышления по простым запросам самостоятельно.
Что должен делать мой код, когда Haiku 5.5 отказывает?
Проверьте причину остановки перед чтением содержимого. Haiku 5.5 не имеет резервного варианта на стороне сервера, поэтому ваш код решает, следует ли переформулировать, отправить запрос на более крупную модель или вернуть ошибку пользователю.
Почему после миграции увеличилось использование токенов?
Две причины. Новый токенизатор считает примерно на 30% больше токенов для того же текста, и размышления включены по умолчанию, добавляя токены вывода. Уменьшите усилия и пересчитайте ваши подсказки на новой модели.
Нужно ли мне что-то менять для кэширования подсказок?
Обычно нет, и это становится проще: минимальная кэшируемая подсказка снижается с 4,096 до 512 токенов, а блоки размышлений из предыдущих ходов остаются в кэшированном префиксе по умолчанию. Избегайте редактирования предыдущих ходов, что теперь делает недействительными блоки размышлений, а также кэш.
Может ли разговор перейти с Haiku 5.5 на более крупную модель?
Да. Sonnet 5.5 и Opus 5.5 читают блоки размышлений Haiku 5.5, поэтому разговор, эскалированный к любой из них, сохраняет свои предыдущие рассуждения. Для других целевых моделей сначала проверьте документацию о сохраненных размышлениях.
Продолжайте читать: серия Claude Haiku 5.5
- Перед планированием миграции полезно знать, соответствует ли новая модель вашему качественному стандарту. Для бенчмарков против Haiku 4.5, GPT-6 Luna и Sonnet 5.5 читайте Claude Haiku 5.5 против Haiku 4.5: Что сейчас покупает десять центов
- Шаг 2 контрольного списка предлагает вам выбрать уровень усилий. Для того, сколько каждый уровень стоит в токенах и с чего начать, читайте Уровни усилий Claude Haiku 5.5: Средний — это стандарт, Низкий часто достаточно
- Изменение токенизатора перемещает ценовую линию, а также ваши панели. Чтобы увидеть, что это делает с реальным счетом, читайте Цены Claude Haiku 5.5: Линия 100K за пределами 90% скидки
Источники
- Руководство по миграции Claude Haiku 5.5 (Документы платформы Claude)
- Подсказки для Claude Haiku 5.5 (Документы платформы Claude)
- Представляем Claude Haiku 5.5 (Anthropic)
- Claude Haiku 5.5 на AIHubMix
- Claude Haiku 5.5 вышел по цене $0.10 за миллион токенов. Прочитайте правило 100K перед миграцией (Рассылка Roo)



