claude-haiku-4-5をclaude-haiku-5-5に変更することは、この移行の中で最も小さな部分です。Haiku 4.5で機能していた5つのリクエストパターンが現在400エラーを返し、さらにいくつかの変更はリクエストを失敗させることはありませんが、返される内容、コスト、またはエージェント内でのモデルの動作を変更します。
Anthropicは、既存のHaiku 4.5プロンプトは変更なしでHaiku 5.5でうまく機能するはずだと言っています。それらのプロンプトに関するリクエストコードは別の話です。この投稿では、出会う問題をリストアップします:あなたが見るもの、なぜそれが起こるのか、そしてそれを修正する方法、最後にチェックリストが続きます。権威あるリファレンスはAnthropicのHaiku 5.5移行ガイドです。
トリアージ:症状に一致させる
| あなたが見るもの | 原因 | 修正 |
|---|---|---|
| 思考予算を持つリクエストで400 | 手動思考が削除された | 適応型思考と努力を加える |
| 温度、top_p、またはtop_kで400 | サンプリングパラメータがロックされた | それらを削除する |
| アシスタントターンでメッセージが終了すると400 | プレフィルが削除された | ユーターンで終了する |
| コンピュータ使用で400 | 古いコンピュータツールが拒否された | コンピュータツールセットに移動する |
| 以前のターンを編集した後に400 | 思考が履歴に束縛されている | 履歴を追加のみとする |
| パーサーが空または間違ったテキストを返す | 思考ブロックが最初に来る | タイプでブロックを選択する |
| 返信が切り取られるか欠落している | 思考が上限にカウントされる | max_tokensを増やすか努力を減らす |
| トークン数と請求が約30%増加 | 新しいトークナイザー | 新しいモデルで再カウントする |
| 停止理由の拒否での応答 | 新しい安全分類器 | クライアントで処理する |
最初の5つは大きな失敗をします。残りは静かに失敗し、見つけるのがより高価になります。
5つの大きな失敗
1. 手動思考予算
あなたが見るもの: thinking: {"type": "enabled", "budget_tokens": N}を送信するリクエストで400。
なぜ: Haiku 4.5はトークン予算を持つ手動拡張思考のみをサポートしていました。Haiku 5.5は適応型思考のみをサポートし、深さをeffortで制御します。
修正: {"type": "adaptive"}を送信するか、thinkingを省略し、努力レベルを選択します。古い予算がトークンを節約するために小さかった場合は、低いレベルを選択します。
# 以前:Haiku 4.5
thinking={"type": "enabled", "budget_tokens": 8000}
# 後:Haiku 5.5
thinking={"type": "adaptive"},
output_config={"effort": "medium"},
2. サンプリングパラメータ
あなたが見るもの: temperature、top_p、またはtop_kを設定したリクエストで400。
なぜ: Haiku 5.5はデフォルトのみを受け入れます:temperatureは1、top_pは0.99です。どちらかの他の値、任意のtop_k、または両方のtemperatureとtop_pを送信すると、思考が使用されているかどうかにかかわらず400が返されます。top_pが1の場合も拒否されます。
修正: すべてを削除します。一般的なケースは、安定したラベルを取得するために分類器で使用されるtemperature=0です。これを構造化された出力または入力が列挙型のツールに置き換え、ラベルセットがサンプリングではなくスキーマによって強制されるようにします。また、デフォルトのサンプリング値を追加するSDKラッパーやゲートウェイを確認してください。
3. アシスタントプレフィル
あなたが見るもの: 最後のエントリがアシスタントターンである場合、たとえ思考がオフでも400。
なぜ: プレフィルはHaiku 5.5ではサポートされておらず、現在のClaudeラインナップの他の部分と一致します。
修正: messagesをユーターンで終了し、プレフィルをそれが何のためであったかに置き換えます。フォーマット制御は構造化された出力(output_config.format)になります。プレフィルされた前文は、直接回答するためのシステムプロンプトの指示になります。中断された返信の続きはユーザーメッセージに移動します:「あなたの前の応答は[text]で終了しました。そこから続けてください。」
4. コンピュータ使用
あなたが見るもの: リクエストがcomputer_20250124ツールを宣言すると、Claude APIまたはGoogle Cloudで400。
なぜ: これらのプラットフォームでは、Haiku 5.5は新しいツールセットcomputer_toolset_20260801を通じてのみコンピュータ使用をサポートします。
修正: computer-use-2025-01-24ベータヘッダーを削除し、ツールエントリを{"type": "computer_toolset_20260801"}に置き換え、エージェントループを更新します:各tool_useブロックのnameとtoolset_nameでディスパッチし、input.actionではなく、各ブロックをターンで処理し、結果にtoolset_nameをエコーします。Zoomはデフォルトでオンになっています。環境がそれを実装していない場合は、ツールセット設定で無効にします。Amazon Bedrockでは、バージョンを選択する前にコンピュータ使用ツールの互換性ノートを確認してください。同じツールセットファミリーは、Haiku 4.5にはなかったブラウザ使用ももたらします。
5. 以前のターンの編集
あなたが見るもの: リクエストが何かが変更された後に思考ブロックを返すと400:システムプロンプト、ツールリスト、または以前のメッセージ。
なぜ: Haiku 5.5の思考ブロックは、それ以前に送信されたすべてが変更されていない間のみ有効です。このチェックは、2026年8月31日以降に作成されたアカウントに対してデフォルトで強制され、古いアカウントではリクエストがオプトインした場合のみ強制されます。
修正: 会話を追加のみとします。一般的な原因は、タイムスタンプ付きのシステムプロンプト、プラグイン接続時に増加するツールリスト、クライアント側の切り捨て、履歴に挿入されたリマインダーで、次のターンで削除されます。ターンごとの指示については、Haiku 5.5はmessages内のシステムメッセージをサポートしており、ベータヘッダーなしで、前の内容を編集せずにコンテキストを追加します。
静かな失敗
思考ブロックが最初に来る。 思考はデフォルトでオンになっているため、応答は1つ以上のthinkingブロックで始まることがあります。response.content[0].textを答えとして読み取るコードは壊れるか、空のテキストを返します。typeでブロックを選択します。
思考テキストはデフォルトで空です。 Haiku 4.5は要約された思考を返しました。Haiku 5.5は、空のテキストフィールドと署名のみを持つthinkingブロックを返します。UIが推論の要約を表示していた場合は、thinking: {"type": "adaptive", "display": "summarized"}を設定します。いずれにせよ、ツール結果とともに思考ブロックを変更せずに返します。空のブロックを削除するシリアライザーは、それらを削除します。
max_tokensは思考をカバーする必要があります。 短い回答用にサイズ設定された上限は、思考によって使い果たされ、テキストの前にstop_reason: "max_tokens"で応答が終了することがあります。上限を上げるか、努力を減らします。
同じテキストが約30%多くのトークンになります。 新しいトークナイザーはusageフィールド、count_tokensの結果、コンテキスト予算、およびHaiku 4.5用に調整された任意のmax_tokensを変更します。また、Haiku 4.5がカウントしたように、100Kトークンの価格ラインを約77Kトークンに移動します。コストダッシュボードを信頼する前に、モデルをclaude-haiku-5-5に設定して実際のプロンプトを再カウントします。
デフォルトの努力は中程度です。 Haiku 4.5には努力設定がありませんでした。Haiku 5.5はデフォルトでmediumに設定されており、単純なルートには必要以上の思考があるかもしれません。明示的に設定します。
思考ブロックはそれを作成したアカウントに残ります。 サービスが異なるAPIアカウントを通じて保存された会話を再生する場合、Haiku 5.5の思考ブロックは静かに削除され、そのリクエストはその推論なしで実行されます。各会話をそれを生成したアカウントを通じて再生します。
優先Tierは持ち越されません。 Haiku 5.5は優先Tierをサポートしていないため、Haiku 4.5に依存している場合は容量を別に計画してください。
実際の権限を持つエージェントにとって重要な動作の変更
拒否は新しく、何もあなたのためにそれをキャッチしません。 Haiku 5.5は、サイバー、生物、フロンティアLLM開発、一般的な危害の4つのカテゴリで安全分類器を実行します。拒否は、stop_reason: "refusal"とstop_details内のカテゴリを持つ通常のHTTP 200として返されます。Haiku 5.5にはサーバー側のフォールバックがありません:フォールバックモデルのリストは400を返し、デフォルトのフォールバックモードはリクエストを拒否します。contentを読む前にstop_reasonを確認し、再表現するか、より大きなモデルにエスカレーションするか、停止するかを自分のコードで決定します。ローンチポストによると、サイバーセーフガードはSonnet 5.5よりも広範囲の防御作業を許可しますが、侵入テストをブロックします。
ツール結果内のユーザーテキストは無視される場合があります。 Haiku 5.5は、ツール結果を通じてプロンプトインジェクションに抵抗するように訓練されています。タスクの途中でユーザーが入力したメッセージをtool_resultブロック内に配信すると、モデルはそれを信頼できないものとして扱い、無視することがあります。ターンの途中のユーザー入力を最後のツール結果の後のテキストブロックに入れ、ハーネス通知を別のシステムメッセージに保持します。
低い努力では、エージェントが早期に停止したり、チェックをスキップしたりすることがあります。 長いコーディングエージェントシステムプロンプトがlowである場合、Haiku 5.5は時々タスクを完了する前に返します。また、lowおよびmediumでは、時々コードの変更をテストせずに完了したと報告します。AnthropicのHaiku 5.5プロンプトガイドには、両方の短い指示があります。ファイルを作成したりコマンドを実行したりできるエージェントの場合、未確認の「完了」は2つの中でより危険です。
ツールを強制すると思考がスキップされます。 強制されたtool_choiceは依然として受け入れられますが、モデルはその後、最初に思考せずにツールを呼び出します。副作用のあるツールの場合、autoと明確な指示を組み合わせることで、モデルが行動する前に推論できるようになります。
検索ツールには今日の日付が必要です。 Haiku 5.5に検索ツールがある場合、システムプロンプトまたはツール説明に現在の日付を与えます。Anthropicのテストでは、これにより最近の結果に基づいた回答が得られました。
AIHubMixを通じた移行リクエスト
temperature=0とJSON用のプレフィルされた{を使用していたHaiku 4.5の分類器が、Haiku 5.5用にAIHubMix Claudeネイティブエンドポイントで書き直されました:
import os
import anthropic
client = anthropic.Anthropic(
api_key=os.environ["AIHUBMIX_API_KEY"],
base_url="https://aihubmix.com",
)
r = client.messages.create(
model="claude-haiku-5-5",
max_tokens=2000, # 思考とJSONのための余裕
output_config={
"effort": "low", # 思考はデフォルトでオン; 軽く保つ
"format": { # プレフィルとtemperature=0を置き換える
"type": "json_schema",
"schema": {
"type": "object",
"properties": {
"label": {"type": "string", "enum": ["billing", "bug", "other"]}
},
"required": ["label"],
"additionalProperties": False,
},
},
},
messages=[{"role": "user", "content": "チケット: '10月に二重請求されました。'"}],
)
if r.stop_reason == "refusal":
raise RuntimeError(f"拒否された: {r.stop_details}")
text = next(b.text for b in r.content if b.type == "text")
print(text)
ゲートウェイがoutput_configフィールドと新しいベータヘッダーを変更せずに転送するかどうかは、最初のテスト実行で確認する価値があります。移行されたルートが評価を通過すると、AIHubMixモデルリストを使用して、Haikuで失敗し続ける任意のタスクタイプに対して同じコードをSonnet 5.5に簡単に指向できます。
移行チェックリスト
- モデルIDをclaude-haiku-5-5に変更し、日付サフィックスを付けない。
- すべての思考予算を適応型思考と明示的な努力レベルに置き換える。
- 温度、top_p、top_kを削除し、ラッパーによって追加されたデフォルトを含む。
- アシスタントのプレフィルを構造化された出力、システム指示、またはユーターンの続きに置き換える。
- コンピュータ使用をコンピュータツールセットに移動し、エージェントループを更新する。
- 思考ブロックが再生される場合、会話履歴を追加のみとする。
- ブロックタイプで応答内容を読み取り、再生時に空の思考ブロックを保持する。
- 短い回答ルートでmax_tokensを増やすか、努力を減らす。
- コンテンツを読む前に拒否停止理由を処理し、サーバー側のフォールバックを構成しない。
- 新しいモデルでプロンプトトークンを再カウントし、コストダッシュボードを再ベースライン化する。
- 現在100Kトークンを超えるプロンプトを確認し、それらをトリムまたは分割する。
- ユーザーが推論の要約を見た場合は表示を要約に設定する。
- ツール結果の外でターンの途中のユーザー入力を配信する。
- 検索可能なエージェントに今日の日付を与える。
- ボリュームを移動する前にレート制限と優先Tierのニーズを再確認する。
FAQ
私のHaiku 4.5プロンプトはHaiku 5.5で機能しますか?
Anthropicは、既存のプロンプトは変更なしでうまく機能するはずだと言っています。それらの周りのリクエストパラメータが壊れるのです:思考予算、サンプリング設定、プレフィル、および古いコンピュータ使用ツールはすべてエラーを返します。
温度0を削除した後、なぜ私の分類器が失敗するのですか?
失敗するべきではありませんが、ラベルがより変動する可能性があります。構造化された出力または列挙型フィールドを持つツールを使用して、許可されたラベルがスキーマによって強制されるようにします。それは温度0よりも信頼性があります。
思考をオフにすることはまだできますか?
はい、低、中、高の努力で。xhighおよびmaxでは、思考を無効にするとエラーが返されます。Anthropicは、モデルが単純なリクエストで自動的に思考をスキップできるため、代わりに低い努力レベルを推奨しています。
Haiku 5.5が拒否した場合、私のコードは何をすべきですか?
コンテンツを読む前に停止理由を確認します。Haiku 5.5にはサーバー側のフォールバックがないため、あなたのコードが再表現するか、リクエストをより大きなモデルに送信するか、ユーザーにエラーを返すかを決定します。
移行後、なぜ私のトークン使用量が増えたのですか?
2つの理由があります。新しいトークナイザーは同じテキストに対して約30%多くのトークンをカウントし、思考がデフォルトでオンになっているため、出力トークンが追加されます。努力を減らし、新しいモデルでプロンプトを再カウントします。
プロンプトキャッシングのために何か変更する必要がありますか?
通常は必要なく、簡単になります:Anthropicの移行ガイドによると、最小キャッシュ可能プロンプトは4096から512トークンに減少し、以前のターンの思考ブロックはデフォルトでキャッシュプレフィックスに残ります。以前のターンを編集することは避けてください。これにより、思考ブロックだけでなくキャッシュも無効になります。
会話はHaiku 5.5からより大きなモデルに移動できますか?
はい、会話自体は持ち越されます。Haiku 5.5の以前の思考ブロックも持ち越されるかどうかはターゲットモデルによりますので、依存する前にAnthropicの保存された思考ドキュメントを確認してください。
読み続ける:Claude Haiku 5.5シリーズ
- 移行を計画する前に、新しいモデルがあなたの品質基準をクリアするかどうかを知っておくと役立ちます。Haiku 4.5、GPT-6 Luna、Sonnet 5.5に対するベンチマークについては、Claude Haiku 5.5 vs Haiku 4.5: What Ten Cents Now Buysをお読みください。
- チェックリストのステップ2では、努力レベルを選択するよう求められます。各レベルのトークンコストと開始地点については、Claude Haiku 5.5 Effort Levels: Medium Is the Default, Low Is Often Enoughをお読みください。
- トークナイザーの変更は価格ラインとダッシュボードを移動します。それが実際の請求に何をもたらすかを確認するには、Claude Haiku 5.5 Pricing: The 100K Line Behind the 90% Cutをお読みください。
出典
- Claude Haiku 5.5移行ガイド (Claude Platform Docs)
- Prompting Claude Haiku 5.5 (Claude Platform Docs)
- Claude Haiku 5.5の紹介 (Anthropic)
- AIHubMixのClaude Haiku 5.5
- Claude Haiku 5.5は1百万トークンあたり$0.10で登場。移行前に100Kルールを読んでください。 (Roo's Newsletter)



