Claude Haiku 5.5の新機能
Claude Haiku 5.5における新機能、破壊的変更、動作の変更の概要です。各機能のガイドと、コード変更のための移行ガイドへのリンクを掲載しています。
Claude Haiku 5.5は、分類、ルーティング、抽出、サブエージェントタスクなど、大量かつ「latency」(レイテンシ)の影響を受けやすい作業向けに構築されています。「effort parameter」(エフォートパラメータ)を伴う「adaptive thinking」(適応型思考)、100万トークンの「context window」(コンテキストウィンドウ)、最大128kの出力トークンをサポートしています。Claude 4.7以降のモデルと同じ新しい「tokenizer」(トークナイザー)を使用しているため、同じテキストがClaude Haiku 4.5と比べて約30%多いトークンとしてカウントされます。その思考ブロックは、それを生成したアカウント、またはそれにリンクされたアカウントでのみ機能します。
コードの変更については、移行ガイドを参照してください。モデルID、料金、制限については、Claude Haiku 5.5の概要を参照してください。プロンプトのガイダンスについては、Claude Haiku 5.5へのプロンプトを参照してください。
Claude Haiku 4.5からの変更点の概要
各行には、1つの変更点、それが新規・変更・破壊的変更のいずれであるか、そしてコードで何を行う必要があるかを示しています。
| 変更点 | 種類 | 必要な対応 |
|---|---|---|
| 適応型思考とエフォート | 新規 | 任意:effortを設定して、応答の品質と速度・コストのバランスを調整します。 |
| より大きなコンテキストウィンドウと出力 | 新規 | なし。既存のmax_tokensの値はそのまま有効ですが、思考トークンもその値にカウントされます。 |
| ブラウザ使用ツール | 新規 | なし。Claude APIとGoogle Cloudで利用できます。 |
| 安全性分類器がリクエストを拒否する場合がある | 新規 | クライアントでstop_reason: "refusal"を処理します。サーバーサイドフォールバックは利用できません。 |
| 手動の拡張思考はエラーを返す | 破壊的変更 | budget_tokensを適応型思考に置き換えます。 |
| デフォルト以外のサンプリングパラメータはエラーを返す | 破壊的変更 | temperature、top_p、top_kを省略します。 |
| アシスタントメッセージのプリフィルはエラーを返す | 破壊的変更 | messagesをユーザーターンで終わらせます。 |
| Claude APIとGoogle Cloudではコンピュータ使用にツールセットが必要 | 破壊的変更 | computer_20250124をcomputer_toolset_20260801に置き換えます。 |
| 以前のターンを変更すると思考ブロックが無効になる | 破壊的変更 | 思考ブロックを送り返す場合は、会話を追記のみにします。 |
| 応答が思考ブロックで始まる場合がある | 変更 | コンテンツブロックは位置ではなくtypeで選択します。 |
| 思考テキストはデフォルトで省略される | 変更 | 要約された思考を受け取るには、thinking.displayを"summarized"に設定します。 |
| 同じテキストがより多くのトークンとしてカウントされる | 変更 | プロンプトのトークン数を再計測し、max_tokensとコスト見積もりを見直します。 |
| アカウント間での思考ブロックの再送 | 変更 | 保存した会話を別のアカウントを通じて再送する場合は、それぞれを生成したアカウントを通じて再送します。 |
新機能
適応型思考とエフォート
適応型思考により、Claude Haiku 5.5はいつ、どの程度思考するかを自ら判断します。適応型思考はデフォルトで有効です。high以下のエフォートでは引き続きthinking: {"type": "disabled"}で思考をオフにできますが、応答の品質と速度・コストのバランスを調整するより良い方法は、エフォートパラメータを使用することです。
より大きなコンテキストウィンドウと出力
Claude Haiku 5.5は100万トークンのコンテキストウィンドウを持ち、最大128kの出力トークンを返します。これはClaude Haiku 4.5の200kおよび64kから増加しています。既存のmax_tokensの値はそのまま有効ですが、思考トークンもmax_tokensにカウントされるため、小さな制限値ではthinkingブロックの後、テキストが出力される前に停止する可能性があります。思考を設定するを参照してください。
動作の変更
応答が思考ブロックで始まる場合がある
適応型思考はデフォルトで有効なため、リクエストで思考について言及していない場合でも、応答が1つ以上のthinkingブロックで始まることがあります。最初のコンテンツブロックを回答として読み取るコードは、typeフィールドでブロックを選択する必要があります。移行ガイドの思考を設定するを参照してください。
同じテキストがより多くのトークンとしてカウントされる
Claude Haiku 5.5は、Claude 4.7以降のモデルと同じ新しいトークナイザーを使用しています。このトークナイザーを使用するすべてのモデルと同様に、同じ入力テキストでもClaude Haiku 5.5ではClaude Haiku 4.5と比べて約30%多くのトークンが生成されます。正確な増加量はコンテンツによって異なります。リクエストと応答の形式はトークナイザーに依存しませんが、トークン単位で計測または予算化しているものはすべて変わります。移行ガイドのトークン数を再計測するを参照してください。
アカウント間での思考ブロックの再送
Claude Haiku 5.5の思考ブロックは、それを生成したアカウント、またはそれにリンクされたアカウントでのみ機能します。これは、会話を保存して別のアカウントを通じて再送する場合にのみ関係します。思考ブロックはそれを生成したアカウントを通じて再送信するを参照してください。
Was this page helpful?