30秒サマリー

長い会話を扱えるモデルを選ぶとき、効くのは文脈長だけではありません。Claude Fable 5.1は100万トークンの文脈を標準で掲げますが、既存のツール指定とthinkingブロックの再送には明確な制約があり、エージェントの移行を「モデル名の差し替え」で終わらせない理由になります。

今日の一本

長い文脈を、再実行できる設計にする

Claude Platform Release Notesによると、9月1日に公開されたClaude Fable 5.1は、長時間のエージェント型コーディング、知識作業、調査を対象とし、100万トークンの文脈と最大12万8,000トークンの出力を提供します。キャッシュ読取価格も100万トークン当たり0.25ドルへ下がりました。

ただし同じリリースノートは、tool_choiceanytoolを受け付けないこと、thinkingブロックは作成元またはより新しいモデルでのみ扱えることを明記します。さらに新規アカウントでは、systemプロンプトやツール定義を変えた後のthinkingブロック再送が400になる場合があります。長い処理ほど、失敗時の再送はありふれた設計です。この制約は単なるAPIの細部ではありません。

ここからは編集部の整理です。移行前に確認する単位を「1回の呼び出し」ではなく「再実行を含む1ジョブ」にすると、問題が見えます。最初の応答では通っても、ツールを増やした二周目や、キャッシュを使った復旧で失敗する実装があるためです。まずは実際の失敗経路を一つ選び、再送するデータと変更される設定を紙に出してみてください。

コミュニティで見つけた一語

thinkingブロック

モデルが内部推論として返すデータのまとまりで、会話を続ける際に再送する実装があります。今回の更新では、それを古いモデルへ渡すことや、前段のsystemプロンプト・ツール定義を変えた後に再送することに制約があります。これは公式リリースノートで確認できる仕様であり、コミュニティの評価や性能比較とは分けて扱う必要があります。

今日の5分アクション

自分のリポジトリで、モデル呼び出しが失敗したときに何を再送するかを一か所だけ確認します。Claudeを使っていない場合は、会話履歴やキャッシュを再利用する任意のAI呼び出しを代替対象にしてください。

コピペ用プロンプト

あなたはソフトウェア開発の移行レビュー役です。
[対象リポジトリ] で、AIモデルの呼び出しを1つ探し、失敗時のリトライまたは会話継続で再送するデータを確認してください。該当するAI呼び出しがなければ、その事実を1行で示して終了してください。

制約:
- 所要時間は5分以内
- ファイルや外部サービスは変更しない
- 秘密情報、APIキー、個人情報を表示しない
- 推測とコード上で確認できた事実を分ける

出力:
1. 確認したファイルと呼び出し箇所
2. 再送する会話履歴・ツール定義・キャッシュの有無
3. 設定変更後に再送すると壊れる可能性の判定
4. 次に読むべき公式リリースノートを1つ

参照元

中心となる原資料を確認する ↗