CLAUDE LABEN
PRICING — 本日9月1日は Sonnet 5 の値上げ予定日でしたが、引き上げは実施されませんでした。導入価格の $2/$10 per MTok がそのまま標準価格として確定していますPARTNER — Salesforce と Anthropic が拡張提携「Claudeforce」を発表しました。Salesforce in Claude プラグインは商談準備やパイプライン管理など37のセールススキルを同梱しますTRUST — Claudeforce の推論は Amazon Bedrock 経由で Salesforce Trust Boundary の内側に留まります。データが境界の外へ出ない構成が、規制業種への回答になっていますBETA — Salesforce in Claude は現在は選抜パイロット顧客向けです。9月中のオープンベータ移行が予告されていますLIMITS — 週次上限の50%増は9月13日までです。9月14日からはプロモ前比+25%が恒久水準になります。今日の水準と比べると約17%の削減にあたりますRELEASE — Claude Code は v2.1.251(8月28日)から新しいリリースが出ていません。約0.8日に1本というペースからすると、4日の間隔は最長クラスですPRICING — 本日9月1日は Sonnet 5 の値上げ予定日でしたが、引き上げは実施されませんでした。導入価格の $2/$10 per MTok がそのまま標準価格として確定していますPARTNER — Salesforce と Anthropic が拡張提携「Claudeforce」を発表しました。Salesforce in Claude プラグインは商談準備やパイプライン管理など37のセールススキルを同梱しますTRUST — Claudeforce の推論は Amazon Bedrock 経由で Salesforce Trust Boundary の内側に留まります。データが境界の外へ出ない構成が、規制業種への回答になっていますBETA — Salesforce in Claude は現在は選抜パイロット顧客向けです。9月中のオープンベータ移行が予告されていますLIMITS — 週次上限の50%増は9月13日までです。9月14日からはプロモ前比+25%が恒久水準になります。今日の水準と比べると約17%の削減にあたりますRELEASE — Claude Code は v2.1.251(8月28日)から新しいリリースが出ていません。約0.8日に1本というペースからすると、4日の間隔は最長クラスです
記事一覧/Claude Code
Claude Code/2026-05-05上級

Claude Code に拡張思考を組み込む 2026

Claude 4 の拡張思考(Extended Thinking)を Claude Code と API で活用する実践ガイド。思考バジェットの設定、ストリーミング処理、本番環境での適切な使いどころを解説します。

拡張思考Extended Thinking3Claude Code242Claude 4API27

「なぜこの答えになったのか」が見えると、AIへの信頼感が大きく変わります。

Claude 4 に搭載された拡張思考(Extended Thinking)は、モデルが答えを出すまでの推論プロセスを開示する機能です。ただ「使える」というだけでなく、実際に本番コードに組み込んだときに「どの場面で役立つか」「どこに落とし穴があるか」を知っておかないと、コストだけが膨らむ結果になりかねません。

ここでは拡張思考の基本的な使い方から、Claude Code での実践的な活用まで、実際に手を動かしながら学べるように整理しました。

拡張思考とは(何が変わるのか

通常の Claude API レスポンスでは、最終的な回答テキストだけが返ってきます。拡張思考を有効にすると、回答の前に thinking タイプのブロックが追加され、そこにモデルが辿った推論の過程が記録されます。

これは単なる「説明の追加」ではありません。モデルが思考プロセスを持てるようになることで、複雑な問題に対する答えの精度自体が上がります。特に数学的推論、多段階の判断が必要なコードレビュー、競合する要件の整理といったタスクで、その差が出やすいです。

ただし、思考プロセスはトークンを消費します。budget_tokens の設定次第でコストが大きく変わるため、使いどころの判断が重要です。

基本的な実装

import anthropic
 
client = anthropic.Anthropic()
 
response = client.messages.create(
    model="claude-opus-4-6",  # 拡張思考は Opus 4 / Sonnet 4 で利用可能
    max_tokens=16000,
    thinking={
        "type": "enabled",
        "budget_tokens": 10000  # 思考に使えるトークン上限
    },
    messages=[{
        "role": "user",
        "content": "このコードのセキュリティ脆弱性を全て指摘してください:\n\n```python\ndef authenticate(username, password):\n    query = f'SELECT * FROM users WHERE name={username} AND pass={password}'\n    return db.execute(query)\n```"
    }]
)
 
# レスポンスブロックを分類して処理
for block in response.content:
    if block.type == "thinking":
        print("=== 思考プロセス ===")
        print(block.thinking)
        print()
    elif block.type == "text":
        print("=== 回答 ===")
        print(block.text)

budget_tokensmax_tokens の上限内に収まるように設定します。上記の例では max_tokens=16000 に対して budget_tokens=10000 としているため、思考に最大1万トークン、回答に最大6千トークンが割り当てられます。

ストリーミングとの組み合わせ

長い思考プロセスをリアルタイムで受け取る場合はストリーミングが実用的です。

import anthropic
 
client = anthropic.Anthropic()
 
with client.messages.stream(
    model="claude-sonnet-4-6",
    max_tokens=8000,
    thinking={
        "type": "enabled",
        "budget_tokens": 5000
    },
    messages=[{
        "role": "user",
        "content": "この要件を満たす最適なデータベーススキーマを設計してください: [要件の詳細]"
    }]
) as stream:
    current_block_type = None
    
    for event in stream:
        # ブロックの開始イベントでタイプを記録
        if hasattr(event, 'type') and event.type == 'content_block_start':
            if hasattr(event.content_block, 'type'):
                current_block_type = event.content_block.type
                if current_block_type == 'thinking':
                    print("\n[思考中...]", flush=True)
                elif current_block_type == 'text':
                    print("\n[回答]", flush=True)
        
        # テキストデルタを出力
        elif hasattr(event, 'type') and event.type == 'content_block_delta':
            if hasattr(event.delta, 'thinking'):
                print(event.delta.thinking, end='', flush=True)
            elif hasattr(event.delta, 'text'):
                print(event.delta.text, end='', flush=True)

思考ブロックのストリーミングは、「AIが今どこまで考えているか」をユーザーに見せる UX として活用できます。特に時間がかかるタスクでの離脱防止に効果的です。

budget_tokens の設定指針

budget_tokens は「多ければ多いほど良い」わけではありません。タスクの複雑さに応じた設定が、コストと品質の最適なバランスを生みます。

1,000〜3,000トークン: 単純な質問の整理、短いコードの修正 5,000〜10,000トークン: 中程度の複雑さのコード設計、要件整理 15,000〜30,000トークン: 大規模システム設計、複雑な数学的問題

過大な budget_tokens を設定しても、モデルが必要以上の思考をするわけではありません。実際には「必要な思考量」で完了します。ただしトークン消費の上限が増えるため、予期せぬコスト増加を避けるために適切な上限設定を心がけてください。

Claude Code での実践的な活用シーン

Claude Code(CLI ツール)から拡張思考を直接制御する方法はまだ限られていますが、API を経由した活用は今すぐ実践できます。以下は実際に効果を感じているシーンです。

本番デプロイ前のコードレビュー

「このPRをマージしていいか」という最終判断を Claude に委ねるとき、拡張思考を有効にすると「なぜ問題なのか」の説明が格段に充実します。表面的なバグだけでなく、設計上の問題や将来の拡張性への懸念も丁寧に言語化してくれます。

複雑な要件定義のレビュー

複数の利害関係者からの要件が競合しているとき、拡張思考モデルに整理を任せると、「このトレードオフをどう考えたか」という判断プロセスが見えて、チーム内の合意形成に役立ちます。

ガイドの前提知識として、Claude Code のモデル選択戦略とトークン使用量の最適化管理を参照していただくと、コスト面での実践的な補完になります。

注意点:思考内容はキャッシュされない

現時点では、thinking ブロックの内容はプロンプトキャッシュの対象外です。マルチターンの会話で思考内容を次のターンに渡すことは技術的には可能ですが、キャッシュが効かないためコストが増大します。

実用上は「1ターンで完結するタスク」に拡張思考を使い、会話的なやりとりには通常モードを使うという切り分けが現実的です。

まず試してほしい一歩

既存のコードベースで「一番難しい」と感じているコードレビューに、拡張思考付きの Opus 4 を使ってみてください。思考ブロックの中身を読むだけで、「なぜこのコードが危ないのか」の新しい視点が得られるはずです。それだけでも、拡張思考の価値を体感できると思います。

シェア

お読みいただきありがとうございます

Claude Lab は広告なしで運営しており、サーバー費用などの運営コストはメンバーシップのご支援で賄っています。実装コード・ベンチマーク・本番設計パターンなど、実務でお役立ていただける記事を毎日更新しています。もし読んでよかったと感じていただけましたら、ぜひご覧ください。

  • コピー&ペーストで使える実装コード付き
  • 毎日新しい上級ガイドを追加
  • ¥580/月 または ¥2,480 の永久アクセス
メンバーシップを見る →

もしこの記事がお役に立ちましたら、チップ(¥150)で応援いただけると大変励みになります。広告なしでの運営を続けるため、皆さまのご支援が大きな力になっています。

関連記事

Claude Code2026-04-24
Claude Code 環境変数 完全リファレンス — 開発者が本当に押さえるべき設定項目
Claude Code で設定可能な環境変数を実務で使う観点から体系化します。API接続・モデル選択・PowerShellツール・ログ・タイムアウトなど、公式ドキュメントに散らばる情報を一本にまとめ、個人開発からチーム運用まで使える推奨設定を提示します。
Claude Code2026-08-31
同じ告知が『+25%』とも『17%減』とも読める — 9月14日に変わる Claude Code の週次上限を検算する
8月29日の告知で Claude Code の週次上限は9月14日から恒久的に+25%へ変わります。『+25%』と『17%減』が同時に成り立つ理由を指数化で検算し、/usage とステータスラインで自分への影響を確かめる手順をまとめました。
Claude Code2026-08-31
無音で半分になっていた定期実行と、欠落を捕まえる突き合わせ
1日2回動いているはずのバッチが、実際には1回しか起動していませんでした。エラーは1件も出ていません。期待起動回数と実行記録を突き合わせて、無音の欠落を検出する仕組みを作ります。
📚RECOMMENDED BOOKS
大規模言語モデル入門
山田育矢
LLM開発
生成AIプロンプトエンジニアリング入門
我妻幸長
プロンプト
Claude CodeによるAI駆動開発入門
平川知秀
AI駆動開発
※ アフィリエイトリンクを含みます
もっと見る →