CLAUDE LABEN
PRICING — 本日9月1日は Sonnet 5 の値上げ予定日でしたが、引き上げは実施されませんでした。導入価格の $2/$10 per MTok がそのまま標準価格として確定していますPARTNER — Salesforce と Anthropic が拡張提携「Claudeforce」を発表しました。Salesforce in Claude プラグインは商談準備やパイプライン管理など37のセールススキルを同梱しますTRUST — Claudeforce の推論は Amazon Bedrock 経由で Salesforce Trust Boundary の内側に留まります。データが境界の外へ出ない構成が、規制業種への回答になっていますBETA — Salesforce in Claude は現在は選抜パイロット顧客向けです。9月中のオープンベータ移行が予告されていますLIMITS — 週次上限の50%増は9月13日までです。9月14日からはプロモ前比+25%が恒久水準になります。今日の水準と比べると約17%の削減にあたりますRELEASE — Claude Code は v2.1.251(8月28日)から新しいリリースが出ていません。約0.8日に1本というペースからすると、4日の間隔は最長クラスですPRICING — 本日9月1日は Sonnet 5 の値上げ予定日でしたが、引き上げは実施されませんでした。導入価格の $2/$10 per MTok がそのまま標準価格として確定していますPARTNER — Salesforce と Anthropic が拡張提携「Claudeforce」を発表しました。Salesforce in Claude プラグインは商談準備やパイプライン管理など37のセールススキルを同梱しますTRUST — Claudeforce の推論は Amazon Bedrock 経由で Salesforce Trust Boundary の内側に留まります。データが境界の外へ出ない構成が、規制業種への回答になっていますBETA — Salesforce in Claude は現在は選抜パイロット顧客向けです。9月中のオープンベータ移行が予告されていますLIMITS — 週次上限の50%増は9月13日までです。9月14日からはプロモ前比+25%が恒久水準になります。今日の水準と比べると約17%の削減にあたりますRELEASE — Claude Code は v2.1.251(8月28日)から新しいリリースが出ていません。約0.8日に1本というペースからすると、4日の間隔は最長クラスです
記事一覧/API & SDK
API & SDK/2026-05-03中級

Claude API の temperature と top_p 実装解説 — タスク別最適設定と実際の挙動を検証した記録

Claude API の temperature・top_p パラメータの仕組みと、コード生成・創作・RAG など用途別の最適設定を実測例つきで解説します。temperature=0 でも非決定論的になる理由も紹介します。

API27temperaturetop_pパラメータ設定プロンプト設計11

temperature=0 にすれば毎回同じ答えが返ってくる——そう信じてテストを組んでいたとき、まったく同じリクエストで微妙に違う出力が返ってきて困惑した経験があります。原因を調べてみると、Claude のサンプリングには他のモデルと少し異なる特性があることが分かりました。

ここではClaude API の temperaturetop_p パラメータの仕組みを整理し、タスクの種類ごとにどう設定すれば良いかを実際に試した結果を交えながら解説していきます。

temperature=0 でも完全に決定論的にならない理由

多くのドキュメントに「temperature=0 で決定論的な出力」と書かれていますが、Anthropic の公式ドキュメントには重要な注釈があります。

システム側の変更(モデルの更新、インフラの変更)によって、同一リクエストでも出力が変わる場合があります。

つまり temperature=0 は「現時点での実装において最も確率の高いトークンを選択する」という意味であり、Anthropic がいつモデルを更新しても完全に同じ出力を保証する約束ではないのです。

実際に私が経験した挙動を整理すると:

  • 短いプロンプト + 短い出力: temperature=0 でほぼ毎回同じ結果
  • 長い出力(1000トークン超): temperature=0 でも末尾付近でわずかな揺れが発生
  • コード生成: 変数名の命名が微妙に変わることがある

本番システムでハッシュ比較やスナップショットテストをしている場合は、完全一致ではなくセマンティックな検証に切り替えた方が安全です。

temperature と top_p の仕組みと Claude での特性

temperature の役割

temperature はトークン選択の「ランダム性」を制御します。値が高いほど確率の低いトークンが選ばれやすくなり、低いほど確率の高いトークンが選ばれます。

  • 0.0: 最も確率の高いトークンを選択(グリーディデコーディング)
  • 0.5〜0.7: バランス型(多くのタスクのデフォルト)
  • 1.0: モデルのデフォルト確率分布をそのまま使用
  • 1.0超: より多様で予測しにくい出力

Claude API のデフォルト値は 1.0 です。GPT-4 系のデフォルト(1.0)と同じですが、実際の挙動には違いがあります。Claude は長文でも一貫性を保ちやすい傾向があるため、temperature=0.7 前後でも安定した構造の出力が得られます。

top_p の役割

top_p(nucleus sampling)は、選択肢となるトークン群を「累積確率で絞り込む」パラメータです。

たとえば top_p=0.9 の場合、累積確率が 90% になるまでのトークン群の中からサンプリングします。高確率のトークンが少数に集中しているときは選択肢が絞られ、確率が分散しているときは選択肢が広がる、という動的な絞り込みが特徴です。

temperature と top_p の使い分けのポイント:

  • 基本的には どちらか一方を調整する(両方を同時に大きく変えると効果の予測が難しくなります)
  • コード生成・構造化出力には temperature を下げる方が直感的
  • 文体の多様性を保ちながら品質を維持したい場合は top_p を下げる

なお、ChatGPT で使える top_kClaude API では非対応です。代わりに top_p を使ってください。

タスク別 temperature 推奨設定(実測ベース)

実際にいくつかのタスクで temperature を変えながら検証した結果です。あくまで私の環境での傾向であり、プロンプトの設計によっても最適値は変わります。

コード生成・デバッグ

temperature: 0.0〜0.2
top_p: デフォルト(1.0)

コードは正確さが最優先のため、低 temperature が基本です。ただし temperature=0 のみに頼るのではなく、プロンプトで「型注釈を必ず付ける」「エラーハンドリングを必ず含める」などの制約を明示する方が品質に直結します。

要約・分析・Q&A

temperature: 0.2〜0.5
top_p: 0.9

事実に基づく作業は低め設定が安定します。temperature=0.3 あたりでは、同じドキュメントを複数回要約してもほぼ同じ構造の出力が返ってきました。

翻訳

temperature: 0.1〜0.3
top_p: 0.9

日英翻訳では temperature=0.2 が自然な表現と一貫性のバランスが取れた印象です。temperature=0 だと少し機械的な訳になる場合があります。

創作・アイデア出し・マーケティングコピー

temperature: 0.7〜1.0
top_p: 0.9〜1.0

多様なバリエーションが欲しい場合は temperature=0.9 前後が使いやすいです。temperature=1.0 超はかなり奇抜な出力になることがあるため、ブレインストーミングの初期フェーズなどに限定して使っています。

RAG(検索拡張生成)

temperature: 0.0〜0.3
top_p: 0.9

RAG では取得した文書の内容を忠実に反映させることが重要なため、低 temperature が適しています。temperature=0.2 前後で、引用の正確さと自然な文章のバランスが取れます。

Python SDK でパラメータを設定するコード例

import anthropic
 
client = anthropic.Anthropic()
 
# コード生成タスク(低 temperature)
def generate_code(prompt: str) -> str:
    response = client.messages.create(
        model="claude-sonnet-4-6",
        max_tokens=2048,
        temperature=0.1,       # 低めに設定して一貫性を確保
        messages=[
            {"role": "user", "content": prompt}
        ]
    )
    return response.content[0].text
 
# 創作タスク(高 temperature)
def generate_creative(prompt: str, n_variants: int = 3) -> list[str]:
    """複数のバリエーションを生成する"""
    results = []
    for i in range(n_variants):
        response = client.messages.create(
            model="claude-sonnet-4-6",
            max_tokens=512,
            temperature=0.9,   # バリエーションのために高めに設定
            top_p=0.95,        # 高確率トークンを広めに取る
            messages=[
                {"role": "user", "content": prompt}
            ]
        )
        results.append(response.content[0].text)
    return results
 
# RAGタスク(コンテキスト忠実型)
def answer_with_context(question: str, context: str) -> str:
    response = client.messages.create(
        model="claude-sonnet-4-6",
        max_tokens=1024,
        temperature=0.2,       # 文書の内容を忠実に反映
        system="与えられたコンテキストの情報のみを使って回答してください。コンテキストに情報がない場合は「分かりません」と答えてください。",
        messages=[
            {
                "role": "user",
                "content": f"コンテキスト:\n{context}\n\n質問: {question}"
            }
        ]
    )
    return response.content[0].text
 
# 使用例
if __name__ == "__main__":
    # コード生成(期待する出力: 型注釈付きのPythonコード)
    code = generate_code("二分探索を実装してください。型注釈とdocstringを付けてください。")
    print("=== コード生成 ===")
    print(code)
 
    # クリエイティブ(3バリエーション生成)
    taglines = generate_creative("AIツールの紹介文を1文で書いてください。")
    print("\n=== タグライン候補 ===")
    for i, t in enumerate(taglines, 1):
        print(f"{i}. {t}")

このコードで注目してほしいのは、generate_creative() が同じプロンプトを複数回呼び出している点です。temperature=0.9 であれば、3回呼び出すたびに異なる表現の文章が返ってきます。temperature=0.1 では3回呼んでもほぼ同じ出力になります。

よくある間違いと落とし穴

実際に遭遇したり、コミュニティで見かけたりしたミスを整理します。

1. コード生成に temperature=1.0(デフォルト)を使い続ける

Claude のデフォルトが 1.0 であるため、明示的に設定しないとコード生成でも temperature=1.0 が使われます。コード生成では temperature=0.0〜0.2 を明示するか、システムプロンプトで「deterministic な回答」を指示した方が安定します。

2. temperature と top_p を両方極端な値に設定する

temperature=0.1 かつ top_p=0.1 のように両方を絞ると、選択肢が極端に狭まり、出力が単調になりすぎることがあります。どちらか一方を調整するのが基本です。

3. Extended Thinking モードでの temperature 設定の誤解

thinking ブロックを使う場合(Extended Thinking)、temperature は内部の思考プロセスには影響せず、最終的な回答の出力部分にのみ適用されます。思考の深さを調整したい場合は budget_tokens を使います。

4. 同じ temperature でモデルを変えて同じ挙動を期待する

claude-haiku-4-5claude-sonnet-4-6 で同じ temperature を設定しても、出力の多様性は異なります。モデルを変更したときは temperature の再調整を行うことをお勧めします。

全体を振り返って

temperature と top_p の設定は、「とりあえずデフォルト」から「タスクに合わせた設定」に変えるだけで出力品質が実感できるくらい変わります。

まずは手元のプロジェクトで最も使っているタスク(コード生成か要約か)の temperature を 0.10.3 に設定して挙動を確認してみてください。1つ設定を変えるだけで、再現性や品質の安定感が上がるはずです。

APIのパラメータ設定についてさらに深く学びたい方には、Claude API 完全コスト最適化ガイドPrompt Caching でコストを半減させる実践記録も参考になると思います。

シェア

お読みいただきありがとうございます

Claude Lab は広告なしで運営しており、サーバー費用などの運営コストはメンバーシップのご支援で賄っています。実装コード・ベンチマーク・本番設計パターンなど、実務でお役立ていただける記事を毎日更新しています。もし読んでよかったと感じていただけましたら、ぜひご覧ください。

  • コピー&ペーストで使える実装コード付き
  • 毎日新しい上級ガイドを追加
  • ¥580/月 または ¥2,480 の永久アクセス
メンバーシップを見る →

もしこの記事がお役に立ちましたら、チップ(¥150)で応援いただけると大変励みになります。広告なしでの運営を続けるため、皆さまのご支援が大きな力になっています。

関連記事

API & SDK2026-08-14
Workbench が止まる8月17日までに、prompt tools API を手元のスクリプトへ移す
旧 Workbench と3つの実験的プロンプトエンドポイントが2026年8月17日に終了します。依存箇所の数え方と、templatize_prompt・improve_prompt を手元のスクリプトへ移す実装を、実際の出力つきでまとめました。
API & SDK2026-07-24
メモリストアの棚卸しが半分しか返らない — path_prefix セグメント一致への移行
agent-memory-2026-07-22 で memories.list が変わりました。順序固定・depth 厳格化・path_prefix のセグメント一致。件数が静かに半減した実例と、破壊的変更に耐える棚卸し層、depth=1 再帰の走査コストの実測をまとめます。
API & SDK2026-07-14
ユーザーに届くAI生成の短文を、公開前に二段ゲートで止める
アプリでユーザーに届くAI生成の短文を、決定的ルール層とClaude分類層の二段ゲートで公開前に検査する設計です。fail-closedを芯に据えた判定統合、生成時に検疫して配信時は取り出すだけの構成、生成数で効くコスト設計、人間のサンプリング体制まで実装コード付きで整理しました。
📚RECOMMENDED BOOKS
大規模言語モデル入門
山田育矢
LLM開発
生成AIプロンプトエンジニアリング入門
我妻幸長
プロンプト
Claude CodeによるAI駆動開発入門
平川知秀
AI駆動開発
※ アフィリエイトリンクを含みます
もっと見る →