Workbench が止まる8月17日までに、prompt tools API を手元のスクリプトへ移す
旧 Workbench と3つの実験的プロンプトエンドポイントが2026年8月17日に終了します。依存箇所の数え方と、templatize_prompt・improve_prompt を手元のスクリプトへ移す実装を、実際の出力つきでまとめました。
長い会話で指示が効かなくなる ― 追従度を測って立て直す設計
長い会話でシステムプロンプトの指示が徐々に効かなくなる現象を、追従度スコアとして数値で捉える方法から解説します。崩れが起きる場所の特定、指示の薄れを抑えるプロンプト構造、会話の途中で錨を打ち直す再アンカーの設計まで、動くコードと実測値を交えて立て直し方を示します。
同じモデル名で挙動が変わったとき — 無人パイプラインに起動時カナリアを置いて差分を捕まえる
同じモデル名のまま挙動が変わる無言の上方更新は、無人パイプラインでは誰も気づけません。起動時に小さなカナリアを走らせて構造の指紋を比べ、ベースラインとの差分でドリフトを判定してバッチを止める設計を、ゴールデンデータセット回帰テストとの違いや実測したコストとともに紹介します。
Claude の output_format タグで仕様逸脱を抑える運用 — 個人開発アプリのコピーライティング自動化で固まった設計
ストア説明文やASOコピーを多言語で量産しても仕様が崩れないよう、Claudeのoutput_formatタグを軸に固めた設計を実運用から書き起こしました。最小構成の例、出力崩れを防ぐ5つのチェックポイント、100言語を並列バッチで流すときの落とし穴、App Store Connect運用への組み込みまで扱います。
Claude のシステムプロンプトに「自分の声」を込める方法——4サイト運営で試して分かった実践パターン
Claudeに書いてもらう文章がどれも同じ顔になる——4サイトを個人運営するなかで直面した問題を、システムプロンプト設計で解消した実践パターンです。指示のBefore/After、Few-shot例文が最も効く理由、サイトごとの設定の差異、文体の一貫性を保つセルフチェックまで共有します。
Claude API の temperature と top_p 実装解説 — タスク別最適設定と実際の挙動を検証した記録
Claude API の temperature・top_p パラメータの仕組みと、コード生成・創作・RAG など用途別の最適設定を実測例つきで解説します。temperature=0 でも非決定論的になる理由も紹介します。
Claude Projects カスタム指示の効果的な書き方——毎回同じことを伝えない仕組みづくり
Claude Projectsのカスタム指示を書こうとして手が止まる方のために、実際に機能する指示の構造を公開します。役割定義・制約・出力形式という3つの要素の書き方、読み手のプロフィールや優先する判断基準の伝え方など、毎回ゼロから説明せずに済む仕組みづくりを解説します。
Claudeのシステムプロンプト実例集 — 業務でそのまま使える9パターンと設計の勘どころ
業務でそのまま使えるClaudeのシステムプロンプトを9パターン用意しました。社内ナレッジ参照型サポート、コードレビュー、JSONスキーマ準拠の構造化抽出、多言語要約、トーン調整付きメール下書き、教育チューターなど用途別に、なぜこう書くかの設計意図までセットで解説します。
自分のコードを「他人のコード」として読ませる — Claude Code に厳しいレビューを引き出す質問設計
自分で書いたコードを自分でレビューすると、不思議と粗が見えなくなります。Claude Code を『他人のコードを読みに来た中堅レビュアー』として召喚するための質問設計と、私が実装現場で使っているプロンプトを公開します。
Claude Code を「設計のスパーリング相手」に変える質問の作法
Claude Codeを単なるコード生成器ではなく、設計を一緒に考えるスパーリング相手として使うための質問の作法です。最初の3行で対話の質が決まる理由、比較できる選択肢を引き出す問いの形、同意されないことを前提にする姿勢、設計対話をCLAUDE.mdへ蓄積する習慣を共有します。
Claudeのカスタム指示(System Prompt)活用法
質問を投げるだけでは届かないClaudeの能力を、カスタム指示(System Prompt)の設計で引き出す方法を解説します。3階層設計モデル、Chain of Thoughtを引き出す戦略、実装の落とし穴と対策、プロダクション環境での保守性、チーム運用での同期方法まで扱います。