CLAUDE LABEN
MODEL — Claude Fable 5.1 と Claude Mythos 5.1 が9月1日に公開されました。両者は同一のモデルで、違うのは安全装置の強度だけという設計ですPRICING — トークン単価の $10/$50 per MTok は据え置きで、下がったのはキャッシュ読み取りだけです。75% 引き下げられて $0.25 per MTok になりましたCOST — 効き方は使い方次第です。典型ワークロードで約25%減、コンテキストとツールの重い作業では最大約45%減。自分の内訳を測らずに一律25%と書くと外れますBENCH — Terminal-Bench-Science 0.1 が Fable 5 の 24.7% から 52.6% へ。ただし公式が標準誤差 ±3.5〜4.5 ポイントと明記しているので、小さな差の扱いには注意が要りますSAFEGUARDS — サイバー安全装置が精密になり、Claude Code のセッションあたり介入が平均で約60%減りました。脆弱性の発見は可能、エクスプロイトの開発は引き続き不可ですAPI — 本日以降に作られた新規 API アカウントでは、思考トランスクリプトを保ったままの過去コンテキスト編集ができなくなりました。蒸留対策で、既存アカウントは当面対象外ですMODEL — Claude Fable 5.1 と Claude Mythos 5.1 が9月1日に公開されました。両者は同一のモデルで、違うのは安全装置の強度だけという設計ですPRICING — トークン単価の $10/$50 per MTok は据え置きで、下がったのはキャッシュ読み取りだけです。75% 引き下げられて $0.25 per MTok になりましたCOST — 効き方は使い方次第です。典型ワークロードで約25%減、コンテキストとツールの重い作業では最大約45%減。自分の内訳を測らずに一律25%と書くと外れますBENCH — Terminal-Bench-Science 0.1 が Fable 5 の 24.7% から 52.6% へ。ただし公式が標準誤差 ±3.5〜4.5 ポイントと明記しているので、小さな差の扱いには注意が要りますSAFEGUARDS — サイバー安全装置が精密になり、Claude Code のセッションあたり介入が平均で約60%減りました。脆弱性の発見は可能、エクスプロイトの開発は引き続き不可ですAPI — 本日以降に作られた新規 API アカウントでは、思考トランスクリプトを保ったままの過去コンテキスト編集ができなくなりました。蒸留対策で、既存アカウントは当面対象外です
TAG

extended-thinking

7 記事
タグ一覧に戻る
関連タグ:
claude-api3claude2cost-optimization2api-sdk2python2reasoning2production2budget-tokens1observability1コスト最適化1本番運用1tool-use1
API & SDK/2026-07-13上級

Extended Thinking を入れたのに精度は横ばい、請求だけ伸びていたとき — 思考トークンの限界効用を計測して budget を決める運用メモ

budget_tokens を大きめに固定したまま、精度が変わらないのに請求だけ伸びていく。思考トークンを台帳に残し、budget を1段上げたときの正解率の伸びを限界効用として計測して、根拠のある値に落とす運用メモです。

API & SDK/2026-05-05上級

Claude API 拡張思考を本番導入して見えたコストの現実 — タスク別の費用対効果と使い分け判断基準

拡張思考(Extended Thinking)を本番環境で3ヶ月運用し、タスク別のコスト・精度・速度を計測した実データを公開します。費用対効果マトリクスによる使い分け判断フロー、モデル選択との組み合わせ、思考トークンが効く場面と不要な場面の見極めまで、実測値に基づいて解説します。

API & SDK/2026-05-05上級

「考えながら調べる」AIエージェントの作り方 — Claude API 拡張思考 × Tool Use 本番実装ガイド

Claude APIの拡張思考(Extended Thinking)とTool Useを組み合わせる実装パターンを詳解。頻出エラーの根本原因、リサーチエージェントの完全実装コード、本番でのコスト・タイムアウト設計まで体系的に解説します。

Claude AI/2026-04-14中級

Gemma 4 の「思考モード」は Claude の拡張思考とどう違うのか

Gemma 4が搭載した4,000トークン超の内部推論「思考モード」を、Claudeの拡張思考と比較しながら解説します。両者の3つの本質的な違い、AIME 89.2%という数学推論スコアの意味、ローカル実装でどちらを選ぶべきかの判断基準、始め方の最初の一歩までまとめました。

Claude AI/2026-04-03中級

Claude Sonnet 4.6 — 1Mトークン・Computer Use・Extended Thinking を本番で使いこなす実装パターン

2026年2月リリースの Claude Sonnet 4.6 を徹底解剖。1Mトークンコンテキスト・Computer Use 72.5点・Extended Thinking の実装から、Opus 4.6 との使い分け・コスト最適化・本番運用パターンまで実装コード付きで完全解説します。

API & SDK/2026-03-30上級

Claude Opus 4.6 拡張思考のプロダクション活用パターン — 複雑な推論を制御する

Claude Opus 4.6の拡張思考をプロダクションで制御するための設計パターン集です。budget_tokensの決め方と動作原理、コスト最適化戦略、ストリーミングとの統合、フォールバックを含むエラーハンドリング、推論チェーン検証、大規模コードレビューへの適用例まで体系的に解説します。

API & SDK/2026-03-26中級

Claude API で PDF 解析・要約アプリを構築する:Vision + Extended Thinking 活用ガイド

契約書やレポートなど大量のPDFを手作業で読む時間を減らすため、Claude APIのVisionとExtended Thinkingを組み合わせた解析・要約アプリを構築します。PDFの画像変換からページ内容の抽出、深い要約の生成、完成版パイプラインまでをPythonのコードとともに段階的に解説します。