CLAUDE LABEN
MODEL — Claude Fable 5.1 と Claude Mythos 5.1 が9月1日に公開されました。両者は同一のモデルで、違うのは安全装置の強度だけという設計ですPRICING — トークン単価の $10/$50 per MTok は据え置きで、下がったのはキャッシュ読み取りだけです。75% 引き下げられて $0.25 per MTok になりましたCOST — 効き方は使い方次第です。典型ワークロードで約25%減、コンテキストとツールの重い作業では最大約45%減。自分の内訳を測らずに一律25%と書くと外れますBENCH — Terminal-Bench-Science 0.1 が Fable 5 の 24.7% から 52.6% へ。ただし公式が標準誤差 ±3.5〜4.5 ポイントと明記しているので、小さな差の扱いには注意が要りますSAFEGUARDS — サイバー安全装置が精密になり、Claude Code のセッションあたり介入が平均で約60%減りました。脆弱性の発見は可能、エクスプロイトの開発は引き続き不可ですAPI — 本日以降に作られた新規 API アカウントでは、思考トランスクリプトを保ったままの過去コンテキスト編集ができなくなりました。蒸留対策で、既存アカウントは当面対象外ですMODEL — Claude Fable 5.1 と Claude Mythos 5.1 が9月1日に公開されました。両者は同一のモデルで、違うのは安全装置の強度だけという設計ですPRICING — トークン単価の $10/$50 per MTok は据え置きで、下がったのはキャッシュ読み取りだけです。75% 引き下げられて $0.25 per MTok になりましたCOST — 効き方は使い方次第です。典型ワークロードで約25%減、コンテキストとツールの重い作業では最大約45%減。自分の内訳を測らずに一律25%と書くと外れますBENCH — Terminal-Bench-Science 0.1 が Fable 5 の 24.7% から 52.6% へ。ただし公式が標準誤差 ±3.5〜4.5 ポイントと明記しているので、小さな差の扱いには注意が要りますSAFEGUARDS — サイバー安全装置が精密になり、Claude Code のセッションあたり介入が平均で約60%減りました。脆弱性の発見は可能、エクスプロイトの開発は引き続き不可ですAPI — 本日以降に作られた新規 API アカウントでは、思考トランスクリプトを保ったままの過去コンテキスト編集ができなくなりました。蒸留対策で、既存アカウントは当面対象外です
TAG

claude api

121 記事
タグ一覧に戻る
関連タグ:
個人開発23本番運用20TypeScript18コスト最適化13Python11SaaS11収益化11エージェント8運用設計7MCP7コスト管理7ストリーミング7
API & SDK/2026-07-09上級

RAG が自信たっぷりに間違え始めたとき — 検索の取りこぼしを接地率で計測する運用メモ

Claude API の RAG で、回答は流暢なのに事実がずれ始める。多くの場合、原因は検索側で答えを含む文書を取りこぼすサイレントなリコール低下です。接地率と検索ヒット率を計測し、段階的に立て直した運用メモを、動くコードと実数値付きで残します。

API & SDK/2026-07-08上級

MCP コネクタを申請・無人運用に回す前に、各ツールを契約テストで確かめる

手元で動いた MCP コネクタをそのまま無人ジョブに繋ぐと、応答形状の誤読や書き込みの二重発火で静かに壊れます。ツール記述・応答契約・冪等性・レイテンシを機械検証する小さなハーネスの作り方を、実測値とともにまとめました。

API & SDK/2026-07-07上級

4サイト分のClaude費用が一つの請求に混ざる — ワークスペース単位で支出を割り当て、絞るパイプラインを見極める

複数プロジェクトのClaude API費用が一つの組織請求に合算されて判断を誤る問題を、Cost Report / Usage Report の group_by でワークスペース別に割り当てて解く実装メモです。防御的パース・showback表・費用対効果での選別まで扱います。

API & SDK/2026-07-07上級

Claude API が本番で突然 429 を返し始めたとき — レート制限の余白をヘッダから計測して枯渇前に絞る運用メモ

429 が出てから慌ててリトライを入れるのは後手です。Claude API のレスポンスヘッダには残量が毎回書かれています。余白を継続計測し、枯渇する前に自分から絞る運用メモを、実装フックと計測ログの読み方でまとめます。

API & SDK/2026-07-05上級

Fable 5 が全世界に戻り、Sonnet 5 が既定になった — 個人運用の自動化スタックで3モデルをどの層に置くか

Fable 5 の全世界提供再開と Sonnet 5 の既定化で、個人運用の自動化に使える上位モデルが一気に3つ揃いました。優劣で選ぶのではなく、タスクの持ち場でモデルを割り当てる方針オブジェクトを、フォールバック梯子と記録つきの実装でまとめます。

API & SDK/2026-07-05中級

Opus 4.7 の fast mode 廃止(7/24)で無人ジョブを落とさない — speed パラメータの事前検査と移行

claude-opus-4-7 の fast mode が 2026-07-24 に廃止され、speed: fast がエラーになります。無人パイプラインを静かに壊さないための、使用箇所の機械検出・fail-closed な実行時ガード・4.8 への移行シムを実装コード付きでまとめました。

API & SDK/2026-07-04上級

Claude apps gateway の発表を読んで、個人開発の管制面を作り直した話

セルフホスト型 Claude apps gateway の設計を管制面と実行面の分離として読み解き、個人開発の規模に縮約します。アプリ別コスト帰属・モデル許可リスト・fail-closed の支出上限を Cloudflare Workers で実装した記録です。

API & SDK/2026-07-03上級

単価が40%下がっても、タスク単価は下がるとは限らない — Opus 4.8 から Sonnet 5 への移行損益をトークン消費プロファイルで測る

Sonnet 5 の導入価格は Opus 4.8 より約40%安ですが、ツール往復が増えるとタスク単価は逆転し得ます。消費ベクトルの記録・並走ハーネス・損益分岐ターン数の逆算までを動くTypeScriptと実測で示します。

API & SDK/2026-07-02中級

9月1日に単価は1.5倍へ戻る — Sonnet 5 導入価格の期限を織り込む実効日付きコスト予測

Claude Sonnet 5 の導入価格 $2/$10 は 2026-08-31 で終わり、9月からは $3/$15 になります。静的な単価表のままでは月次予測が3割ずれる問題を、有効期間つき単価テーブルと予測シミュレータで解く設計をまとめました。

API & SDK/2026-07-02上級

Message Batches に2万件投げたら41件だけ静かに欠けていたとき — 部分失敗を照合して再投入する運用メモ

Message Batches API の processing_status: ended は全件成功を意味しません。errored・expired が結果に静かに混ざる仕組みと、custom_id 台帳で欠落を照合し二重処理なく再投入する実装を、実運用の計測値とともに整理します。

API & SDK/2026-07-01上級

モデルは残るのにパラメータだけ期限切れになる — Claude API リクエストの廃止を日付で先回りする設計

モデル名は有効なまま、指定していたパラメータだけが廃止日を迎えてバッチが落ちることがあります。リクエストを部品に分解し、部品ごとに廃止期限を持たせて起動前に先回りする設計を、TypeScript の動くコードと運用の実測でまとめました。

API & SDK/2026-07-01上級

Claude API のドキュメント抽出が「自信満々に間違える」とき — 沈黙する誤りを不変条件で捕まえる運用メモ

請求書や契約書の構造化抽出で一番怖いのは、クラッシュではなく「スキーマも通り信頼度も高いのに値だけ間違っている」沈黙の誤りです。不変条件・二段抽出・フィールド単位の誤り率で運用する実装メモを共有します。