CLAUDE LABEN
AUTO — Claude Managed Agents の権限ポリシーに auto が入りました。サーバーが呼び出しごとに評価し、実行・拒否・承認待ちのいずれかを選びますEVAL — agent.tool_use と agent.mcp_tool_use が evaluation フィールドを持ち、その呼び出しがどう評価されたのかを報告しますCONNECT — ant beta:sessions connect で、走っているセッションに手元のターミナルから入れます。--web を渡すと Console のビューアをローカルで配信しますCOWORK — Cowork は v1.49585.0 でランタイムが Electron 44 へ上がりました。macOS 13 Ventura 以降が必須になっていますLIMIT — 5時間の利用上限に達して保留されたメッセージが、制限のリセット時に自動で送信されるようになりました。編集もキャンセルもできますCONFIG — 管理設定の非推奨フィールドに対する警告が9月10日から出始めました。旧表記の受付は10月7日 正午 太平洋時間までですAUTO — Claude Managed Agents の権限ポリシーに auto が入りました。サーバーが呼び出しごとに評価し、実行・拒否・承認待ちのいずれかを選びますEVAL — agent.tool_use と agent.mcp_tool_use が evaluation フィールドを持ち、その呼び出しがどう評価されたのかを報告しますCONNECT — ant beta:sessions connect で、走っているセッションに手元のターミナルから入れます。--web を渡すと Console のビューアをローカルで配信しますCOWORK — Cowork は v1.49585.0 でランタイムが Electron 44 へ上がりました。macOS 13 Ventura 以降が必須になっていますLIMIT — 5時間の利用上限に達して保留されたメッセージが、制限のリセット時に自動で送信されるようになりました。編集もキャンセルもできますCONFIG — 管理設定の非推奨フィールドに対する警告が9月10日から出始めました。旧表記の受付は10月7日 正午 太平洋時間までです
TAG

検証

3 記事
タグ一覧に戻る
関連タグ:
Claude Code2サブエージェント1自動運用1Claude Agent SDK1Claude API1ドキュメント処理1構造化抽出1TypeScript1本番運用1依存関係1アップグレード1破壊的変更1
Claude Code/2026-07-01上級

AIが出した数値と出典を、そのまま受け入れない — 検証専任サブエージェントで突き合わせるゲート設計

エージェントが生成した要約の数値と出典を、生成とは別の検証専任サブエージェントで確かめてから受け入れるゲート設計です。主張をクレーム台帳として取り出し、数値は関数で再計算、引用は原文との文字列照合で確認する構成を、動くTypeScriptのコードとともにまとめました。

API & SDK/2026-06-17上級

Claude API のドキュメント抽出が「確信を持って間違える」とき — 検証層の設計メモ

Claude API で請求書や契約書を構造化抽出するとき、最も怖いのは例外ではなく「もっともらしく間違った JSON」です。スキーマ検証・算術整合・二重抽出の一致率で誤抽出を本番前に捕まえる検証層を、TypeScript の実装とともにまとめました。

Claude Code/2026-04-26上級

Claude Code に依存ライブラリのアップグレードを任せる — 破壊的変更を見落とさない検証ループの設計

個人開発で 30 を超える依存ライブラリを抱えると、月一の一括アップグレードが恐怖の儀式になります。Claude Code に任せられるところと、人間が手放してはいけない判断を切り分け、破壊的変更を本番に漏らさない検証ループを実例で整理します。