CLAUDE LABEN
CLI — Claude Code v2.1.259 が9月2日に出ました。組織運用・無人実行・権限まわりの修正が集中した、今週いちばん実務に効くリリースだと感じていますMCP — 組織が HTTP/SSE の MCP サーバーを全ユーザーへ配布できる managedMcpServers が追加されました。同時に allowedMcpServers の役割が変わり、管理配布のサーバーは許可リストで弾けなくなっていますHEADLESS — --permission-prompts none が加わりました。確認が要る操作は自動的に拒否され、auto モードを含む権限判断はそのまま働きます。無人で走らせる自動化に直接効きますSECURITY — Bash の Read() 拒否ルールに抜けがありました。--ignore-revs-file=.env のようにオプション値で渡したファイルや、cd DIR && cat FILE の複合が対象外だったのです。塞がれていますSLACK — Claude Tag がメッセージ単位の判定をやめ、チャンネル全体の文脈から判断する方式になりました。軽量分類器は撤去され、割り込まない判断が約30%改善していますLEARN — Claude Academy が公開されています。Anthropic が自社の新入社員教育に使う 4D AI Fluency Framework を土台にした無料の学習ハブで、修了状況は Claude のプロフィールに記録されますCLI — Claude Code v2.1.259 が9月2日に出ました。組織運用・無人実行・権限まわりの修正が集中した、今週いちばん実務に効くリリースだと感じていますMCP — 組織が HTTP/SSE の MCP サーバーを全ユーザーへ配布できる managedMcpServers が追加されました。同時に allowedMcpServers の役割が変わり、管理配布のサーバーは許可リストで弾けなくなっていますHEADLESS — --permission-prompts none が加わりました。確認が要る操作は自動的に拒否され、auto モードを含む権限判断はそのまま働きます。無人で走らせる自動化に直接効きますSECURITY — Bash の Read() 拒否ルールに抜けがありました。--ignore-revs-file=.env のようにオプション値で渡したファイルや、cd DIR && cat FILE の複合が対象外だったのです。塞がれていますSLACK — Claude Tag がメッセージ単位の判定をやめ、チャンネル全体の文脈から判断する方式になりました。軽量分類器は撤去され、割り込まない判断が約30%改善していますLEARN — Claude Academy が公開されています。Anthropic が自社の新入社員教育に使う 4D AI Fluency Framework を土台にした無料の学習ハブで、修了状況は Claude のプロフィールに記録されます
TAG

testing

5 記事
タグ一覧に戻る
関連タグ:
claude-api3claude-code2vitest2typescript2production2ci-cd2quality-assurance2test-coverage1api-sdk1playwright1e2e-testing1automation1
Claude Code/2026-05-04中級

Claude Code でテストカバレッジを段階的に改善する

カバレッジが低いプロジェクトでClaude Codeを活用し、テストを段階的に増やすワークフローを解説します。カバレッジレポートの解析、未テスト関数の一括検出とテスト生成の依頼方法、TypeScriptとVitestでの実践手順、よく詰まるポイントと対処法までを具体例で示します。

API & SDK/2026-04-26上級

Claude API のReplay駆動テスト — 本番応答を録画して回帰テストを成立させる設計パターン

非決定的なClaude APIの応答を録画・再生し、回帰テストを安定させるReplay駆動テストの設計です。Messages API・Streaming・Tool Use多段それぞれのカセット実装、メッセージハッシュをキーにする理由、CIへの録画ガード組み込み、本番障害の再現への応用まで扱います。

API & SDK/2026-04-12上級

Claude API アプリケーションのテスト戦略 — AI出力の品質をユニットテスト・統合テスト・E2Eテストで保証する

Claude APIを組み込んだアプリケーションで「AIの出力が変わってテストが壊れる」問題を根本解決する。モック・セマンティックアサーション・スナップショットテストを組み合わせた実践的テスト設計パターン。

Claude Code/2026-03-28上級

Claude Code × Playwright で E2E テストを本番運用に乗せる — 6サイト並行運用で測った数値・落とし穴・判断基準

Claude Code と Playwright を組み合わせて E2E テストを本番運用するための実装パターンと、6サイト並行運用で実測した数値(フレーキー率 15.3% → 0.42%、Page Object 生成 4時間 → 18分)。Cloudflare Workers/Pages preview deployment 下での落とし穴と、個人開発者がテストを導入する判断基準まで踏み込んで解説します。

API & SDK/2026-03-27上級

Claude API LLM評価パイプライン構築ガイド — Claude-as-Judge・プロンプトA/Bテスト・品質スコアリングの実装パターン

Claude API を使った LLM アプリケーション評価パイプラインの設計と実装。Claude-as-Judge、プロンプト A/B テスト、品質スコアリング、回帰テストの本番実装パターンを扱います。