確認手順は故障モードから逆算する
トップページだけが 500 になり、記事ページは 200 のままでした。代表的な1枚を見る確認が穴を残す理由を Playwright の実測で示し、故障モードからルートクラスを逆算する手順と、異常系まで実行済みの確認スクリプトを載せます。
読み込み中...
14 件の記事が見つかりました
トップページだけが 500 になり、記事ページは 200 のままでした。代表的な1枚を見る確認が穴を残す理由を Playwright の実測で示し、故障モードからルートクラスを逆算する手順と、異常系まで実行済みの確認スクリプトを載せます。
フレームワークを pin して自動更新を止めた 142 日間(2026-09-06 時点)の記録です。update-types を付けた ignore はセキュリティ更新を止めず、pin 先は既に終了した系列でした。補償コントロールを実測して棚卸しします。
CI ガードの免除リストの唯一のエントリが 132 日残り、うち 116 日は免除する理由が消えていました。免除の器を持たないガードを設計し、その不在をテストで固定しようとして空いた穴までを実測した記録です。
同じ本番障害を、記事を書く上流と公開先の下流が独立に実測し、互いの誤診を4件訂正した記録です。うち2件は相手側の一次資料を読むまで出ませんでした。測っている対象・測った時刻・持っている一次資料の3つがズレるから突き合わせで誤診が落ちる、という構造を実例で示します。
「マージ済み main の最大IDの次を採る」という採番規則を全員が正しく守っても、並行ブランチがある限り同じIDが2つの別物に割り当てられます。本ブログのリポジトリで同じ日に2回起きた衝突を、CI の run ID と終了コードつきで記録しました。
会話履歴の memory では長期運用が回りません。同じリポジトリの知識ストア3つを schema / provenance / expiry / rollback の4軸で実測し、機械が読む列は100%埋まる一方、last_verified は31件中3件しか生きていなかった記録です。測り方も置きます。
生成行数やトークン量のような累積カウンタ型のKPIは定義上単調で、悪化を表現できません。自リポジトリのgit履歴で確かめたところ、判定を確定できた15対象のうち12が一度も純減していませんでした。検証済み成果の側に分母を与える手順と、比率にした途端に桁が変わる罠を記録します。
AIの判断を決定的な自動化へ昇格させるループを実装したところ、「昇格すべきだと気づく」側の判定器が、8つのすり抜け型のうち6つで沈黙していました。対照実験の終了コードと監査スクリプトの実出力で記録します。
モデルが賢くなればSkillやAGENTS.mdは削れる、という前提を自リポジトリの全履歴で検証しました。結果は変更があった9か月すべてで増加、追加417ファイルに対し実質削除5件。削る判断が一度も行われていないという負債の形と、参照エッジ・二面検証という削除基準を、そのまま動くスクリプトと終了コードで示します。
Coding Agent のモデルが更新・廃止されたとき、プロンプト資産と自動化を壊さずに移行する運用設計を解説します。モデル依存の3層棚卸し、Model Matrix、回帰テストの検知率を mutation で実測した自リポジトリのデータ(13変異中8検知)まで。AI Platform / Tech Lead 向け。
AIエージェント開発をチャット指示の延長で終わらせず、仕様・権限・テスト・運用の4層で設計するための保存版ガイド。Claude Code、Codex、MCP、SDDを導入する前に決めるべき順序を整理する。
夜間呼び出しでチームが疲弊し、SRE・EM が離職リスクを抱えるチーム向けに、オンコール疲弊を改善する運用設計を症状診断・根本原因・段階的対策(ローテ・アラートチューニング・AI triage・体制)の 4 ステップで整理する。
AIエージェント運用で障害や想定外の出力が起きたとき、人間が迷わず止めて戻して再開するための Runbook 設計を整理する。AIエージェントを本番環境で動かし始めると、想定外の出力やループ暴走、外部API障害など「止めなければいけない瞬間」が必
AIエージェントが無理に処理を続けず、人間へ正しくエスカレーションするための条件設計と運用ルールを整理する。エスカレーション判定ロジックと実装例を具体的に解説。設計テンプレートと実装コード付きで解説。