AIコードレビューの再現性は構造で決まる
AIコードレビューの結果が毎回ぶれるとき、壊れているのはモデルではなくモデルを囲む構造です。Alibaba の Open Code Review を固定 SHA で読み、対象選定・粒度・位置決め・検証層がどこに置かれているかを確認し、そのうえで「構造を入れただけでは効かない」ことを自リポジトリの失敗台帳 10 行で裏づけた記録です。
読み込み中...
初めての方はここから。テーマごとに代表記事と一覧へ進めます。
PlanGateやHook Enforcementなど、AI実装を制御・検証する仕組みを確認します。
代表記事: AIレビューの導入単位は段取りか本体か「ハーネス設計」の記事を見るAI開発に関する新着記事を確認できます
AIコードレビューの結果が毎回ぶれるとき、壊れているのはモデルではなくモデルを囲む構造です。Alibaba の Open Code Review を固定 SHA で読み、対象選定・粒度・位置決め・検証層がどこに置かれているかを確認し、そのうえで「構造を入れただけでは効かない」ことを自リポジトリの失敗台帳 10 行で裏づけた記録です。
AIコードレビューのツールを入れるとき、導入単位は「レビュー」だと無意識に決めていないでしょうか。Alibaba の Open Code Review には、LLM を一切呼ばず、ファイル選定とルール解決だけを返す委譲モードがあります。固定 SHA で実装とスキル定義を読み、段取りだけを外に出したときに手元へ残るものを数えた記録です。
エージェントに渡すツールを絞れば挙動は安定する、とよく言われます。ではその集合は本当に閉じているのか。Alibaba の Open Code Review を固定 SHA で読み、予約済みの組み込みツールと、動的に足せるツールの口が同じ名前空間に同居している構造を確認し、「閉じていると書いてあるものを拡張点から検算する」という読み方を、自リポジトリのガード実測と合わせて整理した記録です。
OpenAIのAgents APIはCodex harnessをmanaged APIとして開放しました。ではAIエージェント基盤のうち何が買えて、何が手元に残るのか。公式ドキュメントの4構成要素を確認したうえで、このリポジトリのharness 60,841行を層ごとに数え、外注できる列とできない列を分けた記録です。
プロンプトを工夫するだけの段階は終わりました。AIの真価を引き出すのは、自律的なワークフローを設計する『エージェントエンジニアリング』です。Context/Capability/Critical Thinkingの3要素による次世代の開発パラダイムを解説。
CI ガードの免除リストの唯一のエントリが 132 日残り、うち 116 日は免除する理由が消えていました。免除の器を持たないガードを設計し、その不在をテストで固定しようとして空いた穴までを実測した記録です。
単発ではなく継続的に追っているテーマです。最新の検証から続けて読めます。
AIエージェント設計、仕様駆動、ハーネス エンジニアリングの実践的な知見を体系的にまとめています。RSS や記事一覧から継続的にチェックできます。