アプリ・Webサービス・業務ツールの制作を、証拠分析→確定的な初稿→要件定義→体験設計→機能分解→実装→品質ゲート→リリース判定の手順ゲート制で進めるスキル。質問で要件を埋めるのではなく、依頼文・既存コード・資料・ログから最有力案を選び、動く成果物を先に出して差分で改善する。ユーザーが「アプリを作りたい」「ツールを作って」「〜を自動化したい」「システム化したい」「要件定義」「仕様を決めたい」「UI/UXを設計して」「体験を良くしたい」「機能を洗い出して」「MVPを決めたい」「品質チェック」「リリースしていいか判断して」などと言ったら必ず使用する。外部データの取込・マスタ・締め処理を伴う業務システムでは references/data-lifecycle.md も併用する。新規・既存を問わずアプリの制作・改善・リニューアルで使用する。
delegate-codex-skill-review
自セッションで評価せず外部LLMに委譲したいとき、Sycophancyを避けたいときに使う。
インストール方法を見る含まれるファイル(7)
- SKILL.md8.8 KB
- prompts/R1-delegate.md9.5 KB
- prompts/R2-codex-review.md8.5 KB
- references/codex-connection.md2.1 KB
- references/resource-map.yaml524 B
- schemas/io-contract.schema.json1.3 KB
- scripts/check-codex-installed.py1.2 KB
SKILL.md(原文)
インストールする前に、エージェントに与えられる指示の中身を確認できます。
Pre-choice usable artifact execution
Purpose & Output Contractの最小の実成果物をmain contextで作成する。effect別のparse/open・secret・irreversible・corrupt guardだけを実行し、現物path・digest・開き方を提示してからaccept-as-is/light/standard/detailedを記録する。accept-as-isはその場でhandoff完了とし、後続sectionを実行しない。
Post-choice selected improvement execution
以下の既存workflow・goal-seek・評価・修正sectionはlight/standard/detailedが記録されてsemantic_evaluator_startedへ遷移した場合だけ実行する。release/exhaustiveは別の明示eventを必要とする。
delegate-codex-skill-review
Purpose & Output Contract
評価対象 Skill (SKILL.md) を任意の外部 codex CLI に渡すための手順と入力を作り、Sycophancy を避けた第三者レビューの準備をする。
入力: target_skill_path (SKILL.md への絶対パス)
出力: eval-log/delegate-codex-request.json (ユーザーが任意で実行する codex review 入力)
完了条件: codex CLI が標準フローの必須依存ではないことを保ったまま、任意実行用の入力とコマンド例が提示されている。
内製 vs 委譲の選定根拠 (PARA-001)
| 観点 | 内製 (run-elegant-review) | 外部委譲 (本 skill) |
|---|---|---|
| Sycophancy リスク | 高 (自己採点罠) | 低 (第三者 LLM) |
| 再現性 | 高 (schema 固定) | 中 (codex モデル更新で変動) |
| 依存 | Python 標準のみ | 外部 codex CLI 別途インストール |
| 適用シーン | 標準フロー全件 | 重要 PR / 自己採点疑義時の cross-check |
判断指針: 標準フローは内製で完結させ、本 skill は opt-in の cross-check として使う。両者は競合せず補完関係。
Key Rules
- 委譲先は任意:
delegate_agent: codex-cliは外部拡張の識別子であり、標準フローでは起動しない。 - 入力のみ準備: SKILL.md 本文と rubric パスを記録するが、自セッションで採点しない。
- 結果はユーザー管理: codex 実行はユーザーが明示的に行い、返答を eval-log/ に保存する。
- 任意拡張: Node / npm / shell script / codex CLI を標準依存にしない。存在確認は Python 標準ライブラリで行う。
ゴールシーク実行
外部 codex CLI へレビューを委譲する実行系。固定手順ではなくゴール・チェックリストへ向けて反復する(正本 run-build-skill/references/goal-seek-paradigm.md)。
ゴール (Goal)
codex CLI を標準フローの必須依存にしないまま、任意実行用の入力 eval-log/delegate-codex-request.json とコマンド例が提示され、自セッションでは採点していない状態になっている。
目的・背景 (Why)
自己採点の Sycophancy を避けるため、採点は第三者 LLM (codex) に委ね、本 Skill は入力準備と結果提示に徹する(opt-in cross-check)。
完了チェックリスト (Checklist)
-
check-codex-installed.pyが exit 0、または未導入 (exit 2) なら任意拡張と案内し BLOCK している -
target_skill_pathが存在し SKILL.md であることを検証済み - io-contract (
schemas/io-contract.schema.json) 準拠のeval-log/delegate-codex-request.jsonと任意実行コマンド例を提示済み - 自セッションでスコアを付けていない(codex 実行・結果保存はユーザー管理)
ゴールシークループ
正本の 6 ステップ(現状評価→手順生成→実行→検証→Anchor Step→反復/差し戻し)に従う。固有差分: codex 実行自体はループ外(ユーザーが任意で行う)。本 Skill のループは「入力準備が io-contract を満たす」まで回し、委譲結果を自セッションで再評価しない。
局面カタログ(順序は都度判断)
-
codex 存在確認 (決定論):
python3 plugins/harness-creator/skills/delegate-codex-skill-review/scripts/check-codex-installed.pyexit 2 が返ったら BLOCK。標準フローではなく任意拡張であることを案内して停止。
-
target 検証:
target_skill_pathが存在し SKILL.md であることを確認。 -
任意実行コマンドの提示 (正本
references/codex-connection.md):codex --prompt "$(cat plugins/harness-creator/skills/delegate-codex-skill-review/prompts/R2-codex-review.md)" \ --context-file eval-log/delegate-codex-request.json \ --output-format text \ --approval-mode yolo \ > eval-log/delegate-codex-response.jsoncodex に subcommand は無く
--prompt直接指定。rubric (ref-skill-design-rubric/references/rubric.jsonの critical axis) は R2 プロンプト本文へ焼き込み、別フラグでは渡さない。このコマンドは自動実行しない。codex CLI を導入済みのユーザーが任意で実行する。 -
結果提示: 書き出した JSON のサマリをユーザーに返す。修正判断は委ねる。
Gotchas
- 委譲結果を再評価しない: 自セッションでスコア改竄をしない (09章 Sycophancy 防止)。
- codex 未インストール時: BLOCK するが、Node/npm を案内しない。公式に確認済みの配布元をユーザーが選ぶ。
- L1 階層: codex CLI 抽象 (L1)。プロジェクト固有の review 観点は L2 で wrap する。
Additional Resources
- 設計書:
06-classification-and-naming.md(delegate-* prefix),09-evaluation-orchestration.md - 委譲先: codex CLI (https://github.com/openai/codex 等、要別途インストール)
レビュー
まだレビューはありません。使ってみた感想をお寄せください。
同じリポジトリのスキル
概要と使いどころ
Webアプリの準備→要件定義→設計→実装→公開→品質ゲートを実行する内部オーケストレーター。Claude Codeの /build-app /improve-app、Codexの $build-app / $improve-app から明示的に委譲された場合、custom agent起動時、または利用者が $app-orchestrator を明示した場合だけ使用する。一般のアプリ相談から暗黙起動しない。
run-extract-blueprint が生成した章別ブループリントの忠実性を独立 context で評価したいとき、事実/推測区別と粒度と被覆を検証し draft_hash に束縛した PASS/FAIL verdict をローカル品質ゲート (C01 の周回内の受入判定・差し戻し) へ渡したいときに使う。
確認点で利用者が見る深さを選んだあと打ち合わせ資料を作り手とは別の目で確かめたいとき、正確さ・言葉・見た目・シンプルさの指摘を資料の編集なしで受け取りたいときに使う。
生成した handout 資料が初心者に伝わるか読みやすさレビューを依頼したいとき、独立 context のレビュアーから指摘と根拠つきの verdict を回収したいときに使う。
Notion ページを描画する直前に粒度を検証したいとき、info-collector-agent ページと同等の section 充足度を section_canonical_map 基準で機械検証したいときに使う。