Uh oh!
There was an error while loading. Please reload this page.
Docs: 一気通貫実行プランの再構成と skill-stats の集計修正 - #65
Conversation
05-goal-workflow.md を章立てから見直して全面的に書き直した。 - 却下案への否定で始まる記述や、担当範囲の宣言と本文の不一致を解消 - 前提 → 担当範囲 → 実行の流れ → 完了条件 → 停止境界 → ランタイム差分 → 中断と再開 の順に再構成し、3 箇所へ散っていたランタイム差分を集約 - mermaid 図で /goal の評価器が終端ノードの後段に置かれ、ループ終了後に 判定して実装へ戻る矛盾した流れになっていたのを、工程全体を囲む subgraph として描き直し。HTML タグと解釈されて消える <条件> の記法も修正 - 完了条件の上限「40 ターン」と停止境界の「3 巡」の不整合を 3 巡へ統一 - 「条件文への書き方」の表に事前チェックが混在していたため見出しを修正 - Codex / Kiro の引数の扱いが 03-runtime-conformance.md と矛盾していたのを修正 Skill 名は execute-plan から execute-goal へ変更した。goal を含めつつ、 組み込みコマンド /goal とタブ補完で競合しないよう先頭には置かない。 Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01WGWMnk8CcxhqYsJELtFwTN
棚卸の計測に使えない状態だったため、集計ロジックを修正した。 - トリガ抽出が description しか見ておらず、実際にトリガ語を列挙している when_to_use を読まないため 49 個中 48 個で失敗していた。when_to_use を 抽出対象へ加え、見出し語も Triggers: と 明示トリガ: の双方に対応 - 利用者のスラッシュ起動が <command-name> をシステム由来として除外して いたため計上されず、cross-review を 14 と報告していた(実測 285)。 <command-name> から明示起動を数え、自動起動と合算する - ヒット判定はスラッシュコマンドで探索を打ち切る。利用者が自分で打った 時点でトリガは発火していないため、ヒットに数えない - 出力を「計 / 自動 / 明示」の 3 列に拡張(md / json / --by-project) 2026-05-20〜2026-08-07 で検証し、review 58/1/57、cherry-pick-pr 16/1/15 が 実測表と一致。上位 Skill の差は ±2 以内で、計測後にログが増えた分に収まる。 トリガ抽出に失敗する Skill は 48 個から 13 個になった。 Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01WGWMnk8CcxhqYsJELtFwTN
takemi-ohama
left a comment
There was a problem hiding this comment.
🤖 cross-review | round 1 | gemini | APPROVE
PR の目的と変更範囲が一貫しており、ドキュメントの再構成と計測ロジックの修正が正しく行われていることを確認しました。1点、今後のタスク (Task 0-7) に関連してトリガ抽出の正確性を保つための軽微な修正提案をインラインに残しています。
Uh oh!
There was an error while loading. Please reload this page.
takemi-ohama
left a comment
There was a problem hiding this comment.
🤖 cross-review | round 1 | codex | REQUEST_CHANGES
--skill フィルタ時に hit 率が全件集計と食い違う不具合があるため、修正が必要です。
Uh oh!
There was an error while loading. Please reload this page.
PR #65 のレビュー指摘に対応。 - extract_triggers: description と when_to_use を結合せず個別にラベル 検索する。_TRIGGER_LABEL_RE は DOTALL のため、結合すると description 側のラベルが when_to_use 全体を巻き込み、無関係な引用文字列まで トリガ語として拾っていた。 - aggregate_by_project: slash 境界の検出を --skill 絞り込み前の全 Skill 名 で行うよう all_skill_names 引数を追加。従来は絞り込み後の skills から 境界集合を導出していたため、--skill 指定時に対象外 Skill のスラッシュ コマンドが境界にならず hits が過大計上されていた。 Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01WGWMnk8CcxhqYsJELtFwTN
takemi-ohama
left a comment
There was a problem hiding this comment.
🤖 cross-review | round 2 | codex | APPROVE
追加の修正アクションはありません。
takemi-ohama
left a comment
There was a problem hiding this comment.
🤖 cross-review | round 2 | gemini | APPROVE
Task 3-1 の対象ファイル一覧と Codex 向け仕様の記述に不一致があるため、実装漏れを防ぐための修正提案をインラインに残しました。
Uh oh!
There was an error while loading. Please reload this page.
Task 3-1 の対象ファイルに execute-goal の agents/openai.yaml が無い理由を 明記し、Task 0-8 の生成処理で出力されることを示した。 Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01WGWMnk8CcxhqYsJELtFwTN
takemi-ohama
commented
Aug 8, 2026
最終スイープ完了残っていた open review thread 1 件に対応しました。
対応内容
検証
|
Summary
実装プラン
issues/ndf-development-skills/のレビュー指摘対応と、その前提となる計測ツールの修正。05-goal-workflow.md の全面書き直し
章立てから見直した。途中で方向を変えた痕跡が残り、第三者が読めない状態だったため。
実質的な不整合の修正
<条件>が HTML タグと解釈され描画時に消える記法だったargument-hintの形式で解釈する」が、同項目も Claude Code 独自という 03-runtime-conformance.md の記述と矛盾Skill 名の変更:
execute-plan→execute-goalgoalを名前に含めつつ、組み込みコマンド/goalとタブ補完で競合しないよう先頭には置かない。関連 7 ファイル 27 箇所へ反映。skill-stats の修正
棚卸の計測に使えない状態だったため、置き換えではなく修正した(Task 0-1 を前倒し)。
descriptionのみで、実際にトリガ語があるwhen_to_useを読まない。さらに見出し語がTriggers:限定で明示トリガ:表記のcross-reviewを拾えないcross-reviewを 14 と報告(実測 285)<command-name>をシステム由来として除外していた<command-name>から計上し自動起動と合算。接頭辞なしの/review形式も同一視ヒット判定はスラッシュコマンドで探索を打ち切るようにした。利用者が自分で打った時点でトリガは発火していないため、ヒットに数えると発動改善の判定が歪む。出力は「計 / 自動 / 明示」の 3 列に拡張し、台帳へそのまま転記できる形にした。
Test plan
python3 -m py_compile skill-stats.pyが通る--by-project/--show-keywordsの全出力モードが動作するreview58/1/57、cherry-pick-pr16/1/15 は完全一致。上位 Skill の差は ±2 以内で、計測後のログ増加分に収まる)明示トリガ:表記のcross-reviewからトリガ語 5 件を抽出できるgrep -rn 'execute-plan'が 0 件未解決
investigation-rulesが実測表 30 に対し 25、implementation-planが 33 に対し 24 と一致しない。全期間で数え直しても同じ値で、増加ではなく減少のためログ増加では説明できない。実測表の作成時にSkillツール呼び出し以外のシグナルを含めた可能性がある。修正版ツールで台帳を作り直す Task 0-1 で確定させる想定。やらないこと
arguments: planのスカラー表記は、名前付き引数の宣言形式を仕様で確認できていないため変更していない.serena/の差分は Serena が自動再生成した設定で本作業と無関係のため、コミットに含めていない