Skip to content

Docs: 一気通貫実行プランの再構成と skill-stats の集計修正 - #65

Merged
takemi-ohama merged 4 commits into
mainfrom
docs/execute-goal-plan-and-skill-stats-fix
Aug 8, 2026
Merged

Docs: 一気通貫実行プランの再構成と skill-stats の集計修正#65
takemi-ohama merged 4 commits into
mainfrom
docs/execute-goal-plan-and-skill-stats-fix

Conversation

@takemi-ohama

Copy link
Copy Markdown
Contributor

Summary

実装プラン issues/ndf-development-skills/ のレビュー指摘対応と、その前提となる計測ツールの修正。

05-goal-workflow.md の全面書き直し

章立てから見直した。途中で方向を変えた痕跡が残り、第三者が読めない状態だったため。

  • 冒頭が読み手の知らない却下案への否定(「この継続ループを Skill として作り直さない」)で始まっていたのを、肯定形の記述に置き換え
  • 「担うのは次の 2 つだけ」と宣言しながら本文で 5 つの責務を持たせていた不一致を解消
  • 構成を 前提 → 担当範囲 → 実行の流れ → 完了条件 → 停止境界 → ランタイム差分 → 中断と再開 に再編。3 箇所へ散っていたランタイム差分を集約し、2 文だけの独立章「名前」を吸収

実質的な不整合の修正

箇所内容
mermaid 図評価器が終端ノードの後段にあり「ループ終了 → 判定 → 実装へ戻る」と読めた。工程全体を囲む subgraph に描き直し
mermaid 図<条件> が HTML タグと解釈され描画時に消える記法だった
完了条件 / 停止境界上限が「40 ターン」と「3 巡」で食い違い、40 の根拠もなかった。3 巡へ統一
停止境界の表見出し「条件文への書き方」に、条件文ではない事前チェックが混在
引数の扱い「Codex では argument-hint の形式で解釈する」が、同項目も Claude Code 独自という 03-runtime-conformance.md の記述と矛盾
レビュー分岐表4 行中 3 行が同じ呼び先で、理由欄が同義反復

Skill 名の変更: execute-planexecute-goal

goal を名前に含めつつ、組み込みコマンド /goal とタブ補完で競合しないよう先頭には置かない。関連 7 ファイル 27 箇所へ反映。

skill-stats の修正

棚卸の計測に使えない状態だったため、置き換えではなく修正した(Task 0-1 を前倒し)。

不具合原因修正
49 個中 48 個でトリガ抽出に失敗抽出対象が description のみで、実際にトリガ語がある when_to_use を読まない。さらに見出し語が Triggers: 限定で 明示トリガ: 表記の cross-review を拾えない両フィールド・両表記に対応
明示起動を計上せず cross-review を 14 と報告(実測 285)スラッシュ起動が残す <command-name> をシステム由来として除外していた<command-name> から計上し自動起動と合算。接頭辞なしの /review 形式も同一視

ヒット判定はスラッシュコマンドで探索を打ち切るようにした。利用者が自分で打った時点でトリガは発火していないため、ヒットに数えると発動改善の判定が歪む。出力は「計 / 自動 / 明示」の 3 列に拡張し、台帳へそのまま転記できる形にした。

Test plan

  • mermaid ブロックが mermaid v11 パーサで構文検証を通る
  • python3 -m py_compile skill-stats.py が通る
  • md / json / --by-project / --show-keywords の全出力モードが動作する
  • 2026-05-20〜2026-08-07 の集計が実測表と一致(review 58/1/57、cherry-pick-pr 16/1/15 は完全一致。上位 Skill の差は ±2 以内で、計測後のログ増加分に収まる)
  • 明示トリガ: 表記の cross-review からトリガ語 5 件を抽出できる
  • トリガ抽出に失敗する Skill が 48 個 → 13 個
  • grep -rn 'execute-plan' が 0 件

未解決

investigation-rules が実測表 30 に対し 25、implementation-plan が 33 に対し 24 と一致しない。全期間で数え直しても同じ値で、増加ではなく減少のためログ増加では説明できない。実測表の作成時に Skill ツール呼び出し以外のシグナルを含めた可能性がある。修正版ツールで台帳を作り直す Task 0-1 で確定させる想定。

やらないこと

  • arguments: plan のスカラー表記は、名前付き引数の宣言形式を仕様で確認できていないため変更していない
  • .serena/ の差分は Serena が自動再生成した設定で本作業と無関係のため、コミットに含めていない

takemi-ohamaand others added 2 commits August 7, 2026 23:52
05-goal-workflow.md を章立てから見直して全面的に書き直した。
- 却下案への否定で始まる記述や、担当範囲の宣言と本文の不一致を解消
- 前提 → 担当範囲 → 実行の流れ → 完了条件 → 停止境界 → ランタイム差分 →
中断と再開 の順に再構成し、3 箇所へ散っていたランタイム差分を集約
- mermaid 図で /goal の評価器が終端ノードの後段に置かれ、ループ終了後に
判定して実装へ戻る矛盾した流れになっていたのを、工程全体を囲む subgraph
として描き直し。HTML タグと解釈されて消える <条件> の記法も修正
- 完了条件の上限「40 ターン」と停止境界の「3 巡」の不整合を 3 巡へ統一
- 「条件文への書き方」の表に事前チェックが混在していたため見出しを修正
- Codex / Kiro の引数の扱いが 03-runtime-conformance.md と矛盾していたのを修正
Skill 名は execute-plan から execute-goal へ変更した。goal を含めつつ、
組み込みコマンド /goal とタブ補完で競合しないよう先頭には置かない。
Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01WGWMnk8CcxhqYsJELtFwTN
棚卸の計測に使えない状態だったため、集計ロジックを修正した。
- トリガ抽出が description しか見ておらず、実際にトリガ語を列挙している
when_to_use を読まないため 49 個中 48 個で失敗していた。when_to_use を
抽出対象へ加え、見出し語も Triggers: と 明示トリガ: の双方に対応
- 利用者のスラッシュ起動が <command-name> をシステム由来として除外して
いたため計上されず、cross-review を 14 と報告していた(実測 285)。
<command-name> から明示起動を数え、自動起動と合算する
- ヒット判定はスラッシュコマンドで探索を打ち切る。利用者が自分で打った
時点でトリガは発火していないため、ヒットに数えない
- 出力を「計 / 自動 / 明示」の 3 列に拡張(md / json / --by-project)
2026-05-20〜2026-08-07 で検証し、review 58/1/57、cherry-pick-pr 16/1/15 が
実測表と一致。上位 Skill の差は ±2 以内で、計測後にログが増えた分に収まる。
トリガ抽出に失敗する Skill は 48 個から 13 個になった。
Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01WGWMnk8CcxhqYsJELtFwTN

@takemi-ohamatakemi-ohama left a comment

Copy link
Copy Markdown
ContributorAuthor

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

🤖 cross-review | round 1 | gemini | APPROVE

PR の目的と変更範囲が一貫しており、ドキュメントの再構成と計測ロジックの修正が正しく行われていることを確認しました。1点、今後のタスク (Task 0-7) に関連してトリガ抽出の正確性を保つための軽微な修正提案をインラインに残しています。

Comment threadplugins/ndf-shared/skills/skill-stats/scripts/skill-stats.py Outdated

@takemi-ohamatakemi-ohama left a comment

Copy link
Copy Markdown
ContributorAuthor

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

🤖 cross-review | round 1 | codex | REQUEST_CHANGES

--skill フィルタ時に hit 率が全件集計と食い違う不具合があるため、修正が必要です。

Comment threadplugins/ndf-shared/skills/skill-stats/scripts/skill-stats.py Outdated
PR #65 のレビュー指摘に対応。
- extract_triggers: description と when_to_use を結合せず個別にラベル
検索する。_TRIGGER_LABEL_RE は DOTALL のため、結合すると description
側のラベルが when_to_use 全体を巻き込み、無関係な引用文字列まで
トリガ語として拾っていた。
- aggregate_by_project: slash 境界の検出を --skill 絞り込み前の全 Skill 名
で行うよう all_skill_names 引数を追加。従来は絞り込み後の skills から
境界集合を導出していたため、--skill 指定時に対象外 Skill のスラッシュ
コマンドが境界にならず hits が過大計上されていた。
Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01WGWMnk8CcxhqYsJELtFwTN

@takemi-ohamatakemi-ohama left a comment

Copy link
Copy Markdown
ContributorAuthor

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

🤖 cross-review | round 2 | codex | APPROVE

追加の修正アクションはありません。

@takemi-ohamatakemi-ohama left a comment

Copy link
Copy Markdown
ContributorAuthor

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

🤖 cross-review | round 2 | gemini | APPROVE

Task 3-1 の対象ファイル一覧と Codex 向け仕様の記述に不一致があるため、実装漏れを防ぐための修正提案をインラインに残しました。

Comment threadissues/ndf-development-skills/07-tasks.md
Task 3-1 の対象ファイルに execute-goal の agents/openai.yaml が無い理由を
明記し、Task 0-8 の生成処理で出力されることを示した。
Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01WGWMnk8CcxhqYsJELtFwTN
@takemi-ohama

Copy link
Copy Markdown
ContributorAuthor

最終スイープ完了

残っていた open review thread 1 件に対応しました。

項目
対応件数1 件(修正 1 / resolve 1)
commitae44384
残 open thread0 件(全 3 スレッド resolved)

対応内容

issues/ndf-development-skills/07-tasks.md の Task 3-1 に、execute-goal/agents/openai.yaml が Task 0-8 の生成処理でビルド時に出力されるため対象ファイルへ含めない旨を追記しました。

検証

  • python3 scripts/check-markdown-links.py : Markdown local links are valid
  • push 時の pre-push hook : runtime plugin validation passed

@takemi-ohama
takemi-ohama merged commit 03f4b50 into mainAug 8, 2026
6 checks passed
@takemi-ohama
takemi-ohama deleted the docs/execute-goal-plan-and-skill-stats-fix branch August 14, 2026 03:57
Sign up for freeto join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant

@takemi-ohama