fix: architecture review corrections — CONTEXT.md trim and eval backtrack verification

- Remove Fleet, Symbolic oversight, and Data classification tiers from
  CONTEXT.md glossary: Fleet is Phase 2 only; the other two duplicate
  always-on governance.md content
- Drop now-stale governance test assertions for the removed terms
- write-skill eval: add section-ordering assertion; fix duplicate prompt
  across two deterministic tests
- write-eval eval: tighten plan-shown assertion to require per-case
  detail (query + type), not just "a list of test cases"

Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>
This commit is contained in:
2026-05-17 19:30:39 +00:00
parent 3dcd0f08fb
commit 2631142a0e
4 changed files with 6 additions and 31 deletions

View File

@@ -111,14 +111,6 @@ contains "HOTL" "$CONTEXT" \
&& pass "CONTEXT.md: HOTL term defined" \
|| fail "CONTEXT.md: HOTL definition missing"
contains "[Ss]ymbolic oversight" "$CONTEXT" \
&& pass "CONTEXT.md: Symbolic oversight defined" \
|| fail "CONTEXT.md: Symbolic oversight definition missing"
contains "[Dd]ata classification" "$CONTEXT" \
&& pass "CONTEXT.md: Data classification tiers defined" \
|| fail "CONTEXT.md: Data classification tiers missing"
contains "[Ss]ycophancy" "$CONTEXT" \
&& pass "CONTEXT.md: Sycophancy defined" \
|| fail "CONTEXT.md: Sycophancy definition missing"