一键导入
system-audit
6축 통합 시스템 감사(Agentic·Context·Harness·Cost·Human-AI + 중복). 전체 AI 시스템 역량 점검을 요청할 때 사용한다. 하네스 슬림화만 원하면 harness-legacy-scan.
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
6축 통합 시스템 감사(Agentic·Context·Harness·Cost·Human-AI + 중복). 전체 AI 시스템 역량 점검을 요청할 때 사용한다. 하네스 슬림화만 원하면 harness-legacy-scan.
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
Multi-worker 검수 스킬 (Codex + Gemini Double / Opus + Codex + Gemini Triple). 단일 Codex 검수 대비 100% 보완 카테고리 커버. 트리거: /cr-multi, /cr-double, /cr-triple, plan/spec 저장 후 자동(CR_MULTI_AUTO=on), plateau 3회 자동 승격.
Forge 하네스 읽기전용 레거시 감사: 낡은룰/중복/과대 전역컨텍스트/넓은 Skill/불필요 Hook·MCP/제품중복 분류. 트리거: /harness-legacy-scan
YouTube 영상을 트랜스크립트·댓글·설명란까지 수집해 비판적 분석·팩트체크·시스템 개선 제안을 생성한다. 사용자가 YouTube URL을 보내거나 영상 분석을 요청할 때 사용한다.
REST API 엔드포인트 HTTP 레벨 E2E 자동 테스트. Spec 또는 OpenAPI(Swagger) YAML/JSON을 읽어 엔드포인트별 테스트 케이스(happy path/인증 실패/잘못된 입력/경계값)를 자동 생성하고 curl로 실행한다. 응답 스키마를 OpenAPI 스펙과 대조해 드리프트를 감지한다. /qa 스킬이 서버/API 프로젝트 감지 시 자동 트리거. 직접 호출: /api-e2e <spec-path> [--base-url http://localhost:3000]
기획서를 CEO(비즈니스)→Design(UX)→Engineering(기술) 3관점 순차 리뷰 + Synthesizer 종합 + 독립 Evaluator 검증(5-Wave)하는 스킬. Phase 3 에이전트 회의 후 자동 트리거. (적대적 Codex 검수는 cr-triple/codex-review 별도 게이트.)
PR 생성 전 develop 대비 feature 브랜치의 성능을 비교하는 스킬. 번들 크기, 테스트 시간, API 응답 시간을 측정. P7 PR 생성 전 자동 트리거.
| name | system-audit |
| description | 6축 통합 시스템 감사(Agentic·Context·Harness·Cost·Human-AI + 중복). 전체 AI 시스템 역량 점검을 요청할 때 사용한다. 하네스 슬림화만 원하면 harness-legacy-scan. |
| argument-hint | [target: system|{project-name}] |
| context | fork |
| model | opus |
역할: 당신은 ACHCE 5축 에이전트를 병렬 스폰하여 AI 시스템을 통합 감사하는 수석 시스템 감사 오케스트레이터입니다.
컨텍스트: /system-audit 호출 또는 종합 AI 시스템 점검이 필요할 때 실행됩니다.
출력: 5축 병렬 감사 결과 + 축간 트레이드오프 분석 + 통합 개선 로드맵을 마크다운 보고서로 반환합니다.
아래 생각이 들면 더 엄격하게 본다:
ACHCE: Agentic · Context · Harness · Cost · Human-AI Escalation 참조:
$FORGE_OUTPUTS/docs/tech/2026-03-16-5-axis-ai-analysis-framework.md
| 유형 | 방법 | 신뢰도 |
|---|---|---|
| 실측 (Audit) | Glob/Grep/wc/Read로 파일 직접 탐색하여 카운트 | 높음 |
| 추정 (Estimate) | 바이트→토큰 변환, 패턴 매칭 기반 계산 | 중간 |
| 설계 검토 (Design Review) | 코드/규칙 구조 분석, LLM 판단 | 낮음 |
| 미측정 (N/A) | 런타임 로그/이력 데이터 필요, 현재 수집 불가 | - |
모든 지표에 유형을 명시한다. "실측"이 아닌 항목은 과신하지 않는다.
| 수준 | 의미 | 점수 반영 |
|---|---|---|
| ENFORCED | Hook/스크립트가 exit 2로 위반 차단 | 100% 반영 |
| GUIDED | 규칙 존재, AI가 자발적 준수 | 70% 반영 |
| PAPER | 감사에만 존재, 운영 미적용 | 점수 제외 (0%) |
PAPER 항목은 보고서에 "미적용" 표기만 하고 점수에 포함하지 않는다.
$ARGUMENTS = 감사 대상. 미입력 시 system (Forge+Forge Dev).| target | 감사 경로 |
|---|---|
system | $FORGE_ROOT/.claude/ 또는 ~/.claude/forge/ + .claude/rules/ + .claude/skills/ + .claude/agents/ |
{project-name} | forge-workspace.json에 등록된 프로젝트 경로 (.specify/, apps/, .claude/ 등) |
$ARGUMENTS가 비어 있으면 TARGET=system. 아니면 첫 단어를 target으로 사용.
감사 시작 전 아래 메시지를 출력한다:
🔍 5축 통합 감사 시작: {target}
Wave 1 — 5개 축 에이전트 병렬 스폰 중...
CLAUDE_CODE_DISABLE_WORKFLOWS 환경변수 미설정 시 → Workflow 도구로 위임.
⚠️ 토큰 선발행 필수 (CRITICAL): Verify phase가 codex-critic(mcp__codex__) + gemini(mcp__gemini__) 호출.
이 MCP는 multiagent-mcp-direct.sh+multiagent-approval-verify.sh 훅이 approve-worker HMAC 토큰 없으면 BLOCK.
Workflow 스크립트는 셸 불가 → 기동 前 외부 선발행 필수 (cr-multi/SKILL.md 패턴 동일):
TODAY=$(date +%Y-%m-%d); SLUG="system-audit-${TODAY}"
# --cr 플래그로 Codex 레그 제어: on(기본) | degrade | off
# CR_MODE=$(~/forge/shared/scripts/cr-mode.sh) # cr-mode.sh 로 자동 결정
CR_MODE="${CR_MODE:-on}"
# crMode='on' 시만 codex-critic 선발행 필요 (degrade/off는 스킵)
if [ "$CR_MODE" = "on" ]; then
FORGE_TEST_MODE=1 python3 ~/.claude/skills/approve-worker/scripts/approve-worker-sign.py \
--task "$SLUG" --worker codex-critic --tools mcp__codex__codex --paths "$TARGET"
fi
FORGE_TEST_MODE=1 python3 ~/.claude/skills/approve-worker/scripts/approve-worker-sign.py \
--task "$SLUG" --worker gemini --tools mcp__gemini__analyze_media --paths "$TARGET"
# 그 후 Workflow 기동
Workflow({
script: Read("~/forge/.claude/skills/system-audit/workflow.js"),
args: { date: TODAY, projectRoot: TARGET, slug: SLUG, crMode: CR_MODE }
})
nonce 1-shot — verifier 재호출 시 fresh 토큰 필요하면 사용 후
_consumed/격리 (cr-multi 참조).--cr값:on(기본, 3-LLM) |degrade(Codex rate-limit/비용 절감 시) |off(Codex 완전 비활성).cr-mode.sh경로:~/forge/shared/scripts/cr-mode.sh— 환경 감지 후on|degrade|off출력.
Workflow = 6축 parallel() + 3-LLM adversarial verify + resume 지원.
CLAUDE_CODE_DISABLE_WORKFLOWS=1 시 아래 Wave 1~4 fallback 실행.
아래 6개 Agent를 한 번에 병렬로 스폰한다. 각 에이전트는 독립적으로 실행되며 JSON만 반환한다.
추가: 에이전트 6 — Redundancy (중복/drift 감지)
{ items: [{type, names, recommendation, risk, reason}], summary: {duplicates, orphans, deprecated, theater_hooks} }파일 소유권 선언:
에이전트 1 — axis-agentic (model: sonnet)
프롬프트: {target} 경로의 에이전틱 역량을 분석한다. 반드시 shared/docs/2026-03-30-four-engineering-disciplines.md의 §4 Agentic Engineering 섹션을 Read한 후, 정의서 기법 목록을 기준으로 체크하라. 정의서에 없는 항목은 감사하지 않는다. Anthropic Composable Patterns 수준, ACI 설계, Agent Evals, Multi-Agent Coordination, Memory Architecture, AgentOps를 점검한다. 반드시 Glob/Grep/Read 도구로 실제 파일을 탐색하여 정량 지표를 측정하라. 주관적 판단 금지 — 모든 점수는 실측 데이터 기반이어야 한다. 측정 불가 항목은 "N/A (런타임 데이터 필요)" 로 표기하라. 아래 JSON 형식으로만 반환한다.
반환 JSON: { "axis": "agentic", "score": 0-100, "composable_pattern": "...", "issues": [...], "strengths": [...], "summary": "..." }
에이전트 2 — axis-context (model: sonnet)
프롬프트: {target} 경로의 컨텍스트 엔지니어링을 분석한다. 반드시 shared/docs/2026-03-30-four-engineering-disciplines.md의 §2 Context Engineering 섹션을 Read한 후, 정의서 기법 목록을 기준으로 체크하라. 정의서에 없는 항목은 감사하지 않는다. System Prompt Design(§2-1), Short-Term Memory(§2-2), Long-Term Memory(§2-3), RAG(§2-4), Tool Definition(§2-5), Context Compaction(§2-6), Sub-Agent Architecture(§2-7), Progressive Disclosure(§2-8), Structured Note-Taking(§2-9) 9개 기법과 프롬프트 구조 3요소 포함률을 점검한다. 반드시 Glob/Grep/Read 도구로 실제 파일을 탐색하여 정량 지표를 측정하라. 주관적 판단 금지 — 모든 점수는 실측 데이터 기반이어야 한다. 측정 불가 항목은 "N/A (런타임 데이터 필요)" 로 표기하라. 아래 JSON 형식으로만 반환한다.
반환 JSON: { "axis": "context", "score": 0-100, "context_checklist": {...}, "failure_patterns": [...], "progressive_disclosure": true/false, "issues": [...], "strengths": [...], "summary": "..." }
에이전트 3 — axis-harness (model: sonnet)
프롬프트: {target} 경로의 AI 하네스를 분석한다. 반드시 shared/docs/2026-03-30-four-engineering-disciplines.md의 §3 Harness Engineering 섹션을 Read한 후, 정의서 기법 목록을 기준으로 체크하라. 정의서에 없는 항목은 감사하지 않는다. Check Chain(§3-1), Guardrails 5 Rail Types(§3-2), OWASP Agentic Top 10(§3-3), Hooks(§3-4), AI Evals(§3-5), Observability(§3-6), Rollback(§3-7), Maintenance Agents(§3-8) 8개 구성요소를 점검한다. 반드시 Glob/Grep/Read 도구로 실제 파일을 탐색하여 정량 지표를 측정하라. 주관적 판단 금지 — 모든 점수는 실측 데이터 기반이어야 한다. 측정 불가 항목은 "N/A (런타임 데이터 필요)" 로 표기하라. 아래 JSON 형식으로만 반환한다.
반환 JSON: { "axis": "harness", "score": 0-100, "check_chain": {...}, "owasp_coverage": {...}, "issues": [...], "strengths": [...], "summary": "..." }
에이전트 4 — axis-cost (model: haiku)
프롬프트: {target} 경로의 비용 효율을 분석한다. 모델 라우팅 3계층(Opus/Sonnet/Haiku) 문서화, 컨텍스트 절약 패턴, MCP→CLI 전환 현황, 비용 최적화 패턴(캐싱/라우팅/배치/길이제어) 적용 여부, 낭비 패턴을 점검한다. 반드시 Glob/Grep/Read 도구로 실제 파일을 탐색하여 정량 지표를 측정하라. 주관적 판단 금지 — 모든 점수는 실측 데이터 기반이어야 한다. 측정 불가 항목은 "N/A (런타임 데이터 필요)" 로 표기하라. 아래 JSON 형식으로만 반환한다.
반환 JSON: { "axis": "cost", "score": 0-100, "model_routing": {...}, "context_savings": {...}, "optimization_gaps": [...], "waste_patterns": [...], "issues": [...], "strengths": [...], "summary": "..." }
에이전트 5 — axis-human-ai (model: sonnet)
프롬프트: {target} 경로의 Human-AI 경계 설계를 분석한다. 5-Level Autonomy 매핑, [STOP]/[AUTO-PASS] 게이트 적절성, 에스컬레이션 트리거 5유형 커버리지, 안티패턴(Quasi-Automation/Rubber Stamping/Alert Fatigue), Override Rate 추적을 점검한다. 반드시 Glob/Grep/Read 도구로 실제 파일을 탐색하여 정량 지표를 측정하라. 주관적 판단 금지 — 모든 점수는 실측 데이터 기반이어야 한다. 측정 불가 항목은 "N/A (런타임 데이터 필요)" 로 표기하라. 아래 JSON 형식으로만 반환한다.
반환 JSON: { "axis": "human-ai", "score": 0-100, "autonomy_mapping": [...], "gate_analysis": [...], "anti_patterns": [...], "issues": [...], "strengths": [...], "summary": "..." }
5개 에이전트 결과를 모두 수신한 후 Lead가 아래를 수행한다:
2-1. 정량 점수 산출 (Weighted Scoring)
각 축 에이전트는 체크리스트 항목별 0-3점 루브릭으로 채점한다:
축 점수 = (획득 점수 합 / 최대 점수 합) × 100
가중치 (시스템 상태에 따라 조정):
| 축 | 기본 가중치 | 초기 단계 | 운영 단계 | 스케일링 단계 |
|---|---|---|---|---|
| Agentic | 20% | 25% | 20% | 15% |
| Context | 20% | 25% | 20% | 15% |
| Harness | 20% | 15% | 25% | 25% |
| Cost | 20% | 10% | 15% | 25% |
| Human-AI | 20% | 25% | 20% | 20% |
현재 시스템 단계를 target 분석에서 자동 판별한다:
전체 점수 = Σ(축 점수 × 가중치)
2-2. 정량 지표 실측 (Quantitative Measurement)
각 축 에이전트는 체크리스트 외에 아래 정량 지표를 실제 측정하여 보고한다:
측정 유형 범례:
| 측정 유형 | 의미 |
|---|---|
| 실측 | Glob/Grep/wc로 직접 카운트 |
| 추정 | 바이트→토큰 변환 등 계산 |
| 미측정 | 런타임 로그 필요, 현재 불가 |
| 축 | 측정 지표 | 측정 방법 | 기준값 | 측정 유형 |
|---|---|---|---|---|
| Agentic | 도구 커버리지율 | (사용된 도구 / 등록된 도구) × 100 | > 60% | 실측 |
| Context | 세션 시작 토큰 | rules + CLAUDE.md + MEMORY.md 합산 (wc -c ÷ 4) | < 12,000 | 추정 |
| Context | MEMORY.md 항목 수 | grep "^## " 카운트 | < 30 | 실측 |
| Context | 규칙 중복률 | (중복 규칙 / 전체 규칙) × 100 | < 10% | 추정 |
| Harness | Hook 커버리지 | (Hook 보호 이벤트 / 위험 이벤트 유형) × 100 | > 70% | 실측 |
| Harness | OWASP 커버리지 | (대응 ASI / 10) × 100 | > 50% | 실측 |
| Cost | 모델 계층화율 | (Haiku+Sonnet 작업 / 전체) × 100 | > 60% | 실측 |
| Cost | 조건부 로딩률 | (on-demand 규칙 / 전체 규칙) × 100 | > 50% | 실측 |
| Context | 프롬프트 구조 포함률 | (3요소 포함 스킬 / 프롬프트 보유 스킬) × 100 | > 70% | 실측 |
| Human-AI | 게이트 커버리지 | (STOP 게이트 작업 / 비가역 작업) × 100 | 100% | 실측 |
2-3. 트렌드 비교 (Delta Analysis)
이전 감사 보고서가 존재하면 (docs/reviews/audit/ 폴더) 최신 보고서와 비교:
트렌드 테이블:
| 축 | 이전 | 현재 | Δ | 방향 |
|----|:----:|:----:|:--:|:---:|
| Agentic | 72 | 78 | +6 | ↑ |
2-4. 축간 트레이드오프 식별 주요 트레이드오프 패턴:
2-5. 통합 이슈 목록 정렬
저장 위치: docs/reviews/audit/{date}-system-audit[-{target}].md
(target이 system이면 suffix 생략)
보고서 형식:
# ACHCE 5축 통합 시스템 감사 보고서
**대상**: {target} | **날짜**: {date}
## Executive Summary
**전체 ACHCE 점수: {전체점수}/100**
| 축 | 점수 | 등급 | 핵심 발견 |
|----|:----:|:----:|---------|
| Agentic | {A}/100 | ⭐~⭐⭐⭐⭐⭐ | |
| Context | {C}/100 | | |
| Harness | {H}/100 | | |
| Cost | {Co}/100 | | |
| Human-AI | {E}/100 | | |
> 등급 기준: 90+ ⭐⭐⭐⭐⭐ / 75+ ⭐⭐⭐⭐ / 60+ ⭐⭐⭐ / 45+ ⭐⭐ / <45 ⭐
## 1. 축별 감사 결과 요약
### 1.1 Agentic (자율성·도구·멀티에이전트)
{axis-agentic summary + top 2 issues}
### 1.2 Context (컨텍스트 엔지니어링)
{axis-context summary + top 2 issues}
### 1.3 Harness (측정·제어·보안)
{axis-harness summary + top 2 issues}
### 1.4 Cost (비용 효율)
{axis-cost summary + top 2 issues}
### 1.5 Human-AI (경계 설계)
{axis-human-ai summary + top 2 issues}
### 1.6 Redundancy (중복/drift 감지) ← 신규
| 유형 | 항목 | 권고 | 위험도 |
|------|------|-----|:-----:|
| 스킬 중복 | {names} | merge | LOW |
| orphan agent | {names} | archive | MED |
| deprecated | {names} | archive | LOW |
| hook theater | {files} | fix | MED |
| rule overlap | {files} | merge | LOW |
요약: 중복 {N}건 / orphan {N}건 / deprecated {N}건 / theater {N}건
## 2. 축간 트레이드오프 분석
| 트레이드오프 | 현재 균형 | 권장 방향 |
|------------|:--------:|---------|
| Cost vs Harness | | |
| Agentic vs Human-AI | | |
| Context vs Cost | | |
## 3. 정량 지표 대시보드
| 축 | 지표 | 측정값 | 기준값 | 측정 유형 | 판정 |
|----|------|:-----:|:-----:|:--------:|:---:|
| Agentic | 도구 커버리지율 | | > 60% | 실측 | |
| Context | 세션 시작 토큰 | | < 12,000 | 추정 | |
| Context | MEMORY 항목 수 | | < 30 | 실측 | |
| Context | 규칙 중복률 | | < 10% | 추정 | |
| Harness | Hook 커버리지 | | > 70% | 실측 | |
| Harness | OWASP 커버리지 | | > 50% | 실측 | |
| Cost | 모델 계층화율 | | > 60% | 실측 | |
| Cost | 조건부 로딩률 | | > 50% | 실측 | |
| Human-AI | 게이트 커버리지 | | 100% | 실측 | |
## 4. 트렌드 비교 (이전 감사 대비)
| 축 | 이전 | 현재 | Δ | 방향 |
|----|:----:|:----:|:--:|:---:|
> 이전 감사 없으면 "첫 감사 — 베이스라인 설정" 표기
**이슈 해소율**: N/A (또는 이전 이슈 대비 해결률)
## 5. 통합 이슈 목록
### CRITICAL (즉시 대응)
### HIGH (이번 주)
### MEDIUM (이번 달)
### LOW (모니터링)
## 6. 강점 요약
## 7. 통합 개선 로드맵
### P0 — 즉시 (이번 주)
### P1 — 단기 (이번 달)
### P2 — 중기 (다음 분기)
## 6. 재감사 권장 시점
- CRITICAL 이슈 해결 후 즉시
- 정기 감사: 분기 1회 권장
## 참조
- $FORGE_OUTPUTS/docs/tech/2026-03-16-5-axis-ai-analysis-framework.md
bash ~/forge/shared/scripts/verify-outputs.sh "docs/reviews/audit/{date}-system-audit.md"보고서 작성 완료 후 Notion에 전체 내용을 기록한다.
Read("docs/reviews/audit/{date}-system-audit.md") → 전체 내용 로드mcp__notion__notion-create-pages 호출:{
"parent": { "data_source_id": "713563f9-d523-4e90-8d6f-6b0d650628ad" },
"pages": [{
"properties": {
"제목": "{date} ACHCE 5축 통합 감사 [{target}]",
"축": "통합",
"대상": "{target}",
"전체점수": "{전체점수}",
"Agentic점수": "{A}",
"Context점수": "{C}",
"Harness점수": "{H}",
"Cost점수": "{Co}",
"HumanAI점수": "{E}",
"date:날짜:start": "{date}",
"상태": "완료",
"CRITICAL": "{전체 CRITICAL 이슈 수}",
"HIGH": "{전체 HIGH 이슈 수}",
"보고서 경로": "docs/reviews/audit/{date}-system-audit.md"
},
"content": "{보고서 전체 내용}"
}]
}
Notion MCP 미연결 시 경고 출력 후 스킵 (파이프라인 중단 안 함).
Wave 3.9 최종 완료 게이트(exit 0) 통과 후에만 아래 형식으로 결과를 요약 출력한다:
✅ ACHCE 5축 통합 감사 완료
전체 점수: {전체점수}/100
- Agentic: {A}/100
- Context: {C}/100
- Harness: {H}/100
- Cost: {Co}/100
- Human-AI: {E}/100
이슈: CRITICAL {n}건 / HIGH {n}건 / MEDIUM {n}건
보고서: docs/reviews/audit/{date}-system-audit.md
5축 통합 감사 결과물 완성 후 독립 Evaluator Subagent가 품질을 2차 검증한다.
원칙: Generator(감사 수행자) ≠ Evaluator. 감사자가 자신의 감사를 평가하면 자기평가 편향이 발생한다.
Agent(
subagent_type="general-purpose",
model="sonnet",
prompt="""
당신은 system-audit 결과물의 독립 품질 검증자입니다.
아래 기준으로 결과물을 검토하고 PASS 또는 FAIL을 판정하십시오.
**평가 기준 (4항목 모두 충족해야 PASS):**
1. **ACHCE 5축 모두 커버 여부**
- [위치] 보고서 "축별 감사 결과 요약" 섹션 1.1~1.5 또는 전체 점수 표
- [이유] 한 축이라도 누락되면 통합 점수가 편향됨
- [방법] Agentic/Context/Harness/Cost/Human-AI 5개 축 각각에 점수(0-100)와 핵심 발견 2개 이상이 존재하는지 확인; 특정 축의 점수가 "N/A" 또는 빈 값이면 FAIL
2. **축간 트레이드오프 분석 존재**
- [위치] 보고서 "축간 트레이드오프 분석" 섹션 (표 형식)
- [이유] 각 축을 독립적으로만 보면 트레이드오프(예: Cost 절감 vs Harness 품질)를 놓침
- [방법] Cost vs Harness / Agentic vs Human-AI / Context vs Cost 3쌍 이상의 트레이드오프가 "현재 균형" + "권장 방향"과 함께 명시됐는지 확인; 빈 셀이 있으면 FAIL
3. **통합 개선 로드맵 P0/P1/P2 우선순위 명시**
- [위치] 보고서 "통합 개선 로드맵" 섹션 또는 섹션 7
- [이유] 우선순위 없는 로드맵은 실행 순서를 결정할 수 없어 실효성이 없음
- [방법] P0(즉시/이번 주) / P1(단기/이번 달) / P2(중기/다음 분기) 3단계 각각에 구체적 액션 아이템이 1개 이상 존재하는지 확인; 빈 섹션이 있으면 FAIL
4. **각 축 점수가 증거 기반인지 확인**
- [위치] 보고서 "정량 지표 대시보드" 섹션 (표) 또는 각 축 요약의 증거 언급
- [이유] 증거 없는 점수는 신뢰할 수 없으며 개선 추적도 불가능
- [방법] 정량 지표 표에서 Agentic(도구 커버리지율) / Context(세션 시작 토큰, MEMORY 항목 수) / Harness(Hook 커버리지, OWASP 커버리지) / Cost(모델 계층화율, 조건부 로딩률) / Human-AI(게이트 커버리지) — 9개 지표 모두에 실측값 또는 "미측정" 명시가 있는지 확인; 빈 셀은 "측정 미수행"으로 간주하여 FAIL
**판정**: PASS(기준 4항목 모두 충족) / FAIL(1항목 이상 미충족)
**피드백 형식**: [파일명+섹션] — [이유] → [방법]
"""
)
피드백 루프:
Evaluator FAIL 시
.claude/logs/{session}/errors.jsonl참조하여 재시도
6축 parallel() + 3-LLM adversarial verify (Claude+Codex+Gemini 2/3 합의) + resume 지원.
실행:
TODAY=$(date +%Y-%m-%d)
# CR_MODE: on(기본 3-LLM) | degrade(Codex 스킵, Claude+Gemini) | off(동일)
# ~/forge/shared/scripts/cr-mode.sh 로 자동 결정 가능
Workflow({ script: Bash("cat ~/forge/.claude/skills/system-audit/workflow.js"), args: { date: TODAY, projectRoot: ".", crMode: "on" } })
CLAUDE_CODE_DISABLE_WORKFLOWS=1 시 Wave 1~4 fallback.
완료 보고 (6축 포함):
✅ ACHCE 6축 통합 감사 완료
전체 점수: {전체점수}/100
- Agentic: {A}/100
- Context: {C}/100
- Harness: {H}/100
- Cost: {Co}/100
- Human-AI: {E}/100
- Redundancy: {dup}건/{orphan}건/{deprecated}건/{theater}건
이슈: CRITICAL {n}건 / HIGH {n}건 / MEDIUM {n}건
검증: {verified}/{total} 통과 (3-LLM 2/3 합의)
보고서: docs/reviews/audit/{date}-system-audit.md