증거 규율
대부분의 AI 실패는 극적인 환각이 아니라 ‘그럴듯한 중간 결과가 더 강한 결론으로 승격되는 것’입니다:- 명령이 성공으로 끝나면 에이전트가 시스템이 고쳐졌다고 말합니다;
- 파일이 변경되면 에이전트가 기능이 작동한다고 말합니다;
- 로컬 빌드가 통과하면 에이전트가 배포가 라이브라고 말합니다;
- 검색 결과가 없으면 에이전트가 아무것도 없다고 말합니다;
- 당신이 전제를 말하면 에이전트가 독립적으로 검증된 사실처럼 반복합니다.
builtin-economy)가 만드는 모든 답변에 ‘주장-증거 계약’을 적용해 이런 실패를 드물게 만듭니다.
무엇을 하는가
스킬은 주장을 증거 유형별로 구분하고, 주장의 강도에 비례한 증명 의무를 적용합니다:안전 계약
증거 라벨링을 넘어, 스킬은 에이전트가 조용히 거짓말하는 흔한 방식을 차단합니다:- 태스크에서 실제로 사용할 수 없었던 리소스에 접근했다고 주장하지 않음.
- 계획이나 시도한 행동을 이미 일어난 행동으로 제시하지 않음.
- 도구 오류, 빈 결과, 부분 동기화, 접근 불가 데이터를 성공적인 검증으로 재해석하지 않음.
- 더 강한 증거를 얻기 위해 무관한 파괴적 행동을 하지 않음.
- 부정적 주장(예: “아무것도 없다”)은 실제로 확인한 범위에 한정.**
과도한 신중함에 대한 내장 균형
증거 규율은 양날의 검이라 스킬은 반대 극단도 방지합니다:- UNKNOWN을 남용하지 않음. 증거를 합리적으로 얻을 수 있다면 검증하세요—주의를 검사 생략의 핑계로 쓰지 마세요.
- 묻기 전에 먼저 확인. 증거를 직접 검사할 수 있다면, 사용자에게 정보 반복을 요청하기 전에 직접 확인하세요.
사용 방법
제로 구성. 스킬은 기본적으로 내장 범용 에이전트(builtin-economy)에 바인딩되어 모든 대화에서 활성화됩니다—웹 세션, 예약 태스크, 채널 포함.
또한:
- 설정 → 스킬에서 다른 사전 빌드 스킬과 함께 확인할 수 있습니다.
- 생성한 모든 에이전트에 바인딩하거나 필요 없는 에이전트에서 제거할 수 있습니다.
- 에이전트 맞춤 시스템 프롬프트에서 “중요한 주장은 답변 전에 증명하세요”처럼 더 강한 트리거를 줄 수 있습니다.
검증 및 계약 테스트
스킬의 행동 계약은 33개 아키텍처 계약 테스트로 보호됩니다—모든 조항의 존재와 frontmatter 버전 유효성을 조항별로 단언하여 스킬이 조용히 드리프트하거나 퇴화하지 않습니다. 전체 파이프라인(동기화 → 바인딩 → 가시성)은 mock 없이 통합 테스트로 검증됩니다.관련
- 스킬 발견 및 등록 미러 — 사전 빌드 스킬 설치 및 관리
- 스킬 진화 — 설치 후 스킬 자동 개선
- 레이어드 검증 플레이북 — 표현 계층 규율 위의 아키텍처 수준 검증