Skip to main content

증거 규율

대부분의 AI 실패는 극적인 환각이 아니라 ‘그럴듯한 중간 결과가 더 강한 결론으로 승격되는 것’입니다:
  • 명령이 성공으로 끝나면 에이전트가 시스템이 고쳐졌다고 말합니다;
  • 파일이 변경되면 에이전트가 기능이 작동한다고 말합니다;
  • 로컬 빌드가 통과하면 에이전트가 배포가 라이브라고 말합니다;
  • 검색 결과가 없으면 에이전트가 아무것도 없다고 말합니다;
  • 당신이 전제를 말하면 에이전트가 독립적으로 검증된 사실처럼 반복합니다.
Myrm의 증거 규율 스킬은 기본 에이전트(builtin-economy)가 만드는 모든 답변에 ‘주장-증거 계약’을 적용해 이런 실패를 드물게 만듭니다.

무엇을 하는가

스킬은 주장을 증거 유형별로 구분하고, 주장의 강도에 비례한 증명 의무를 적용합니다:

안전 계약

증거 라벨링을 넘어, 스킬은 에이전트가 조용히 거짓말하는 흔한 방식을 차단합니다:
  • 태스크에서 실제로 사용할 수 없었던 리소스에 접근했다고 주장하지 않음.
  • 계획이나 시도한 행동을 이미 일어난 행동으로 제시하지 않음.
  • 도구 오류, 빈 결과, 부분 동기화, 접근 불가 데이터를 성공적인 검증으로 재해석하지 않음.
  • 더 강한 증거를 얻기 위해 무관한 파괴적 행동을 하지 않음.
  • 부정적 주장(예: “아무것도 없다”)은 실제로 확인한 범위에 한정.**

과도한 신중함에 대한 내장 균형

증거 규율은 양날의 검이라 스킬은 반대 극단도 방지합니다:
  • UNKNOWN을 남용하지 않음. 증거를 합리적으로 얻을 수 있다면 검증하세요—주의를 검사 생략의 핑계로 쓰지 마세요.
  • 묻기 전에 먼저 확인. 증거를 직접 검사할 수 있다면, 사용자에게 정보 반복을 요청하기 전에 직접 확인하세요.
결과: 모르는 것에 정직하고, 검증 가능한 것은 적극 검증하며, 자신의 숙제를 사용자에게 떠넘기지 않는 에이전트.

사용 방법

제로 구성. 스킬은 기본적으로 내장 범용 에이전트(builtin-economy)에 바인딩되어 모든 대화에서 활성화됩니다—웹 세션, 예약 태스크, 채널 포함. 또한:
  • 설정 → 스킬에서 다른 사전 빌드 스킬과 함께 확인할 수 있습니다.
  • 생성한 모든 에이전트에 바인딩하거나 필요 없는 에이전트에서 제거할 수 있습니다.
  • 에이전트 맞춤 시스템 프롬프트에서 “중요한 주장은 답변 전에 증명하세요”처럼 더 강한 트리거를 줄 수 있습니다.

검증 및 계약 테스트

스킬의 행동 계약은 33개 아키텍처 계약 테스트로 보호됩니다—모든 조항의 존재와 frontmatter 버전 유효성을 조항별로 단언하여 스킬이 조용히 드리프트하거나 퇴화하지 않습니다. 전체 파이프라인(동기화 → 바인딩 → 가시성)은 mock 없이 통합 테스트로 검증됩니다.

관련