근본 원인 분석
근본 원인 분석(Root-Cause Analysis, RCA)은 인시던트가 왜 일어났을 수 있는지 설명합니다. FDAI는 분석 결과를 인용, 신뢰도, 티어, 근거 확인 상태를 갖춘 가설로 저장합니다. 분석 결과는 판단에 쓰는 근거일 뿐, 변경을 실행할 권한이 아닙니다.
신뢰 티어별 근본 원인 분석
섹션 제목: “신뢰 티어별 근본 원인 분석”| 티어 | 역할 | 흔히 쓰는 근거 |
|---|---|---|
| T0 | 결정론적으로 바로 드러나는 원인 | 일치한 룰, 위반된 통제 항목, 선언된 수정 방법 |
| T1 | 과거 인시던트 재사용 또는 결정론적 인과 사슬 | 해결된 인시던트, 순서가 있는 변경과 증상 이벤트, 리소스 의존 관계 |
| T2 | 새롭거나 모호한 사례에 대한 근거 기반 추론 | 검증된 관측 데이터, 이벤트, 룰, 지식 조각, 시나리오 근거 |
T1 재사용은 과거의 원인과 그때 쓴 작업이 지금 근거에도 들어맞는지 다시 확인합니다. T1 인과 사슬은 앞선 변경이 뿌리로 있어야 성립합니다. 증상만 모여 있는 구간에서는 원인을 지어내지 않고 판단을 보류합니다.
재확인에 실패하면 FDAI는 과거 작업을 그대로 되풀이하지 않습니다. 현재 근거로 구성한 T2 추론을 시도하거나 사람 검토로 넘깁니다. 어느 쪽이든 T1을 거절한 이유를 기록하므로, 유사도만 높은 결과가 낡은 범위나 바뀐 의존 관계, 이미 대체된 수정 방법을 가리는 일이 없습니다.
근거 확인 관문
섹션 제목: “근거 확인 관문”모든 인용은 추론기에 전달된 근거 묶음 안에서 나와야 합니다. 형식이 깨진 응답, 지어낸 인용, 뒷받침되지 않는 주장, 설정된 임계값에 못 미치는 신뢰도는 모두 판단 보류 가설이 되어 사람 검토로 넘어갑니다.
관측 데이터와 운영자가 쓴 문서는 신뢰할 수 없는 입력으로 다룹니다. 모델이 쓴 문장이 정책, what-if 결과, 결정론적 검증기를 덮어쓸 수는 없습니다.
신뢰도는 추론기가 스스로 매긴 점수가 아니라 검증기, 교차 검증, 근거 확인 신호에서 계산합니다. T2 품질 검토는 독립적인 교차 검증, 결정론적 검증, 그리고 제공된 근거 목록 안에서 확인되는 인용을 요구합니다. 채점 기준이나 교차 검증은 자격을 낮출 수만 있고, 근거가 없는 후보를 구제하지는 못합니다.
| 분석 결과 | 저장되는 형태 | 이어지는 경로 |
|---|---|---|
| 근거가 있고 설정 임계값 이상 | 인용이 붙은 가설 | 타입이 정의된 제안의 근거로 쓸 수 있음 |
| 대안이 여럿이라 모호함 | 신뢰도가 제한된 가설 | 사람 검토 |
| 오래된 T1 재사용 | 출처가 남은 거절 기록 | 현재 근거 기반 T2 또는 사람 검토 |
| 형식이 깨졌거나 지어낸 인용 | 판단 보류 가설 | 실행 없음, 감사와 검토만 |
인과 사슬
섹션 제목: “인과 사슬”구조화된 T1 사슬은 뿌리 이벤트 ID와 장애 이벤트 ID, 그리고 순서가 있는 연결 고리를 보존합니다. 각 고리에는 원인과 결과 참조, 시간 간격, 관계, 신뢰도를 기록합니다. 리소스 의존 데이터가 있으면 관련 있는 경로를 강화하고 무관한 연결은 차단합니다.
시간 순서만으로는 원인이 확정되지 않습니다. 여러 뿌리가 장애를 비슷하게 설명하면 신뢰도는 낮아지며, 최종 신뢰도는 가장 약한 연결 고리를 기준으로 정해집니다.
인과 주장의 강도
섹션 제목: “인과 주장의 강도”인용이 붙은 가설이라도 강도는 크게 다릅니다. FDAI는 그 강도를 명시적으로 등급화하므로, “배포가 원인인 것 같다”와 “배포를 되돌렸더니 오류가 멈췄다”가 같은 무게로 읽히지 않습니다.
| 등급 | 근거 기반 | 뒷받침할 수 있는 것 |
|---|---|---|
| 연관 | 관련 리소스에서 시간상 가까이 발생함 | 설명과 다음 조사 방향 결정 |
| 예측적 선행 | 후보가 결과에 반복적으로 선행하고 방향까지 예측함 | 관찰 모드 또는 명시적 승인이 있는 복구 제안 |
| 준실험적 | 처치받지 않은 비교 집단이 다르게 동작함 | 다른 안전 검사를 모두 통과했을 때 제한된 복구 자격 |
| 개입적 | 승인된 개입이 예측한 효과를 재현하거나 제거함 | 승격 근거. 그 자체로 권한이 되지는 않습니다 |
등급을 정직하게 유지하는 장치가 두 가지 있습니다. 사슬은 가장 약한 고리로 점수가 매겨지므로, 뒷받침되지 않는 고리 하나가 평균으로 희석되지 않고 주장 전체를 무너뜨립니다. 그리고 모든 지지 질의에는 반증 질의가 짝지어집니다. 가설이 배포 후에 오류가 늘었다고 말하면, FDAI는 변경되지 않은 호스트에서도 그 전에 같은 증가가 있었는지 함께 묻습니다. 반증이 없으면 지지가 아니라 알 수 없음으로 기록됩니다.
반증 근거가 도착하면 가설은 반증됨으로 표시되거나 더 낮은 등급으로 내려가고, 기존 내용을 고치는 대신 새 리비전이 기록됩니다. 이미 내려진 결정이 조용히 다시 쓰이지는 않지만, 등급이 정책이 요구하는 기준에 못 미치면 앞으로의 자율성은 낮아질 수 있습니다.
종결(종결)은 개입 이후의 최종 상태입니다. 확인됨, 반증됨, 결과 근거가 오래됐거나 불완전했던 경우 판단 불가, 관측된 영향이 승인 범위를 넘은 경우 안전하지 않음으로 나뉩니다. 종결은 가설에 대한 근거입니다. 실행 권한을 주지 않고 안전 검사를 건너뛰지 않으며, 안전하지 않은 영향과 함께 확인된 가설은 그 가설과 관련 작업을 모두 관찰 모드로 되돌립니다.
현재 상태: 가설 수명주기, 가장 약한 고리 기준 점수, 지지와 반증 연결, 시간 분석, 독립적인 종결 분류가 구현돼 있습니다. 컨트롤 루프는 인과를 온톨로지에 쓰는 대신 관찰 모드로 분석하고 감사하며, 배포 환경이 자체 시계열, 투영 게시자, 결과 프로바이더, 영수증 해석기를 연결합니다. 어떤 인과 결과도 실행 권한을 부여하지 않습니다.
분석 결과 읽기
섹션 제목: “분석 결과 읽기”다음 항목을 함께 확인하세요.
- 인시던트 ID와 상관관계 ID.
- 티어, 결과, 신뢰도, 근거 확인 상태.
- 인용과 근거의 최신성.
- 대안 가설이나 모호한 가설.
- 있다면 구조화된 인과 고리.
- 연결된 대응 계획, 결정, 모드, 롤백 참조.
사슬 데이터나 근거가 없으면 확인 불가로 표시합니다. 브라우저가 감사 기록보다 더 확신에 찬 설명을 지어내는 일은 없습니다.
다음 단계
섹션 제목: “다음 단계”| 알아볼 내용 | 문서 |
|---|---|
| 근거 범위를 제한하는 방법 | 분류와 조사 |
| 완화 조치를 제안하는 방법 | 대응 계획과 완화 |
| 판단을 감사하는 방법 | 감사 로그 읽기 |
| 상세 분석 계약 | 관측성과 감지 |