KPI 스택이 구조적으로 이러한 점을 간과하도록 설계된 이유는 무엇일까요?
성과 측정 관련 문헌에는 아직 완전히 해결되지 않은 문제가 있는데, 그 문제는 프레임워크의 부족에 있는 것이 아닙니다. 드러커(1954)가 조직에는 균형 잡힌 성과 측정 지표가 필요하다고 주장한 이후, 이 Field 회계, 운영 관리, 심리학, 공공 거버넌스 등 다양한 영역으로 확장되었으며, 확장된 모든 방향에서 더 많은 프레임워크, 지표, 그리고 정교한 보고 체계를 만들어냈습니다. 하지만 조직이 의도한 바와 실제로 달성한 바 사이의 차이를 감지하는 메커니즘은 일관되게 제시하지 못했습니다.
이는 단순한 실수가 아닙니다. 성과 측정 체계가 만들어진 목적에서 비롯된 구조적인 결과입니다.
사슬 길이 문제
Bititci 등(1997)은 전략적 의도가 Field 활동으로 확실하게 이어지지 않는다는 일관된 현상인 '정렬 격차'를 지적했습니다. Field 이 전략적 결정에서 멀어질수록 신호는 더욱 약화됩니다. 본사에서 설정된 목표는 부서 목표가 되고, 부서 목표는 팀 과제가 되고, 팀 과제는 개개인의 일상 업무가 됩니다. 이러한 각 단계에서 무언가가 손실됩니다. Field 의 측정 결과가 보고된 수치로 다시 같은 계층을 거쳐 올라갈 때쯤이면, 원래의 전략적 의도와 실제 운영 현실은 같은 언어를 사용하더라도 서로 다른 내용을 나타내는 경우가 많습니다.
가렌고(2005)는 중소기업의 맥락에서 동일한 관찰 결과를 더욱 날카롭게 지적했습니다. 서비스 공급망이 긴 환경에서는 중요한 측정 지표가 시작 단계에서부터 소멸한다는 것입니다. 측정 체계는 전략적 의도에서 Field 현실로, 그리고 다시 전략적 의도로 돌아오는 과정에서 살아남지 못합니다. 보고되는 내용은 공급망이 감당할 수 있는 범위 내에 있는 것인데, 이는 Field 에서 실제로 생산되는 내용과는 다릅니다.
이는 구조적인 문제이지, 인력 문제가 아닙니다. 더 성실한 보고자를 고용하거나, 더 정교한 대시보드를 설치하거나, 검토 빈도를 늘린다고 해서 나아지는 문제가 아닙니다.
측정 아키텍처를 보고서가 수집되는 지점이 아니라 신호가 실제로 생성되는 지점, 즉 Field 에서 작동하도록 재설계할 때 비로소 상황이 개선됩니다.
누락된 조건
반증 가능성 조건 4, 즉 성과 측정 프레임워크에서 공식화된 자연적 공정 한계가 부재한 것은 공정 변동이 명백해질 때까지 눈에 띄지 않게 유지되도록 하는 특정한 구조적 공백입니다(Skogvold, 2026). Shewhart(1931)의 공통 원인 변동과 특수 원인 변동에 대한 원래의 구분을 바탕으로 Wheeler와 Chambers(1992)는 공정 한계가 지정되지 않은 측정값은 신호가 아니라 숫자일 뿐임을 보여주었습니다. 이 숫자는 특정 시점의 관찰값으로는 정확할 수 있지만, 관찰자에게 해당 숫자를 생성하는 공정이 관리 상태에 있는지, 변동 중인지, 아니면 이미 고장 났는지에 대해 아무것도 알려주지 않습니다.
균형성과표(Balanced Scorecard), OKR, 그리고 LogFrame 기반 모니터링 시스템은 이러한 격차를 해소하기 위해 만들어진 것이 아닙니다. 이러한 시스템들은 목표 대비 진행 상황을 추적하기 위해 만들어졌는데, 이는 전혀 다른 차원의 작업입니다. 목표 대비 진행 상황 추적은 측정 시점에서 조직이 목표를 향해 제대로 나아가고 있는지 여부만 알려줍니다. 하지만 목표 자체가 이미 바뀌었는지, 혹은 의존하는 측정 지표가 실제 상황을 제대로 포착하고 있는지, 아니면 단순히 요약의 요약에 그친 것인지는 알려주지 않습니다.
그 결과, 표준 KPI 체계에 의존하는 모든 부문과 모든 거버넌스 시스템에서 일관된 패턴이 나타납니다. 전략적 의도와 Field 현실 간의 격차가 측정치 하나하나, 보고서 하나하나를 통해 조용히 벌어지다가, 더 이상 덮어둘 수 없을 정도로 커지면, 대개 위기, 조사 또는 등급 하락의 형태로 한꺼번에 드러나게 됩니다.
같은 주에, 세 개의 기관
2026년 3분기에만 세 개의 독립적인 기관이 각기 다른 경로를 통해 동일한 진단을 내렸습니다. 한 주요 신용평가기관은 미해결된 인프라 조사, 즉 보고된 내용과 현장 검증 내용 간의 차이를 지적하며 동남아시아 은행 부문의 전망을 하향 조정했습니다. 한 대륙 개발 금융 기관은 자사가 추적 중인 인프라 위기가 자금 부족이 아니라 실행 부족 때문이라고 공개적으로 밝혔습니다. 한 글로벌 금융 데이터 제공업체는 한 국가 정부가 부패 척결을 원인으로 들며 자체 성장률 전망치를 하향 조정했다고 보고했는데, 이 부패 척결의 존재는 보고 체계가 상황을 제때 감지하지 못해 이를 막지 못했음을 확인시켜 주었습니다.
세 개의 기관. 세 가지 임무. 결과는 동일했다. 기존 측정 체계는 탐지가 아닌 확인을 위해 설계되었다는 것이다.
그것은 격차가 명백해질 때까지 충실하게 확인시켜 주었습니다.
무엇이 더 일찍 그것을 잡았을까요?
기준선. 자연적 과정 한계. 사전 신호 임계값 - 이는 약속을 하는 당사자가 약속 시점에 자발적으로 설정하는 것으로, 통계적 한계가 발동되는 수준보다 낮습니다. 이러한 세 가지 구조적 추가 사항은 성과 약속을 보고 도구에서 신호 도구로 전환하는 데 필수적입니다.
이러한 방안들은 새로운 기술을 필요로 하지 않습니다. 예산 승인도 필요하지 않습니다. 필요한 것은 시행 시점에 어떤 수준의 증거가 진정한 경고로 간주될 것인지에 대한 합의입니다. 경고 기간이 이미 지난 후에 무엇이 잘못되었는지 사후 조사하는 것이 아니라, 진정한 경고로 간주되어야 한다는 것입니다.
대부분의 KPI 스택은 이 세 가지 요소를 모두 생략합니다. 이는 우연이 아니라 의도적인 설계입니다. KPI 스택은 다른 목적을 위해 만들어졌으며, 그 목적은 확실하게 수행합니다. 문제는 조직이 실제로 필요로 하는 목적이 확인인지, 아니면 너무 늦은 후에야 차이점을 알아차릴 여유가 있는지 여부입니다.
Bititci, US et al. (1997). 통합 성능 측정 시스템.
드러커, PF (1954). 경영의 실제.
Garengo, P. (2005). 중소기업의 성과 측정 시스템.
Shewhart, WA (1931). 제조 제품의 품질에 대한 경제적 관리.
Skogvold, T. (2026). 증거 기반 리더십의 기초.
Wheeler, DJ 및 Chambers, DS (1992). 통계적 공정 관리의 이해.
MetriqOne · 잡음 없는 증거 · metriq.one