고객 만족도는 오르는데 왜 이탈은 줄지 않을까요?
핵심은 서비스 품질이 절대적인 성능이 아니라 기대와 인식의 차이로 결정된다는 점입니다. 1988년 파라수라만(A. Parasuraman), 자이탐(V. Zeithaml), 베리(L. Berry)가 제시한 SERVQUAL(서브퀄)은 서비스 품질을 신뢰성·응답성·확신성·공감성·유형성 5개 차원 22개 문항으로 측정합니다. 같은 응대를 받아도 기대가 높았던 고객은 불만을 느끼고 기대가 낮았던 고객은 만족합니다. 2026년 한국서비스품질지수(KS-SQI) 일반 서비스업 평균이 77.3점으로 역대 최고를 기록했는데도 체감 불만이 줄지 않는 현상은 이 구조에서 설명됩니다. 만족도 점수를 올리는일과 기대와의 간격을 좁히는 일은 다른 작업입니다.
목차
- 고객 만족도는 오르는데 왜 이탈은 줄지 않을까요?
- 같은 응대에 정반대 평가가 나온 설문 한 건
- 만족도 점수만 보는 조직에서 벌어지는 일
- SERVQUAL이란 무엇인가: 5개 차원과 22문항
- 갭 모델: 품질은 다섯 군데에서 새어 나갑니다
- SERVQUAL 점수를 실제로 계산하는 방법
- SERVQUAL의 한계와 SERVPERF 논쟁
- 현장에 적용하는 네 단계
- FAQ
- 같이 읽으면 좋은 것들
기대라는 변수를 빼면 품질이 설명되지 않습니다
서비스는 물건과 다릅니다. 만들어 놓고 검사할 수 없습니다. 제공되는 순간에 소비되고 응대하는 사람과 시간대에 따라 결과가 달라집니다. 그래서 제조업의 품질 개념을 그대로 가져오면 측정이 어긋납니다. 불량률이 0%인데도 고객은 나쁜 서비스를 받았다고 느낄 수 있습니다.
SERVQUAL의 출발점은 여기입니다. 고객은 서비스를 받기 전에 이미 머릿속에 기준선을 하나 그려둡니다. 실제 경험은 그 기준선과 비교되어 평가됩니다. 그러니까 품질 개선은 두 방향으로 가능합니다. 경험을 끌어올리거나, 어긋난 기대를 조정하는 것입니다. 두 번째 방향을 놓치는 조직이 의외로 많습니다.
같은 응대에 정반대 평가가 나온 설문 한 건
연구소에서 자문했던 중견 가전 유통사 사례가 기억에 남습니다. 설치 서비스 만족도가 5점 척도에서 4.3점이었는데 재구매율은 업계 평균을 밑돌았습니다. 회사 내부에서는 가격 문제로 결론이 나 있었습니다.
저희는 설문을 두 번 나눠 돌렸습니다. 설치 예약 직후에 "설치 기사가 어느 정도로 응대할 것이라 예상하는지"를 물었습니다. 그리고 설치 완료 직후에 같은 항목으로 "실제 어땠는지"를 다시 물었습니다. 두 점수의 차이를 계산했더니 전체 평균은 -0.4로 크지 않았습니다. 그런데 채널별로 쪼개자 그림이 달라졌습니다.
프리미엄 라인을 구매한 고객군의 갭은 -1.2였습니다. 같은 기사가 같은 절차로 설치했는데도 평가가 갈린 이유는 단순했습니다. 프리미엄 제품 상세페이지에 "전담 컨설턴트가 끝까지 함께합니다"라는 문구가 있었기 때문입니다. 고객은 전담 인력을 기대했고 실제로는 일반 설치팀이 왔습니다. 응대의 품질이 아니라 약속과 전달의 간격이 문제였던 것입니다.
이후 회사는 두 가지만 바꿨습니다. 상세페이지 문구를 실제 프로세스에 맞게 고쳤습니다. 그리고 예약 확인 문자에 방문 인원과 소요 시간, 작업 범위를 명시했습니다. 6개월 뒤 프리미엄 고객군의 갭은 -0.3으로 좁혀졌습니다. 서비스 자체는 그대로였습니다.
만족도 점수만 보는 조직에서 벌어지는 일
많은 기업이 CSAT이나 NPS 하나로 서비스 품질을 관리합니다. 이 지표들은 결과를 잘 요약하지만 어디를 고쳐야 하는지는 알려주지 않습니다. 점수가 3.8점에서 4.0점으로 올랐다는 사실만으로는 다음 행동이 나오지 않습니다.
여기서 흔히 나타나는 두 가지 함정이 있습니다.
- 점수 관리가 목적이 되는 경우입니다. 현장에서 "5점 부탁드립니다"라는 요청이 나오기 시작하면 지표는 오르고 실제 품질 정보는 사라집니다.
- 평균에 묻히는 경우입니다. 고객군별로 기대 수준이 다른데 전체 평균만 보면 특정 세그먼트의 큰 갭이 상쇄됩니다. 위 사례가 정확히 이 유형이었습니다.
SERVQUAL이 여전히 쓰이는 이유는 진단 도구이기 때문입니다. 5개 차원으로 쪼개면 신뢰성이 문제인지 공감성이 문제인지가 드러납니다. 기대와 인식을 따로 물으면 개선 방향이 두 갈래로 나뉩니다.
SERVQUAL이란 무엇인가: 5개 차원과 22문항
SERVQUAL은 서비스 품질을 고객의 기대(Expectations)와 지각된 성과(Perceptions)의 차이로 정의하고 이를 5개 차원 22개 문항으로 측정하는 도구입니다. 초기 연구에서는 10개 차원이었는데 통계적 검증을 거쳐 5개로 압축됐습니다.
| 차원 | 영문 | 핵심 질문 | 현장 관리 포인트 |
|---|---|---|---|
| 신뢰성 | Reliability | 약속한 것을 정확히 해냈는가 | 납기, 오류율, 재방문율 |
| 응답성 | Responsiveness | 빠르고 도움이 되었는가 | 응답 시간, 처리 지연 고지 |
| 확신성 | Assurance | 믿을 만하고 유능했는가 | 담당자 역량, 자격 표시, 안전 |
| 공감성 | Empathy | 나를 이해하고 있었는가 | 개별 상황 반영, 호칭, 이력 연동 |
| 유형성 | Tangibles | 눈에 보이는 요소가 적절했는가 | 매장, 복장, 문서, 앱 화면 |
다섯 차원 중 여러 연구에서 만족과 재구매에 가장 크게 작용한다고 보고되는 것은 신뢰성입니다. 친절함보다 약속 이행이 먼저라는 뜻입니다. 국내 연구에서도 같은 경향이 확인됩니다. 한국보건사회연구원이 발표한 장애인 서비스 품질 연구는 SERVQUAL 구조를 사회서비스 영역에 적용한 사례입니다.
갭 모델: 품질은 다섯 군데에서 새어 나갑니다
SERVQUAL의 뿌리는 갭 모델입니다. 고객이 느끼는 최종 격차(갭 5)는 조직 내부의 네 가지 격차가 누적된 결과라고 봅니다.
| 구분 | 어디와 어디의 차이 | 전형적인 원인 |
|---|---|---|
| 갭 1 | 고객 기대 ~ 경영진의 이해 | 고객 조사 부재, VOC가 위로 올라가지 않음 |
| 갭 2 | 경영진의 이해 ~ 서비스 설계 | 표준 미비, 설계에 현장 제약 미반영 |
| 갭 3 | 서비스 설계 ~ 실제 전달 | 인력·교육 부족, 과부하, 권한 없음 |
| 갭 4 | 실제 전달 ~ 외부 커뮤니케이션 | 과장 광고, 지키지 못할 약속 |
| 갭 5 | 고객 기대 ~ 고객 인식 | 위 네 가지의 누적 결과 |
앞서 소개한 가전 유통사 사례는 갭 4의 교과서적인 형태였습니다. 전달 자체는 설계대로 됐는데 광고가 앞서 나갔습니다. 이 진단이 중요한 이유는 처방이 완전히 달라지기 때문입니다. 갭 3이면 인력과 교육에 투자해야 하고 갭 4라면 마케팅 문구를 고치는 것이 먼저입니다. 후자는 비용이 거의 들지 않습니다.
SERVQUAL 점수를 실제로 계산하는 방법
계산 구조는 단순합니다. 같은 22개 문항을 기대용과 인식용으로 두 번 측정한 뒤 문항별로 인식 점수에서 기대 점수를 뺍니다. 7점 리커트 척도를 쓰는 것이 원형입니다.
차원 점수는 해당 차원에 속한 문항의 갭 평균입니다. 전체 SERVQUAL 점수는 5개 차원 점수의 평균입니다. 여기에 차원별 중요도를 고객에게 100점 배분 방식으로 물어 가중치를 적용하는 변형도 널리 쓰입니다. 결과는 음수가 나오는 것이 정상입니다. 기대가 성과보다 높은 경우가 대부분이기 때문입니다.
예시로 확신성 차원의 문항 하나를 보겠습니다. "담당자가 내 문의에 확실하게 답할 수 있다"에 기대 6.5점, 인식 5.1점이 나왔다면 이 문항의 갭은 -1.4입니다. 같은 차원의 다른 세 문항이 -0.3, -0.5, -0.4라면 확신성 평균 갭은 -0.65가 됩니다. 이때 평균만 보고하면 -1.4짜리 문항이 묻힙니다. 그래서 보고서에는 차원 평균과 함께 갭이 가장 큰 문항 세 개를 따로 적는 편이 좋습니다.
실무에서 놓치기 쉬운 것은 측정 시점입니다. 기대를 서비스 종료 후에 회상해서 묻는 방식은 이미 경험에 오염된 답을 얻습니다. 예약 시점과 완료 시점으로 나누어 측정하거나, 최소한 기대 문항을 "이 업종의 이상적인 기업이라면" 형태로 일반화해서 물어야 합니다.
응답자에게 같은 문항을 두 번 묻는 부담
기대와 인식을 모두 묻는 방식은 문항이 44개로 늘어납니다. 실제로 돌려보면 완료율이 뚝 떨어지고 후반 문항의 응답 품질이 나빠집니다. 저희가 쓴 방법은 조사를 두 시점으로 쪼개는 것이었습니다. 예약 확인 화면에서 기대 문항 11개, 서비스 완료 문자에서 인식 문항 22개를 받았습니다. 응답 시간이 한번에 3분을 넘지 않도록 설계하면 완료율이 유지됩니다.
SERVQUAL의 한계와 SERVPERF 논쟁
SERVQUAL은 30년 넘게 쓰였지만 비판도 함께 쌓였습니다. 가장 강한 반론은 크로닌과 테일러가 제시한 SERVPERF입니다. 기대를 따로 측정하지 말고 성과만 측정해도 예측력이 같거나 더 낫다는 주장입니다. 문항 수가 절반으로 줄어드는 실무적 장점도 분명합니다.
정리하면 이렇습니다. 조직이 지금 무엇을 고쳐야 하는지 찾는 진단 단계에는 기대를 함께 측정하는 SERVQUAL이 유용합니다. 반복 추적과 벤치마킹에는 문항이 적은 성과 기반 측정이 효율적입니다. 국내에서 널리 인용되는 KS-SQI 모델도 정확성·전문성·진정성·친절성 등 8개 차원으로 성과를 측정하는 방식을 택하고 있습니다.
또 하나의 한계는 업종 이식성입니다. 22개 문항은 원래 은행, 수리 서비스, 통신 같은 업종을 대상으로 개발됐습니다. 디지털 서비스나 의료처럼 맥락이 다른 영역에서는 문항을 수정해야 하는데 이때 차원 구조가 흔들리는 경우가 보고됩니다. 실제로 의료 서비스에 적용한 국제 비교 연구에서도 차원별 신뢰도가 나라마다 다르게 나타났습니다.
마지막으로 문화적 차이도 지적됩니다. 한국을 포함한 동아시아 응답자는 척도의 중간값에 몰리는 경향이 있어 7점 척도에서 갭이 작게 나타나는 편입니다. 절대 수치를 해외 벤치마크와 그대로 비교하기보다, 같은 조직 안에서 시점별·세그먼트별 차이를 보는 쪽이 안전합니다. 저희가 자문한 사례에서도 전체 갭 -0.4는 업계 기준으로 나쁘지 않았는데 세그먼트 간 격차가 0.9나 벌어져 있었습니다. 문제는 평균이 아니라 분포에 있었습니다.
현장에 적용하는 네 단계
1단계는 대상 접점을 하나만 고르는 것입니다. 전사 서비스 전체를 한 번에 측정하려 하면 문항이 추상화되어 아무 처방도 나오지 않습니다. 설치, 상담, 반품처럼 절차가 분명한 접점에서 시작하시면 됩니다.
2단계는 22문항을 그 접점의 언어로 고쳐 쓰는 것입니다. 차원 다섯 개는 유지하고 문항의 주어와 상황만 바꿉니다. 문항이 실제 업무용어로 쓰여 있으면 결과를 받은 현장이 바로 해석할 수 있습니다.
3단계는 고객군을 쪼개서 갭을 보는 것입니다. 구매 채널, 등급, 첫 구매 여부로 나누면 전체 평균에 묻혀 있던 큰 갭이 드러납니다. 최소 표본은 세그먼트당 30~50명 수준을 확보하는 편이 안전합니다.
4단계는 가장 큰 갭 하나를 갭 모델로 되짚는 것입니다. 원인이 설계인지 전달인지 커뮤니케이션인지 판정한 뒤 그에 맞는 부서에 과제를 넘깁니다. 이 단계를 생략하면 결과 보고서가 "친절 교육 강화"로 수렴하고 다음 분기에 같은 점수가 다시나옵니다.
FAQ
SERVQUAL은 지금도 유효한 모델인가요?
진단 도구로는 여전히 유효합니다. 1988년 제시된 이후 수천 편의 후속 연구가 축적되어 업종별 변형이 잘 정리돼 있습니다. 다만 추적 지표로 매달 돌리기에는 문항이 많아 부담이 큽니다. 분기 또는 반기 진단에 SERVQUAL, 월간 추적에 CSAT·CES를 병행하는 구성이 실무에서 자주 쓰입니다.NPS나 CSAT와 무엇이 다른가요?
측정 목적이 다릅니다. NPS와 CSAT는 결과 지표로 "얼마나 좋았는가"를 한 숫자로 요약합니다. SERVQUAL은 진단 지표로 "어느 차원에서 기대에 못 미쳤는가"를 알려줍니다. 결과 지표가 떨어진 이유를 찾을 때 진단 지표를 꺼내는 순서가 자연스럽습니다.기대 점수를 측정하기 어려운데 꼭 필요한가요?
개선 방향이 두 갈래라면 필요합니다. 성과만 측정하면 항상 "성과를 올려라"는 결론이 나오는데요. 실제로는 광고 문구나 안내 메시지를 조정해 기대를 현실에 맞추는 것이 더 빠르고 저렴한 경우가 많습니다. 예산이 부족하다면 기대 문항을 5개 차원당 1개씩만 축약해 쓰는 방법도 있습니다.차원별 갭이 모두 음수면 무엇부터 고쳐야 하나요?
갭의 크기와 고객이 부여한 중요도를 함께 봅니다. 중요도가 높고 갭이 큰 차원이 1순위입니다. 여러 연구에서 신뢰성의 중요도가 가장 높게 나오는 경향이 있어, 약속 이행과 관련된 항목이 상위에 오는 경우가 많습니다.작은 조직에서도 쓸 수 있나요?
가능합니다. 22문항 전체를 쓰지 않고 5개 차원마다 2\~3문항으로 줄인 축약형으로 시작하면 됩니다. 고객 50명 규모의 조사로도 세그먼트 간 갭 차이를 확인할 수 있습니다. 중요한 것은 문항 수가 아니라 기대와 인식을 분리해 묻는 구조입니다.같이 읽으면 좋은 것들
출처
- SERVQUAL모형을 바탕으로 한 장애인서비스의 품질과 서비스 기관의 영향에 대한 연구 (보건사회연구)(ScholarlyArticle)
- 서비스 품질의 이해 - KS-SQI (한국표준협회)
- 기업들 서비스 고도화 노력…상반기 만족도 0.9점 올라, KS-SQI 2026 (한국경제)(NewsArticle)
- The Servqual Method as an Assessment Tool of the Quality of Medical Services in Selected Asian Countries(ScholarlyArticle)
- SERVQUAL (Wikipedia)