2026-10-09 · 최유진 (수석연구원)

UX 리서치 도구는 무엇을 보고 골라야 하나요? 리서치 질문 세 종류와 응답 수 기준 1년치 비용 비교 가이드

#고객경험#ux리서치#사용성테스트#리서치도구#고객인터뷰#패널품질#리서치리포지터리#cx전략

UX 리서치 도구는 무엇을 보고 골라야 하나요?

도구 선택의 출발점은 기능 목록이 아니라 답하려는 질문의 종류입니다. 이 화면에서 사용자가 과업을 끝낼 수 있는지를 재려면 비조정형(unmoderated) 테스트 도구가 맞습니다. 왜 중간에 멈췄는지 알려면 조정형(moderated) 인터뷰 도구가 필요합니다. 쌓인 인터뷰를 6개월 뒤에도 찾아 쓰려면 리서치 리포지터리가 별도로 있어야 합니다. 세 가지를 한 제품으로 해결하려다 결국 아무것도 쓰지 않게 되는 경우가 가장 흔합니다. 글로벌 UX 리서치 소프트웨어 시장은 2025년 4억 7,030만 달러 규모로 연 11.6%씩 성장합니다. 유료 구간은 월 99달러에서 199달러 사이에 몰려 있습니다.

목차

도구를 먼저 사고 질문을 나중에 정한 팀

컨설팅으로 만난 한 커머스 팀의 기록을 그대로 옮겨봅니다. 연 1,200만 원짜리 리서치 플랫폼을 도입하고 7개월 만에 해지했습니다. 해지 사유서에 적힌 문장이 "활용도 저하"였습니다.

인터뷰를 해 보니 사정이 조금 달랐습니다. 도구는 잘 작동했습니다. 도입 목적이 "경쟁사가 쓰니까"였던 겁니다. 계정은 12개를 샀는데 실제로 로그인한 사람은 PM 두 명이었습니다. 그리고 그 두 명이 하고 싶었던 일은 비조정형 과업 테스트가 아니라 심층 인터뷰였습니다. 산 도구는 비조정형 쪽이었습니다.

7개월 동안 남은 산출물은 테스트 리포트 4건이었습니다. 그중 3건은 결론이 "큰 문제 없음"이었습니다. 과업 성공률이 90%를 넘었기 때문입니다. 그런데 같은 기간 결제 전환율은 계속 떨어졌습니다. 과업을 완료할 수 있는지와 하고 싶은지는 다른 질문인데 도구는 앞쪽만 재고 있었습니다.

이 팀이 나중에 고른 조합은 단순했습니다. 월 99달러짜리 비조정형 도구 1개와 월 17달러짜리 조정형 세션 녹화 도구 1개, 그리고 무료 등급의 히트맵 도구였습니다. 연 비용이 300만 원 아래로 내려갔고 분기별 산출물은 3배가 됐습니다.

리서치 질문은 세 종류로 나뉩니다

도구 선택에 앞서 질문을 분류하면 후보가 자동으로 좁혀집니다.

첫째는 '되는가' 질문입니다. 과업 성공률, 소요 시간, 오류 발생 지점을 재는 영역입니다. 표본이 어느 정도 필요하고(통상 20~50명) 사람이 붙어 진행할 필요가 없습니다. 비조정형 테스트와 프로토타입 테스트가 여기 해당합니다.

둘째는 '왜 그런가' 질문입니다. 사용자의 맥락, 대안, 감정, 포기 이유를 캐는 영역입니다. 5~8명이면 충분하지만 진행자가 실시간으로 꼬리 질문을 던져야 합니다. 조정형 인터뷰와 맥락 관찰이 여기 듭니다.

셋째는 '전에 뭐라고 했나' 질문입니다. 조직 안에 쌓인 리서치를 검색해 재활용하는 일입니다. 같은 질문을 1년에 세 번 다시 조사하는 낭비가 여기서 발생합니다. 태깅과 검색이 되는 리포지터리가 담당합니다.

지금 어느 단계인지를 먼저 정해야 합니다. 세 질문의 비중은 조직 단계에 따라 다릅니다. 제품이 막 나온 단계면 둘째가 압도적이고 기능이 쌓인 단계면 첫째가 늘어납니다. 조직이 커지면 셋째가 병목이 됩니다.

유형별 도구 지형

2026년 기준으로 많이 쓰이는 도구를 유형별로 정리했습니다. 가격은 공개된 플랜 기준입니다.

유형대표 도구시작 가격강점주의할 점
비조정형 과업·프로토타입 테스트Maze무료 / Starter 월 99달러속도와 가격, 프로토타입 연동깊은 '왜'는 안 나옴
비조정형 + 선호도 테스트Lyssna무료 / Growth 월 199달러카드소팅·트리테스트 포함연간 결제 시에만 할인 큼
조정형 라이브 세션LookbackFreelance 월 17달러 / Team 월 99달러저렴한 진입, 관찰자 모드패널 모집은 별도
조정형 + 패널Userlytics엔터프라이즈 세션당 34달러부터좌석 무제한, 패널 포함세션 단가 과금 구조
행동 분석·히트맵Hotjar무료 / 월 32달러부터실사용 데이터, 설치 간단표본 통제가 안 됨
종합·다기능UXtweak무료 ~ 라이선스당 월 153유로기능 폭이 넓음라이선스 단위 과금
리서치 리포지터리Dovetail플랜별검색·태깅·인용 관리쌓이기 전에는 효용 낮음

같은 가격이라도 과금 단위가 다릅니다. 표에서는 가격대보다 이 단위를 먼저 봐야 합니다. 좌석 과금, 세션 과금, 응답 수 과금, 라이선스 과금이 섞여 있어서 '월 99달러'라는 숫자만으로는 1년 뒤 청구액을 예측할 수 없습니다.

가격은 좌석이 아니라 응답 수에서 올라갑니다

계약서를 뜯어보면 비용이 커지는 자리는 거의 정해져 있습니다.

  • 응답자 모집비: 플랫폼 패널로 모집하면 응답당 과금이 붙습니다. 일반 소비자는 응답당 수천 원대, 특정 직군(개발자·의료진)은 그 5~10배로 뜁니다
  • 세션 녹화 보관 기간: 무료·저가 플랜은 30~90일 뒤 영상이 사라집니다. 분기 보고에 쓰려면 보관 기간 연장 비용을 봐야 합니다
  • 관찰자 좌석: 라이브 세션을 함께 보는 이해관계자 수에 제한이 걸립니다. 디자이너·PM·개발자가 같이 보려면 상위 플랜이 필요한 경우가 많습니다
  • 번역·자막: 해외 사용자 조사에서는 자막과 번역 비용이 세션비보다 커질 수 있습니다

공식으로 쓰면 이렇습니다. 연 비용 = (좌석 수 × 좌석 단가) + (연간 응답 수 × 응답 단가) + (녹화 보관 연장) 입니다. 분기에 비조정형 2건(각 30명), 조정형 1건(6명)을 돌리는 팀이라면 연간 응답 수가 264건입니다. 응답 단가가 5,000원이면 모집비만 132만 원이 됩니다. 좌석 비용보다 큰 경우가 흔합니다.

자체 사용자 풀을 쓰면 이 항목이 사라집니다. 이미 고객이 있는 서비스라면 인앱 배너나 이메일로 모집하는 쪽이 비용과 표본 적합성 모두 유리합니다. 다만 기존 고객만 보면 이탈한 사용자의 목소리가 빠지므로 분기 한 번은 외부 패널을 섞는 조합이 안전합니다.

패널 품질은 어떻게 검증하나요

응답을 돈으로 사는 구조라서 품질 관리가 필요합니다. 도구를 고를 때 물어 볼 항목이 네 가지 있습니다.

첫째, 스크리닝 질문 설계가 얼마나 자유로운가입니다. 객관식만 되는 플랫폼과 개방형 질문으로 걸러낼 수 있는 플랫폼의 표본 품질 차이가 큽니다.

둘째, 응답 품질 필터가 있는가입니다. 과도하게 빠른 응답, 동일 패턴 응답, 주의 확인 문항 실패를 자동으로 걸러 재모집해 주는지 확인합니다. 이 기능이 없으면 수작업으로 걸러야 하고 그만큼 응답 단가가 실질적으로 올라갑니다.

셋째, 같은 패널이 반복 참여하는 비율입니다. 전문 응답자가 많은 패널은 과업 수행이 지나치게 능숙해 실제 사용자보다 성공률이 높게 나옵니다. 과업 성공률이 의심스럽게 높으면 이 가능성을 먼저 봅니다.

넷째, 국내 표본 확보 능력입니다. 글로벌 도구는 북미·유럽 패널이 두텁고 한국 표본은 얇습니다. 50대 이상, 특정 지역, 특정 직군 조건을 걸면 모집 기간이 몇 주로 늘어나는 경우가 있습니다. 계약 전에 테스트 모집을 한 번 돌려 실제 소요 시간을 재보는 것이 좋습니다.

AI 진행 인터뷰는 어디까지 믿을 수 있나요

2026년 들어 도구들이 공통으로 밀고 있는 기능이 AI 진행 인터뷰와 자동 분석입니다. AI가 응답을 듣고 꼬리 질문을 생성해 조정형의 깊이를 비조정형의 비용으로 얻는다는 제안입니다.

쓸 수 있는 구간이 분명히 있습니다. 넓게 탐색하는 초기 단계, 같은 질문을 100명에게 던져 패턴을 찾는 작업, 1차 코딩과 요약이 그렇습니다. 사람이 20시간 걸려 하던 전사·태깅을 크게 줄여 줍니다.

아직 사람을 대체하지 못하는 구간도 있습니다. 응답자가 말과 행동이 어긋날 때 그 간극을 파고드는 질문, 감정이 올라온 순간을 알아보고 머물러 주는 판단, 거짓이나 과장을 눈치채는 감각입니다. 사용자가 "불편한 건 없었어요"라고 말하면서 세 번 뒤로 돌아간 장면을 붙잡는 일은 여전히 진행자의 몫입니다.

그래서 운용은 섞는 쪽이 현실적입니다. 1차 광범위 수집은 AI 진행으로, 그 결과에서 뽑은 가설 검증 인터뷰 5~8건은 사람이 진행합니다. 분석 단계에서는 AI 요약을 초안으로 쓰고 인용문은 원본 영상에서 확인합니다. AI가 만든 요약을 검증 없이 보고서에 넣으면 존재하지 않는 인용이 섞여 들어가는 사고가 생깁니디.

조직 규모에 따라 답이 달라집니다

같은 질문을 던져도 조직 크기가 다르면 다른 도구가 답이 됩니다. 사람이 병목인 조직과 데이터가 병목인 조직이 다르기 때문입니다.

리서처가 없는 조직에서는 도구의 기능 폭이 오히려 부담입니다. PM이 분기에 한 번 테스트를 돌리는 수준이라면 설정이 세 단계 안에 끝나는 제품을 골라야 합니다. 기능이 많은 제품은 템플릿 선택부터 막히고 그 지점에서 사용이 멈춥니다. 무료 등급으로 충분한 경우도 많습니다.

리서처가 한두 명인 조직에서는 모집이 병목입니다. 질문 설계는 리서처가 하는데 응답자 50명을 모으는 데 2주가 걸립니다. 이때는 패널을 포함한 도구의 값어치가 큽니다. 세션 단가가 비싸 보여도 리서처의 2주를 되돌려 받습니다.

리서처가 세 명을 넘기면 중복이 병목입니다. 각자 조사한 내용을 서로 모르고 같은 사용자에게 비슷한 질문을 반복합니다. 이 단계에서 리포지터리가 비용을 회수하기 시작합니다. 태그 체계를 먼저 합의하고 과거 자료를 옮기는 작업이 도입의 절반입니다.

마지막으로 사내 데이터 연결을 짚습니다. 리서치 결과가 CRM이나 제품 분석 도구의 세그먼트와 이어지지 않으면 어떤 사용자가 그렇게 말했는지에 답할 수 없습니다. 고객 세분화 기준이 이미 있는 조직이라면 그 기준으로 응답자를 분류할 수 있는지를 도구 선정 항목에 넣습니다.

도입 4단계

1단계 — 질문 목록을 먼저 씁니다. 앞으로 6개월 안에 답해야 하는 리서치 질문 10개를 적습니다. 그 10개를 '되는가·왜 그런가·전에 뭐라고 했나'로 분류합니다. 분포가 도구 유형을 결정합니다.

2단계 — 무료 등급으로 2주를 돌립니다. 후보 2개를 골라 각각 실제 과업 1건을 끝까지 해 봅니다. 데모 영상으로는 안 됩니다. 자기 제품, 자기 사용자로 해야 합니다. 이 단계에서 걸러지는 도구가 많습니다.

3단계 — 1년치 비용을 응답 수 기준으로 계산합니다. 앞의 공식에 분기 계획을 넣습니다. 좌석 단가만 비교하면 2년차에 예산이 터집니다.

4단계 — 산출물이 어디로 가는지 정합니다. 리포트를 누가 읽고 어떤 의사결정에 들어가는지 미리 합의하지 않으면 도구는 쓰이다가 멈춥니다. VOC 체계나 고객 여정 지도처럼 이미 돌아가는 프로세스에 산출물을 꽂는 자리를 만들어둡니다.

FAQ

작은 팀이면 어떤 조합이 현실적인가요? 무료 등급 히트맵 도구 하나와 월 17\~99달러대 조정형 세션 도구 하나로 시작하는 조합을 권합니다. 비조정형 테스트는 사용자 수가 적은 초기에는 표본을 채우기 어렵고 얻는 정보도 제한적입니다. 자체 고객 10명에게 직접 연락해 인터뷰하면 같은 기간에 훨씬 많은 것을 알게 됩니다.
리서치 리포지터리는 언제 도입해야 하나요? 인터뷰가 30건을 넘기거나 리서처가 2명 이상이 되는 시점이 기준선입니다. 그 전에는 공유 문서와 폴더 구조로 충분합니다. 비어 있는 리포지터리는 오히려 관리 부담만 늘립니다. 반대로 같은 질문을 두 번 이상 다시 조사한 경험이 생겼다면 이미 도입 시점을 지났습니다.
과업 성공률이 90%인데 전환율은 떨어집니다. 무엇을 잘못한 건가요? 질문이 틀렸을 가능성이 높습니다. 비조정형 과업 테스트는 '지시받은 과업을 완료할 수 있는가'를 잽니다. '스스로 하고 싶은가'는 재지 않습니다. 동기와 대안 비교, 가격 인식 같은 영역은 조정형 인터뷰나 실제 행동 데이터에서만 보입니다. 성공률이 높고 전환율이 낮다면 측정 대상을 동기 쪽으로 옮겨야 합니다.
해외 사용자 조사도 같은 도구로 할 수 있나요? 가능하지만 비용 구조가 달라집니다. 글로벌 패널 모집 단가와 번역·자막 비용이 붙고 특정 직군 조건을 걸면 응답 단가가 몇 배로 뜁니다. 또한 조정형 세션은 시차 때문에 진행자 일정이 제약을 받습니다. 1차는 비조정형과 AI 진행으로 폭을 확보하고 핵심 가설만 사람이 진행하는 구성이 비용 측면에서 현실적입니다.
AI 분석 결과를 그대로 보고서에 써도 되나요? 요약과 1차 태깅은 초안으로 쓸 만합니다. 다만 인용문은 반드시 원본 영상이나 전사에서 확인해야 합니다. AI 요약이 여러 응답자의 말을 합성해 실제로는 아무도 하지 않은 문장을 만들어 내는 사례가 보고됩니다. 보고서에 들어가는 인용은 타임스탬프를 함께 적어 두면 검증이 쉬워집니다.

같이 읽으면 좋은 것들