무슨 연구인가
ADHD를 겪는 사람과 보호자들이 온라인 커뮤니티에 쏟아내는 질문들. 그런데 병원이 만든 공식 FAQ는 이 질문들에 얼마나 답이 되고 있을까요? 이 연구는 커뮤니티 질문과 FAQ를 나란히 놓고 '아무도 답해주지 않는 질문'을 컴퓨터로 찾아냈습니다.
🔬 어떻게 분석했나
- ① 한국 온라인 커뮤니티에서 ADHD 질문 4,988건을 모았어요. 먼저 각 질문을 '숫자 좌표'로 바꿨습니다(문장 임베딩) — 뜻이 비슷한 문장일수록 가까운 자리에 놓이게 하는 기술이라, 컴퓨터가 '이 질문과 저 FAQ가 비슷하다'를 거리로 잴 수 있게 됩니다.
- ② 커뮤니티 질문과 병원 FAQ의 거리를 재서, 가까우면 '이미 답이 있는 질문', 멀면 '답이 없는 질문'으로 나눴어요. 그 경계선(유사도 0.766)은 실험으로 정했습니다.
- ③ '답이 없는 질문'만 따로 모아 LimTopic이라는 도구로 숨은 주제를 뽑았어요 — BERTopic(비슷한 질문끼리 자동으로 묶어 주제를 찾아주는 기법)에 요즘 챗봇 같은 대형언어모델(LLM)을 붙여, 각 주제 묶음이 무슨 얘긴지 사람이 읽을 문장으로 요약하게 한 겁니다.
- ④ 마지막으로 '답이 있는 질문'에 대해, 병원 답변과 커뮤니티 사람들의 답변이 말투·근거 제시 방식에서 어떻게 다른지 LLM으로 비교했어요.
📊 무엇을 찾았나
병원 FAQ는 커뮤니티 질문의 절반(52%)밖에 못 덮고 있었고, 그마저도 18개 FAQ에 몰려 있었어요. 학교·사회적 지원, 치료 접근성처럼 '생활 속 고민' 12가지가 통째로 빠져 있었습니다.
💡 내 연구에 가져갈 것
내 서비스의 FAQ가 진짜 고객 질문을 덮는지 보고 싶다면, 임베딩 유사도로 '안 겹치는 질문'부터 골라내 보세요 — 거기에 사람들이 진짜 묻고 싶은 게 숨어 있어요.
📄 논문 정보
What Provider Frequently Asked Questions Miss: Evaluating Unmet Attention-Deficit/Hyperactivity Disorder Information Needs Through Comparison of Online Community Posts Using Large Language Model–Assisted Semantic Analysis in a Mixed Methods Study
Jaeeun Baek, Hyeoneui Kim
Journal of Medical Internet Research · 2026-09-11
원문 보기 ↗
이 글은 연구 소개를 위한 해설이며, 논문 원문의 저작권은 저자와 출판사에 있습니다. 원문은 위 링크(DOI)에서 확인하실 수 있습니다. 권리자께서 요청하시면 바로 내리겠습니다.