AI 기반 CBT 훈련도구를 실제 정신건강 현장에서 사용하면 어떻게 되는가

논문 정보

  • 원문 제목: Preliminary Investigation of an Artificial Intelligence-Based Cognitive Behavioral Therapy Training Tool
  • 저자: Sarah L. Kopelovich 외
  • 발표 연도: 2025
  • 학술지: Psychotherapy
  • DOI: 10.1037/pst0000550
  • 공식 원문: https://pmc.ncbi.nlm.nih.gov/articles/PMC11913585/
  • 연구 국가: 미국
  • 연구 유형: 단일군 2주 자연주의 현장시험
  • 연구 대상: 지역사회 정신건강기관에서 정신증 성인을 지원하는 상담자 14명, 동료지원가 4명, 사례관리자 3명 등 21명
  • 원문 확인 범위: 도구 구성, 모집과 절차, 사용 로그, 일일평가, 구현지표, 기술오류, 결과, 임상적 의미, 이해상충과 한계

핵심요약

이 연구는 여덟 가지 CBT 기술을 온라인으로 학습하고, 영상 사례에 대한 사용자의 음성 반응을 AI가 평가해 피드백하는 비동기 훈련도구의 현장 사용성을 살펴봤습니다. 참여자들은 2주 동안 평균 6.57회 로그인했고 수용성·적절성·실행가능성과 사용성은 높게 평가했지만, 21명 중 실제 AI 피드백 기능을 한 번이라도 사용한 사람은 12명에 그쳤습니다. AI 피드백을 받은 응답의 96.6%는 어느 정도 이상 정확하다고 평가됐지만, 연구는 독립된 전문가 평정과의 정확도나 실제 CBT 역량 향상, 내담자 결과를 검증하지 않았습니다. 따라서 AI 훈련의 효과가 입증됐다기보다, 일상 업무 속에서 자율형 훈련도구가 사용될 가능성과 동시에 시간 확보·책임구조·사용 지원이 필요하다는 점을 보여준 예비연구입니다.

이 연구는 왜 필요했나

전통적 CBT 교육은 강의, 역할연습, 수퍼비전에 많은 시간과 전문가 자원이 필요합니다. 온라인 교육은 접근성을 높이지만, 학습자가 실제로 어떻게 말하고 개입하는지 피드백하기 어렵습니다. 연구진은 AI가 음성 연습을 분석해 즉각적 피드백을 제공하면 반복훈련을 확장할 수 있는지, 실제 기관 업무환경에서 사용자가 자발적으로 활용하는지를 먼저 확인하려 했습니다.

연구는 어떻게 진행됐나

미국 지역사회 정신건강기관 종사자 21명이 15일 동안 원하는 시간과 빈도로 도구를 사용했습니다. 업무량은 줄이지 않았고 필수 사용량도 정하지 않았습니다. 시스템 로그, 매일의 사용 설문, 종료 시점의 사용성·만족도·수용성·적절성·실행가능성 평가가 수집됐습니다. 참여자는 정신교육부터 웰니스 계획까지 여덟 CBT 기술을 학습하고 영상 속 내담자에게 말하듯 음성 반응을 녹음할 수 있었습니다.

주요 결과

  • 참여자는 2주 동안 평균 6.57회 로그인했고, 절반 이상이 일일 설문에서 도구를 사용했다고 보고했습니다.
  • 사용은 주로 개인시간이나 업무 중 휴식시간에 15~30분 단위로 이루어졌습니다.
  • 21명 중 12명만 AI 피드백 기능을 사용했고, 이들은 총 251개의 고유 음성반응을 녹음했습니다.
  • AI 피드백 정확도에 대한 59개 평가 중 96.62%가 ‘어느 정도 정확’ 이상이었습니다.
  • 링크 오류, 피드백 수신 실패, 영상 재생과 HTML 오류 등 네 유형의 기술문제가 보고됐습니다.

연구자의 해석

저자들은 도구가 일반적인 구현기준을 충족했고 짧은 단위의 자기주도 훈련에 적합할 가능성을 제시했습니다. 동시에 43%가 핵심 AI 기능을 사용하지 않았다는 점에서, 단순 제공만으로 충분하지 않고 관리자 지원, 훈련시간 보장과 사용 책임성이 필요하다고 보았습니다.

상담실 활용

상담기관이 AI 훈련을 도입할 때는 로그인 수보다 실제 연습, 피드백 검토, 수정 후 재시도 여부를 확인해야 합니다. 상담자 교육기록에는 학습한 기술, AI가 제시한 피드백, 상담자·수퍼바이저가 동의하지 않은 부분, 실제 회기 적용 결과를 구분해 남기는 것이 안전합니다. 실제 내담자 음성이나 개인정보를 검증되지 않은 시스템에 입력해서는 안 되며, AI 점수는 역량 인증이나 수퍼비전 대체수단으로 사용해서는 안 됩니다.

한계

대조군이 없고 표본이 21명으로 작으며 사용기간도 2주뿐입니다. 참여자에게 보상이 제공됐고 단일기관 표본이어서 일반적인 자발적 사용을 과대평가했을 수 있습니다. 실제 역량의 전후 변화와 내담자 성과를 측정하지 않았으며, AI 피드백 정확도도 사용자의 인상평가에 의존했습니다. 여러 저자가 개발회사와 재정적 이해관계를 가지고 있어 독립적 재현이 필요합니다.

기억할 핵심

AI는 상담기술을 반복 연습하고 즉시 피드백하는 통로를 확장할 수 있지만, 사용 가능성과 교육효과는 다릅니다. 현 단계에서는 보조 훈련도구로만 사용하고 사람 수퍼비전, 개인정보 보호와 실제 역량평가를 별도로 유지해야 합니다.

Similar Posts

답글 남기기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다