1. 연구 개요 및 분석 설계
논문 작성용 상세 본문
본 연구는 국내 콜센터 VOC 음성 데이터를 대상으로 음성 특징 기반 스트레스 지수를 설계하고, 통화 전체 단위의 구성 타당도를 검증한 뒤 화자분리 기반 확장 분석으로 연결하는 연구이다.
논문 본문 기준은 datasets0413 최종 유효 분석 n=998이며, TO-BE n=1,000과 7~11번 화자분리 분석은 재현성·부록·후속 연구 축으로 관리한다.
연구의 핵심 원칙은 ① 본문 결과 교체 금지, ② 역할 매핑 전 고객/상담사 확정 금지, ③ 시간 순서 연관성을 인과로 표현하지 않기, ④ 생성되지 않은 segment stress_score를 완료로 표시하지 않기이다.
본 연구는 하나의 분석 결과를 과장하여 확장하는 방식이 아니라, 통화 전체 단위의 본문 분석과 화자분리 기반 확장 분석을 서로 다른 분석 층위로 분리하였다. 이 설계는 결과의 재현성과 해석의 안전성을 동시에 확보하기 위한 것이다.
AS-IS n=998은 논문 본문의 통계적 기준이며, TO-BE n=1,000은 자동화 및 재현성 확인용이다. 화자분리 7~11번은 통화 내부의 상호작용 구조를 다루는 부록 및 후속 분석으로 배치한다.
검증되지 않은 역할 매핑과 segment-level stress를 완료 결과처럼 사용하지 않는 것이 핵심 연구 윤리 원칙이다.
분석 수치 및 결과표
표 1-1. 연구 데이터와 분석 단위
| 구분 | 분석 단위 | 건수 | 논문 위치 |
|---|---|---|---|
| AS-IS 최종 | 통화 전체 음성 | 998 | 본문 핵심 |
| TO-BE | 통화 전체 음성 | 1,000 | 재현성/부록 |
| 화자분리 | SPEAKER 세그먼트 | 57,619 | 확장 분석 |
| 화자 슬롯 | 통화×화자 후보 | 2,000 | 확장 분석 |
| 응답쌍 | S0→S1 시간 순서 | 28,149 | 탐색 분석 |
표 1-2. 연구 단계별 완료 상태
| 단계 | 상태 | 판정 |
|---|---|---|
| STT/특징/통화단위 stress | READY | 본문/TO-BE 활용 가능 |
| 실제 화자분리 | READY | 57,619 세그먼트 생성 |
| 역할 매핑 | 미검증 | SPEAKER 후보 명칭 유지 |
| segment-level stress | PENDING | STT/WPM 병합 필요 |
표 1-Q. 연구 질문
| 번호 | 연구 질문 |
|---|---|
| 1 | 통화 전체 음성 기반 비지도 stress_score의 구성 타당도는 확보되는가? |
| 2 | 동일 분석 파이프라인은 n=1,000 운영 데이터에서 재현 가능한가? |
| 3 | 실제 화자분리 후 화자 후보별 상호작용 구조를 분석할 수 있는가? |
| 4 | segment-level STT/WPM/stress 병합 이전과 이후의 주장 범위는 어떻게 구분해야 하는가? |
표 1-M. 분석 방법 및 도구
| 순서 | 방법/도구 |
|---|---|
| 1 | VOC 통화 전체 분석 |
| 2 | Whisper STT |
| 3 | Acoustic feature extraction |
| 4 | Construct validity |
| 5 | pyannote diarization |
| 6 | Sequential response-pair analysis |
분석 그림 및 도식











원본 분석 산출물 연계
해당 장과 직접 매칭되는 추가 CSV/JSON/텍스트 산출물이 없습니다.
결과 해석
본문 타당도 검증과 화자분리 확장 분석을 분리함으로써, 현재 완료된 결과와 후속 분석을 명확히 구분한다.
한계 및 논문 반영 기준
7~11번 결과는 본문 n=998 결과를 대체하지 않는다.