상세 보기
An Automatic Data Construction Approach for Korean Speech Command Recognition
An Automatic Data Construction Approach for Korean Speech Command Recognition
- 임연수;
- 서덕진;
- 박정식;
- 정유철
초록
최근 화두가 되고 있는 AI분야에서 가장 큰 문제점은 학습데이터의 부족 문제를 꼽을 수 있다. 수동 데이터 구축에는 많은 시간과 노력이 소요되기에 개인이 손쉽게 필요 데이터를 구축하기는 매우어렵다. 반면, 수동 데이터 구축에 비해 자동으로 구축하는 것은 높은 품질을 유지하는 것이 관건이다. 본 논문에서는 한국어 음성 명령어 인식기 개발에 필요한 데이터를 웹에서 자동으로 추출하고, 학습데이터로 사용할 수 있는 데이터를 자동으로 선별하는 방법을 소개한다. 특히, 자동 구축된 한국어 음성 데이터를 대상으로 우수한 성능을 보이는 ResNet기반의 수정 모델을 기반으로, 건강 및일상생활도메인의 명령어 셋을 대상으로 적용가능성을 보이기 위한 실험을 진행하였다. 자동으로구축된 데이터만을 사용한 일련의 실험에서 건강도메인은 ResNet15에서 89.5%, 일상생활도메인에서는 ResNet8에서 82%의 정확도를 보임으로써, 자동 수집 데이터의 활용 가능성을 검증하였다.
키워드
Korean Speech Command; Speech Recognition; Automatic Data Construction; ResNet; CNN; 한국어 명령어 인식; 음성인식; 자동 데이터 구축; 레스넷; 합성곱신경망
- 제목
- An Automatic Data Construction Approach for Korean Speech Command Recognition
- 제목 (타언어)
- An Automatic Data Construction Approach for Korean Speech Command Recognition
- 저자
- 임연수; 서덕진; 박정식; 정유철
- 발행일
- 2019
- 저널명
- 한국컴퓨터정보학회논문지
- 권
- 24
- 호
- 12
- 페이지
- 17 ~ 24
- 언어
- KOR
- 출판사
- 한국컴퓨터정보학회
- 발행국가
- 대한민국
- 분량
- 8 페이지
- ISSN
- E 2383-9945
P 1598-849X