기관회원 [로그인]
소속기관에서 받은 아이디, 비밀번호를 입력해 주세요.
개인회원 [로그인]

비회원 구매시 입력하신 핸드폰번호를 입력해 주세요.
본인 인증 후 구매내역을 확인하실 수 있습니다.

회원가입
서지반출
음소의 1차원 배열을 이용한 한글 유사도 및 편집거리 알고리즘
[STEP1]서지반출 형식 선택
파일형식
@
서지도구
SNS
기타
[STEP2]서지반출 정보 선택
  • 제목
  • URL
돌아가기
확인
취소
  • 음소의 1차원 배열을 이용한 한글 유사도 및 편집거리 알고리즘
저자명
노강호,박근수,조환규,장소원,Roh. Kang-Ho,Park. Kun-Soo,Cho. Hwan-Gue,Chang. So-Won
간행물명
정보과학회논문지. Journal of KIISE. 컴퓨팅의 실제 및 레터
권/호정보
2011년|17권 10호|pp.519-526 (8 pages)
발행정보
한국정보과학회
파일정보
정기간행물|
PDF텍스트
주제분야
기타
이 논문은 한국과학기술정보연구원과 논문 연계를 통해 무료로 제공되는 원문입니다.
서지반출

기타언어초록

문자열에 대한 편집 거리 문제는 하나의 문자열을 다른 문자열로 변환할 때 필요한 최소한의 연산의 개수를 구하는 문제이다. 영어와 같은 1차원 문자열에 대한 최적해에 대해서는 오랫동안 연구가 진행되어 왔으나, 한글과 같이 좀 더 복잡한 언어에 대한 편집 거리에 대해서는 많은 연구가 진행되지 못했다. 본 논문에서는 음소와 음절의 특정과 음소 분류 체계를 이용하여 편집거리를 구하는 기존 연구를 확장하여, 음소의 1차원 배열을 사용하는 2가지 유사도 알고리즘을 제안한다. 본 논문에서 제안한 알고리즘은 오타와 같은 유사단어들과 비속어들에 대한 실험에서 기존의 알고리즘보다 더 좋은 성능을 보여주었다.

기타언어초록

The edit distance problem is finding the minimum number of edit operations to transform a string into another one. There are some algorithms that compute an optimal edit distance for one-dimensional languages such as the English language. However, there was little research to find the edit distance for more complicated languages such as the Korean. In this paper, we define two measures of similarity using one dimensional array of phonemes by extending previous edit-distance algorithms for the Korean alphabet based on the properties of syllables and phonemes, and the phoneme classification system. The algorithms presented in this paper, show better experimental results than the previous algorithms for the data of similar words and Korean slang.