• Title, Summary, Keyword: 복합명사

Search Result 142, Processing Time 0.036 seconds

The development of a document retrieval system using thesaurus and signature file (시소러스 및 요약화일을 이용한 문서 검색시스템)

  • Jeong, Sang-Cheol;Shin, Dong-Wook
    • Annual Conference on Human and Language Technology
    • /
    • /
    • pp.400-408
    • /
    • 1994
  • 본 논문에서는 요약화일을 이용하여 복합명사를 효율적으로 처리하며 시소러스를 이용하여 검색하는 한글문서 검색시스템을 제안한다. 본 한글문서 검색 시스템은 한글문서를 대상으로 색인하는 자동색인기와 사용자의 질의를 받아 관련된 문서를 검색하는 검색기로 구성된다. 자동색인기는 우선 한글문서를 대상으로 최장일치 방법으로 명사들을 출출한 후 복합명사의 패턴을 분석하여 복합명사의 가능성이 높은 것들을 복합명사화한다. 두번째로 이들 복합명사들을 1+2SP 방식으로 코딩한 후 요약화일 방법을 이용하여 요약화일을 작성한다. 검색기는 사용자 질의어를 받아 명사들을 추출한 후 시소러스를 이용하여 질의어를 확장한다. 다음 확장된 질의어를 1+2SP 방식으로 코딩한 후 관련된 문서를 검색한다. 본 논문에서는 한국통신에서 만든 코퍼스를 이용하여 제안된 방법의 성능을 평가하였는데 복합명사 처리 및 시소러스 이용방식이 효율적임이 입증되었다. 또한 KAIST에서 개발한 문서검색 시스템보다 동일한 코퍼스로 실험하였을 경우 재현률 및 정확률이 $7{\sim}8%$ 정도 앞서 기존의 시스템보다도 성능이 우수하다는 것이 밝혀졌다.

  • PDF

The Interpretation of Noun Sequences Using Semantic Relation and Subcategorization Information (의미관계와 문형정보를 이용한 복합명사 해석)

  • Kim, Do-Wan;Lee, Kyung-Soon;Kim, Gil-Chang
    • Annual Conference on Human and Language Technology
    • /
    • /
    • pp.310-315
    • /
    • 1999
  • 본 논문에서는 기계가독형사전과 말뭉치로부터 명사의 의미관계정보를 추출하고, 추출된 의미관계정보와 명사에서 파생된 용언의 문형정보를 이용하여 복합명사를 해석하는 방법을 제안한다. 의미관계정보는 상 하위관계, 목적관계, 위치관계, 시간관계, 소유관계, 원인관계 등 11개에 대해서 정규식 패턴을 정의하여 기계가독형 사전과 말뭉치로부터 추출한다. 복합명사 해석은 한국어 복합명사의 대부분을 차지하는 '수식명사 + 핵심명사' 형태를 해석 대상으로 하며, 핵심명사의 특성에 따라 의미관계정보와 문형정보를 이용하여 해석한다.

  • PDF

A Division Method of Korean Compound Noun by number of syllable (음절수에 따른 한국어 복합 명사 분리 방안)

  • Choi, Jae-Hyuk
    • Annual Conference on Human and Language Technology
    • /
    • /
    • pp.262-267
    • /
    • 1996
  • 한국어 맞춤법 검사기는 문서내에서 발생되는 비표준어 오류, 띄어쓰기/붙여쓰기 오류, 조사/어미 오류, 외래어 오류, 철자 오류 등에 대해서 이에 적합한 대치어를 제시해 준다. 일반적으로 한국어의 맞춤법 오류 중 가장 빈번하게 발생되는 것이 띄어쓰기 오류이며, 이 중에서도 복합 명사에 대한 띄어쓰기 오류가 가장 많이 발생한다. 본 논문에서는 복합 명사에 대한 띄어쓰기 교정 방안으로 복합명사의 음절수에 따라 1개의 결과만을 출력하도록 하는 복합 명사 분리 방안을 제시하며, 또한 복합 명사 분리 시의 사전 참조 횟수를 줄이는 방법을 제안한다.

  • PDF

A Segmentation Method of Compound Nouns Using Syllable Preference (선호 음절 정보를 이용한 복합명사의 분해 방법)

  • Park Chan-Ee;Ryu Bang;Kim Sang-Bok
    • Journal of Korea Multimedia Society
    • /
    • v.9 no.2
    • /
    • pp.151-159
    • /
    • 2006
  • The ratio of a segmentation algorithm of compound nouns causes an effect a lot in nouns which are not in the dictionary. The structure of Korean compound nouns are mostly derived from the Chinese characters and it includes some preference ratio. So it will be able to use segmentation rule of compound nouns. This paper suggests a segmentation algorithm using some preference ratio of Korean compound nouns which are not in the dictionary. The experiment resulted in getting 88.49% of correct segmentation and showed effective result from the comparative experimentation with other algorithm.

  • PDF

Die Aktualgenese von Nominalkomposita im Deutschen (독일어 '임시복합명사'의 생성과정과 해석)

  • Oh Young-Hun
    • Koreanishche Zeitschrift fur Deutsche Sprachwissenschaft
    • /
    • v.6
    • /
    • pp.1-21
    • /
    • 2002
  • '임시복합명사'는 명사 하나 하나의 의미가 개인의 머릿속에 저장되어 있지만, 이들이 결합해서 생긴 단어가 일반적인 언어사전에 등록되어 있지 않고 문맥에 따라 새로운 의미가 형성되어서 결합된 명사를 의미한다. 따라서 이 논문에서는 사전의 목록에 등록되어 있지 않아서 의미적으로 애매한 복합명사들을 '임시복합명사' ad-hoc Nominal-komposita 라고 지칭하였다. 이때 이러한 '임시복합명사'를 생성하는데 있어서 '임시복합명사'를 구성하는 각 요소들은 새로운 복합명사를 만드는데 필요한 '입력'의 역할을 담당한다. 이 논문에서는 '임시복합명사'를 구성하는데 필요한 일종의 다양한 원칙들을 다루어 보았다. 그러한 원칙들은 순수 언어학적인 논거를 바탕으로 '임시복합명사'를 생산하고 해석해 나가는 과정에 대한 타당성을 입증해 주었다. 그러나 일반적인 지식 Weltwissen과 텍스트 문맥에 맞는 구조를 편입함으로써 그 형태와 해석이 가능한 다른 형태의 복합어는 이 논문에서 자세히 다루지 않았다. 이 논문에서 제시된 복합명사의 생성과 해석과정은 대부분의 경우 복합어 고유의 현상만을 설명한 것이 아니라, 일반적으로 복합어를 생산하고 해석하는 과정을 다룬 것이다. 마찬가지로 이 점은 텍스트 문맥과 상관없이 해석이 가능한 복합어 내지는 텍스트 문맥에 따라 해석이 가능한 복합어에서도 똑같이 적용된다. 텍스트의 문맥을 통해서 자체적으로 해석이 가능하지 않은 복합어를 명확하게 의미를 부여하고 해석하는 과정, 예를 들어 의사소통상에서 일반적인 지식을 이용하여 '임시복합어'를 해석하는 과정은 이후의 연구에 다양하게 다루어 질 테마가 될 것임이 분명하다. 또한 '임시복합명사'를 생산하기 위해 이 논문에서 다룬 전제조건들은 또 다른 새로운 복합어를 생산하는데, 예를 들어 명사로부터 파생된 동사들의 복합어를 연구하는데 밑거름이 될 것이다.학의 강력한 연구가 요구된다.에 기대어 텍스트, 문장, 어휘영역 등이 투입되어 적용되었으며, 이에 상응되게 구체적인 몇몇 방안들이 제시되었다. 학습자들이 텍스트를 읽고 중심내용을 찾아내며, 단락을 구획하고 또한 체계를 파악하는데 있어서 어휘연습은 외국어 교수법 측면에서도 매우 관여적이며 시의적절한 과제라 생각된다. Sd 2) PL - Sn - pS: (1) PL[VPL - Sa] - Sn - pS (2) PL[VPL - pS] - Sn - pS (3) PL(VPL - Sa - pS) - Sn - pS 3) PL[VPL - pS) - Sn -Sa $\cdot$ 3가 동사 관용구: (1) PL[VPL - pS] - Sn - Sd - Sa (2) PL[VPL - pS] - Sn - Sa - pS (3) PL[VPL - Sa] - Sn - Sd - pS 이러한 분류가 보여주듯이, 독일어에는 1가, 2가, 3가의 관용구가 있으며, 구조 외적으로 동일한 통사적 결합가를 갖는다 하더라도 구조 내적 성분구조가 다르다는 것을 알 수 있다. 우리는 이 글이 외국어로서의 독일어를 배우는 이들에게 독일어의 관용구를 보다 올바르게 이해할 수 있는 방법론적인 토대를 제공함은 물론, (관용어) 사전에서 외국인 학습자를 고려하여 관용구를 알기 쉽게 기술하는 데 도움을 줄 수 있기를 바란다.되기 시작하면서 남황해 분지는 구조역전의 현상이 일어났으며, 동시에 발해 분지는 인리형 분지로 발달하게 되었다. 따라서, 올리고세 동안 발해 분지에서는 퇴적작용이, 남황해 분지에서는 심한 구조역전에 의한 분지변형이 동시에 일어났다 올리고세 이후 현재까지, 남황해 분지와 발해 분지들은 간헐적인 해침과 함께 광역적 침강을 유지하면서 안정된 대륙 및 대륙붕 지역으로 전이되었다.

  • PDF

Nominal Compound Analysis Using Statistical Information and WordNet (통계정보와 WordNet을 이용한 복합명사 분석)

  • Lyu, Min-Hong;Ra, Dong-Yul;Jang, Myung-Gil
    • Annual Conference on Human and Language Technology
    • /
    • /
    • pp.33-40
    • /
    • 2000
  • 복합명사의 한 구조는 구성 명사간의 수식관계의 집합이라고 본다. 한 복합명사에 대하여 가능한 여러 구조 중에서 올바른 구조를 알아 내는 것이 본 논문의 목표이다. 이를 위하여 우리는 최근에 유행하는 통계 기반 분석 기법을 이용한다. 먼저 우리의 복합 명사 분석 문제에 알맞은 통계 모델을 개발하였다. 이 모델을 이용하면 분석하려는 복합명사의 가능한 분석 구조마다 확률 값을 얻게 된다. 그 다음 가능한 구조들 중에서 가장 확률값이 큰 구조를 복합명사의 구조로 선택한다. 통계 기반 기법에서 항상 문제가 되는 것이 데이터 부족문제이다. 우리는 이를 해결하기 위해 개념적 계층구조의 하나인 워드넷(WordNet)을 이용한다.

  • PDF

Base-Noun Extraction with filtering and Segmentation in Korean (여과 및 분리 기법을 이용한 한국어 기준명사 추출)

  • 김재훈;김준홍;박호진
    • Proceedings of the Korean Society for Cognitive Science Conference
    • /
    • /
    • pp.3-10
    • /
    • 2000
  • 웹의 등장으로 방대한 양의 문서를 다루는 정보검색, 정보추출, 정보요약 등의 분야에서 명사 추출은 대단히 중요한 역할을 담당하는 한 모듈이다. 본 논문에서는 대량의 문서에서 효과적으로 명사를 추출하기 위해 여과기법과 분리기법을 이용한 한국어 기준명사 추출 시스템을 기술한다. 기준명사는 명사들 중에서 기본이 되는 명사로서 복합명사는 제외된다. 본 논문의 기본적인 개념은 먼저 여과기법을 이용해서 명사를 포함하지 않은 어절을 미리 제거하고, 그리고 분리기법을 이용해서 명사가 포함된 어절에서 명사어구와 조사를 분리하고, 복합명사에 해당할 경우에는 각 명사를 분리하여 기준명사를 추출한다. ETRI 말뭉치를 대상으로 실험한 결과, 재헌율과 정확률 모두 약 89% 정도의 성능을 보였으며, 제안된 시스템을 한국어 정보요약 시스템에 적용해 보았을 때, 좋은 결과를 얻을 수 있었다.

  • PDF

Base-Noun Extraction with Filtering and Segmentation in Korean (여과 및 분리 기법을 이용한 한국어 기준명사 추출)

  • Kim, Jae-Hoon;Kim, Jun-Hong;Park, Ho-Jin
    • Annual Conference on Human and Language Technology
    • /
    • /
    • pp.3-10
    • /
    • 2000
  • 웹의 등장으로 방대한 양의 문서를 다루는 정보검색, 정보추출, 정보요약 등의 분야에서 명사 추출은 대단히 중요한 역할을 담당하는 한 모듈이다. 본 논문에서는 대량의 문서에서 효과적으로 명사를 추출하기 위해 여과기법과 분리기법을 이용한 한국어 기준명사 추출 시스템을 기술한다. 기준명사는 명사들 중에서 기본이 되는 명사로서 복합명사는 제외된다. 본 논문의 기본적인 개념은 먼저 여과기법을 이용해서 명사를 포함하지 않은 어절을 미리 제거하고, 그리고 분리기법을 이용해서 명사가 포함된 어절에서 명사어구와 조사를 분리하고, 복합명사에 해당할 경우에는 각 명사를 분리하여 기준명사를 추출한다. ETRI 말뭉치를 대상으로 실험한 결과 재현율과 정확률 모두 약 89% 정도의 성능을 보였으며, 제안된 시스템을 한국어 정보시스템에 적용해 보았을 때, 좋은 결과를 얻을 수 있었다.

  • PDF

Using the Extension of Korean Compound Noun the improvement of KRISTAL2000 DBMS Retrieval System (복합명사확장을 이용한 KRISTAL2000 DBMS검색 성능 향상)

  • 서정현;김광영;최성필
    • Proceedings of the Korean Information Science Society Conference
    • /
    • /
    • pp.124-126
    • /
    • 2002
  • 복합명사는 한국어에서 가장 빈번하게 나타나는 색인어의 한 형태로서, 영어권 중심의 정보검색모델로는 다루기가 어려운 언어 현상의 하나이다. 복합명사는 2개 이상의 단일어들의 조합으로 이루어져 있고. 그 형태 또한 여러 가지로 나타나기 때문에 색인과 검색의 큼 문제로 여겨져 왔다. 특히 한국어에서는 복합명사 분석이 어렵고 복잡하다. 그러므로 본 논문에서는 복합명사 질의어 대해서 질의어를 확장 또는 최적방법을 이용하여 KRISTAL2000 DBMS의 성능을 항상 연구에 중점을 두었다.

  • PDF

Term Weighting Method by Postposition and Compound Noun Recognition (조사 유형 및 복합명사 인식에 의한 용어 가중치 부여 기법)

  • 강승식;이하규;손소현;홍기채;문병주
    • Proceedings of the Korean Information Science Society Conference
    • /
    • /
    • pp.196-198
    • /
    • 2001
  • 문서의 내용을 대표하는 용어를 추출하기 위해 일반적으로 영어에서는 명사구를 색인하는 기법을 사용하지만 주제어 추출의 관점에서 영어의 명사구가 한국어의 복합명사에 해당하기 때문에 한국어에서는 복합명사 색인 기법을 중요시하고 있다. 본 논문에서는 한글 문서에서 추출된 용어의 가중치를 결정하기 위하여 경험적인 방법에 따라 가중치를 계산하는 방법을 제안한다. 구체적인 가중치 계산 방법으로 용어 자체의 특성에 의한 가중치를 부여한 후에, 복합명사의 경계를 인식하여 띄어쓴 복합명사의 가중치를 조절하고, 다시 용어의 조사 유형에 따라 가중치를 재계산하는 방법을 제안한다. 신문기사에 대한 실험결과에 의하면 제안한 방법이 단순 출현빈도에 의한 주제어 추출 기법보다 정확도가 더 높았다.

  • PDF