Coverage Modeling in Neural Machine Translation using Orthogonal Regularization

직교 정규화를 이용한 신경망 기계 번역에서의 커버리지 모델링

  • Lee, Yo-Han (Electronics and Telecommunications Research Institute) ;
  • Kim, Young-Kil (Electronics and Telecommunications Research Institute)
  • Published : 2018.10.12

Abstract

최근 신경망 번역 모델에 주의 집중 네트워크가 제안되어 기존의 기계 번역 모델인 규칙 기반 번역 모델, 통계적 번역 모델에 비해 높은 번역 성능을 보이고 있다. 그러나 주의 집중 네트워크가 잘못 모델링되는 경우 과소 번역 현상이 나타난다. 신경망 번역 모델에 커버리지 메커니즘을 추가하여 과소 번역 현상을 완화하는 연구가 진행되었으나 이는 모델의 구조를 변경해야하는 불편함이 있다. 본 논문에서는 신경망 번역 모델의 구조를 변경하지 않고 새로운 손실 함수를 정의하여 과소 번역 현상을 완화하는 방법을 제안한다. 한-영 번역 실험을 통해 제안한 주의 집중 네트워크의 정규화 방법이 커버리지 메커니즘의 목적을 효율적으로 달성함을 보인다.

Acknowledgement

Grant : 지식증강형 실시간 동시통역 원천기술 개발

Supported by : 정보통신기술진흥센터