OpenNMT-py 빠른 시작 — 데이터 준비부터 번역까지

OpenNMT-py 빠른 시작

OpenNMT-py 퀵스타트는 번역 실습을 짧게 따라 해 보려는 사람에게 딱 알맞아요. 데이터 전처리, 모델 훈련, 번역, 평가를 한 흐름으로 보여줍니다.

출처: https://opennmt.net/OpenNMT-py/quickstart.html

다루는 단계

  1. 훈련·검증에 쓸 병렬 코퍼스를 준비해요.
  2. 문장을 토큰으로 나누고 어휘(vocabulary)를 만듭니다.
  3. 시퀀스 투 시퀀스 모델을 훈련(cuda 훈련 가능)해요.
  4. 훈련된 모델로 테스트 문장을 번역하고, BLEU 같은 지표로 평가해요.

참고

OpenNMT-tf(TensorFlow)를 원한다면 같은 사이트의 별도 문서를 보면 돼요. 두 구현 모두 MIT 라이선스라 상업적으로도 재사용하기 편해요.

더 알아보기