OpenNMT-py 빠른 시작 — 데이터 준비부터 번역까지
OpenNMT-py 빠른 시작
OpenNMT-py 퀵스타트는 번역 실습을 짧게 따라 해 보려는 사람에게 딱 알맞아요. 데이터 전처리, 모델 훈련, 번역, 평가를 한 흐름으로 보여줍니다.
다루는 단계
- 훈련·검증에 쓸 병렬 코퍼스를 준비해요.
- 문장을 토큰으로 나누고 어휘(vocabulary)를 만듭니다.
- 시퀀스 투 시퀀스 모델을 훈련(cuda 훈련 가능)해요.
- 훈련된 모델로 테스트 문장을 번역하고, BLEU 같은 지표로 평가해요.
참고
OpenNMT-tf(TensorFlow)를 원한다면 같은 사이트의 별도 문서를 보면 돼요. 두 구현 모두 MIT 라이선스라 상업적으로도 재사용하기 편해요.