NLTK API 참조
NLTK API 참조
NLTK의 각 기능은 모듈 단위로 나뉘어 있어요. 토큰화는 nltk.tokenize, 품사 태깅은 nltk.tag, 개체명 인식은 nltk.chunk, 분류는 nltk.classify처럼 영역별로 정리돼 있죠.
유용한 모듈
nltk.tokenize— 문장·단어 토큰화nltk.tag— 품사 태깅 (pos_tag)nltk.chunk— 청킹·개체명 인식 (ne_chunk)nltk.classify— 분류기 학습·평가
from nltk.tokenize import sent_tokenize, word_tokenize
sentences = sent_tokenize("Hello world. This is NLTK.")
print(sentences)
확인 포인트
- 공식 API 문서에서 함수 시그니처와 반환형을 정확히 확인할 수 있어요.
- 모듈 이름이 곧 기능의 영역이라 찾기 쉬워요.