NLTK API 참조

NLTK API 참조

NLTK의 각 기능은 모듈 단위로 나뉘어 있어요. 토큰화는 nltk.tokenize, 품사 태깅은 nltk.tag, 개체명 인식은 nltk.chunk, 분류는 nltk.classify처럼 영역별로 정리돼 있죠.

유용한 모듈

  • nltk.tokenize — 문장·단어 토큰화
  • nltk.tag — 품사 태깅 (pos_tag)
  • nltk.chunk — 청킹·개체명 인식 (ne_chunk)
  • nltk.classify — 분류기 학습·평가
from nltk.tokenize import sent_tokenize, word_tokenize
sentences = sent_tokenize("Hello world. This is NLTK.")
print(sentences)

확인 포인트

  • 공식 API 문서에서 함수 시그니처와 반환형을 정확히 확인할 수 있어요.
  • 모듈 이름이 곧 기능의 영역이라 찾기 쉬워요.

출처: https://www.nltk.org/api/nltk.html

더 알아보기