NLTK HowTo

NLTK HowTo

NLTK는 토큰화, 개체명 인식, 감정 분석처럼 특정 작업을 빠르게 확인할 수 있는 HowTo 주제별 노트를 제공해요. 실제 코드 예시를 그대로 따라 하며 개별 기능을 익히기 좋아요.

토큰화 예시

import nltk
from nltk.tokenize import word_tokenize

text = "Natural language processing is fun."
tokens = word_tokenize(text)
print(tokens)

개체명 인식 예시

from nltk import pos_tag, ne_chunk
from nltk.tokenize import word_tokenize

tokens = word_tokenize("Alice works at Google.")
print(ne_chunk(pos_tag(tokens)))

확인 포인트

  • HowTo 별로 독립된 예시가 있어서 필요한 주제만 골라 볼 수 있어요.
  • 감정 분석은 nltk.sentiment.SentimentIntensityAnalyzer가 자주 쓰여요.

출처: https://www.nltk.org/howto/

더 알아보기