Hugging Face에서 Stanza 사용하기

Hugging Face에서 Stanza 사용하기 (Using Stanza at Hugging Face)

stanza는 많은 인간 언어의 언어학적 분석을 위한 정확하고 효율적인 도구 모음이에요. 원시 텍스트부터 구문 분석과 개체 인식까지, Stanza는 내가 선택한 언어에 최신 NLP 모델을 가져다줍니다.

출처: 문서

본문

stanza는 많은 인간 언어의 언어학적 분석을 위한 정확하고 효율적인 도구 모음입니다. 원시 텍스트에서 구문 분석과 개체 인식까지, Stanza는 선택한 언어에 최신 NLP 모델을 제공해요.

Hub에서 Stanza 살펴보기 (Exploring Stanza in the Hub)

models 페이지 왼쪽에서 필터링하면 stanza 모델을 찾을 수 있어요. 다양한 언어로 된 70개 이상의 모델을 찾을 수 있습니다!

Hub의 모든 모델에는 다음 기능이 함께 제공됩니다:

  1. 검색 가능성에 도움이 되는 간단한 설명과 메타데이터 태그가 있는 자동 생성 모델 카드.
  2. 브라우저에서 모델을 직접 만져볼 수 있는 대화형 위젯 (named entity recognition과 part of speech용).
  3. 추론 요청을 할 수 있는 Inference Providers 위젯 (named entity recognition과 part of speech용).

기존 모델 사용하기 (Using existing models)

stanza 라이브러리는 Hub에서 모델을 자동으로 다운로드합니다. stanza.Pipeline을 사용해 Hub에서 모델을 다운로드하고 추론을 할 수 있어요.

import stanza

nlp = stanza.Pipeline('en') # download th English model and initialize an English neural pipeline
doc = nlp("Barack Obama was born in Hawaii.") # run annotation over a sentence

모델 공유하기 (Sharing your models)

새 공식 Stanza 모델을 추가하려면 새 언어 추가 과정을 따르고 모델을 Stanza 팀과 공유하면 됩니다. Hub에 모델을 업로드하는 공식 스크립트는 여기에서 찾을 수 있어요.

추가 리소스 (Additional resources)

더 알아보기 (Learn more)

stanza.Pipeline('en')로 Hub에서 모델을 자동 다운로드해 언어 분석 추론을 수행할 수 있어요. 70개 이상의 언어별 모델이 있고, named entity recognition·part of speech 위젯으로 웹에서 바로 시험해볼 수 있습니다. 새 언어 모델 추가는 Stanza 팀의 가이드를 따르세요.