LlamaHub 개요

LlamaHub 개요

LlamaHub는 'LLM에게 다양한 데이터를 연결해주는 다리' 역할을 하는 로더·도구 모음이에요. Google Docs, SQL, Notion 같은 소스의 데이터를 읽어 LlamaIndex나 LangChain의 파이프라인에 주입할 수 있게 해 줘요.

출처: run-llama/llama-hub

LlamaHub는 커뮤니티가 만든 데이터 로더(data loader)/리더(reader)/도구(tool)/llama-pack/llama-dataset 모음이에요. 큰 모델의 지식 소스와 강력한 언어 모델을 연결하는 걸 쉽게 하는 게 목표였어요. 로더와 리더는 검색·리트리벌을 위해 데이터를 간편하게 주입하게 해 주고, 도구는 언어 모델이 다양한 소스를 읽고 사용할 수 있게 해 줘요.

이용 방식은 간단해요. 필요에 따라 단일 로더를 쓰거나, LlamaIndex의 download_loader / VectorStoreIndex와 연결해 문서를 색인하고 질의하는 구조예요.

from llama_index import VectorStoreIndex
from llama_hub.google_docs import GoogleDocsReader

gdoc_ids = ['1wf-y2pd9C878Oh-FmLH7Q_BQkljdm6TQal-c1pUfrec']
loader = GoogleDocsReader()
documents = loader.load_data(document_ids=gdoc_ids)
index = VectorStoreIndex.from_documents(documents)
index.query('Where did the author go to school?')

⚠️ 주의: 이 저장소는 LlamaIndex v0.10 출시와 함께 아카이브되어 읽기 전용이 됐어요. 데이터 로더·도구·팩 통합은 이제 코어 llama-index 파이썬 저장소에 포함돼 있어요. LlamaHub 사이트(llamahub.ai)는 계속 운영되며 해당 통합들을 가리키고 있죠. 새 프로젝트라면 코어 llama-index의 통합을 쓰는 게 올바른 방향이에요.

더 알아보기