Arxiv 논문 도구
Arxiv 논문 도구 (ArxivPaperTool)
CrewAI의 ArxivPaperTool은 arXiv API에 쿼리해서 학술 논문을 찾고, 간결하고 읽기 쉬운 결과를 반환하는 도구예요. 선택적으로 PDF를 디스크에 다운로드할 수도 있답니다. API 키가 따로 필요 없어서 학술 리서치에 바로 사용하기 좋아요.
출처: 문서
본문
ArxivPaperTool은 학술 논문을 위해 arXiv API에 쿼리하고, 간결하고 읽기 쉬운 결과를 반환합니다. 선택적으로 PDF를 디스크에 다운로드할 수도 있어요.
설치 (Installation)
이 도구는 crewai-tools 외에 특별한 설치가 필요 없습니다.
uv add crewai-tools
API 키가 필요 없고, 이 도구는 공개 arXiv Atom API를 사용해요.
시작하는 방법 (Steps to Get Started)
- 도구를 초기화하세요.
search_query를 제공하세요 (예: "transformer neural network").- 선택적으로
max_results(1–100)를 설정하고, 생성자에서 PDF 다운로드를 활성화하세요.
예시 (Example)
from crewai import Agent, Task, Crew
from crewai_tools import ArxivPaperTool
tool = ArxivPaperTool(
download_pdfs=False,
save_dir="./arxiv_pdfs",
use_title_as_filename=True,
)
agent = Agent(
role="Researcher",
goal="Find relevant arXiv papers",
backstory="Expert at literature discovery",
tools=[tool],
verbose=True,
)
task = Task(
description="Search arXiv for 'transformer neural network' and list top 5 results.",
expected_output="A concise list of 5 relevant papers with titles, links, and summaries.",
agent=agent,
)
crew = Crew(agents=[agent], tasks=[task])
result = crew.kickoff()
직접 사용하기 (에이전트 없이)
from crewai_tools import ArxivPaperTool
tool = ArxivPaperTool(
download_pdfs=True,
save_dir="./arxiv_pdfs",
)
print(tool.run(search_query="mixture of experts", max_results=3))
파라미터 (Parameters)
초기화 파라미터 (Initialization Parameters)
download_pdfs(bool, 기본값False): PDF를 다운로드할지 여부save_dir(str, 기본값./arxiv_pdfs): PDF를 저장할 디렉터리use_title_as_filename(bool, 기본값False): 파일명에 논문 제목 사용 여부
실행 파라미터 (Run Parameters)
search_query(str, required): arXiv 검색 쿼리예요.max_results(int, 기본값5, 범위 1–100): 결과 수입니다.
출력 형식 (Output format)
이 도구는 사람이 읽기 쉬운 논문 목록을 반환하며, 각 항목에 다음이 포함됩니다.
- 제목(Title)
- 링크(Link, abs 페이지)
- 스니펫/요약(Snippet/summary, 잘린 형태)
download_pdfs=True이면 PDF가 디스크에 저장되고 요약에 저장된 파일이 언급됩니다.
사용 참고 (Usage Notes)
- 이 도구는 핵심 메타데이터와 링크가 포함된 포맷된 텍스트를 반환합니다.
download_pdfs=True이면 PDF가save_dir에 저장됩니다.
문제 해결 (Troubleshooting)
- 네트워크 타임아웃이 발생하면 다시 시도하거나
max_results를 줄이세요. - Invalid XML 오류는 arXiv 응답 파싱 문제를 의미하니, 더 간단한 쿼리를 시도해 보세요.
- PDF 저장 중 파일 시스템 오류(예: permission denied)가 발생할 수 있으니
save_dir이 쓰기 가능한지 확인하세요.
관련 링크 (Related links)
- arXiv API 문서: https://info.arxiv.org/help/api/index.html
에러 처리 (Error Handling)
- 네트워크 문제, 잘못된 XML, OS 오류는 정보성 메시지로 처리됩니다.