Phoenix — 오픈소스 LLM 옵저버빌리티 플랫폼
Phoenix
생성형 AI 앱을 만들었다면, 한 번의 실행에서 모델이 뭘 받아서 어떻게 답했는지 — 그리고 그 답이 옳은지 — 보여주는 도구가 필요해요. Phoenix는 Arize AI와 오픈소스 커뮤니티가 만든 LLM 옵저버빌리티 플랫폼으로, 앱에서 보낸 상세 로그인 트레이스(trace)를 봐서 실행 중 무슨 일이 일어났는지 확인하고, 평가 테스트로 출력 품질을 점수화해 실패와 회귀를 찾으며, 실제 운영 예제로 프롬프트를 반복 개선하고, 같은 입력에서 변경을 비교하는 실험으로 앱을 최적화해요. OpenTelemetry 위에 구축되고 OpenInference 인스트루멘테이션으로 동작해요.
이 카테고리의 문서
- 소개: Phoenix가 제공하는 관찰·평가·개선 흐름
- 핵심 기능: 트레이싱·평가·프롬프트·데이터셋/실험
- 트레이싱 실전: 로컬 기동부터 에이전트 인스트루먼트까지