회사소개
블로그
DataSketchers

전체 메뉴

회사소개
사업영역
D-SKET
웹빌더CanvasEvents
고객사
블로그
위키
보도자료
ESG
Topics
기술 스택AI·LLM 통합 (AI & LLM)DeepEval ›››
  • Confident AI
    • 거버넌스 컨트롤
    • 운영 컨트롤
    • 배포 전 평가 컨트롤
    • 배포 전 레드팀 컨트롤
    • 런타임 컨트롤
    • AI 거버넌스 소개
    • 거버넌스 폴리시
    • CI/CD에서 배포 게이트 걸기
    • Confident AI 체인지로그
    • 코딩 에이전트용 MCP 서버
    • 코딩 에이전트용 플러그인
    • 코딩 에이전트용 스킬
    • Confident AI 관리 스킬
    • Confident OpenTelemetry 스킬
    • Confident Tracing 스킬
    • DeepEval 평가 스킬
    • 커스텀 대시보드
    • 커스텀 리포트
    • 가이드
    • Custom Agent Skills로 온보딩 표준화
    • 즉석에서 프로젝트를 거버넌스 폴리시에 할당하기
    • 클라이언트 자격 증명으로 AI 연결 인증
    • 프로덕션에서 모델 비교하기
    • 에어갭 Confident Agent 설정
    • OpenAI Responses 호환 엔드포인트 연결하기
    • MCP 서버 평가하기
    • MCP 클라이언트를 코드에서 평가하기
    • URL로 필터된 뷰 만들기
    • 거버넌스 게이트로 레드티밍된 AI 에이전트 게이트하기
    • 장기 실행 AI Connection 설정하기
    • Arize에서 Confident AI로 전환하기
    • Braintrust에서 Confident AI로 전환하기
    • Langfuse에서 Confident AI로 전환하기
    • LangSmith에서 Confident AI로 전환하기
    • 에이전트용 프로젝트를 즉시 프로비저닝하기
    • 이해관계자를 위한 리포트 생성하기
    • 자동화된 기업용 태그 기반 배포 설정하기
    • 트레이스에서 테스트 런 만들기
    • 관리 작업을 Vibe Code로 하기
    • 어노테이션 큐
    • 피드백 수집하기
    • 오류 분석
    • Eval Alignment
    • Human-in-the-Loop 소개
    • 통합
    • AWS Bedrock AgentCore
    • Google Gemini Enterprise 에이전트 플랫폼
    • Microsoft Foundry
    • OpenTelemetry
    • 분산 추적
    • 수동 계측
    • 트레이스 브로드캐스팅
    • 트레이스 포워딩
    • AgentCore
    • Agno
    • Bifrost
    • Claude Agent SDK
    • Crew AI
    • Deep Agents
    • Google ADK
    • LangChain
    • LangGraph
    • LiteLLM
    • LiveKit Agents
    • LlamaIndex
    • Mastra
    • OpenAI
    • OpenAI Agents
    • OpenInference
    • OpenRouter
    • Portkey
    • Pydantic AI
    • smolagents
    • Strands Agents
    • TrueFoundry
    • Vercel AI SDK
    • 멀티턴 평가
    • LLM-as-a-Judge 메트릭
    • 싱글턴 vs 멀티턴 평가
    • 테스트 케이스, 골든스, 데이터셋
    • 데이터셋 관리 자동화
    • 데이터셋 관리
    • 데이터 소스 커넥터
    • 합성 데이터 생성 소개
    • 데이터셋 가져오기
    • AI 앱으로 실험하기
    • LLM 평가 소개
    • Arena에서 프롬프트와 모델 비교하기
    • 멀티턴 평가
    • 노코드 평가 퀵스타트
    • 싱글턴 평가
    • 프롬프트 관리 자동화
    • 프롬프트 가져오기
    • 프롬프트 버전 관리
    • LLM 평가 퀵스타트
    • 싱글턴 컴포넌트 레벨 평가
    • 싱글턴 종단 간 평가
    • CI/CD에서의 단위 테스트
    • 스레드 평가
    • 트레이스·스레드 알림
    • 고객
    • 트레이스 버리기
    • 트레이스 환경 설정
    • 트레이스 내보내기
    • 입력/출력 설정
    • 프롬프트 로깅
    • 민감한 트레이스 데이터 마스킹
    • 트레이스에 메타데이터 추가
    • 트레이스 모니터
    • 트레이스 이름 커스터마이즈
    • 트레이스를 프로젝트로 보내기
    • 트레이스 샘플링
    • 트레이스·스레드 신호
    • 스팬 타입 구성
    • 트레이스에 태그 추가
    • 스레드 트레이스
    • 위협 탐지
    • LLM 비용 추적
    • 트레이스 컨텍스트 관리
    • 트레이스 트리아지
    • 트레이스에서 사용자 추적
    • LLM 관측성·트레이싱 소개
    • 트레이스·스팬 평가
    • LLM 트레이싱 퀵스타트
    • LLM 트레이싱 트러블슈팅
    • 트레이스 워크플로우
    • 커스텀 메트릭
    • 코드 평가
    • DAG
    • G-Eval
    • LLM 평가 메트릭
    • 메트릭 컬렉션
    • 대화 완성도
    • 목표 정확도
    • 지식 보존
    • 역할 준수
    • 주제 준수
    • 턴 컨텍스트 정밀도
    • 턴 컨텍스트 재현율
    • 턴 컨텍스트 관련성
    • 턴 충실성
    • 턴 관련성
    • 응답 관련성
    • 인자 정확도
    • 편향
    • 컨텍스트 정밀도
    • 컨텍스트 재현율
    • 컨텍스트 관련성
    • 정확 일치
    • Faithfulness
    • Hallucination
    • Image Coherence
    • Image Editing
    • Image Helpfulness
    • Image Reference
    • Misuse
    • Non-Advice
    • Pattern Match
    • PII Leakage
    • Plan Adherence
    • Plan Quality
    • Prompt Alignment
    • Role Violation
    • Step Efficiency
    • Summarization
    • Task Completion
    • Tool Correctness
    • Toxicity
    • DeepTeam으로 레드 팀링(Red Team Using DeepTeam)
    • 코드 취약점 스캐닝(Code Vulnerability Scanning)
    • 레드 팀링 프레임워크 & 정책(Red Teaming Frameworks & Policies)
    • AI 레드 팀링 소개(Introduction to AI Red Teaming)
    • 레드 팀링 퀵스타트(Red Teaming Quickstart) — 노코드
    • 위험 프로필(Risk Profiles)
    • 트레이스 수준 탐지(Trace-Level Detections)
    • 데이터 처리(Data Handling)
    • LLM 사용 사례(LLM Use Cases)
    • 왜 Confident AI인가(Why Confident AI)
    • 셀프 호스팅(Self-Hosting)
    • AWS에서 셀프 호스팅(Self-Hosting on AWS)
    • AWS에서 Helm으로 배포(Deploy on AWS with Helm)
    • AWS 인프라 프로비저닝(Provision AWS Infrastructure)
    • Azure에서 셀프 호스팅(Self-Hosting on Azure)
    • Azure에서 Helm으로 배포(Deploy on Azure with Helm)
    • Azure 인프라 프로비저닝(Provision Azure Infrastructure)
    • 셀프 호스팅 구성 참조(Self-Hosted Configuration Reference)
    • 셀프 호스팅 배포의 재해 복구(Disaster Recovery for Self-Hosted Deployments)
    • 셀프 호스팅 FAQ(Self-Hosting FAQs)
    • Google Cloud에서 셀프 호스팅(Self-Hosting on Google Cloud)
    • Google Cloud에서 Helm으로 배포(Deploy on Google Cloud with Helm)
    • Google Cloud 인프라 프로비저닝(Provision Google Cloud Infrastructure)
    • 셀프 호스팅 POC 환경(Self-Hosted POC Environments)
    • 셀프 호스팅 인프라 확장(Scaling Self-Hosted Infrastructure)
    • 셀프 호스팅 보안 & 컴플라이언스(Security & Compliance for Self-Hosted Deployments)
    • 셀프 호스팅 배포 문제 해결(Troubleshooting Self-Hosted Deployments)
    • 플랫폼 설정(Platform Settings)
    • 데이터 리전(Data Residency)
    • 조직 감사 로그(Organization Audit Logs)
    • 조직 데이터 보존(Organization Data Retention)
    • 기능 접근
    • 조직 모델 자격 증명
    • 온보딩 스킬
    • 조직 프로젝트 관리
    • 조직 역할 및 권한
    • SSO
    • 조직 사용자 관리
    • AI Connections
    • AI Connections용 Async Responses
    • AI Connections용 Authorization
    • 테스트 케이스를 트레이스에 연결하기
    • AI Connections용 Multi-Generation
    • AI Connections용 Multi-Turn State
    • AI Connections용 Prompts & Hyperparameters
    • AI Connections용 Streaming Responses
    • AI Connections용 Throttling & Retries
    • 주석 옵션
    • 프로젝트 API 키
    • 프로젝트 감사 로그
    • Confident Agent
    • Handler Mode
    • 프로젝트 데이터 보존
    • 지식 베이스
    • 데이터 사용량
    • 평가 모델
    • 프로젝트 통합
    • MR Eval Gate
    • PR Eval Gate
    • Admin SDK로 API 키 관리하기
    • Admin SDK로 거버넌스 정책 관리하기
    • Admin SDK 소개
    • Admin SDK로 멤버와 초대 관리하기
    • Admin SDK로 조직 관리하기
    • Admin SDK로 프로젝트 관리하기
    • Admin SDK 퀵스타트
    • Admin SDK로 역할과 권한 관리하기
    • MCP 서버
    • 모델 비용
    • 프로젝트 역할과 권한
    • 팀 멤버
    • 위협 탐지 구성
    • 트랜스포머
    • 역할 기반 접근 제어
    • 설정 및 설치
    • 지원
기술 스택AI·LLM 통합 (AI & LLM)DeepEval › › ›

Confident AI

목차
Confident AI

Confident AI

Confident AI LLM 평가·옵저버빌리티 플랫폼 공식 문서입니다.

Confident AI
DataSketchers AI·데이터·디자인으로 기업의 디지털 전환을 지원합니다. 서울시립대학교 캠퍼스타운 창업기업
회사소개 사업영역 D-SKET 고객사 블로그 위키 보도자료 ESG 문의
© 데이터스케쳐스. All rights reserved. 사업자등록번호 349-81-03411