데이터 처리(Data Handling)

데이터 처리(Data Handling)

Confident AI에서 데이터가 어떻게 구성되고 분리되는지, 프라이버시, 리전(리지던시) 등 데이터와 관련된 모든 것을 다룰 수 있어요. 조직이 커질수록 데이터가 어디에 어떻게 쌓이는지 정확히 알아야 안심하고 쓸 수 있으니까요.

출처: 문서

본문

데이터 구성과 분리(Data Organization and Separation)

Confident AI에서 계정을 처음 만들면, **조직(organization)**과 그 안의 **프로젝트(project)**가 자동으로 생겨요. 각 조직에는 여러 개의 프로젝트와 사용자가 있을 수 있어요.

서로 다른 LLM 사용 사례마다 별도의 프로젝트를 만들어 두는 걸 권해요. 같은 코드베이스나 비즈니스 로직을 공유하더라도 말이죠. 사용 사례마다 데이터셋과 지표가 달라지기 때문이에요.

Confident AI의 데이터 구성

Confident AI의 데이터 구성과 분리

조직이 규모를 키우면서 할 수 있는 일들:

  • 프로젝트에 사용자를 더 초대해요 (프로젝트 데이터 접근 권한이 생겨요)
  • 조직에 사용자를 더 초대해요 (아직 프로젝트 데이터에 접근할 수 없어요)
  • 조직 안에 프로젝트를 더 만들 수 있어요

모든 데이터(테스트 케이스 데이터, 지표 데이터, 데이터셋 데이터, 트레이싱 데이터 등)는 프로젝트 수준에서 분리돼요. 한 프로젝트의 사용자는 같은 조직에 속해 있더라도, 자기 프로젝트가 아닌 데이터에는 접근할 수 없어요.

조직(Organization)

조직은 모든 Confident AI 리소스의 최상위 컨테이너예요. 구독 플랜과 결제 주기는 조직 수준에서 관리돼요. 예를 들어 Team 플랜을 구독하면 조직 안의 모든 프로젝트가 자동으로 Team 플랜 기능을 받아요.

프로젝트(Project)

프로젝트는 조직 안에서 데이터와 접근 권한이 격리된 별도의 작업 공간처럼 동작해요. 조직 안의 서로 다른 팀이나 사용 사례가 각자 독립된 LLM 평가 워크플로우를 유지할 수 있게 해 주죠.

계정을 만든 뒤 초기 온보딩을 마치면, 당신이 조직 안의 프로젝트에 속한 유일한 사용자가 돼요.

graph TD
    ORG[Your Organization] --> PROJ[Your Project]
    ORG --> USER[You]
    USER -. Access .-> PROJ
    PROJ --> DATA[Project Data]

데이터 보존(Data Retention)

데이터 보존 기간은 가격 플랜에 따라 달라져요. 아래 데이터 유형만 자동 삭제 대상이에요:

  • 테스트 실행 데이터 (지표 데이터 포함)
  • 트레이싱 데이터 (지표 데이터 포함)

데이터셋과 프롬프트는 활성 계정을 유지하는 한 보존돼요. 테스트 실행·트레이싱 데이터의 보존 기간을 멤버십 등급별로 정리하면:

  • Free: 1주
  • Starter: 무제한
  • Team: 무제한
  • Enterprise: 무제한

더 긴 보존 기간이 필요하면 [email protected]로 연락해 주세요.

데이터 프라이버시(Data Privacy)

Confident AI가 처리하고 저장하는 모든 데이터는 저장 중(at rest) 암호화되고, 전송 중에는 TLS로 보호돼요. 엔터프라이즈 고객의 가장 엄격한 데이터 보안 요구를 충족하도록 SOC II와 HIPAA 컴플라이언스를 유지하고 있어요.

SOC II 인증과 HIPAA BAA(Business Associate Agreement)는 Team 플랜 이상 고객에게 제공돼요.

데이터 내보내기(Data Exportation)

Confident AI를 떠나기로 결정해도 모든 데이터를 내보낼 수 있게, 벤더 락인(vendor lock-in)을 방지하고 있어요. 이 서비스는 Team 플랜 이상 고객에게 제공되며, 해지 후 30일 안에 요청을 제출하면 돼요.

Confident AI를 계속 사용하는 경우에는, 다운스트림 처리를 위해 데이터를 조회·검색할 수 있는 포괄적인 API 엔드포인트를 제공해요.

더 알아보기