Architecture
타란툴라 데이터 플랫폼의 제품 구성과 계층별 역할
플랫폼 개요
Tarantula Data Platform은 운영 데이터베이스, 대규모 분석, AI 검색과 PostgreSQL 성능 진단을 네 개의 제품으로 연결합니다. 각 제품은 독립적으로 도입할 수 있으며 데이터 성장과 활용 목적에 맞춰 단계적으로 확장합니다.
01
TarantulaDB
핵심 업무 데이터의 안정적인 저장과 운영
02Lakehouse
대규모 이력 데이터의 통합·분석·보존
03AI 벡터DB
RAG와 의미 기반 검색을 위한 데이터 엔진
04TaranTuner
PostgreSQL 관측·진단·튜닝
데이터 흐름
업무 트랜잭션은 TarantulaDB에서 처리하고, 장기 이력과 대규모 분석 데이터는 Lakehouse로 수집합니다. AI 서비스는 원천 데이터에서 필요한 범위를 선별해 벡터화하고, 운영 품질은 TaranTuner로 관찰·분석합니다.
Design principle
운영, 분석과 AI 워크로드를 물리적으로 분리해 서로의 부하 영향을 줄이되 개방형 인터페이스와 표준 SQL로 연결합니다.
배포 모델
- 단일 제품으로 시작하는 부서·업무 단위 구성
- TarantulaDB와 Lakehouse를 연결하는 운영·분석 분리 구성
- Lakehouse와 AI 벡터DB를 연결하는 RAG·AI 데이터 플랫폼
- 고가용성, 백업, 모니터링과 DR을 포함한 엔터프라이즈 구성
이 문서가 도움이 되었나요?