
Chango 주요 기능
에이전트와 데이터가 같은 플랫폼 안에서 함께 사는, 자체 호스팅형 AI 데이터 플랫폼.
Iceberg Native 레이크하우스
Chango는 Iceberg를 단순 지원하는 것이 아니라, 처음부터 Apache Iceberg를 1급 저장 모델로 설계했습니다. Spark·Trino·Flink가 하나의 Iceberg 카탈로그(Apache Polaris)를 공유하고, ACID 트랜잭션·스키마 진화·타임 트래블을 그대로 활용합니다. 데이터는 표준 Iceberg 포맷으로 오픈 스토리지에 저장되어 엔진·벤더 종속이 없습니다.
하나의 자체 호스팅 플랫폼
오브젝트 스토리지, 스트리밍, 배치·SQL, OLTP·벡터·그래프, 워크플로우, 그리고 에이전트까지 — 단일 컨트롤 플레인에서 설치·기동·확장·관측합니다.
AI는 별도 통합이 아닌 기본 구성
멀티 에이전트 런타임과 MCP(Model Context Protocol) 서버가 1급 컴포넌트로 함께 제공됩니다. Ontul MCP 서버는 ontul_search_metrics·ontul_describe_semantic_view 같은 도구로 메트릭 발견과 자연어 검색(매출 ↔ revenue), 인증 메타데이터를 LLM 에이전트에게 표준 인터페이스로 제공합니다.
Ontul 시맨틱 레이어 — 에이전트의 단일 진실
Chango의 데이터 엔진 Ontul은 프로덕션급 시맨틱 레이어를 내장합니다. 메트릭을 한 번 정의하면 LLM 에이전트·BI 대시보드·분석가가 모두 같은 정의로 같은 숫자를 봅니다. 집계·조인·RBAC은 서버에서 처리되어 에이전트는 컬럼명만 알면 되고, 환각된 수식이 아니라 검증된 비즈니스 정의로 답합니다.
네이티브 Retrieval 스택
벡터 유사도, BM25 풀텍스트, 그래프 탐색이 트랜잭션 데이터와 같은 엔진 안에서 동작합니다. 별도 벡터 DB도, 동기화도 필요 없습니다.
하나의 ID 체계
하나의 IAM 정책이 SQL 쿼리, 에이전트 도구 호출, MCP 요청, 객체 접근, 스트림 소비까지 — 모든 계층에 일관되게 적용됩니다. 여기에 **싱글 사인온(OIDC · SAML 2.0 · LDAP/Active Directory)** 을 붙이면 기존 ID 제공자가 그대로 신원의 출처가 됩니다. 제공자가 알려준 그룹이 플랫폼의 그룹으로 매핑되고 권한은 여전히 그 그룹에 붙은 정책이 결정하므로, 제공자를 바꿔도 정책은 그대로입니다. 로컬 계정을 새로 만들지 않으니 디렉터리에서 사람을 지우면 접근도 함께 사라집니다.
엔진 통합 리니지 · 감사
별도의 리니지 수집기나 로그 수집 에이전트 없이, 인가(authorization) 계층에서 곧바로 기록합니다. Trino · Spark · Flink의 모든 테이블 접근이 감사 이벤트로 남고 — 허용된 쿼리뿐 아니라 거부된 시도까지 사유와 함께 — 성공한 쓰기(CTAS · INSERT · MERGE)는 소스에서 타깃으로 이어지는 리니지 그래프가 됩니다. 기록은 비동기 · 베스트에포트로 동작해 쿼리를 절대 지연시키지 않습니다.
검증된 오픈소스 엔진 포용
모든 엔진(Spark · Trino · Flink · Kafka)이 Apache Iceberg 테이블 포맷과 Apache Polaris 카탈로그를 공통 기반으로 공유합니다 — 같은 IAM, 같은 관측성, 같은 운영 경험으로.
믿을 수 있는 운영
클러스터 토폴로지, 실시간 메트릭, KMS 암호화 상태, 버전 고정형 컴포넌트 라이프사이클, 감사 가능한 대시보드까지 기본 제공. 마스터키는 무중단 회전이 가능하고(구 키는 읽기 전용으로 함께 보유), 컨트롤 플레인 백업은 S3 호환 스토리지로 스케줄 업로드되며 복원 전에 '어느 키가 필요한지'를 검증합니다. 제품 클러스터를 삭제해도 그 제품의 마스터키는 보존되어, 외부 DB나 별도 데이터 디스크에 남은 데이터를 다시 읽을 수 있습니다.
카탈로그까지 지키는 백업
컨트롤 플레인뿐 아니라 관리 대상 PostgreSQL도 S3로 백업하고 복원합니다. Iceberg 카탈로그(Polaris)의 메타스토어가 여기 있기 때문입니다 — 이 메타스토어를 잃으면 오브젝트 스토리지의 데이터 파일은 한 바이트도 사라지지 않지만, 그 파일들을 가리키는 모든 포인터가 사라집니다. 덤프는 데이터베이스가 있는 노드에서 만들어 곧바로 S3로 올라가므로 마스터를 거치지 않고, 크론 스케줄·보존 정책·화면에서의 1클릭 복원을 지원합니다.
폐쇄망 반입까지 고려한 배포
설치 과정에 외부 저장소 접속이 없습니다. 하나의 번들을 매체로 반입해 기반부터 컴포넌트까지 설치합니다. 번들에는 3계층 체크섬(매체 · 내용물 · 제품별)과 두 종류의 BOM이 함께 들어갑니다 — 제품 단위 인벤토리(버전 · 다이제스트 · 라이선스 · 출처)와 라이브러리 단위 CycloneDX SBOM. 취약점 공지는 제품이 아니라 라이브러리 이름으로 나오기 때문에, 고객 보안 부서가 영향 여부를 직접 조회할 수 있습니다.
활용 사례
AI 네이티브 분석
비즈니스 사용자가 자연어로 질문하면 에이전트가 MCP로 데이터 엔진에 접근해, 운영자의 IAM 안에서 신뢰할 수 있는 답을 돌려줍니다.
Retrieval-Augmented 애플리케이션
벡터·풀텍스트·그래프 관계가 한 엔진에 모여, 외부 벡터 DB 없이 프로덕션 RAG와 하이브리드 검색을 구동합니다.
소버린 데이터 플랫폼
AI 데이터 스택 전체를 온프레미스 또는 자체 클라우드 계정에서 운영 — 데이터가 경계 밖으로 나가지 않습니다.
멀티테넌트 엔진 메시
Spark·Trino·Flink·Kafka가 하나의 ID와 리소스 그룹 아래에서 인프라를 공유하되 데이터는 격리됩니다.
