전체 그래프
Concepts

Data Fabric

data-engineeringarchitecturedata-fabricdata-integration

상위: Data Engineering

요약

데이터 패브릭은 기업이 보유한 분산된 데이터 환경을 하나의 통합된 계층으로 원활하게 연결하고 관리하는 현대적인 데이터 아키텍처 접근 방식입니다. 사용자는 데이터의 물리적 위치나 기술적 복잡성을 몰라도 필요한 데이터에 쉽게 접근하고 활용할 수 있습니다.

핵심 개념 및 장점

  • 통합된 데이터 관리:
    • 다양한 환경에 분산된 데이터를 하나의 플랫폼에서 통합하고 모니터링
    • 데이터 사일로를 해소하고 전체 데이터에 대한 통합된 뷰를 제공
  • 지능형 자동화:
    • AI와 머신러닝을 활용하여 데이터 통합, 품질 관리, 거버넌스 등의 프로세스를 자동화
    • 이를 통해 데이터 관리 효율을 높여, Gartner 추정에 따르면 통합 설계·배포 시간을 각 30%, 유지보수 관련 개발 작업량을 최대 70%까지 절감 가능
  • 데이터 접근성 향상:
    • 사용자는 데이터의 물리적 위치나 형식을 몰라도 셀프 서비스 인터페이스를 통해 필요한 데이터에 쉽게 접근할 수 있음
  • 강화된 거버넌스 및 규제 준수:
    • 중앙화된 데이터 거버넌스를 통해 데이터 보안, 프라이버시, 관련 규제 준수를 효과적으로 관리할 수 있음

주요 구성 요소

데이터 패브릭 아키텍처는 일반적으로 다음과 같은 요소들로 구성

  1. 데이터 카탈로그: 모든 데이터 자산에 대한 메타데이터(데이터에 대한 정보)를 중앙에서 관리
  2. 데이터 통합 레이어: 다양한 데이터 소스를 연결하고 ETL(추출, 변환, 적재) 프로세스를 자동화
  3. 데이터 가상화: 물리적인 데이터 이동 없이 다양한 소스의 데이터를 통합된 뷰로 제공
  4. AI/ML 엔진: 데이터 관리 프로세스를 자동화하고 최적화하는 데 사용
  5. 셀프 서비스 인터페이스: 사용자가 쉽게 데이터를 탐색하고 활용할 수 있도록 지원

Data Fabric vs. Data Mesh

특징데이터 패브릭 (Data Fabric)데이터 메시 (Data Mesh)
아키텍처중앙화된 통합 레이어 (하나의 거대 그물망)분산형 아키텍처 (독립적 생태계의 공존)
데이터 소유권중앙 IT 팀이 주도비즈니스 도메인이 자체 데이터 소유/책임
핵심 강조점AI/ML을 통한 높은 수준의 자동화도메인 전문성과 자율성