상위: Data Engineering
요약
Elasticsearch는 Apache Lucene 기반의 분산 검색 및 분석 엔진입니다. JSON 기반의 문서를 저장하고, REST API를 통해 검색 및 분석 기능을 제공합니다.
핵심 개념
- Node: 클러스터의 실행 인스턴스
- Shard & Replication: 데이터 분산 및 복제 단위
- Mapping & Fields: 데이터 구조 정의
- Indexing: 데이터 저장 과정
- Analyzer: 텍스트 분석 및 토큰화
기능 및 사용법
시작하기
- Installation: 설치 및 환경 구성
- REST API: 기본 CRUD 및 API 사용법
검색 및 분석
- Search APIs: 검색 API
- Query DSL: 검색 질의 언어
- Aggregation: 데이터 집계
운영 및 관리
- Cluster Management: 클러스터 운영
- Data Lifecycle: 데이터 수명 주기 관리 (ILM)
- Migration: 데이터 마이그레이션
특징
- 분산 구조: 자동 분산 저장 및 검색
- 전문 검색 (Full-Text Search): 강력한 검색 기능
- 확장성: 수평적 확장 용이
- 유연성: 스키마리스(Schemaless) 지원 (권장되지는 않음)
- Elastic Stack: Logstash, Kibana, Beats와 함께 사용
활용 사례
- 기업 검색 (Enterprise Search)
- 로그 수집 및 분석 (Log Analytics)
- SIEM (보안 관제)
- 데이터 분석 및 추천 시스템