데이터베이스 주제 모음
45개 주제
- 데이터베이스
데이터 가상화(Data Virtualization)
흩어진 이기종 데이터를 복제·이동 없이 질의 시점에 가상 계층으로 실시간 통합해 단일 뷰로 제공하는 통합 기술 — 연결·가상뷰·질의최적화(푸시다운)·거버넌스 계층, ETL/DW와의 비교와 하이브리드, 논리적 데이터 웨어하우스·데이터 패브릭 연계.
- 데이터베이스
공공데이터베이스 표준화 관리(2023.04)
공공DB 표준화 관리 매뉴얼의 구축 단계별 예방적 품질관리 활동과 4개 진단영역·9개 진단항목.
- 데이터베이스
다차원 색인구조(Multidimensional Index Structure)
다차원·공간 데이터 검색을 위한 색인구조(R-Tree·KD-Tree·Quad-Tree·Grid File)의 개념·유형·활용.
- 데이터베이스
컬럼 기반 저장(Columnar Storage)
테이블을 열 단위로 물리 배치해 선택적 컬럼 읽기·고압축·벡터화 실행을 실현하는 분석(OLAP) 최적 저장 모델 — 행 지향(NSM)과의 구조 비교, 사전·RLE·델타 인코딩과 데이터 스키핑·늦은 구체화, Parquet·ORC 하이브리드 포맷과 레이크하우스, HTAP·압축 트레이드오프·개방형 포맷 락인 회피 등 기술사 고려사항을 논술형으로 다룬다.
- 데이터베이스
정적 SQL과 동적 SQL 비교
컴파일 시 확정되는 정적 SQL과 런타임 생성되는 동적 SQL의 성능·유연성·보안(Injection) 비교.
- 데이터베이스
CRUD 매트릭스(CRUD Matrix)
프로세스와 엔터티의 생성·조회·수정·삭제 관계를 행렬로 표현해 데이터-기능 정합성을 검증하는 분석 도구.
- 데이터베이스
데이터 품질관리(Data Quality Management)
데이터 품질관리 아키텍처·성숙도, 정형/비정형 품질기준, 표준화·예방·측정·책임 전략.
- 데이터베이스
최종 일관성(Eventual Consistency)과 분산 시스템 일관성 모델
갱신이 멈추고 복제 전파가 완료되면 복제본이 수렴하는 최종 일관성의 원리와 강한·인과적·세션 일관성 비교, 버전·논리시계·충돌 해결·멱등 재시도, CQRS·CRDT·글로벌 서비스 사례 및 기술사 관점의 보장 수준·관측·복구 설계를 논술형으로 정리한다.
- 데이터베이스
데이터베이스 병행 제어(Concurrency Control)
동시 트랜잭션의 이상현상을 막는 병행 제어 기법(로킹 2PL·타임스탬프·낙관적·MVCC)과 격리 수준·교착상태 관리.
- 데이터베이스
그래프 데이터베이스(Graph Database)와 프로퍼티 그래프·RDF 모델
노드·관계·속성을 저장 구조의 핵심으로 삼아 경로·패턴·연결성을 질의하는 그래프 데이터베이스의 구조와 모델링 절차를 설명하고, 프로퍼티 그래프와 RDF의 선택 기준, 질의·분석·사기탐지·추천 적용 및 품질·보안·원장 경계를 정리한다.
- 데이터베이스
데이터베이스 정규화(Normalization)
중복 제거와 이상현상(삽입·삭제·갱신) 방지를 위한 정규화 — 이상현상 발생 원리, 함수종속 기반 무손실 분해, 1NF~BCNF 단계, 반정규화와의 트레이드오프.
- 데이터베이스
CAP 이론의 한계와 PACELC
CAP은 분할 시 C·A 택일만 설명하는 한계. PACELC는 정상 시 지연(L) vs 일관성(C) 트레이드오프를 추가해 분산 DB 선택을 안내.
- 데이터베이스
오픈 테이블 포맷(Apache Iceberg)
객체 스토리지 위 파일 뭉치에 스냅샷 기반 ACID·숨은 파티셔닝·스키마/파티션 진화·타임 트래블을 부여하는 엔진 중립적 오픈 테이블 포맷 Apache Iceberg의 메타데이터 계층 구조, 동작 원리, CoW/MoR·컴팩션, Delta·Hudi·Hive 비교와 표준화 동향을 심화 정리한다.
- 데이터베이스
데이터 거버넌스(Data Governance)
정책·조직·프로세스·기술로 데이터의 표준·품질·메타데이터·보안·생애주기를 통합 관리하는 통제 체계. 데이터 스튜어드십과 표준화가 핵심이며 데이터 메시·DataOps·AI 거버넌스로 진화.
- 데이터베이스
데이터베이스 커넥션 풀(Connection Pool) 설계와 튜닝
데이터베이스 연결을 재사용해 연결 설립 비용과 동시성 폭주를 제어하는 커넥션 풀의 원리, 대여·반납·검증·타임아웃, 풀 크기 산정, 애플리케이션 풀과 외부 풀러 비교, 장애 전환·관측성·보안 설계를 정리한다.
- 데이터베이스
로그 선기록(WAL)과 데이터베이스 회복 기법(ARIES)
'데이터보다 로그를 먼저'라는 WAL 프로토콜로 원자성·지속성을 보장하는 원리와 로그 구조(LSN·물리논리 로깅), 체크포인트, ARIES의 분석·재실행·취소 3단계와 DPT·CLR·반복 이력을 LSN 기반 시나리오로 설명하고 steal/no-force 정책 트레이드오프와 복제·CDC·클라우드 DB로의 확장을 정리한다.
- 데이터베이스
비트맵 인덱스(Bitmap Index)와 분석 데이터베이스 최적화
저카디널리티·읽기 중심 환경에서 값별 행 집합을 비트열로 표현하고 AND·OR 연산으로 다중 조건 분석 질의를 가속하는 인덱스 구조와, B-Tree·해시 비교·비트맵 조인·DML 트레이드오프·데이터웨어하우스 적용 전략.
- 데이터베이스
데이터 표준화의 필요성과 기대효과
용어·도메인·코드를 일관 기준으로 통일해 일관성·상호운용성·효율성을 확보하는 데이터 거버넌스 기반.
- 데이터베이스
데이터 통합·마이그레이션 — 무결성·정합성
데이터 마이그레이션의 무결성·정합성 차이, 프로파일링 분석 관점, 다층 검증 방법과 리허설·롤백·CDC 전환 전략.
- 데이터베이스
분산 락(Distributed Lock)
여러 서버가 공유 자원을 동시에 변경하지 않도록 원자적 획득·임대·소유자 토큰·펜싱 토큰으로 상호 배제를 구현하는 분산 락의 구조와 프로토콜. 데이터베이스·Redis·합의 기반 코디네이터 비교, TTL 만료와 좀비 클라이언트 대응, 조건부 갱신·멱등성·운영 전략을 정리한다.
- 데이터베이스
데이터 저장: 파일·DB·블록체인 비교
파일(앱관리)·DBMS(중앙 ACID)·블록체인(분산 원장 불변성)의 신뢰 주체·무결성·성능 비교.
- 데이터베이스
LSM 트리(Log-Structured Merge-Tree)
무작위 쓰기를 MemTable에 모아 순차 플러시하고 불변 SSTable을 백그라운드 컴팩션으로 정리하는 쓰기 최적화 저장 구조 — WAL·블룸필터·툼스톤·MVCC 동작, 레벨드/크기계층 컴팩션과 읽기·쓰기·공간 증폭(RUM) 트레이드오프, B+트리 비교와 RocksDB·Cassandra 적용 사례를 정리한다.
- 데이터베이스
2단계 커밋(2PC)과 3단계 커밋(3PC) 프로토콜
분산 트랜잭션의 원자성을 보장하는 2PC(준비·완료)와 그 블로킹을 완화한 3PC(사전커밋) 프로토콜 — 조정자·참여자 구조, 로그 기반 복구, 블로킹·분할 취약성, XA·사가·Paxos Commit 대안 비교.
- 데이터베이스
데이터 카탈로그(Data Catalog)와 메타데이터 관리
기술·업무·운영·거버넌스 메타데이터를 데이터 자산·용어집·품질·계보·정책과 연결하는 데이터 카탈로그의 개념과 구조, 수집·큐레이션·검색·영향 분석 프로세스, ISO/IEC 11179·W3C DCAT 연계, 데이터 제품·AI 활용과 도입 전략을 정리한다.
- 데이터베이스
Data Vault 2.0 기반 데이터 웨어하우스 모델링
비즈니스 키·관계·속성 이력을 Hub·Link·Satellite로 분리하고 Raw Vault와 Business Vault를 계층화해 변화 탄력성·감사 가능성·병렬 적재를 확보하는 데이터 웨어하우스 모델링 방법론. 스타 스키마·3NF·레이크하우스와의 차이, 키·시점·멱등성·품질·개인정보 설계를 함께 정리한다.
- 데이터베이스
공공기관 DB 표준화지침 — 테이블 정의서
표준화지침에 따라 테이블 구조·의미·제약을 표준 양식으로 문서화한 산출물. 기록 항목·작성 지침·품질 진단·데이터 거버넌스 연계까지 심화.
- 데이터베이스
MVCC(다중 버전 동시성 제어)와 스냅샷 기반 트랜잭션
트랜잭션별 스냅샷과 다중 행 버전으로 읽기·쓰기 경합을 줄이는 MVCC의 가시성 판정, 격리 수준, PostgreSQL·InnoDB 구현, 버전 정리·잠금·직렬성 재시도와 운영 설계를 정리한다.
- 데이터베이스
데이터베이스 인덱스 구조(B-Tree · B+Tree)
노드=디스크 페이지로 fan-out을 키운 균형 다진 탐색 트리 B-Tree와, 데이터를 리프에만 두고 연결 리스트로 이어 범위·정렬 질의를 강화한 B+Tree의 구조·동작(탐색·분할·병합)·비교, 클러스터드/커버링 인덱스와 안티패턴, LSM-Tree·SSD 시대의 변화까지 정리한다.
- 데이터베이스
데이터베이스 복제(Replication)와 고가용성 설계
동기·비동기 복제, 단일·다중 리더 토폴로지, 복제 지연과 읽기 일관성, 장애 전환·펜싱·RPO·RTO를 중심으로 데이터베이스 고가용성 설계와 운영 전략을 정리한다.
- 데이터베이스
데이터베이스 옵티마이저(RBO·CBO)
SQL의 최적 실행계획을 선택하는 옵티마이저의 개념과 규칙 기반 RBO(폐기)·비용 기반 CBO(표준) 비교, 통계·히스토그램·힌트 등 튜닝 요소와 적응형 최적화까지.
- 데이터베이스
데이터베이스 샤딩(Sharding)
대용량 데이터를 여러 DB 서버에 수평 분할해 부하 분산·확장성을 확보하는 기법. 파티셔닝 비교, 샤드 키.
- 데이터베이스
데이터베이스 트랜잭션의 특징(ACID)
트랜잭션의 원자성·일관성·격리성·지속성(ACID)과 구현 기법(로킹·MVCC·WAL), 격리수준, 분산환경의 CAP·BASE·2PC·Saga 확장.
- 데이터베이스
마스터 데이터 관리(MDM)
고객·상품 같은 핵심 기준 데이터를 단일 관리하는 MDM의 개념·필요성, 구성요소와 구축 시 고려사항.
- 데이터베이스
시계열 데이터베이스(Time Series Database)
시간을 일급 축으로 삼아 append-only 대량 수집·시간축 압축(델타/Gorilla)·범위 집계·다운샘플링과 보존정책을 최적화한 시계열 데이터베이스의 데이터 모델, LSM 기반 저장 엔진, 제품 유형 비교와 관측성·IoT 실무 적용을 심화 정리한다.
- 데이터베이스
데이터베이스 튜닝(DB Tuning)
DB 성능 저하를 실행계획 기반으로 진단·최적화하는 튜닝의 개념·목적과 설계(반정규화·인덱스·파티셔닝)·DBMS·SQL(옵티마이저·힌트) 계층별 기법.
- 데이터베이스
HTAP(Hybrid Transactional/Analytical Processing)
인메모리·행/컬럼 하이브리드 저장과 워크로드 격리로 OLTP와 OLAP를 하나의 엔진에서 ETL 없이 처리해 운영 데이터에 대한 실시간 분석을 제공하는 아키텍처 — 구현 유형·핵심기술·트레이드오프.
- 데이터베이스
MongoDB
데이터를 JSON 유사 문서(BSON)로 저장하는 문서형 NoSQL MongoDB의 데이터 모델·복제셋·샤딩·인덱스·집계와 관계형 DB 비교, 트랜잭션·벡터 검색 등 최신 동향.
- 데이터베이스
데이터 웨어하우스(Data Warehouse)와 OLAP
운영계(OLTP)와 분리해 주제지향·통합·시간가변·비휘발 원칙으로 이력을 축적하는 분석 전용 저장소인 데이터 웨어하우스의 구조와 ETL/ELT 파이프라인, 차원 모델링(스타·스노우플레이크·SCD), OLAP 연산과 MOLAP/ROLAP/HOLAP 비교, 클라우드 DW·레이크하우스로의 진화를 기술사 논술형으로 정리한다.
- 데이터베이스
데이터 패브릭(Data Fabric)
분산·이기종 환경의 데이터를 물리적으로 모으지 않고 능동 메타데이터(active metadata)·지식 그래프·AI 자동화를 활용해 발견·통합·거버넌스·전달을 하나의 논리 계층으로 엮는 기술 중심 데이터 관리 아키텍처 — 데이터 가상화로 이동을 최소화하고 계보 기반 거버넌스를 자동 집행하며, 조직 중심의 데이터 메시와 상호보완적으로 결합할 때 실효를 낸다.
- 데이터베이스
변경 데이터 캡처(CDC, Change Data Capture)
원천 DB의 트랜잭션 로그 등에서 변경분(INSERT·UPDATE·DELETE)만 실시간 추출해 하류로 전파하는 데이터 통합 기법 — 로그·트리거·쿼리 방식과 오프셋·순서·멱등·아웃박스 패턴.
- 데이터베이스
벡터 데이터베이스(Vector Database)
비정형 데이터를 임베딩한 고차원 벡터를 ANN 색인으로 고속 유사도 검색하는 데이터베이스 — HNSW·IVF·PQ 색인과 하이브리드 검색·재순위로 RAG·추천·이상탐지의 의미 기반 지식 저장소 역할을 하며 정확도·성능·비용 트레이드오프 조율이 핵심.
- 데이터베이스
RDBMS 데이터 모델링(식별·비식별 관계)
개념→논리→물리 단계 모델링과 식별관계(부모 PK가 자식 PK 포함)·비식별관계(일반 FK) 비교, 정규화·무결성 고려사항.
- 데이터베이스
분산 데이터베이스의 5가지 투명성
분산 DB의 위치·분할·중복·병행·장애 투명성 — 분산·복제·동시성·장애를 숨겨 단일 DB처럼 보이게 하는 개념.
- 데이터베이스
NoSQL 유형과 데이터 모델링 절차
비정형·대용량·분산에 최적화된 저장 기술 — Key-Value·Document·Column·Graph 유형과 쿼리 우선 비정규화 모델링 절차.
- 데이터베이스
트랜잭션 격리 수준(Transaction Isolation Level)
4가지 격리 수준(Read Uncommitted~Serializable)과 Dirty·Non-repeatable·Phantom Read 이상현상을 사례 중심으로 정리.