1 min read
Dense index Sparse Index Secondary Indices B+Tree Index Files
Secondary Indices 는 반드시 Dense index 여야 한다.
이 방식은 Dense index와 비교했을 때 저장 공간이 적게 필요하고, 삽입 시 발생하는 오버헤드도 줄어든다는 장점이 있다. 반면, 검색 속도는 Dense index보다 더 오래 걸린다는 단점이 있다.
Sparse Index Sparse Index는 인덱스 레코드가 모든 검색 키를 포함하지 않고, 일부 선택된 검색 키만 저장하는 방식이다. 검색 과정은 다음과 같다. 찾고자 하는 키 K가 주어졌을 때, 먼저 K보다 작은 값 중 가장 큰 검색 키를 인덱스에서 찾는다.
search-key 가 아닌 다른 field 에 대한 index 가 search-key 값에 대한 index record 를 가리키고 있을 때 Index record points to a bucket that contains pointers to all the actual records with that...
Indexing Indexing 이란 원하는 데이터에 더 빠르게 접근할 수 있도록 Index file 을 구성하는 메커니즘을 의미한다.
관계 데이터 모델에서 relation 에 포함된 tuple 들을 유일하게 구별해주는 역할 Key 의 종류 Super Key (슈퍼키) candidate Key (후보키) Alternate Key (대체키) 기본키 외래키 .
Alternate Key B) Related C) References.
SQL Join 두개이상의 테이블이나 데이터베이스를 연결하여 데이터를 검색하는 방법이다. 주로 정규화된 릴레이션을 통해 원하는 정보를 찾고자 할때 사용한다. 테이블을 연결하려면 적어도 하나의 속성은 서로 공유되고 있어야한다.
Parquet 데이터를 저장하는 방식 중 하나로, hadoop ecosystem 에서 많이 사용되는 파일 포맷이다. 파켓은 컬럼 단위 저장 포맷 (columnar storage) 을 사용하는 방식이다.
What is ACID Transaction 의 성질: Atomicity, Consistency, Isolation, Durability 총 4 가지를 의미한다.
Notations 샤딩은 대규모 데이터를 여러 개의 작은 데이터 단위로 나누어 저장하는 기술을 의미합니다. 이 방식은 특히 하나의 데이터베이스에 모든 데이터를 저장하기에는 너무 클 때 사용됩니다.
