h3.1. 반정규화를 통한 성능향상 전략
h5.가.반정규화의 정의
정규화된 엔티티, 속성, 관계에 대해 시스템의 성능향상과 개발과 운영의 단순화를 위해 중복, 통합, 분리 등을 수행한느 데이터 모델링 기법을 의미한다.
데이터 무결성이 깨질 수 있는 위험을 무릅쓰고 반정규화를 적용하는 이유는 데이터를 조회할 때 디스크 I/O량이 많아서 성능이 저하되거나 경로가 너무 멀어 조인으로 인한 성능저하가 예상되거나 컬럼을 계산하여 읽을 때 성능이 저하될 것이 예상되는 경우 반정규화를 수행하게 된다.
업무적으로 조회에 대한 처리성능이 중요하다고 판단될때 부분적으로 반정규화를 고려하게 된다.
설계단계에서 반정규화를 적용하게 되며, 반정규화 미수행시에는 다음과 같은 현상이 발생된다.
h5.나.반정규화의 적용방법
반정규화에 대한 필요성이 결정되면 컬럼의 반정규화 뿐만 아니라, 테이블의 반정규화와 관계의 반정규화를 종합적으로 고려하여 적용해야 한다. 또한 반정규화를 막연하게 중복을 유도하는 것만을 수행하기 보다는 성능을 향상시킬 수 있는 다른방법을 고려하고 그 이후에 반정규화를 적용하도록 해야 한다.
h3.2. 반정규화의 기법
h5.가.테이블 반정규화
기법분류 | 기법 | 내용 | ||||||
---|---|---|---|---|---|---|---|---|
테이블병합 | 1:1 관계 테이블병합 | 1:1 관계를 통합하여 성능향상 | ||||||
1:M 관계 테이블병합 | 1:M 관계를 통합하여 성능향상 | 슈퍼/서브타입 테이블병합 | 슈퍼/서브 관계를 통합하여 성능향상 | 테이블분할 | 수직분할 | 컬럼단위의 테이블을 디스크 I/O를 분산처리하기 위해 테이블을 1:1로 분리하여 성능향상(트랜잭션의 처리되는 유형파악이 선행되어야 함) | ||
수평분할 | 로우단위로 집중 발생되는 트랜잭션을 분석하여 디스크I/O 및 데이터 접근의 효율성을 높여 성능을 향상하기 위해 로우단위로 테이블을 쪼갬(관계가 없음) | |||||||
테이블추가 | 중복테이블 추가 | 다른 업무이거나 서버가 다른 경우 동일한 테이블구조를 중복하여 원격조인을 제거하여 성능을 향상 | ||||||
통계테이블 추가 | SUM,AVG 등을 미리 수행하여 계산해 둠으로써 조회시 성능을 향상 | |||||||
이력테이블 추가 | 이력테이블 중에서 마스터 테이블에 존재하는 레코드를 중복하여 이력테이블에 존재하는 방법 | |||||||
부분테이블 추가 | 하나의 테이블을 전체 칼럼 중 자주 이용하는 집중화된 컬럼이 있을땨, 디스크I/O를 줄이기 위해 해당 컬럼들을 모아놓은 별도의 반정규화된 테이블을 생성 |
h5.나.컬럼 반정규화
반정규화 기법 | 내용 |
---|---|
중복컬럼 추가 | 조인시 성능저하를 예방하기 위해,중복된 컬럼을 위치시킴 |
파생컬럼 추가 | 트랜잭션이 처리되는 시점에 계산에 의해 발생되는 성능저하를 예방하기 위해, 미리 계산하여 컬럼에 보관 |
이력테이블 컬럼추가 | 대량의 이력데이터 처리시 불특정 일 조회나 최근 값을 조회할때 나타날 수 있는 성능저하를 예방하기 위해 기능성 컬럼(최근값여부, 시작일자,종료일자)을 추가함 |
PK에 의한 컬럼추가 | 복합의미를 갖는 PK를 단일속성으로 구성했을 때 발생되며, PK안에 데이터가 존재하지만 성능향상을 위해 일반속성으로 포함하는 방법 |
응용시스탬 오작동을 위한 컬럼 추가 | 업무적으로는 의미가 없으나, 데이터 처리시 오류로 인해 원래값으로 복구하길 원하는 경우 이전 데이터를 임시적으로 중복보관하는 방법 |
h5.다.관계 반정규화
반정규화 기법 | 내용 |
---|---|
중복관계 추가 | 여러 경로를 거쳐 조인이 가능하지만, 성능저하를 예방하기 위해 추가적인 관계를 맺는 방법 |
==> 테이블, 컬럼의 반정규화는 데이터 무결성에 영향을 미치나, 관계의 반정규화는 데이터 무결성을 깨뜨리지 않고도 성능을 향상시킬 수 있는 반정규화의 기법이다.
h3.3. 정규화가 잘 정의된 데이터 모델에서 성능이 저하될 수 있는 경우
그림 2-14 정규화 모델의 문제점
==> 마스터 테이블인 공급자 테이블에 최근 변경된 전화번호, 메일주소, 위치 컬럼을 반경규화하여 위치시키면, 간단하게 SQL이 작성된다.
h3.4. 정규화가 잘 정의된 데이터 모델에서 성능이 저하된 경우
=> 서버B에서 데이터를 조회할 때, 항상 부서명을 가져오기 위해서 서버A를 거쳐야 하므로 성능저하가 발생한다.
부서명을 서버B의 연계테이블에 반정규화함으로 써 성능을 개선 시킬 수 있다.