속성

HELLO_DINO·2022년 8월 18일
0

SQL전문가가이드

목록 보기
3/28

속성(Attribute)의 개념

속성이란 사전적인 의미로는 사물의 성질, 특징 또는 본질적인 성질, 그것이 없다면 실체를 생각할 수 없는 것으로 정의할 수 있다. 사물이나 개념이 어떤 것인지를 나타내고 그것을 다른 것과 구별하는 성질이라고 할 수 있다.

데이터 모델링 관점에서 속성을 정의하면, "업무에서 필요로 하는 인스턴스로 관리하고자 하는 의미상 더 이상 분리되지 않는 최소의 데이터 단위"로 정의 가능하다.

이미지 에러

속성의 정의를 정리해 보면 다음과 같다.

  1. 업무에서 필요로 한다.
  2. 의미상 더 이상 분리되지 않는다.
  3. 엔터티를 설명하고 인스턴스의 구성요소가 된다.

엔터티, 인스턴스와 속성, 속성값에 대한 내용과 표기법

가. 엔터티, 인스턴스, 속성, 속성값의 관계

한 개의 엔터티는 두 개 이상의 인스턴스의 집합이다.
한 개의 엔터티는 두 개 이상의 속성을 갖는다.
한 개의 속성은 한 개의 속성값을 갖는다.

이미지 에러

속성은 엔터티에 속한 엔터티에 대한 자세하고 구체적인 정보를 나타내며 각각의 속성은 구체적인 값을 갖게 된다.

나. 속성의 표기법
속성의 표기법은 엔터티 내에 이름을 포함하여 표현하면 된다.

이미지 에러

속성의 특징

  • 엔터티와 마찬가지로 반드시 해당 업무에서 필요하고 관리하고자 하는 정보이어야 한다.
  • 정규화 이론에 근간하여 정해진 주식별자에 함수적 종속성을 가져야 한다.
  • 하나의 속성에는 한 개의 값만을 가진다.
  • 하나의 속성에 여러 개의 값이 있는 다중값일 경우 별도의 엔터티를 이용하여 분리한다.

속성의 분류

가. 속성의 특성에 따른 분류

기본속성(Basic Attribute) : 업무분석을 통해 바로 정의한 속성.
설계속성(Designed Attribute) : 원래 업무상 존재하지는 않지만 설계를 하면서 도출해내는 속성.
파생속성(Derived Attribute) : 다른 속성으로부터 계산이나 변형이 되어 생성되는 속성.

1) 기본속성
기본 속성은 업무로부터 추출한 모든 속성이 여기에 해당. 코드성 데이터, 엔터티를 식별하기 위해 부여된 일련번호, 그리고 다른 속성을 계산하거나 영향을 받아 생성된 속성을 제외한 모든 속성은 기본속성이다.

2) 설계속성
설계속성은 업무상 필요한 데이터 이외에 데이터 모델링을 위해, 업무를 규칙화하기 위해 속성을 새로 만들거나 변형하여 정의하는 속성이다.

3) 파생속성
파생속성은 다른 속성에 영향을 받아 발생하는 속성으로서 보통 계산된 값들이 이에 해당. 다른 속성에 영향을 받기 때문에 프로세스 설계 시 데이터 정합성을 유지하기 위해 유의해야 할 점이 많으며 가급적 파생속성을 적게 정의하는 것이 좋다.

이미지 에러

이러한 분류 방식은 프로젝트에서 엄격하게 분류하여 속성정의서에 나열하는 경우도 있다. 이 때 파생속성의 경우는 그 값이 계산된 로직을 속성의 정의서의 기록함으로써 향후 속성 값에 대한 검증 시 활용되기도 한다. 파생속성은 그 속성이 가지고 있는 계산방법에 대해서 반드시 어떤 엔터티에 어떤 속성에 의해 영향을 받는지 정의가 되어야 한다.

파생속성은 일반 엔터티에서는 많이 사용하지 않으며 통계관련 엔터티나 배치 작업이 수행되면서 발생되는 엔터티의 경우 많이 이용된다.


나. 엔터티 구성방식에 따른 분류

엔터티를 식별할 수 있는 속성을 PK(Primary Key)속성, 다른 엔터티와의 관계에서 포함된 속성을 FK(Foreign Key)속성, 엔터티에 포함되어 있고 PK, FK에 포함되지 않은 속성을 일반속성이라 한다.

이미지 에러

속성은 그 안에 세부 의미를 쪼갤 수 있는지에 따라 단순형 혹은 복합형으로 분류할 수 있다.

하나의 값 아니면 여러 개의 값이 존재하는 지에 따라 단일값 속성(Single-Valued Attribute) 혹은 다중값 속성(Multi-Valued Attribute)으로 분류할 수 있다. 다중값 속성의 경우 하나의 엔터티에 포함될 수 없으므로 1차 정규화를 하거나, 아니면 별도의 엔터티를 만들어 관계로 연결해야 한다.


도메인(Domain)

도메인(Domain) : 각 속성은 가질 수 있는 값의 범위.
각 속성은 도메인 이외의 값을 갖지 못한다.
즉, 엔터티 내에서 속성에 대한 데이터타입과 크기 그리고 제약사항을 지정하는 것이라 할 수 있다.


속성의 명명(Naming)

C/S(Client/Server) 환경이든 Web 환경이든 속성명이 곧 사용자 인터페이스(User Interface)에 나타나기 때문에 업무와 직결되는 항목이다. 용어사전과 도메인정의를 같이 사용하여 프로젝트를 진행할 경우 용어적 표준과 데이터타입의 일관성을 확보할 수 있게 된다.

속성명을 부여하는 원칙은 아래 그림과 같다.

이미지 에러

  1. 속성의 이름을 부여할 때는 현업에서 사용하는 이름을 부여하는 것이 가장 중요하다.

  2. 일반적으로는 서술식의 속성명은 사용하지 말아야 한다. 명사형을 이용하고 수식어나 소유격을 사용하지 않는다.

  3. 공용화되지 않은 업무에서 사용하지 않는 약어는 사용하지 않는 것이 좋다. 약어를 많이 사용하면 업무분석자 내에서도 의사소통이 제약을 받으며 시스템을 운영할 때도 불편을 초래할 수 있다.

  4. 가능하면 모든 속성의 이름은 유일하게 작성하는 것이 좋다. 데이터에 대한 흐름을 파악하고 데이터의 정합성을 유지하는데 좋다. 또한 반정규화(테이블통합, 분리, 칼럼의 중복 등)를 적용할 때 속성명의 충돌(Conflict)을 해결헤 반정규화를 적용할 수 있게 된다.

출처: SQL 전문가 가이드, https://dataonair.or.kr/

0개의 댓글