
프로젝트 주제 선정에 대한 전반적 방향
이번 프로젝트에서 가장 중요한 것은 주제를 빨리 정하는 것보다, 잘 정하는 것이다.
이미 존재하는 예제를 그대로 구현하는 수준에서 그치면, 단순한 CV(Computer Vision) 실습이나 튜토리얼 재현에 불과해져 취업용 포트폴리오로서의 가치가 낮아진다.
모든 프로젝트에 공통으로 적용되는 개념:
단순히 모델을 쓰는 것이 아니라,
왜 이 모델을 쓰는지 / 어떤 데이터를 비교하는지를 설명할 수 있어야 함.
면접 대비 및 개념 이해용으로 반드시 알아야 할 키워드:
※ 모든 수식을 외울 필요는 없지만, 의미와 쓰임은 설명 가능해야 함
모델이 얼마나 불확실한지(헷갈리는지)를 수치로 표현한 개념
AI에서 말하는 엔트로피(Entropy) 는 한 문장으로 요약하면 다음과 같다.
모델이 현재 얼마나 불확실하고 헷갈리고 있는지를 수치로 표현한 개념이다.
이 문서는 정보이론에서 시작해 AI, 그리고 GPT 같은 언어모델까지 이어지는 엔트로피 개념을 Velog용으로 간결하게 정리한 요약본이다.
엔트로피는 정보이론의 창시자 클로드 섀넌이 정의한 개념이다.
핵심 질문은 단순하다.
어떤 사건의 결과를 예측하기 얼마나 어려운가?
결과를 예측하기 어려울수록 엔트로피는 높고,
결과가 거의 확실할수록 엔트로피는 낮다.
공정한 동전 던지기는 앞과 뒤가 반반이기 때문에 예측이 어렵고 엔트로피가 높다.
앞면이 99% 나오는 동전은 결과가 거의 정해져 있어 엔트로피가 낮다.
즉, 불확실성의 정도가 엔트로피다.
AI 모델은 항상 하나의 정답을 바로 내놓는 것이 아니라,
각 선택지에 대한 확률 분포를 만든다.
엔트로피는 이 확률 분포를 보고 다음을 판단한다.
모델이 지금 이 판단을 얼마나 확신하고 있는가?
확률이 한 클래스에 몰려 있으면 엔트로피는 낮고,
여러 클래스에 비슷하게 퍼져 있으면 엔트로피는 높다.
엔트로피는 수식으로 정의되지만, 수식을 외울 필요는 없다.
중요한 해석은 두 가지다.
확률이 고르게 퍼질수록 엔트로피는 증가한다.
확률이 특정 결과에 집중될수록 엔트로피는 감소한다.
즉, 엔트로피는 확률 분포의 “흐트러짐 정도”를 나타낸다.
엔트로피가 낮은 경우는 모델이 거의 확신하는 상황이다.
하나의 선택지가 압도적인 확률을 가질 때 발생한다.
엔트로피가 높은 경우는 모델이 헷갈리는 상황이다.
여러 선택지의 확률이 비슷하게 나뉘어 있을 때 발생한다.
이 경우 모델의 판단 리스크는 커진다.
언어모델은 문장을 한 번에 생성하지 않는다.
매 순간 다음 단어에 대한 확률 분포를 계산한다.
다음에 올 단어 후보들의 확률이 비슷하면 엔트로피가 높다.
특정 단어가 거의 확실하면 엔트로피가 낮다.
그래서 어떤 문장은 다양한 방향으로 이어질 수 있고,
어떤 문장은 거의 정해진 표현으로 이어진다.
Temperature는 확률 분포의 퍼짐 정도를 조절하는 값이다.
Temperature가 높아질수록 확률 분포가 고르게 퍼지고 엔트로피가 증가한다.
Temperature가 낮아질수록 확률 분포가 한쪽으로 몰리고 엔트로피가 감소한다.
정리하면 다음과 같다.
낮은 Temperature: 보수적이고 결정적인 출력
높은 Temperature: 창의적이고 랜덤한 출력
딥러닝 학습에서 자주 사용하는 손실 함수가 Cross Entropy Loss다.
이는 정답 분포와 모델 예측 분포가 얼마나 다른지를 측정한다.
예측이 틀릴수록 크로스 엔트로피는 커지고,
예측이 정확할수록 작아진다.
결국 모델 학습의 목표는
정답에 대한 불확실성, 즉 엔트로피를 줄이는 것이다.
엔트로피는 단순한 이론 개념이 아니라 실무에서 매우 중요하다.
첫째, 불확실성 감지
엔트로피가 높은 결과는 사람이 직접 검토해야 할 신호가 된다.
의료, 자율주행 같은 분야에서 필수적이다.
둘째, Active Learning
엔트로피가 높은 데이터만 골라서 추가 학습에 사용한다.
셋째, 이상 탐지
평소보다 엔트로피가 급격히 높아지면 비정상 상황일 가능성이 있다.
AI에서 엔트로피는
모델이 현재 얼마나 헷갈리고 있는지를 수치로 표현한 지표다.