예: A -> B 로 번역 시, 모델이 A -> C 를 응답한 경우 B <-> C 의 유사도를 측정하여 스코어를 먹인다.
의미적 유사도: embedding 을 통해 의미적으로 얼마나 비슷한지 계산한다.
embedding 은 텍스트 뿐 아니라, 이미지, PDF, 기업 내부 제품 등 모든 데이터의 유사도를 계산할 수 있다.
AI 평가자: 개방형 응답의 평가는 사람에 의존한다.