
이 글에서는 데이터셋 구축부터 OCR 모델 학습까지 다루어 본다.OCR모델은 Text Detection과 Text Recognition으로 나뉜다.여기서는 Recognition만 해보고자 한다.광학 문자 인식(OCR) 이란 사람이 쓰거나 기계로 인쇄한 문자 이미지를 기
tensorflow에서는 CTC loss가 내장되어 있어 CTC를 구현할 필요가 없었다.pytorch에는 없는데 구현하기에는 까다롭고 필요성을 못느껴 Listen-Attend-and-Spell이라는 아키텍처의 OCR을 만들고자 한다.물론, 이 글에서도 Recogniti