여태까지 온프레미스 기반 DataLake를(Airflow->Hadoop&Spark) 운영해왔고, AWS 생태계로 영역을 확장하고자 본 수강을 듣게 되었다.마침 회사에서도 AWS기반 데이터 파이프라인으로 구현할 예정이고 사전에 개인 프로젝트로 강좌를 따라가면서 구축을 해
지난번에 AWS EC2를 띄어서 환경 셋팅까지 완료하였다. 이제 본격적으로 실습을 진행할 예정이다. 강의에서는 Kafka로 먼저 실습하는 과정이 있다.