본문/내용
1. 과제1~ 9
빅데이터 자료 처리 과제는 다양한 주제를 다루며, 각 과제는 빅데이터의 이해와 활용에 필요한 기본적인 개념과 기술을 다룬다. 이를 통해 학생들은 데이터 수집, 처리, 분석, 해석 등 빅데이터에 관련된 다양한 기술들을 익힐 수 있다. 과제 1에서는 빅데이터의 정의와 특성을 살펴본다. 빅데이터는 일반적으로 데이터의 크기, 속도, 다양성 등을 기준으로 정의된다. 기존의 데이터베이스 관리 도구로는 처리하기 어려운 방대한 양의 데이터를 다루는 것을 의미한다. 이러한 데이터는 소셜 미디어, IoT 기기, 거래 기록 등 다양한 출처에서 생성된다. 이 과정에서 데이터의 품질, 신뢰성, 보안 문제도 고려해야 하며, 이러한 요소들은 데이터 처리 과정에서 큰 영향을 미친다. 빅데이터의 3V로 유명한 Volume, Velocity, Variety는 이러한 특성을 단적으로 보여준다. 과제 2는 빅데이터 처리 기술에 대한 내용을 다룬다. 대표적인 빅데이터 처리 기술로는 Hadoop과 Spark가 있다. Hadoop은 대규모 데이터 세트를 처리하기 위한 분산 컴퓨팅 플랫폼으로, 데이터 저장을 위한 HDFS와 데이터 처리 모델인 MapReduce로 구성된다. 반면 Spark는 인메모리 처리 기…