본문/내용
1. 서론
빅데이터라는 단어를 처음 마주했을 때 머릿속이 한순간에 복잡해졌다. 평소에는 친구가 보낸 이모티콘 목록이나 SNS에 올라온 사진만 보아도 금방 감탄하던 내가, 어느 날 과제 때문에 수천 건에 달하는 댓글 데이터를 마주하며 “이 숫자들이 대체 무슨 이야기를 하는 걸까”라는 의문에 사로잡히게 되었다. 단순히 ‘좋아요’ 수와 댓글 수를 비교하는 수준에서 멈추지 않고, 텍스트 속 숨겨진 감정과 패턴을 찾아내는 일이 이렇게 어렵고도 신비로운 작업인지 그제야 깨달았다. 새벽까지 엑셀 셀을 바라보며 통계 기법을 적용하려고 애쓰던 순간, 나는 통계적 의사결정이라는 개념에 본격적으로 호기심을 갖게 되었다.
사실 이전까지는 ‘빅데이터’라는 용어가 마치 먼 미래 기술처럼 느껴졌다. 우리 가정에서는 부모님이 휴대폰 요금 명세서를 해석하려 하고, 친구들은 학과 과제에서 수집된 설문 결과를 정리하기도 했지만, 모두 수백 명 안팎이었다. 그때마다 나는 “데이터가 많으면 뭔가 대단한 인사이트가 나올 것 같다”는 막연한 기대만 품었을 뿐이었다. 그러나 실제로는 수집된 데이터만 많다고 해서 답이 저절로 나오는 것이 아니었다. 통계 기법…