책소개
호튼웍스 데이터 과학팀이 알려주는 실용 데이터 과학
이 책은 하둡과 스파크를 활용해 대규모 데이터 분석을 수행하고자 하는 데이터 과학자, 데이터 엔지니어, 비즈니스 이해 관계자를 대상으로 한다. 데이터 엔지니어링 전 과정을 파악하고, 핵심 개념을 개괄적으로 배우고, 실용적 구현 사례를 학습한다. 하둡을 손쉽게 시작할 수 있도록 호튼웍스의 가상 머신 샌드박스를 사용해 실습한다.
저자소개
저자 : 오퍼 멘델리비치
저자 : 오퍼 멘델리비치
저자 오퍼 멘델리비치는 렌드업(Lendup)의 데이터 과학 VP로, 머신러닝과 고급 분석 그룹을 이끌고 있다. 이전에는 호튼웍스의 데이터 과학 디렉터를 역임하며 의료, 금융, 리테일 등 여러 산업에 하둡과 스파크를 전파하였다.
저자 : 케이시 스텔라
저자 케이시 스텔라는 호튼웍스의 수석 데이터 과학자며, 아파치 메트론이라는 사이버 보안 오픈 소스 프로젝트의 분석과 데이터 과학팀을 이끌고 있다. 이전에는 의료 정보학 스타트업인 익스플로리스(Explorys)의 아키텍트로 근무하였다.
저자 : 더글라스 에드라인
저자 더글라스 에드라인은 리눅스 고성능 컴퓨팅의 혁명을 목격한 기록자이자 실무자로 커리어를 시작했다. 그는 지금 빅데이터 분야의 기술 저자이자 고성능 컴퓨팅과 데이터 분석 산업의 컨설턴트로 활동하고 있다.
역자 : 이춘오
역자 이춘오는 학계에서 성공할 꿈을 품고 KAIST 정보통신공학부 학사와 데이터마이닝 & 머신러닝 분야로 박사 학위를 받았지만, 학자보다는 실무자의 길에 더 큰 매력을 느껴 지금은 일반 기업에 다닌다. 삼성전자를 거쳐 현재 SK 플래닛에 재직하며, 빅데이터 플랫폼 개발과 운영 그리고 데이터 분석 업무를 수행해왔다. 최근에는 데이터 과학 애플리케이션의 기획과 제안(즉, PPT 작성), 그리고 프로토타입 개발을 맡고 있다.