책소개
이 책이 속한 분야
이 책의 주제어
# 전산통계
[R을 이용한 데이터 처리&분석 실무]는 통계, 기계 학습, 프로그래밍의 세 가지 키워드 중 프로그래밍 언어에 중점을 두고 R을 능숙하게 사용하는 방법을 설명한 책이다. 데이터 시각화, 통계 및 기계 학습에 대한 간결한 이론 설명과 함께 이를 코드로 작성하는 방법을 설명하고, 프로그래밍 측면에서 코드를 다루므로 코드의 수행시간을 중요하게 다루고 있다.
저자소개
저자 서민구는 2007년부터 구글 코리아에서 소프트웨어 엔지니어로 일하고 있다. 국내 및 세계를 대상으로 검색 관련 제품들을 개발해왔고, 최근에는 자연어 처리 관련 업무를 수행하면서 사용자 쿼리에 어떤 답을 보여줄 경우 더 나은 검색 품질을 이룰 수 있을지를 연구하고 있다. 연세대학교와 카이스트에서 각각 컴퓨터과학 학사, 석사를 취득했고 이후 방송통신대학교에서 정보통계학 학사를 취득했다. Coursera 등의 MOOC에 적극적으로 참여하고 있다.
홈페이지 http://mkseo.pe.kr/
출판사서평
R은 통계 및 기계 학습을 위한 프로그래밍 언어다. 이 책은 통계, 기계 학습, 프로그래밍의 세 가지 키워드 중 프로그래밍 언어에 중점을 두고 R을 능숙하게 사용하는 방법을 설명한다. 이어서 데이터 시각화, 통계 및 기계 학습에 대한 간결한 이론 설명과 함께 이를 코드로 작성하는 방법을 설명한다.
대부분의 데이터 분석 또는 모델링에서 데이터를 처리하는 과정에 많은 시간과 노력이 소요되며 간단한 프로그래밍 문제에 부딪쳐 진도가 나가지 않는 경우가 종종 있음을 생각해보면 프로그래밍에 중심을 둔 접근 방법이 반드시 필요하다. 또 프로그래밍 측면에서 코드를 다루므로 코드의 수행시간을 중요하게 다룬다. 따라서 더 빠르고 효율적인 분석 방법을 배울 수 있다.
[추천평]
이 책의 가장 큰 특징은 현재 소프트웨어 엔지니어로 일하고 있는 저자의 R 습득/활용 과정을 그대로 투영하여 책을 구성했다는 점이다. 소프트웨어 엔지니어 입장에서 다른 소프트웨어 엔지니어에게 옆에서 설명하듯 언어 요소와 함수 설명 등을 구성했고, 실제로 프로그래밍하면서 궁금해 할 만한 내용이 ‘Note’로 적절히 배치되어 있다.
또한 실제 업무에 적용하기 위한 통계 분석, 데이터 마이닝 및 기계 학습에 대한 분석 모델 및 알고리즘을 소개하는 후반부도 기본적인 모델/알고리즘을 설명하고 실행을 해볼 수 있도록 구성되어 있다. 자칫 지나친 분석 모델/알고리즘에 관한 이론적인 설명의 나열로 그치기 쉬운 부분을 실제 소프트웨어 엔지니어 입장에서 풀어내어 이해해야 할 이론과 구현 방법을 깔끔하게 소개하고 있다.
꼭 빅데이터를 다루지 않더라도 소프트웨어 엔지니어라면 한 번쯤은 읽어보았으면 하는 책이다.
- 구글 코리아 테크니컬 리드 매니저 박영찬
이 책은 R의 기초부터 R을 통계 처리와 데이터 마이닝에 활용하는 방법에 이르기까지 폭넓은 내용을 풍부한 예제와 함께 담고 있습니다. 많은 분에게 도움이 되겠지만, 통계와 데이터 마이닝에 입문한 학생에게는 배운 것을 실제 적용해보고 과제를 수행하는 데 도움을 주는 소개서로써, 현업에 종사하는 개발자에게는 좀 더 깊은 내용을 발견할 수 있는 참고서로써 특히 유용하리라 생각합니다. 관심 있는 부분을 제시한 예와 함께 하나하나 진행하다 보면 어느덧 R과 더 친숙해진 자신을 발견하리라 믿습니다.
- 구글 코리아 소프트웨어 엔지니어 강재호
[출판사 리뷰]
효율적인 데이터 처리와 분석을 위한 R 프로그래밍 실습서!
R 프로그래밍에 능숙해야 더 빠르고 효율적인 분석이 가능하다
데이터 분석 또는 모델링에서 데이터를 조작하고 처리하는 과정에 많은 시간과 노력이 소요되며, 간단한 프로그래밍 문제에 부딪쳐 진도가 나가지 않는 경우도 있다. 이 책은 효율적으로 데이터를 분석할 수 있는 능력을 키울 수 있게 프로그래밍에 중점을 두고 R을 능숙하게 사용하는 방법을 설명한다.
R 기본부터 실제 데이터 분석까지 실습으로 익힌다
쉽게 로딩해서 실행해 볼 수 있는 R의 기본 데이터 셋부터 실제 업무에 적용하기 위한 통계 분석, 데이터 마이닝, 기계 학습에 대한 분석 모델 및 알고리즘과 같은 더 실제적이고 실용적인 예까지 실습을 통해 학습할 수 있다.
저자의 실무와 학습 경험을 통해서 데이터 분석 과정의 다양한 문제를 해결한다
저자가 R을 배우고 활용하면서 답답했던 문제를 해결하기 위해 노력했던 결과가 담겨 있다. 문법도 이해했고 책도 읽었는데 막상 데이터를 갖다놓으면 막막하고, 데이터를 분석하려고 할 때마다 방법을 몰라 구글 검색으로 찾아서 해결했던 바로 그 문제들에 대한 답들이 정리되어 있다.
* 현재 책속 한문장이 없습니다. 책속 한문장을 작성해주세요.