Description
이 책과 관련된 동영상 강의와 R 코드는 다음 웹사이트에서 볼 수 있습니다.
-동영상 강의: https://www.youtube.com/곽기영
-R 코드: https://github.com/kykwahk
오늘날 우리는 상상조차 어려울 만큼 방대한 데이터를 생성하며 살아가고 있습니다. 스마트폰, 인터넷, 센서, 소셜미디어, 각종 디지털 기기를 통해 매 순간 쏟아지는 이 데이터는 단순한 숫자나 문자가 아니라 사람들이 살아가는 흔적이자 세상의 움직임을 담은 기록입니다. 그러나 데이터는 그 자체로는 아무런 가치를 지니지 않습니다. 분석하고, 해석하며, 예측 가능한 정보로 변환될 때에야 비로소 의미를 갖게 됩니다. 머신러닝(machine learning)은 이러한 과정을 자동화하고 체계화하며, 궁극적으로는 인사이트(insight)를 도출해내는 하나의 도구이자 언어입니다.
이 책은 복잡하고 방대한 머신러닝의 영역을 가능한 한 체계적이고 실용적인 관점에서 풀어내고자 했습니다. 독자 여러분이 머신러닝을 처음 접하든, 이미 알고 있는 내용을 더 깊이 정리하려고 하든, 이 책이 데이터로부터 가치를 창출하는 여정에 든든한 동반자가 되기를 기대합니다. 머신러닝의 활용 가능성은 제조 현장의 공정최적화, 금융범죄 예방을 위한 사기탐지, 고객세분화를 통한 마케팅 전략수립, 보건의료 분야의 질병예측은 물론, 고도의 창의성을 요구하는 예술창작에 이르기까지 실로 무한합니다. 그러나 이처럼 폭넓은 가능성에도 불구하고 막상 머신러닝을 배우고 활용하려는 입장에서는 높은 장벽을 체감하게 됩니다. 그 이유는 다양하지만 많은 입문 자료들이 지나치게 이론 중심적이거나 반대로 무비판적인 도구 사용에 치우쳐 있다는 점도 한몫을 합니다. 이 책은 이러한 두 극단 사이에서 균형을 추구합니다. 머신러닝의 이론적 기반을 충실히 설명하되, 그것이 실제로 어떻게 구현되고, 어떻게 해석되며, 어떤 문제에 적합한지를 이해하는 데 중점을 둡니다.
이 책은 「R을 이용한 머신러닝: 모델링, Tidymodels, Caret」을 시작으로, 「R을 이용한 머신러닝: 지도학습」과 「R을 이용한 머신러닝: 비지도학습」으로 이어지는 ‘R을 이용한 머신러닝’ 시리즈의 두 번째 권입니다. 이 시리즈의 각 권은 머신러닝의 핵심 영역을 다루되, 서로 유기적으로 연결되어 있습니다. 시리즈의 두 번째 권인 이 책은 머신러닝의 대표적 영역인 지도학습(supervised learning)을 다룹니다. 어떤 데이터에는 이미 ‘정답’이 주어져 있습니다. 그리고 우리의 과제는 그 정답을 예측하는 가장 효과적인 방법을 찾는 것입니다. 예를 들어, 매출예측, 질병진단, 이메일 스팸분류 등과 같이 예측 대상이 수치나 범주로 명확히 정해져 있는 경우에 주로 사용됩니다. 이 책에서는 먼저 수치를 예측하는 회귀문제와 범주를 예측하는 분류문제의 차이를 설명하고, 이어서 각각에 사용될 수 있는 다양한 알고리즘을 소개합니다. 선형회귀와 로지스틱회귀 같은 고전적인 방법부터, 서포트벡터머신, 랜덤포레스트, XGBoost, 인공신경망 및 딥러닝에 이르기까지 총 18개의 지도학습 알고리즘이 예제와 함께 설명됩니다. 무엇보다 이 책의 큰 특징은 이론 설명과 동시에 R 언어를 이용한 실제 예제 코드가 함께 제공된다는 점입니다. 독자는 각 알고리즘이 어떻게 작동하는지 이론만으로 이해하는 데 그치지 않고 직접 데이터셋을 불러오고, 모델을 학습시키며, 결과를 시각화하는 과정을 따라 할 수 있습니다.
이러한 실습을 기반으로 한 구성은 독자가 단순한 독자가 아니라 ‘참여자’가 되어 머신러닝을 손끝으로
익히게 합니다.
‘R을 이용한 머신러닝’ 시리즈의 첫 번째 권인 「R을 이용한 머신러닝: 모델링, Tidymodels, Caret」은 머신러닝 모델링과 관련하여 빈번히 등장하는 주요 개념과 함께 모델개발 절차, 데이터 전처리, 성능평가 등의 주제를 다룹니다. 또한 활용도가 높은 핵심 머신러닝 알고리즘을 간략히 설명하고 머신러닝을 위한 원스톱 솔루션을 제공하는 대표적 도구인 Tidymodels와 Caret을 예제와 함께 소개합니다. 이 시리즈의 세 번째 권인 「R을 이용한 머신러닝: 비지도학습」은 비지도학습(unsupervised learning)을 다룹니다. 비지도학습은 구체적인 목표 없이 많은 변수로부터 주요한 특성을 추출하고(차원축소), 데이터셋에 내재되어 있는 자연스러운 그룹을 식별하며(군집식별), 사건 간 연관성을 바탕으로 동시에 등장하는 패턴을 탐색합니다(연관규칙탐색). 여기에서는 이러한 차원축소, 군집식별, 연관규칙탐색을 위한 다양한 비지도학습 알고리즘을 예제와 함께 소개합니다.
-동영상 강의: https://www.youtube.com/곽기영
-R 코드: https://github.com/kykwahk
오늘날 우리는 상상조차 어려울 만큼 방대한 데이터를 생성하며 살아가고 있습니다. 스마트폰, 인터넷, 센서, 소셜미디어, 각종 디지털 기기를 통해 매 순간 쏟아지는 이 데이터는 단순한 숫자나 문자가 아니라 사람들이 살아가는 흔적이자 세상의 움직임을 담은 기록입니다. 그러나 데이터는 그 자체로는 아무런 가치를 지니지 않습니다. 분석하고, 해석하며, 예측 가능한 정보로 변환될 때에야 비로소 의미를 갖게 됩니다. 머신러닝(machine learning)은 이러한 과정을 자동화하고 체계화하며, 궁극적으로는 인사이트(insight)를 도출해내는 하나의 도구이자 언어입니다.
이 책은 복잡하고 방대한 머신러닝의 영역을 가능한 한 체계적이고 실용적인 관점에서 풀어내고자 했습니다. 독자 여러분이 머신러닝을 처음 접하든, 이미 알고 있는 내용을 더 깊이 정리하려고 하든, 이 책이 데이터로부터 가치를 창출하는 여정에 든든한 동반자가 되기를 기대합니다. 머신러닝의 활용 가능성은 제조 현장의 공정최적화, 금융범죄 예방을 위한 사기탐지, 고객세분화를 통한 마케팅 전략수립, 보건의료 분야의 질병예측은 물론, 고도의 창의성을 요구하는 예술창작에 이르기까지 실로 무한합니다. 그러나 이처럼 폭넓은 가능성에도 불구하고 막상 머신러닝을 배우고 활용하려는 입장에서는 높은 장벽을 체감하게 됩니다. 그 이유는 다양하지만 많은 입문 자료들이 지나치게 이론 중심적이거나 반대로 무비판적인 도구 사용에 치우쳐 있다는 점도 한몫을 합니다. 이 책은 이러한 두 극단 사이에서 균형을 추구합니다. 머신러닝의 이론적 기반을 충실히 설명하되, 그것이 실제로 어떻게 구현되고, 어떻게 해석되며, 어떤 문제에 적합한지를 이해하는 데 중점을 둡니다.
이 책은 「R을 이용한 머신러닝: 모델링, Tidymodels, Caret」을 시작으로, 「R을 이용한 머신러닝: 지도학습」과 「R을 이용한 머신러닝: 비지도학습」으로 이어지는 ‘R을 이용한 머신러닝’ 시리즈의 두 번째 권입니다. 이 시리즈의 각 권은 머신러닝의 핵심 영역을 다루되, 서로 유기적으로 연결되어 있습니다. 시리즈의 두 번째 권인 이 책은 머신러닝의 대표적 영역인 지도학습(supervised learning)을 다룹니다. 어떤 데이터에는 이미 ‘정답’이 주어져 있습니다. 그리고 우리의 과제는 그 정답을 예측하는 가장 효과적인 방법을 찾는 것입니다. 예를 들어, 매출예측, 질병진단, 이메일 스팸분류 등과 같이 예측 대상이 수치나 범주로 명확히 정해져 있는 경우에 주로 사용됩니다. 이 책에서는 먼저 수치를 예측하는 회귀문제와 범주를 예측하는 분류문제의 차이를 설명하고, 이어서 각각에 사용될 수 있는 다양한 알고리즘을 소개합니다. 선형회귀와 로지스틱회귀 같은 고전적인 방법부터, 서포트벡터머신, 랜덤포레스트, XGBoost, 인공신경망 및 딥러닝에 이르기까지 총 18개의 지도학습 알고리즘이 예제와 함께 설명됩니다. 무엇보다 이 책의 큰 특징은 이론 설명과 동시에 R 언어를 이용한 실제 예제 코드가 함께 제공된다는 점입니다. 독자는 각 알고리즘이 어떻게 작동하는지 이론만으로 이해하는 데 그치지 않고 직접 데이터셋을 불러오고, 모델을 학습시키며, 결과를 시각화하는 과정을 따라 할 수 있습니다.
이러한 실습을 기반으로 한 구성은 독자가 단순한 독자가 아니라 ‘참여자’가 되어 머신러닝을 손끝으로
익히게 합니다.
‘R을 이용한 머신러닝’ 시리즈의 첫 번째 권인 「R을 이용한 머신러닝: 모델링, Tidymodels, Caret」은 머신러닝 모델링과 관련하여 빈번히 등장하는 주요 개념과 함께 모델개발 절차, 데이터 전처리, 성능평가 등의 주제를 다룹니다. 또한 활용도가 높은 핵심 머신러닝 알고리즘을 간략히 설명하고 머신러닝을 위한 원스톱 솔루션을 제공하는 대표적 도구인 Tidymodels와 Caret을 예제와 함께 소개합니다. 이 시리즈의 세 번째 권인 「R을 이용한 머신러닝: 비지도학습」은 비지도학습(unsupervised learning)을 다룹니다. 비지도학습은 구체적인 목표 없이 많은 변수로부터 주요한 특성을 추출하고(차원축소), 데이터셋에 내재되어 있는 자연스러운 그룹을 식별하며(군집식별), 사건 간 연관성을 바탕으로 동시에 등장하는 패턴을 탐색합니다(연관규칙탐색). 여기에서는 이러한 차원축소, 군집식별, 연관규칙탐색을 위한 다양한 비지도학습 알고리즘을 예제와 함께 소개합니다.
R을 이용한 머신러닝: 지도학습
$70.36