출고예상일 안내
주문하신 상품이 한국에서 현지 배송을 위한 출고단계가 이루어질 것으로 예상되는 날짜입니다. 상품을 준비하는 과정에서 내부적인 사정으로 인해 출고예상일에 다소 오차가 생길 수 있습니다.
여러 상품(예약상품포함)을 함께 주문하신 경우 출고예상일이 가장 늦은 날짜에 맞춰 함께 배송됩니다.

파이썬과 기계 학습 scikit-learn을 활용한
원제 : Learning scikit-learn: Machine Learning in Py
라울 가레타, 기예르모 몬세치 저 | 전철욱 역 | 에이콘출판 | 2016년 01월
ISBN : 9788960778108 / 144쪽 188 x 235 (㎜)
이 상품에 궁금하신점이 있으세요? 1:1상담문의

-
클리커, 강민혁
-
칼릭스(손윤석)
-
김현철, 신은경, 이민정, 박선우, 정기민, 곽소아, 정문수
- 23,400
- 19,800
- 21,420
- 20,700
출판사 리뷰
출판사 서평 ★ 이 책에서 다루는 내용 ★ ■ 파이썬 환경에서 scikit-learn 설치 ■ 서포트 벡터 머신(Support Vector Machine)이나 나이브 베이즈(Na?ve Bayes) 등 다양한 기법을 활용함으로써 속성에 기반한 사?물(문서, 얼굴, 꽃의 품종 등) 분류 ■ 타이타닉호 탑승객의 생존 같은 특정 현상의 주원인을 설명하기 위해 결정 트리 사용 ■ 회귀 기법으로 주택 가격 예측 ■ 차원 축소를 사용한 데이터 분석과 시각화 ■ 모델 선택을 통한 모델의 최적 매개변수 선택 ■ 병렬 기술을 통한 모델 성능 향상 ... ★ 이 책에서 다루는 내용 ★ ■ 파이썬 환경에서 scikit-learn 설치 ■ 서포트 벡터 머신(Support Vector Machine)이나 나이브 베이즈(Na?ve Bayes) 등 다양한 기법을 활용함으로써 속성에 기반한 사물(문서, 얼굴, 꽃의 품종 등) 분류 ■ 타이타닉호 탑승객의 생존 같은 특정 현상의 주원인을 설명하기 위해 결정 트리 사용 ■ 회귀 기법으로 주택 가격 예측 ■ 차원 축소를 사용한 데이터 분석과 시각화 ■ 모델 선택을 통한 모델의 최적 매개변수 선택 ■ 병렬 기술을 통한 모델 성능 향상 ★ 이 책의 대상 독자 ★ 기계 학습과 데이터 기반에 대한 소프트웨어 기술을 습득하고자 하는 개발자를 대상으로 한다. ★ 이 책의 구성 ★ 1장, '기계 학습: 친절한 소개'에서는 간단한 분류(classification) 문제를 해결하면서 기계 학습의 주요한 개념을 알아본다. 꽃의 특성을 바탕으로 꽃 품종을 판별한다. 2장, '지도 학습'에서는 네 가지 분류 기법인 서포트 벡터 머신(Support Vector Machine), 나이브 베이즈(Na?ve Bayes), 결정 트리(decision tree), 랜덤 포레스트(Random Forests)를 소개하고 이러한 기법을 얼굴 인식, 텍스트 분류, 그리고 타이타닉호 사고에서 탑승객이 생존할 수 있었던 이유를 설명하는 데 사용한다. 보스턴 주택 가격을 예측하기 위해 서포트 벡터 머신과 랜덤 포레스트를 다시 보고 선형 모델(Linear Model)을 살펴본다. 3장, '비지도 학습'에서는 고차원 데이터를 2차원으로 시각화하기 위해 주성분 분석(Principal Component Analysis)으로 차원을 축소하는 기법을 살펴본다. k평균(k-means) 알고리즘을 사용해 유사성에 따라 손글씨 숫자의 인스턴스를 무리 짓는 군집화 기술을 소개한다. 4장, '고급 기능'에서는 데이터를 전처리하고 학습을 위해 최적의 속성을 선택하는 속성 선택(Feature Selection) 기법을 소개하며, 모델 선택(Model Selection) 기법도 살펴본다. 이용할 수 있는 데이터와 병렬 계산(parallel computation)을 활용해 최적의 매개변수를 선택한다.
★ 지은이의 말 ★
내일 날씨가 맑을지 비가 올지 예측한다고 가정해보자. 날씨 예측을 위해 다소 복잡한 규칙 집합을 사용해 현재 날씨와 기상 지식을 바탕으로 알고리즘을 개발할 수 있다. 지난 5년 동안 매일 날씨를 기록했더니 연속해서 이틀 동안 맑은 날씨이면 다음 날도 맑은 날씨였다는 점을 발견했다. 알고리즘은 이를 일반화할 수 있고 어제와 오늘 날씨가 맑았기 때문에 내일 날씨는 맑을 것으로 예측할 수 있다. 이 알고리즘은 경험에서 학습하는 꽤 간단한 예제다.
기계 학습(Machine Learning)은 이것이 전부다. 사용할 수 있는 데이터로 학습하는 알고리즘이다. 이 책에서는 문서 분류부터 이미지 인식까지 다양한 실제 문제를 해결하는 기계 학습 애플리케이션을 개발하는 일부 기법에 대해 학습한다.
단순하면서 널리 사용되는 프로그래밍 언어인 파이썬과 오픈소스 기계 학습 라이브러리인 scikit-learn을 사용하겠다. 각 장에서는 각기 다른 기계 학습 설정과 문제 해결을 위해 scikit-learn과 파이썬을 사용하는 단계별 예제를 보여줄 뿐만 아니라 두서너 개의 잘 연구된 기법도 보여준다. 또한, 정확도와 계산 비용의 관점으로 알고리즘의 성능을 향상해줄 팁과 트릭을 알려줄 것이다.
★ 옮긴이의 말 ★
'기계 학습을 하는 자’와 ‘기계 학습을 당하는 자'
피타고라스 정리 a2+b2=c2는 중고등학교 수학 시간에 배우는 기본적인 공식이다. 이 공식을 조금 변형하면 유명한 ‘페르마의 마지막 정리’가 된다. 여기서 보기도 싫은 수학 공식을 설명하고자 하는 것은 아니다. 다만, 수학이 매우 추상적인 사고를 할 수 있는 도구라는 점은 강조하고 싶다. 사실, 데이터를 다루는 작업도 매우 추상적인 사고 과정이다. 나의 일부를 추상화해 내가 알지 못하는 정보를 구할 수도 있다. 이를테면, 나의 유전자를 추상화함으로써 암을 예측할 수 있다. 오늘도 사물들은 인류가 세어본 적도 없는 수많은 추상화된 데이터를 쏟아낸다. 데이터는 정보를 만들고 이를 토대로 결정한다. 내가 본 영화로 새 영화를 추천받고 영화를 본다. 이 과정에는 기계 학습이 관여한다. 단순한 통계를 벗어나 고도로 추상화된 기법이 데이터를 모래의 숨은 진주로 만든다. 기계 학습은 새로운 세상을 보게 하는 망원경이자 현미경이다. 플루서의 말을 인용하자면, 컴퓨팅 환경은 ‘기계 학습을 하는 자’와 ‘기계 학습을 당하는 자’로 분류될 것이다.
미비한 시작으로
기계 학습은 다양한 분야가 융합되어 있다. 먼저, 탁월한 계산력을 활용하기 위해 컴퓨터에 명령을 내려야 한다. 두 번째는 수학이다. 대부분의 기법은 확률/통계나 선형 대수를 바탕으로 이루어져 있다. 마지막으로 데이터다. 데이터는 이 모든 것에 기본이며, 넘쳐나지만 잘 활용하면 황금 원천이 된다. 이러한 관점에서 보면, 이 책은 기계 학습을 접하는 처음 독자에게 매우 유용하다.
파이썬은 쉬울 뿐만 아니라 과학 생태계를 지원하는 언어다. 파이썬 기계 학습 라이브러리 scikit-learn은 우리가 일일이 각 기법을 구현해야 할 번거로움을 대신해준다. 이 책에서는 복잡한 수학식을 다루지 않는다. 처음 접하는 독자에게 수식을 나열하며 세부적으로 설명하지 않는다. 오히려 수식 대신 개념으로 최대한 이해하기 쉽게 설명한다. 마지막으로 데이터는 기계 학습 기법의 개념을 잘 이해할 수 있도록 쉽고 구하기도 편한 실질적인 것을 선택했다.
배경지식이 없는 독자에게 이 모든 것이 쉽지는 않을 것이다. 피타고라스 정리를 다시 생각해보자. 조금만 생각해보면 이 정리를 만족하는 a, b, c를 구할 수 있고, 관심을 좀 더 가지면 '페르마의 마지막 정리'인 an+bn≠cn(n은 3 이상)에 도전해볼 수도 있다. 이 과정에서 다양한 수학적 기법을 알게 되며 흥미로운 세상을 만날 수도 있다. 이 책이 기계 학습을 심도 있게 학습하고자 하는 독자에게 피타고라스 정리와 같은 역할을 하면 좋겠다. 각 장에서 나온 기법을 실행해보고 약간씩 변경해보면서, 기법에 대한 세부사항과 수학적 배경지식을 찾아 학습해 자신이 원하는 분야에 기계 학습을 적용하길 바란다.
목차
1장 기계 학습: 친절한 소개
__scikit-learn 설치
____리눅스
____맥
____윈도우
____설치 확인
__첫 번째 기계 학습 기법: 선형 분류
__결과 평가
__기계 학습 종류
__기계 학습에 관련된 중요한 개념
__요약
2장 지도 학습
__서포트 벡터 머신과 이미지 인식
____서포트 벡터 머신 훈련
__나이브 베이즈로 텍스트 분류
____데이터 전처리
____나이브 베이즈 분류기 훈련
____성능 평가
__결정 트리와 타이타닉 가설 설명
____데이터 전처리
____결정 트리 분류기 훈련
____결정 트리 해석
____랜덤 포레스트: 무작위 결정
____성능 평가
__회귀로 주택 가격 예측
____첫 번째 도전: 선형 모델
____두 번째 도전: 회귀를 위한 서포트 벡터 머신
____세 번째 도전: 랜덤 포레스트 다시 보기
____평가
__요약
3장 비지도 학습
__주성분 분석
__k평균으로 손글씨 숫자 군집화
__다른 군집 기법
__요약
4장 고급 기능
__속성 추출
__속성 선택
__모델 선택
__격자 검색
__병렬 격자 검색
__요약






































