출고예상일 안내
주문하신 상품이 한국에서 현지 배송을 위한 출고단계가 이루어질 것으로 예상되는 날짜입니다. 상품을 준비하는 과정에서 내부적인 사정으로 인해 출고예상일에 다소 오차가 생길 수 있습니다.
여러 상품(예약상품포함)을 함께 주문하신 경우 출고예상일이 가장 늦은 날짜에 맞춰 함께 배송됩니다.

핸즈온 생성형 AI GPT, 라마, 뮤직젠, 스테이블 디퓨전으로 배우는 트랜스포머와 확산 모델 활용법
오마르 산세비에로, 페드로 쿠엥카, 아폴리나리우 파소스, 조나단 휘태커 저 | 장윤경 역 | 한빛미디어 | 2025년 06월
ISBN : 9791169213981 / 472쪽 / 897g / 183 x 235 (㎜)
이 상품에 궁금하신점이 있으세요? 1:1상담문의

-
리카이푸, 천치우판
-
김지희(릴스 마법사 롱제이)
- 27,000 →26,999원
- 26,820 →26,819원
- 24,300 →24,299원
- 20,700 →20,699원
- 컴퓨터/IT > 프로그래밍
- 컴퓨터/IT > 컴퓨터공학 > 인공지능/신경망/퍼지
반디앤루니스 리뷰
프로프트 엔지니어링을 넘어 트랜스포머와 확산 모델의 내부 구조를 탐구하면서 생성형 AI의 핵심 원리를 이해하고, 최신 기술을 직접 구현해보며 학습할 수 있도록 구성되어 있다. 트랜스포머와 확산 모델을 중심으로 생성형 AI의 주요 구조와 동작 방식을 다루고, 이미지·텍스트·오디오를 생성하는 멀티모달 모델의 작동 방식과 활용법을 깊이 있게 설명한다.
오토인코더, CLIP, U-Net 등 핵심 개념을 정리하고, 텍스트 생성, 조건부 이미지 생성, 오디오 생성까지 다양한 프로젝트 중심 실습을 통해 개념과 구현을 함께 익힐 수 있도록 구성했다. 특히 허깅 페이스와 구글 코랩 기반의 환경을 활용해 복잡한 설정 없이 직접 실습할 수 있으며, 스테이블 디퓨전, 드림부스, LoRA 같은 최신 기술도 단계적으로 구현해볼 수 있다.
출판사 리뷰

[1부 개방형 모델 활용]
1장 생성 미디어 입문
_1.1 이미지 생성
_1.2 텍스트 생성
_1.3 사운드 클립 생성
_1.4 윤리적 및 사회적 영향
_1.5 생성 모델의 과거와 현재
_1.6 생성형 AI 모델 개발 방법
_1.7 요약
2장 트랜스포머
_2.1 언어 모델의 활용 사례
_2.2 트랜스포머 블록
_2.3 트랜스포머 모델 계보
_2.4 사전 학습의 힘
_2.5 트랜스포머 요약
_2.6 언어 모델을 이용한 텍스트 생성 프로젝트
_2.7 요약
_연습 문제
_도전 과제
_참고 자료
3장 정보 압축과 표현
_3.1 오토인코더
_3.2 변이형 오토인코더
_3.3 CLIP
_3.4 CLIP의 대안
_3.5 의미 기반 이미지 검색 프로젝트
_3.6 요약
_연습 문제
_도전 과제
_참고 자료
4장 확산 모델
_4.1 핵심 원리: 반복 정제
_4.2 확산 모델 학습
_4.3 노이즈 스케줄 심층 분석
_4.4 U-Net과 대안 심층 분석
_4.5 확산 목표 심층 분석
_4.6 비조건부 확산 모델 학습 프로젝트
_4.7 요약
_연습 문제
_도전 과제
_참고 자료
5장 스테이블 디퓨전과 조건부 생성
_5.1 조건부 확산 모델을 위한 조건 추가하기
_5.2 효율성을 높이는 잠재 확산
_5.3 스테이블 디퓨전 구성 요소 심층 분석
_5.4 주석이 달린 샘플링 루프
_5.5 오픈 데이터, 오픈 모델
_5.6 Gradio로 인터랙티브 머신러닝 데모 만들기 프로젝트
_5.7 요약
_연습 문제
_도전 과제
_참고 자료
[2부 생성 모델을 위한 전이 학습]
6장 언어 모델 파인튜닝
_6.1 텍스트 분류
_6.2 텍스트 생성
_6.3 지시 사항
_6.4 어댑터 소개
_6.5 양자화 소개
_6.6 통합 구현
_6.7 평가 방법에 대한 더 깊은 이해
_6.8 검색 증강 생성 프로젝트
_6.9 요약
_연습 문제
_도전 과제
_참고 자료
7장 스테이블 디퓨전 파인튜닝
_7.1 스테이블 디퓨전 전체 모델 파인튜닝
_7.2 드림부스
_7.3 LoRA 학습
_7.4 스테이블 디퓨전에 새로운 기능 추가하기
_7.5 SDXL 드림부스 LoRA 학습하기 프로젝트
_7.6 요약
_연습 문제
_도전 과제
_참고 자료
[3부 더 나아가기]
8장 텍스트-이미지 모델의 창의적 활용
_8.1 이미지-이미지 변환
_8.2 인페인팅
_8.3 프롬프트 가중치와 이미지 편집
_8.4 인버전으로 실제 이미지 편집하기
_8.5 컨트롤넷
_8.6 이미지 프롬프팅과 이미지 변형
_8.7 창의적 그림 생성 프로젝트
_8.8 요약
_연습 문제
_참고 자료
9장 오디오 생성
_9.1 오디오 데이터
_9.2 트랜스포머 기반 아키텍처를 활용한 음성-텍스트 변환
_9.3 텍스트에서 음성으로, 생성 오디오로
_9.4 오디오 생성 시스템 평가
_9.5 향후 발전 방향
_9.6 엔드-투-엔드 대화 시스템 프로젝트
_9.7 요약
_연습 문제
_도전 과제
_참고 자료
10장 생성형 AI 분야의 발전과 최신 동향
_10.1 선호도 최적화
_10.2 긴 컨텍스트
_10.3 전문가 혼합
_10.4 최적화와 양자화
_10.5 데이터
_10.6 모든 것을 해결하는 단일 모델
_10.7 컴퓨터 비전
_10.8 3D 컴퓨터 비전
_10.9 비디오 생성
_10.10 멀티 모달리티
_10.11 커뮤니티
APPENDIX A. 오픈 소스 도구
APPENDIX B. LLM 메모리 요구사항
APPENDIX C. 엔드-투-엔드 검색 증강 생성






































