Web Scraping and Bot Development with Python
웹 스크래핑과 봇 자동화는 데이터 엔지니어링, 경쟁 인텔리전스, 워크플로우 자동화의 핵심 기술입니다. 이 트랙은 웹사이트에서 구조화된 데이터를 추출하고, 동적 콘텐츠를 탐색하며, 실제 봇 방어 기술을 다루고, 대규모로 안정적으로 실행되는 스크래퍼를 배포하는 방법을 Python으로 배웁니다. 정적 HTML 읽기부터 분산 크롤러 아키텍처 설계까지, 첫 번째 수업부터 실용적인 도구를 만들게 됩니다.
학습 내용
HTTP와 HTML 파싱의 기초부터 시작해 봇 상호작용, 폼 제출, 다단계 워크플로우로 나아갑니다. 핵심 주제는 데이터 추출 및 저장, JavaScript 렌더링 페이지와 동적 웹 콘텐츠 처리, 스크래핑 윤리 및 법률 관리, 프록시 로테이션, 안티스크래핑 우회입니다. 고급 과정은 실제 봇 배포, 확장 가능한 스크래핑 아키텍처, 자동화된 데이터 수집의 윤리 및 법률 환경을 다룹니다.
학습 경로
A1부터 C1까지 12개 과정으로 구성됩니다. 이 트랙은 Introduction to Web Scraping Fundamentals와 Basic HTML Parsing with Python으로 시작하고, Advanced Data Extraction Techniques, Data Storage and Persistence, Advanced Bot Interactions & Workflows B1 레벨 과정을 거칩니다. B2 단계에서는 Handling Dynamic Web Content와 Real-world Bot Development & Deployment를 다룹니다. Bypassing Anti-Scraping Measures와 Scalable Scraping Architectures로 C1 수준에서 마무리됩니다.
학습 방식
각 과정은 짧고 실습 중심의 수업으로 구성되며, 내장된 코드 에디터에서 실시간 피드백을 받으며 완료합니다. 막히는 부분이 있으면 AI 튜터가 개념을 설명하고 정답을 직접 주지 않으면서 수정을 안내합니다.