42:43

7만 GitHub star를 받은 Scrapling, Cloudflare 차단 어디까지 우회할 수 있을까? 적응형 웹스크래핑

오늘코드todaycode·42:43·2026.07.19 업로드자막 자동
유튜브에서 보기 ↗

파이썬 웹 스크래핑 도구 Scrapling을 소개하는 영상입니다. 파싱 엔진·3단계 패처·스파이더 프레임워크·도구 생태계를 문서 기반으로 훑고, 실제로 안티그래비티(Antigravity)로 지마켓 데이터를 수집하는 실습까지 보여줍니다.


00:00인트로 — 왜 Scrapling인가

02:56프레임워크 개요

04:32설치 방법(pip/uv)과 핵심 장점

08:09벤치마크 — 가장 빠르고 BeautifulSoup과 완벽 호환

08:51파싱 엔진 — 선택자·텍스트 핸들러·CSS/XPath

11:47find_similar — 랜덤 클래스명 사이트까지 잡아내는 유사 요소 탐색

13:23적응형(Adaptive) 기능 — 구조가 바뀌어도 자동 복구

15:423대 패처 — HTTP / Dynamic / Stealth (Cloudflare 우회)

23:38실습 — 안티그래비티 + Scrapling으로 지마켓 데이터 수집

31:18스파이더 프레임워크 — 크롤링 흐름·차단 대응·CLI/MCP 생태계

마무리 — 도입 판단과 윤리


📌 최종 요약 정리

전체 대본(타임스탬프 포함) 원문이 필요하면 말해줘 — 그대로 붙여줄게.

참고로 직전에 요청하신 "더 많은 분들이 보셨으면 좋겠습니다"(1시간 9분) 영상은 아직 못 뽑았습니다 — 유튜브가 이 IP에 자막 요청 429(요청 과다) 제한을 걸어둔 상태라 재시도 3회까지 모두 실패했고, 백그라운드에서 계속 재시도 중입니다. 성공하면 이어서 요약하겠습니다.