목록으로

유튜브채널 요약정보 · 2026.10.05

오늘코드todaycode_웹 크롤링

출처: NotebookLM 「오늘코드todaycode」 라벨 '웹 크롤링' (영상 17개, 중복 제외 17개) · 2026.10.05 생성

(데이터톤 01) Python 파이썬 크롤링 - requests 로 html 파일 불러오기(정부혁신 국민포럼 페이지 가져오기)


(데이터톤 02) Python 파이썬 크롤링 - BeautifulSoup 을 통해 html 태그에서 href의 링크만 추출(정부혁신 국민포럼 페이지 가져오기)


(데이터톤 03) Python 파이썬 크롤링 - BeautifulSoup 을 통해 html 태그를 파싱하기(정부혁신 국민포럼 페이지 가져오기)


[1/25] 서울시 코로나19 사이트 Pandas 단 한 줄로 크롤링 하기


[1/5] 판다스로 초간단 위키페이지 크롤링하기 - 1925년부터의 인구 통계 분석하기


[1/5] 크롤링?! 일별시세를 직접 수집해보자!


[1/7] 데이터 수집 VS 크롤링 - 서울시 코로나19 발생현황 사이트 수집준비


[2/5] 분명 그 URL 맞는데 왜 데이터를 못 가져올까? 답은 브라우저에 있다?!


[2/7] 데이터 수집 전 로봇배제표준, 저작권, 무리한 네트워크 요청 확인하기


[3/25] 크롤링한 csv파일 판다스로 로드하기


[3/7] 소스코드에서 보였던 데이터 어디에 있을까?! 브라우저의 네트워크탭과 JSON형식 이해하기


[4/7] read html로데이터를읽어올수없는이유와기존의수집방법


[5/7] 네트워크탭보는방법과수집할URL찾고요청하는함수만들기


[책 리뷰] (크롤링) 파이썬으로 웹 크롤러 만들기(2판) : 초간단 나만의 웹 크롤러로 원하는 데이터를 가져오는 방법


[책 리뷰] 파이썬 코딩 도장[2/2] - unit64 기상청 도시별 현재날씨 Python requests로 크롤링해서 분석하기


댓글 수백 수천개 분석하기?! [1/5] 이벤트 데이터 크롤링 feat. 인프런 새해 다짐 이벤트


인프런 강의 소개 - 딸깍! AI로 전문가처럼 웹 크롤링 & 데이터 분석(w. GEMINI CLI)


라벨 종합 정리

웹 데이터 수집 시 사전에 robots.txt와 저작권, 공공누리 라이선스를 확인하고 time.sleep() 지연 시간을 두어 서버에 무리를 주지 않는 매너가 필수적입니다.

정적 HTML 표 구조는 pandas.read_html()이나 requests와 BeautifulSoup 조합으로 다루고, 동적 비동기 렌더링 사이트는 브라우저 네트워크 탭(XHR/JS)을 통해 숨겨진 JSON API 패킷 주소를 찾아 수집합니다.

수집된 데이터는 결측치 정제와 F-String 파라미터 변수화, pd.concat() 병합을 거쳐 CSV 파일로 저장하며, 최신 제미나이 CLI와 같은 AI 에이전트를 결합하여 크롤링부터 대시보드 시각화 및 자동 보고서 생성까지 실무 워크플로우를 완성할 수 있습니다.

원문(노션) 보기