このコースでは Python の requests と BeautifulSoup4 を使った Web スクレイピングの基礎を学びます。
固定 HTML 文字列を題材に、HTTP リクエスト不要でブラウザ内だけで安全に練習できます。
📚 このコースで学べること
🌐
HTML取得
requests.get の仕組み
HTML取得
requests.get の仕組み
🔍
要素検索
find / find_all / select
要素検索
find / find_all / select
🏷️
属性取得
href / src / data-*
属性取得
href / src / data-*
✂️
テキスト整形
strip / re.sub / 型変換
テキスト整形
strip / re.sub / 型変換
📄
複数ページ
ループ処理とエラー対応
複数ページ
ループ処理とエラー対応
💾
保存
JSON / CSV / pandas
保存
JSON / CSV / pandas
✅ 学習後にできるようになること
- BeautifulSoup4 でHTMLを解析できる
- find()・find_all()・select() で目的のデータを抽出できる
- href・src・data-* などの属性値を取得できる
- 取得したテキストを整形・クリーニングできる
- 複数ページのデータを収集してリストにまとめられる
- 収集データを JSON・CSV に変換できる