Python 網頁爬蟲入門實戰課程單元環境設定與網頁爬蟲初探1-1. 環境設定: 安裝 Python 及使用 venv1-2. 使用 Visual Studio Code1-3. Browser-Based 開發環境1-4. 網頁文件解構與網頁爬蟲初探使用 Beautiful Soup2-1. 不要重覆造輪子:寫爬蟲之前2-2. 使用 BeautifulSoup - 定位標籤元件2-3. 使用 BeautifulSoup - 巡覽網頁結構2-4. 正規表示式 (Regular Expression)網頁爬蟲範例實戰3-1. 自由時報今日熱門新聞3-2. 東森新聞今日熱門新聞3-3. WordPress 部落格文章3-4. momo 購物網搜尋結果3-5. Yahoo 奇摩電影本週新片3-6. PTT 八卦板今日熱門文章3-7. GitHub Repositories 列表使用 API4-1. API 簡介4-2. WordPress API 取得部落格文章4-3. 自由時報新聞網 API4-4. IMDB API4-5. GitHub API: Repositories 列表4-6. YouTube Data API: 頻道觀看數及影片列表資料儲存5-1. 儲存為 JSON 與 CSV 檔5-2. 儲存圖片 (PTT Beauty 板圖片下載)5-3. 儲存資料到資料庫 SQLite動態網站爬蟲6-1. 台銀法拍屋 - 使用 Selenium6-2. PCHome 搜尋 - 使用 Selenium 及分析 API Endpoint6-3. 臺灣證交所每日收盤行情 - 使用 Selenium 及分析 API Endpoint爬蟲程式經驗談被封鎖的常見原因: Timing, Policy Violation (robots.txt)常用 Header 欄位、網站隱藏欄位使用代理伺服器說明範例程式在各章目錄內, 講義在 lecture 目錄下範例程式所需套件 pip install -r requirements.txt (Python 3)