課程對象:數據分析師、職場上班族、學生與研究人員、程式新手
商品分類:線上課程
商品標籤:
研發,生產,語言
你可以學到:
一、基礎爬蟲技術: 掌握 Requests 與 BeautifulSoup,快速抓取靜態網頁資訊。
二、動態網頁攻克: 使用 Selenium 模擬真人行為,搞定需要捲動、點擊或登入的複雜網站。
三、數據自動化處理: 結合 Pandas 套件,將抓取的資料自動清洗並匯出成 Excel 或 CSV 報表。
四、實戰專案演練: 包含工商名錄、學術文章、結合Telegram聊天平台等案例。
五、AI+LLM:學會利用AI與超利害的開源套件,輕鬆開發爬蟲與精進爬蟲能力。
課程資訊:
本課程教學單元:
01-利用pandas讀取網頁表格資料
02-表格提取,從網站提取CSV文件
03-表格提取從PDF文件
04-爬蟲必要基礎知識:HTML 基礎 標籤和元素
05-爬蟲基本功:使用XPath從網頁取特定資料
06-爬蟲基本功:XPath 語法、函數和運算子練習
07-專門對付動態網頁:Selenium網頁自動化與爬蟲技巧
08-Google Scholar自動下載含PDF檔全攻略
09-越南工商名錄爬蟲詳細教學
10-用Telegram查高鐵班次:高鐵網站爬蟲實作
11-氣象資料爬蟲與MySQL資料庫實作
12-零基礎利用AI寫出爬蟲程式
13-ChatGPT結合Python開發-爬蟲實作圖表數據
14-開源神庫 Trafilatura:網頁自動化數據提取專家,告別複雜爬蟲!
15-免寫爬蟲程式也能抓網站資料?:Browser-Use顛覆傳統爬蟲!最強AI操作瀏覽器自動化工具!
16-進階:擁有AI的Reader API 再結合 LLM技術,巔覆你對網路爬蟲程式想像
17-進階:用n8n打造金融資料爬蟲|從券商分點自動抓到解決Big5亂碼
課程大綱: