Scrape Web
功能概述
Scrape Web 工具節點是一個網頁文字擷取工具,允許您自目標網頁中精準擷取與萃取文字內容。
適用情境
在以下情況使用此節點:
- 欲從特定網頁中提取純文字內容
- 欲自動化自外部網站蒐集最新資訊
- 從線上資料來源爬取結構或非結構化資料
- 構建自動化的網頁內容擷取與監控流程
使用方式說明
基礎設定步驟
- 將 Scrape Web 工具節點新增至工作流程中
- 設定欲爬取網頁的 URL 參數
- 將其輸出埠連線至需要已爬取內容的下游節點
參數說明
- url:欲擷取內容的目標網頁網址 (URL)
輸出埠說明
- output:從目標網頁中萃取出的純文字內容
範例展示
自特定網頁擷取內文以供下游分析:
- 將 Scrape Web 工具節點新增至工作流程中
- 輸入欲爬取頁面的目標 URL
- 將 "output" 輸出引腳連線至其他需要該文字內容的節點(例如 Agent 或 Summarize Text 節點)
實作細節
Scrape Web 工具運用強大的網頁解析技術萃取網頁中的文字內容。它能透過 CSS 選擇器精準鎖定目標區塊,並具備完善的連線逾時處理與網路例外容錯機制。