跳轉至

Scrape Web

功能概述

Scrape Web 工具節點是一個網頁文字擷取工具,允許您自目標網頁中精準擷取與萃取文字內容。

適用情境

在以下情況使用此節點:

  • 欲從特定網頁中提取純文字內容
  • 欲自動化自外部網站蒐集最新資訊
  • 從線上資料來源爬取結構或非結構化資料
  • 構建自動化的網頁內容擷取與監控流程

使用方式說明

基礎設定步驟

  1. 將 Scrape Web 工具節點新增至工作流程中
  2. 設定欲爬取網頁的 URL 參數
  3. 將其輸出埠連線至需要已爬取內容的下游節點

參數說明

  • url:欲擷取內容的目標網頁網址 (URL)

輸出埠說明

  • output:從目標網頁中萃取出的純文字內容

範例展示

自特定網頁擷取內文以供下游分析:

  1. 將 Scrape Web 工具節點新增至工作流程中
  2. 輸入欲爬取頁面的目標 URL
  3. 將 "output" 輸出引腳連線至其他需要該文字內容的節點(例如 Agent 或 Summarize Text 節點)

實作細節

Scrape Web 工具運用強大的網頁解析技術萃取網頁中的文字內容。它能透過 CSS 選擇器精準鎖定目標區塊,並具備完善的連線逾時處理與網路例外容錯機制。