Web スクレイピング (Scrape Web)
概要 (What is it?)
Scrape Web ツールは、Web ページからテキストコンテンツを抽出するためのユーティリティノードです。
使用する場面 (When would I use it?)
以下のような場面でこのノードを使用します:
- 特定の Web ページからテキストコンテンツを抽出したい場合
- Web サイトから情報を収集したい場合
- オンラインソースからデータを取得したい場合
- Web コンテンツの抽出を自動化したい場合
使い方 (How to use it)
基本セットアップ
- ワークフローに Scrape Web ツールを追加します
- スクレイピングのパラメータを設定します
- スクレイピングしたコンテンツを必要とするノードに出力を接続します
パラメータ一覧 (Parameters)
- url: スクレイピング対象の Web ページの URL
出力 (Outputs)
- output: Web ページから抽出されたテキストコンテンツ
使用例 (Example)
特定の Web ページからコンテンツを抽出したい場合の例:
- ワークフローに Scrape Web ツールを追加します
- スクレイピングしたいページの URL を設定します
- スクレイピング結果を必要とする別のノードに "output" を接続します
実装の詳細 (Implementation Details)
Scrape Web ツールは、Web スクレイピング機能を利用して Web ページからテキストコンテンツを抽出します。CSS セレクタを用いた特定コンテンツのターゲティングが可能で、タイムアウトや通信エラーも安全に処理します。