| IP地址(210) | 伺服器名稱 | 所屬國家 |
|---|---|---|
| 64.124.8.60 | ? | US |
| 64.124.8.25 | ? | US |
| 64.124.8.52 | ? | US |
| 64.124.8.24 | ? | US |
| 64.124.8.62 | ? | US |
可能不需要,尤其是如果你自己也受益於資訊蒐集服務。不過,如果你擔心伺服器資源佔用等問題,可以選擇攔截它們。
您可以通過在網站的 robots.txt 中設定使用者代理訪問規則來遮蔽 ImagesiftBot 或限制其訪問許可權。我們建議安裝 Spider Analyser 外掛,以檢查它是否真正遵循這些規則。
# robots.txt # 下列程式碼一般情況可以攔截該代理 User-agent: ImagesiftBot Disallow: /
您無需手動執行此操作,可通過我們的 Wordpress 外掛 Spider Analyser 來攔截不必要的蜘蛛或者爬蟲。
ImageSiftBot 是一個網路爬蟲,可以在網際網路上抓取公開可用的影象,以支援 Imagesift 的網路智慧產品套件。
來自 ImageSiftBot 的請求將使用者代理設定為:
Mozilla/5.0 (compatible; ImagesiftBot; +imagesift.com)
ImageSiftBot 是否遵循 Robots.txt 規則?
尊重 robots.txt 中針對 ImagesiftBot 的標準指令。例如,以下內容將允許 ImagesiftBot 抓取除 /private/ 下的頁面之外的所有頁面:
User-Agent: ImagesiftBot Allow: / Disallow: /private/
ImagesiftBot 還支援 robots.txt 檔案中的抓取延遲指令。它將值解釋為連續請求開始之間的最短持續時間(以秒為單位)。例如,假設您在 robots.txt 檔案中指定了以下內容:
User-Agent: ImagesiftBot Crawl-delay: 5
ImagesiftBot 會將每天分成 5 秒的時間間隔,並在每個時間間隔內最多向您的域發出一個請求。
如果沒有針對 ImagesiftBot 的規則,但有針對 Googlebot 的規則,則 ImagesiftBot 將遵循 Googlebot 指令。例如,ImagesiftBot 將獲取所有頁面,除了 /private/ 下的頁面,其中包含以下 robots.txt:
User-Agent: * Disallow: / User-Agent: Googlebot Allow: / Disallow: /private/
ImageSiftBot 儲存哪些資訊?
除了影象之外,ImageSiftBot 還儲存以下資訊:
ImageSift 如何使用這些資訊?
從網頁下載影象和文字後,ImageSift 會分析該頁面的資料並將資訊儲存在索引中。我們的網路智慧產品使用此索引來搜尋和檢索類似影象。
ImageSift 是一個允許使用者從網際網路上的各種來源搜尋和發現圖片的網站(反向影象搜尋平臺)。它為使用者提供了一個根據自己的興趣和喜好篩選和整理圖片的平臺。
有關 ImageSift 的更多資訊,請訪問其官方網站:https://www.imagesift.com/。
此外,您還可以檢視其社交媒體頁面,瞭解更新和新聞:
如果您對 ImageSiftBot 有任何疑問或希望選擇不被抓取,請通過電子郵件聯絡:support@imagesift.com