| IP地址(210) | 服务器名称 | 所属国家 |
|---|---|---|
| 64.124.8.60 | ? | US |
| 64.124.8.25 | ? | US |
| 64.124.8.52 | ? | US |
| 64.124.8.24 | ? | US |
| 64.124.8.62 | ? | US |
可能不需要,尤其是如果你自己也受益于信息搜集服务。不过,如果你担心服务器资源占用等问题,可以选择拦截它们。
您可以通过在网站的 robots.txt 中设置用户代理访问规则来屏蔽 ImagesiftBot 或限制其访问权限。我们建议安装 Spider Analyser 插件,以检查它是否真正遵循这些规则。
# robots.txt # 下列代码一般情况可以拦截该代理 User-agent: ImagesiftBot Disallow: /
您无需手动执行此操作,可通过我们的 Wordpress 插件 Spider Analyser 来拦截不必要的蜘蛛或者爬虫。
ImageSiftBot 是一个网络爬虫,可以在互联网上抓取公开可用的图像,以支持 Imagesift 的网络智能产品套件。
来自 ImageSiftBot 的请求将用户代理设置为:
Mozilla/5.0 (compatible; ImagesiftBot; +imagesift.com)
ImageSiftBot 是否遵循 Robots.txt 规则?
尊重 robots.txt 中针对 ImagesiftBot 的标准指令。例如,以下内容将允许 ImagesiftBot 抓取除 /private/ 下的页面之外的所有页面:
User-Agent: ImagesiftBot Allow: / Disallow: /private/
ImagesiftBot 还支持 robots.txt 文件中的抓取延迟指令。它将值解释为连续请求开始之间的最短持续时间(以秒为单位)。例如,假设您在 robots.txt 文件中指定了以下内容:
User-Agent: ImagesiftBot Crawl-delay: 5
ImagesiftBot 会将每天分成 5 秒的时间间隔,并在每个时间间隔内最多向您的域发出一个请求。
如果没有针对 ImagesiftBot 的规则,但有针对 Googlebot 的规则,则 ImagesiftBot 将遵循 Googlebot 指令。例如,ImagesiftBot 将获取所有页面,除了 /private/ 下的页面,其中包含以下 robots.txt:
User-Agent: * Disallow: / User-Agent: Googlebot Allow: / Disallow: /private/
ImageSiftBot 保存哪些信息?
除了图像之外,ImageSiftBot 还保存以下信息:
ImageSift 如何使用这些信息?
从网页下载图像和文本后,ImageSift 会分析该页面的数据并将信息存储在索引中。我们的网络智能产品使用此索引来搜索和检索类似图像。
ImageSift 是一个允许用户从互联网上的各种来源搜索和发现图片的网站(反向图像搜索平台)。它为用户提供了一个根据自己的兴趣和喜好筛选和整理图片的平台。
有关 ImageSift 的更多信息,请访问其官方网站:https://www.imagesift.com/。
此外,您还可以查看其社交媒体页面,了解更新和新闻:
如果您对 ImageSiftBot 有任何疑问或希望选择不被抓取,请通过电子邮件联系:support@imagesift.com