ImagesiftBot

ImagesiftBot蜘蛛/爬虫属于信息搜集类型,由Castle Global, Inc.开发运行。您可以继续阅读下方信息,以深入了解ImagesiftBot基本信息,用户代理和访问控制等。

基本信息

ImagesiftBot的基本信息如下表。但部分不是很规范的蜘蛛和爬虫,可能存在信息不明的情况。
蜘蛛/爬虫名称
ImagesiftBot
类型
信息搜集
开发商
Castle Global, Inc.
当前状态
活动

用户代理

关于ImagesiftBot蜘蛛或者爬虫的用户代理字符串,IP地址和服务器,所在地等信息如下表格所示:
ImagesiftBot
用户代理字符串
Mozilla/5.0 (compatible; ImagesiftBot; +imagesift.com)
首次出现
2023-11-24 07:47:42
最后出现
2025-01-08 02:02:14
遵循robots.txt
未知
来源
IP地址(210) 服务器名称 所属国家
64.124.8.60 ? US
64.124.8.25 ? US
64.124.8.52 ? US
64.124.8.24 ? US
64.124.8.62 ? US

访问控制

了解如何控制ImagesiftBot访问权限,避免ImagesiftBot抓取行为不当。

是否拦截ImagesiftBot?

可能不需要,尤其是如果你自己也受益于信息搜集服务。不过,如果你担心服务器资源占用等问题,可以选择拦截它们。

通过Robots.txt拦截

您可以通过在网站的 robots.txt 中设置用户代理访问规则来屏蔽 ImagesiftBot 或限制其访问权限。我们建议安装 Spider Analyser 插件,以检查它是否真正遵循这些规则。

# robots.txt
# 下列代码一般情况可以拦截该代理
User-agent: ImagesiftBot
Disallow: /

您无需手动执行此操作,可通过我们的 Wordpress 插件 Spider Analyser 来拦截不必要的蜘蛛或者爬虫。

更多信息

ImageSiftBot 是一个网络爬虫,可以在互联网上抓取公开可用的图像,以支持 Imagesift 的网络智能产品套件。

来自 ImageSiftBot 的请求将用户代理设置为:

Mozilla/5.0 (compatible; ImagesiftBot; +imagesift.com)

常问问题

ImageSiftBot 是否遵循 Robots.txt 规则?

尊重 robots.txt 中针对 ImagesiftBot 的标准指令。例如,以下内容将允许 ImagesiftBot 抓取除 /private/ 下的页面之外的所有页面:

User-Agent: ImagesiftBot 
Allow: / 
Disallow: /private/

ImagesiftBot 还支持 robots.txt 文件中的抓取延迟指令。它将值解释为连续请求开始之间的最短持续时间(以秒为单位)。例如,假设您在 robots.txt 文件中指定了以下内容:

User-Agent: ImagesiftBot
Crawl-delay: 5

ImagesiftBot 会将每天分成 5 秒的时间间隔,并在每个时间间隔内最多向您的域发出一个请求。

如果没有针对 ImagesiftBot 的规则,但有针对 Googlebot 的规则,则 ImagesiftBot 将遵循 Googlebot 指令。例如,ImagesiftBot 将获取所有页面,除了 /private/ 下的页面,其中包含以下 robots.txt:

User-Agent: *
Disallow: /
User-Agent: Googlebot 
Allow: / 
Disallow: /private/

ImageSiftBot 保存哪些信息?

除了图像之外,ImageSiftBot 还保存以下信息:

  • 页面上的主机 URL 和文本
  • 与图像关联的替代文本

ImageSift 如何使用这些信息?

从网页下载图像和文本后,ImageSift 会分析该页面的数据并将信息存储在索引中。我们的网络智能产品使用此索引来搜索和检索类似图像。

关于 ImageSift

ImageSift 是一个允许用户从互联网上的各种来源搜索和发现图片的网站(反向图像搜索平台)。它为用户提供了一个根据自己的兴趣和喜好筛选和整理图片的平台。

有关 ImageSift 的更多信息,请访问其官方网站:https://www.imagesift.com/。

此外,您还可以查看其社交媒体页面,了解更新和新闻:

  • Twitter: https://twitter.com/imagesift
  • Facebook: https://www.facebook.com/ImageSift/

联系

如果您对 ImageSiftBot 有任何疑问或希望选择不被抓取,请通过电子邮件联系:support@imagesift.com

常见蜘蛛/爬虫

Common Spiders
StatistikHessen
StatistikHessen蜘蛛/爬虫属于信息搜集类型,由Hessischen Statistischen Landesamts开发运行。您可以继续阅读下方信息,以深入了解StatistikHessen基本信息,用户代理和访问控制等。
Wadoo! crawler
Wadoo! crawler蜘蛛/爬虫属于信息搜集类型,由Wadoo!开发运行。您可以继续阅读下方信息,以深入了解Wadoo! crawler基本信息,用户代理和访问控制等。
FH Muenster bot
FH Muenster bot蜘蛛/爬虫属于信息搜集类型,由FH Münster开发运行。您可以继续阅读下方信息,以深入了解FH Muenster bot基本信息,用户代理和访问控制等。
Website-info.net Robot
Website-info.net Robot蜘蛛/爬虫属于信息搜集类型,由Meins und Vogel GmbH开发运行。您可以继续阅读下方信息,以深入了解Website-info.net Robot基本信息,用户代理和访问控制等。
Mithril
Mithril蜘蛛/爬虫属于搜索引擎类型,由University of Michigan开发运行。您可以继续阅读下方信息,以深入了解Mithril基本信息,用户代理和访问控制等。
TikTokSpider
TikTokSpider蜘蛛/爬虫属于信息搜集类型,由ByteDance Inc.开发运行。您可以继续阅读下方信息,以深入了解TikTokSpider基本信息,用户代理和访问控制等。
OpenINTEL bot
OpenINTEL bot蜘蛛/爬虫属于信息搜集类型,由University of Twente开发运行。您可以继续阅读下方信息,以深入了解OpenINTEL bot基本信息,用户代理和访问控制等。
linkfluence
linkfluence蜘蛛/爬虫属于信息搜集类型,由Meltwater News US Inc.开发运行。您可以继续阅读下方信息,以深入了解linkfluence基本信息,用户代理和访问控制等。

相关文章

Related Articles