DotBot

DotBot蜘蛛/爬蟲屬於營銷型別,由SEOmoz, Inc.開發執行。您可以繼續閱讀下方資訊,以深入瞭解DotBot基本資訊,使用者代理和訪問控制等。

基本資訊

DotBot的基本資訊如下表。但部分不是很規範的蜘蛛和爬蟲,可能存在資訊不明的情況。
蜘蛛/爬蟲名稱
DotBot
型別
營銷
開發商
SEOmoz, Inc.
當前狀態
活動

使用者代理

關於DotBot蜘蛛或者爬蟲的使用者代理字串,IP地址和伺服器,所在地等資訊如下表格所示:
DotBot/1.2
使用者代理字串
Mozilla/5.0 (compatible; DotBot/1.2; +https://opensiteexplorer.org/dotbot; help@moz.com)
首次出現
2021-03-18 12:51:46
最後出現
2025-01-10 17:47:39
遵循robots.txt
未知
來源
IP地址(16) 伺服器名稱 所屬國家
216.244.66.197 ? US
216.244.66.247 ? US
216.244.66.243 ? US
216.244.66.248 ? US
216.244.66.237 216-244-66-237.reverse.wowrack.com US
使用者代理字串
Mozilla/5.0 (compatible; DotBot/1.1; http://www.dotnetdotcom.org/, crawler@dotnetdotcom.org)
首次出現
2009-05-11 05:50:00
最後出現
2016-12-27 11:15:45
遵循robots.txt
未知
來源
IP地址(128) 伺服器名稱 所屬國家
35.153.133.186 ec2-35-153-133-186.compute-1.amazonaws.com US
54.196.89.197 ec2-54-196-89-197.compute-1.amazonaws.com US
54.196.168.34 ec2-54-196-168-34.compute-1.amazonaws.com US
54.224.84.45 ec2-54-224-84-45.compute-1.amazonaws.com US
54.80.131.215 ec2-54-80-131-215.compute-1.amazonaws.com US
使用者代理字串
Mozilla/5.0 (compatible; DotBot/1.1; http://www.dotnetdotcom.org/, crawler@dotnetdotcom.org)
首次出現
2009-05-11 05:50:00
最後出現
2016-12-27 11:15:45
遵循robots.txt
未知
來源
IP地址(10) 伺服器名稱 所屬國家
208.115.111.243 crawl2.dotnetdotcom.org US
208.115.111.248 crawl7.dotnetdotcom.org US
208.115.111.247 crawl6.dotnetdotcom.org US
208.115.111.249 crawl8.dotnetdotcom.org US
208.115.111.250 crawl9.dotnetdotcom.org US
使用者代理字串
dotbot
首次出現
2013-11-09 11:26:07
最後出現
2014-05-17 20:35:05
遵循robots.txt
未知
來源
IP地址(6) 伺服器名稱 所屬國家
208.184.81.30 ? US
72.44.63.103 ec2-72-44-63-103.compute-1.amazonaws.com US
107.20.88.61 ec2-107-20-88-61.compute-1.amazonaws.com US
184.72.90.45 ec2-184-72-90-45.compute-1.amazonaws.com US
184.73.99.2 ec2-184-73-99-2.compute-1.amazonaws.com US

訪問控制

瞭解如何控制DotBot訪問許可權,避免DotBot抓取行為不當。

是否攔截DotBot?

一般不需要攔截,尤其是如果你自己也受益於搜尋引擎優化服務。不過,如果你擔心伺服器資源佔用等問題,且您都不使用這些工具,當然也可以選擇攔截它們。

通過Robots.txt攔截

您可以通過在網站的 robots.txt 中設定使用者代理訪問規則來遮蔽 DotBot 或限制其訪問許可權。我們建議安裝 Spider Analyser 外掛,以檢查它是否真正遵循這些規則。

# robots.txt
# 下列程式碼一般情況可以攔截該代理
User-agent: DotBot
Disallow: /

您無需手動執行此操作,可通過我們的 Wordpress 外掛 Spider Analyser 來攔截不必要的蜘蛛或者爬蟲。

更多資訊

在本頁面中,您將瞭解更多關於我們的爬蟲Dotbot的資訊,它被用來抓取Moz連結索引,為Moz API、連結瀏覽器和您的活動中的連結部分提供動力。

Moz連結索引抓取器

Dotbot是Moz的網路爬蟲,它為Moz連結指數收集網路資料。我們通過Dotbot收集的這些資料可以在您的Moz Pro廣告系列的連結部分、連結瀏覽器和Moz連結API中找到。Dotbot與Rogerbot不同,Rogerbot是我們為Moz Pro廣告系列提供的網站審計爬行器。

為什麼Moz會抓取網路?

我們的一些工具,如Link Explorer,需要我們抓取網站。當這種情況發生時,使用者代理Dotbot被用來識別我們的爬行器。最好記住,你需要一個Moz專業賬戶來訪問收集到的大部分資訊。我們的免費網路營銷社羣成員的訪問許可權有限。要看我們收集的資料型別的一個例子,在連結瀏覽器的搜尋框中輸入一個URL。

如何阻止Dotbot抓取你的網站

如果您不希望Dotbot抓取您的網站,我們總是尊重標準的Robots排除協議(又稱robots.txt)。如果您想阻止Dotbot,您只需將我們的user-agent字串新增到您的robots.txt檔案。

禁止Dotbot進入您網站的某些區域

User-agent: dotbot 
Disallow: /admin/ 
Disallow: /scripts/ Disallow: /images/

完全禁止Dotbot進入您網站

User-agent: dotbot
Disallow: /

減緩Dotbot的速度

User-agent: dotbot
Crawl-delay: 10

Dotbot何時能檢測網站robots.txt檔案的變化?

Dotbot只在新的索引抓取過程中第一次遇到該網站時檢視你的robots.txt檔案。這意味著,如果Dotbot看到它被允許進入該網站一次,對該許可權的任何改變都不會被檢視,直到Dotbot下次定位到你的網站的連結。

常見蜘蛛/爬蟲

Common Spiders
RidderBot
RidderBot蜘蛛/爬蟲屬於營銷型別,由Ridder開發執行。您可以繼續閱讀下方資訊,以深入瞭解RidderBot基本資訊,使用者代理和訪問控制等。
Upsales bot
Upsales bot蜘蛛/爬蟲屬於營銷型別,由Upsales Nordic AB開發執行。您可以繼續閱讀下方資訊,以深入瞭解Upsales bot基本資訊,使用者代理和訪問控制等。
HealRWorld
HealRWorld蜘蛛/爬蟲屬於營銷型別,由HealRWorld LLC.開發執行。您可以繼續閱讀下方資訊,以深入瞭解HealRWorld基本資訊,使用者代理和訪問控制等。
Scope3
Scope3蜘蛛/爬蟲屬於營銷型別,由Scope3, PBC.開發執行。您可以繼續閱讀下方資訊,以深入瞭解Scope3基本資訊,使用者代理和訪問控制等。
MercuryLeads/1.0
MercuryLeads/1.0蜘蛛/爬蟲屬於營銷型別,由Mercury Leads開發執行。您可以繼續閱讀下方資訊,以深入瞭解MercuryLeads/1.0基本資訊,使用者代理和訪問控制等。
mediaboardbot
mediaboardbot蜘蛛/爬蟲屬於營銷型別,由Mediaboard s.r.o.開發執行。您可以繼續閱讀下方資訊,以深入瞭解mediaboardbot基本資訊,使用者代理和訪問控制等。
HaloScan bot
HaloScan bot蜘蛛/爬蟲屬於營銷型別,由ARCHI301開發執行。您可以繼續閱讀下方資訊,以深入瞭解HaloScan bot基本資訊,使用者代理和訪問控制等。
Matchory Bot
Matchory Bot蜘蛛/爬蟲屬於營銷型別,由Matchory GmbH開發執行。您可以繼續閱讀下方資訊,以深入瞭解Matchory Bot基本資訊,使用者代理和訪問控制等。

相關文章

Related Articles