coccocbot

coccocbot蜘蛛/爬蟲屬於搜尋引擎型別,由Coc Coc Company Limited.開發執行。您可以繼續閱讀下方資訊,以深入瞭解coccocbot基本資訊,使用者代理和訪問控制等。

基本資訊

coccocbot的基本資訊如下表。但部分不是很規範的蜘蛛和爬蟲,可能存在資訊不明的情況。
蜘蛛/爬蟲名稱
coccocbot
型別
搜尋引擎
開發商
Coc Coc Company Limited.
當前狀態
活動

使用者代理

關於coccocbot蜘蛛或者爬蟲的使用者代理字串,IP地址和伺服器,所在地等資訊如下表格所示:
coccocbot-image/1.0
使用者代理字串
Mozilla/5.0 (compatible; coccocbot-image/1.0; +http://help.coccoc.com/searchengine)
首次出現
2016-10-04 14:53:39
最後出現
2025-01-10 14:18:46
遵循robots.txt
未知
來源
IP地址(56) 伺服器名稱 所屬國家
103.131.71.36 ? VN
103.131.71.35 bot-103-131-71-35.coccoc.com VN
103.131.71.39 ? VN
103.131.71.204 bot-103-131-71-204.coccoc.com VN
103.131.71.42 ? VN
使用者代理字串
Mozilla/5.0 (compatible; coccocbot-web/1.0; +http://help.coccoc.com/searchengine)
首次出現
2016-10-05 01:14:37
最後出現
2025-01-10 12:11:30
遵循robots.txt
未知
來源
IP地址(144) 伺服器名稱 所屬國家
103.131.71.84 ? VN
103.131.71.129 ? VN
103.131.71.64 ? VN
103.131.71.126 ? VN
103.131.71.135 ? VN
使用者代理字串
Mozilla/5.0 (compatible; coccoc/1.0; +http://help.coccoc.com/)
首次出現
2013-06-03 09:20:00
最後出現
2016-05-08 17:03:01
遵循robots.txt
未知
來源
IP地址(10) 伺服器名稱 所屬國家
123.30.175.209 static.vdc.vn VN
123.30.175.207 static.vdc.vn VN
123.30.175.175 static.vdc.vn VN
123.30.175.222 static.vdc.vn VN
123.30.175.223 static.vdc.vn VN
使用者代理字串
Mozilla/5.0 (compatible; imagecoccoc/1.0; +http://help.coccoc.com/)
首次出現
2016-04-15 09:46:00
最後出現
2016-05-08 03:02:11
遵循robots.txt
未知
來源
IP地址(4) 伺服器名稱 所屬國家
123.30.175.140 static.vdc.vn VN
123.30.175.141 static.vdc.vn VN
123.30.175.142 static.vdc.vn VN
123.30.175.139 static.vdc.vn VN
使用者代理字串
Mozilla/5.0 (compatible; imagecoccoc/1.0; +http://help.coccoc.com/)
首次出現
2016-04-15 09:46:00
最後出現
2016-05-08 03:02:11
遵循robots.txt
未知
來源
IP地址(4) 伺服器名稱 所屬國家
123.30.175.142 static.vdc.vn VN
123.30.175.140 static.vdc.vn VN
123.30.175.139 static.vdc.vn VN
123.30.175.141 static.vdc.vn VN
使用者代理字串
Mozilla/5.0 (compatible; image.coccoc/1.0; +http://help.coccoc.com/)
首次出現
2015-01-15 02:50:00
最後出現
2015-10-28 11:34:20
遵循robots.txt
未知
來源
IP地址(4) 伺服器名稱 所屬國家
123.30.175.135 static.vdc.vn VN
123.30.175.133 static.vdc.vn VN
123.30.175.134 static.vdc.vn VN
123.30.175.132 static.vdc.vn VN
使用者代理字串
coccoc
首次出現
2012-04-30 04:20:26
最後出現
2013-05-12 20:04:47
遵循robots.txt
未知
來源
IP地址(6) 伺服器名稱 所屬國家
123.30.175.165 static.vdc.vn VN
123.30.175.160 static.vdc.vn VN
123.30.175.158 static.vdc.vn VN
123.30.175.128 static.vdc.vn VN
123.30.175.129 static.vdc.vn VN
使用者代理字串
coccoc/1.0 (http://help.coccoc.com/)
首次出現
2013-02-18 08:15:00
最後出現
2013-04-21 20:02:04
遵循robots.txt
未知
來源
IP地址(8) 伺服器名稱 所屬國家
123.30.175.100 static.vdc.vn VN
123.30.175.86 static.vdc.vn VN
123.30.175.90 static.vdc.vn VN
123.30.175.81 static.vdc.vn VN
123.30.175.87 static.vdc.vn VN
使用者代理字串
coccoc/1.0 (http://help.coccoc.vn/)
首次出現
2012-08-30 10:31:00
最後出現
2013-01-29 02:09:09
遵循robots.txt
未知
來源
IP地址(10) 伺服器名稱 所屬國家
123.30.175.85 static.vdc.vn VN
123.30.175.87 static.vdc.vn VN
123.30.175.98 static.vdc.vn VN
123.30.175.96 static.vdc.vn VN
123.30.175.97 static.vdc.vn VN
使用者代理字串
coccoc/1.0 ()
首次出現
2012-06-19 01:34:28
最後出現
2012-08-23 21:10:20
遵循robots.txt
未知
來源
IP地址(32) 伺服器名稱 所屬國家
123.30.175.181 coccoc.com VN
123.30.175.180 static.vdc.vn VN
123.30.175.217 static.vdc.vn VN
123.30.175.221 static.vdc.vn VN
123.30.175.228 static.vdc.vn VN
使用者代理字串
coccoc/1.0 ()
首次出現
2012-06-19 01:34:28
最後出現
2012-08-23 21:10:20
遵循robots.txt
未知
來源
IP地址(5) 伺服器名稱 所屬國家
123.30.175.83 static.vdc.vn VN
123.30.175.86 static.vdc.vn VN
123.30.175.85 static.vdc.vn VN
123.30.175.84 static.vdc.vn VN
123.30.175.87 static.vdc.vn VN

訪問控制

瞭解如何控制coccocbot訪問許可權,避免coccocbot抓取行為不當。

是否攔截coccocbot?

一般不要攔截。搜尋引擎爬蟲為搜尋引擎提供動力,是使用者發現您網站的有效途徑。事實上,攔截搜尋引擎爬蟲可能會嚴重減少網站的自然流量。

通過Robots.txt攔截

您可以通過在網站的 robots.txt 中設定使用者代理訪問規則來遮蔽 coccocbot 或限制其訪問許可權。我們建議安裝 Spider Analyser 外掛,以檢查它是否真正遵循這些規則。

# robots.txt
# 下列程式碼一般情況可以攔截該代理
User-agent: coccocbot
Disallow: /

您無需手動執行此操作,可通過我們的 Wordpress 外掛 Spider Analyser 來攔截不必要的蜘蛛或者爬蟲。

更多資訊

coccocbot(bot,爬蟲)是由Coc Coc搜尋引擎製作的網路爬行機器人。該機器人發現並下載網站/網頁,以便將其納入Coc Coc的搜尋引擎索引。通過允許coccocbot抓取您的網站,您可以通過增加能夠找到您的內容的使用者數量,使您的網站更受歡迎。

下面您可以找到關於coccocbot和搜尋的一些常見問題的答案。

1.為什麼我的網站/子頁面沒有出現在 coccoc.com/search 的搜尋結果中?

您可以通過使用 “site: “操作符檢查coccoc.com是否已將您的網站的任何頁面新增到coccoc.com的索引中。進入coccoc.com/search,輸入查詢 “site:yourwebsite.com yourwebsite.com”。例如。site:coccoc.com coccoc.com。

如果你的查詢沒有檢索到任何結果,有幾個潛在的原因,你的網站可能不包括在coccoc.com的索引中。

首先,確保你的網頁能被coccoc.com的爬蟲找到。機器人是一個通過跟蹤連結爬行網路的程式。它通過從發現的網頁中提取URL,並從這些新的URL中下載網頁,從而下載和索引網頁。這個過程在一個迴圈中重複。因此,為了使你的網站能夠被coccocbot發現,你的網站需要被其他網站連結。這些連結必須不標有nofollow指令。此外,由於coccocbot是為網際網路的越南部分而設計的,這些連結必須在該地區。coccocbot試圖將自己限制在越南語的內容上。為了達到這個目的,它從用越南語編寫的網頁和一般的.vn域名中提取連結。如果您的網站是全新的,coccocbot也可能需要一些時間來找到連結到它的頁面。

如果你的網站有這樣的連結,請檢查這些URL連結到的內容是coccocbot可以到達的,並且允許被新增到coccoc.com的索引中。檢查你的robots.txt檔案,確保它沒有禁止coccocbot下載你的網頁。此外,確保你的網頁內容中沒有noindex指令。此外,您的網站(或您的網際網路服務提供商,ISP)可以通過阻止coccocbot的使用者代理字串或阻止coccocbot的IP地址來阻止coccocbot。請聯絡您的系統管理員/ISP,檢查是否是這個問題。

如果你想手動新增一些頁面到coccoc.com的索引,請通過線上表格提交相關的URL。

2.如何將網站/網頁從coccoc.com/search的搜尋結果中刪除

你可以通過幾種方式指示coccocbot不將你的網頁加入coccoc.com的索引和/或不下載你的網頁。

首先,你可以在你的 robots.txt 檔案中向coccocbot發出指示。例如,如果你想指示coccocbot不下載任何路徑以/cgi-bin/開頭的頁面,你可以在你的robots.txt中新增以下指示。

User-agent: coccocbot-web
Disallow: /cgi-bin/

在大多數情況下,robots.txt中不允許的URL不會出現在coccoc.com的索引中,因為它們不會被coccoc.com的機器人下載。然而,一些在robots.txt中不允許的URL的頁面仍然可能被新增到coccoc.com的索引中,而沒有頁面的內容。在這些情況下,類似於下面這個例子的片段會出現在coccoc.com的搜尋結果中。

example.com
http://example.com

There is no general description due to policy restricting access from the host site

其次,要指示coccocbot從coccoc.com的索引中完全排除一個頁面,你可以在該頁面上使用noindex指令。如果你使用noindex,確保該頁面的URL在你的robots.txt中不被禁止下載。在這種情況下,即使coccocbot能夠找到指向你的頁面的連結,它也不會將該頁面新增到索引中(儘管它仍然會下載該頁面,因為它需要下載它來找到noindex指令)。

最後,你也可以對你網站上的一些連結使用nofollow指令。如果你的網站上所有指向某個特定URL的連結都使用這個指令,coccocbot就不會請求這個URL。當然,由於你不能控制其他網站,他們仍然可能包括一個沒有nofollow指令的連結到你的網站。如果coccocbot發現這樣的連結,它可以請求你的URL,並仍然將其新增到索引中。因此,nofollow指令可以在你的網站內部使用,以排除其某些部分或URL被coccocbot下載和索引。然而,像這樣使用nofollow不能完全阻止你的網頁被索引。

在你的robots.txt或其他指令的變化在coccoc.com的索引中更新之前,可能需要一些時間。如果你已經對你的網站做了這樣的改變,並想強制應用你的改變到coccoc.com的索引中,你可以通過線上表格提交你的網址/網站。

3.coccocbot導致網站/伺服器過載

如果你想降低coccocbot訪問你的網站的速度,你可以在你的robots.txt中使用爬行延遲指令。

例如,要為coccocbot設定5秒的爬行延遲,請在您的robots.txt中新增以下指令。

User-agent: coccocbot-web
Crawl-delay: 5

請注意:coccocbot不支援超過10秒的抓取延遲。因此,100秒的爬行延遲被視為10秒的爬行延遲。

增加抓取延遲可能會導致您的網站在coccoc.com的索引中更新緩慢。如果您的網站很小,這可能不是一個問題。在這種情況下,即使延遲值很大,coccocbot也能夠以足夠的頻率請求您網站的頁面。然而,如果你有數以百萬計的頁面,一個大的延遲值會影響更新速度。在這種情況下,首先要確保你所有的可索引頁面對使用者是有用的。例如,一個網站可能使用Faceted搜尋。Faceted搜尋是一種常見的方式,通過使用過濾器在一個大的資料庫中找到一個專案。每個過濾器都由URL中的一個參數列示。不同數值的組合數量可能非常大,儘管只有一小部分實際產生了資料庫中的專案。如果你想指示coccocbot不要從你的網站下載某些頁面,請閱讀上面第2點。

如果您是網際網路服務提供商,想降低coccocbot對您的伺服器的訪問率,請通過頁面的問題和投訴表與coccoc.com聯絡。

常見蜘蛛/爬蟲

Common Spiders
Palpex crawler
Palpex crawler蜘蛛/爬蟲屬於搜尋引擎型別,由Palpex開發執行。您可以繼續閱讀下方資訊,以深入瞭解Palpex crawler基本資訊,使用者代理和訪問控制等。
lyonl
lyonl蜘蛛/爬蟲屬於搜尋引擎型別,由lyonl開發執行。您可以繼續閱讀下方資訊,以深入瞭解lyonl基本資訊,使用者代理和訪問控制等。
lyonl-crawler
lyonl-crawler蜘蛛/爬蟲屬於搜尋引擎型別,由lyonl開發執行。您可以繼續閱讀下方資訊,以深入瞭解lyonl-crawler基本資訊,使用者代理和訪問控制等。
kagi bot
kagi bot蜘蛛/爬蟲屬於搜尋引擎型別,由Kagi Inc.開發執行。您可以繼續閱讀下方資訊,以深入瞭解kagi bot基本資訊,使用者代理和訪問控制等。
AVALW-SearchBot
AVALW-SearchBot蜘蛛/爬蟲屬於搜尋引擎型別,由AVALW SRL開發執行。您可以繼續閱讀下方資訊,以深入瞭解AVALW-SearchBot基本資訊,使用者代理和訪問控制等。
amazon-kendra
amazon-kendra蜘蛛/爬蟲屬於搜尋引擎型別,由Amazon.com, Inc.開發執行。您可以繼續閱讀下方資訊,以深入瞭解amazon-kendra基本資訊,使用者代理和訪問控制等。
Stripebot
Stripebot蜘蛛/爬蟲屬於搜尋引擎型別,由Stripe, Inc.開發執行。您可以繼續閱讀下方資訊,以深入瞭解Stripebot基本資訊,使用者代理和訪問控制等。
Qwantbot
Qwantbot蜘蛛/爬蟲屬於搜尋引擎型別,由Qwant SAS開發執行。您可以繼續閱讀下方資訊,以深入瞭解Qwantbot基本資訊,使用者代理和訪問控制等。

相關文章

Related Articles