偵測機器人的最佳信號(排名)
並非所有機器人偵測信號都同樣可靠。以下是最有用的 IP、網絡及行為信號,按可靠性排序,用於識別自動化流量。
2026年4月1日閱讀約 3 分鐘
並不存在單一的「這是否機器人」測試,但可用信號的可靠程度差異甚大。 以下按可靠性排序,讓你把精力集中在最有效的地方。
第一級:網絡來源(最強、成本最低)
大部分自動化流量來自會暴露自身的基礎設施:
- 數據中心/託管 ASN。 雲端伺服器上出現的「訪客」是典型的機器人特徵,參見 甚麼是 ASN。
- 代理使用。 HTTP/SOCKS、住宅及數據中心代理,可透過 代理偵測 API 識別。
- VPN 及 Tor。 用於隱藏來源的匿名化工具。
- IP 信譽。 該地址或地址段過往的濫用紀錄。
一次 IP 查詢即可涵蓋以上所有內容,這正是網絡來源被列為槓桿效應最高一層的原因。
檢查某個 IP 的機器人相關網絡信號
第二級:行為信號(識別更複雜的機器人)
對於使用住宅代理並模仿人類的機器人,行為特徵會將其暴露:
- 請求頻率與請求量。
- 瀏覽模式,人類不會產生的那種(按順序逐一瀏覽每個頁面)。
- 缺失的用戶端行為,即沒有執行 JS,亦沒有滑鼠或觸控事件。
- 時間節奏,過快或過於規律。
第三級:薄弱線索(須謹慎使用)
- User-Agent 字串,極易偽造。
- 單一標頭異常,只具參考價值,不能作為定論。
- 原始 IP 封鎖名單,很快便會過時,參見 為何免費 IP 封鎖名單並不足夠。
如何綜合運用
排序的意義在於指示各類信號應賦予多大權重:
| 級別 | 權重 | 原因 |
|---|---|---|
| 網絡來源 | 高 | 成本低,能識別大部分流量 |
| 行為 | 對隱蔽機器人權重高 | 能識別使用住宅代理的機器人 |
| 薄弱線索 | 低 | 易偽造/很快過時 |
先將網絡信號納入 IP 詐騙評分,再疊加行為信號處理餘下部分。有關以 IP 優先的處理流程,參見 如何透過 IP 地址偵測機器人。
總結
按可靠性為機器人信號排序:網絡來源(代理/VPN/託管/信譽)是成本最低、效果最強的第一重 過濾;行為信號能識別使用住宅代理的複雜機器人;User-Agent 及靜態封鎖名單僅屬薄弱線索。將前 兩級結合運用,其餘部分只需賦予較低權重即可。
常見問題
常見問題解答
網絡來源。大多數機器人透過代理伺服器、VPN 或託管 IP 接入,因此匿名化及託管 ASN 信號只需一次 IP 查詢,便能識別出當中很大部分。