Security
安全邊界應該清楚,而不是藏在口號裡
圖圖搜把公開搜尋與個人資料分開:匿名搜尋無需賬號,登入只用於收藏和歷史;抓取遵守 robots.txt,並對出站地址和響應體做限制。
搜尋與外部連結
搜尋結果可能來自本站索引或外部兜底,介面會顯示來源。客戶端只允許開啟 http/https 地址,異常結果不會變成可執行連結。
- 搜尋頁不進入搜尋引擎索引。
- 查詢、分頁和響應都有資源上限。
- 網路失敗保留當前上下文,並提供真實重試。
抓取邊界
爬蟲在請求前檢查目標地址,拒絕迴環、私網、鏈路本地和雲後設資料地址;重定向後也要重新校驗。
- 預設遵守 robots.txt 和 Crawl-delay。
- HTML 響應採用流式讀取並限制大小。
- 抓取、索引和失敗恢復都有可追蹤狀態。
賬號與個人資料
匿名使用者不會為了搜尋被強制建立賬號。登入使用圖圖賬號單點登入,收藏和歷史可以單獨刪除或清空。
- 管理介面與普通使用者介面使用不同授權檢查。
- 登入失效時清理本地會話並明確提示。
- 不應把 API Key 放在 URL 查詢引數中。