Security
सुरक्षा सीमाएं स्पष्ट होनी चाहिए
TutuSoo सार्वजनिक खोज को व्यक्तिगत डेटा से अलग करता है: गुमनाम खोज को खाता नहीं चाहिए, साइन-इन केवल संग्रह व इतिहास के लिए। क्रॉलिंग robots.txt का पालन करती है और आउटबाउंड पता व प्रतिक्रिया-आकार सीमाएं लागू करती है।
खोज और बाहरी लिंक
परिणाम लोकल इंडेक्स या लेबल किए वेब फ़ॉलबैक से आ सकते हैं। क्लाइंट केवल HTTP या HTTPS पते खोलता है, इसलिए विकृत परिणाम निष्पादन योग्य लिंक नहीं बन सकते।
- खोज-परिणाम पेज इंडेक्स नहीं होते।
- क्वेरी, पेजिनेशन और प्रतिक्रियाओं की संसाधन सीमाएं हैं।
- नेटवर्क त्रुटियां संदर्भ बनाए रखती हैं और वास्तविक पुनः प्रयास देती हैं।
क्रॉलर सीमाएं
अनुरोध से पहले लक्ष्य जांचे जाते हैं। loopback, निजी, link-local और क्लाउड-मेटाडेटा पते अस्वीकृत, और रीडायरेक्ट फिर से सत्यापित।
- robots.txt और Crawl-delay डिफ़ॉल्ट रूप से माने जाते हैं।
- HTML को प्रतिक्रिया-आकार सीमा के साथ स्ट्रीम किया जाता है।
- क्रॉल, इंडेक्स और रिकवरी स्थितियां हमेशा ट्रेस करने योग्य रहती हैं।
खाते और व्यक्तिगत डेटा
गुमनाम उपयोगकर्ताओं को खाता बनाने के लिए बाध्य नहीं किया जाता। Tutu ID साइन-इन देता है; संग्रह और खोज इतिहास अलग-अलग हटाए या साफ़ किए जा सकते हैं।
- एडमिन और सामान्य-उपयोगकर्ता endpoint अलग प्राधिकरण जांच उपयोग करते हैं।
- समाप्त सत्र स्थानीय रूप से स्पष्ट संदेश के साथ साफ़ किए जाते हैं।
- API keys को कभी भी URL क्वेरी पैरामीटर में न रखें।