Security
Sicherheitsgrenzen sollten explizit sein
TutuSoo trennt öffentliche Suche von persönlichen Daten: anonyme Suche braucht kein Konto, die Anmeldung dient nur Sammlungen und Verlauf. Crawling beachtet robots.txt und begrenzt Ausgangsadressen und Antwortgröße.
Suche und externe Links
Ergebnisse können aus dem lokalen Index oder einem gekennzeichneten Web-Fallback stammen. Der Client öffnet nur HTTP- oder HTTPS-Adressen, sodass fehlerhafte Ergebnisse keine ausführbaren Links werden.
- Suchergebnisseiten werden nicht indexiert.
- Abfragen, Paginierung und Antworten haben Ressourcenlimits.
- Netzwerkfehler bewahren den Kontext und bieten einen echten Wiederholungsversuch.
Crawler-Grenzen
Ziele werden vor Anfragen geprüft. Loopback-, private, Link-Local- und Cloud-Metadaten-Adressen werden abgelehnt, und Weiterleitungen werden erneut validiert.
- robots.txt und Crawl-delay werden standardmäßig beachtet.
- HTML wird mit einer Antwortgrößenbegrenzung gestreamt.
- Crawl-, Index- und Wiederherstellungszustände bleiben nachvollziehbar.
Konten und personenbezogene Daten
Anonyme Nutzer müssen keine Konten erstellen. Tutu ID bietet die Anmeldung; Sammlungen und Suchverlauf lassen sich einzeln entfernen oder leeren.
- Admin- und normale Nutzer-Endpunkte verwenden getrennte Autorisierungsprüfungen.
- Abgelaufene Sitzungen werden lokal mit einer expliziten Meldung gelöscht.
- API-Schlüssel gehören niemals in URL-Abfrageparameter.