Security
I confini di sicurezza devono essere espliciti
TutuSoo separa la ricerca pubblica dai dati personali: la ricerca anonima non richiede account, l’accesso serve solo per raccolte e cronologia. Il crawling rispetta robots.txt e applica limiti su indirizzi in uscita e dimensione della risposta.
Ricerca e link esterni
I risultati possono provenire dall’indice locale o da un fallback web etichettato. Il client apre solo indirizzi HTTP o HTTPS, quindi risultati malformati non possono diventare link eseguibili.
- Le pagine dei risultati non vengono indicizzate.
- Query, paginazione e risposte hanno limiti di risorse.
- Gli errori di rete preservano il contesto e offrono un vero nuovo tentativo.
Confini del crawler
I target vengono verificati prima delle richieste. Indirizzi loopback, privati, link-local e di metadati cloud sono rifiutati, e i reindirizzamenti vengono rivalidati.
- robots.txt e Crawl-delay sono rispettati per impostazione predefinita.
- L’HTML è trasmesso in streaming con un limite di dimensione della risposta.
- Gli stati di crawl, indicizzazione e recupero restano tracciabili.
Account e dati personali
Gli utenti anonimi non sono obbligati a creare account. Tutu ID fornisce l’accesso; raccolte e cronologia di ricerca possono essere rimosse singolarmente o svuotate.
- Gli endpoint admin e utente comune usano controlli di autorizzazione separati.
- Le sessioni scadute vengono cancellate localmente con un messaggio esplicito.
- Le API key non devono mai essere inserite nei parametri di query dell’URL.