Security

I confini di sicurezza devono essere espliciti

TutuSoo separa la ricerca pubblica dai dati personali: la ricerca anonima non richiede account, l’accesso serve solo per raccolte e cronologia. Il crawling rispetta robots.txt e applica limiti su indirizzi in uscita e dimensione della risposta.

Ricerca e link esterni

I risultati possono provenire dall’indice locale o da un fallback web etichettato. Il client apre solo indirizzi HTTP o HTTPS, quindi risultati malformati non possono diventare link eseguibili.

  • Le pagine dei risultati non vengono indicizzate.
  • Query, paginazione e risposte hanno limiti di risorse.
  • Gli errori di rete preservano il contesto e offrono un vero nuovo tentativo.

Confini del crawler

I target vengono verificati prima delle richieste. Indirizzi loopback, privati, link-local e di metadati cloud sono rifiutati, e i reindirizzamenti vengono rivalidati.

  • robots.txt e Crawl-delay sono rispettati per impostazione predefinita.
  • L’HTML è trasmesso in streaming con un limite di dimensione della risposta.
  • Gli stati di crawl, indicizzazione e recupero restano tracciabili.

Account e dati personali

Gli utenti anonimi non sono obbligati a creare account. Tutu ID fornisce l’accesso; raccolte e cronologia di ricerca possono essere rimosse singolarmente o svuotate.

  • Gli endpoint admin e utente comune usano controlli di autorizzazione separati.
  • Le sessioni scadute vengono cancellate localmente con un messaggio esplicito.
  • Le API key non devono mai essere inserite nei parametri di query dell’URL.