Cosa raccogliamo, e quando
Quando leggi una pagina
Su questo sito non viene caricato alcuno script di analisi o di tracciamento, e la lettura di una pagina non scrive alcuna riga in nessun nostro database. Quello che avviene è la normale distribuzione web: Cloudflare consegna la pagina, e la richiesta arriva ai suoi server portando con sé ciò che ogni richiesta HTTP porta con sé.
- Il tuo indirizzo IP.
- L'indirizzo della pagina che hai chiesto, e la pagina da cui provieni se il tuo browser ha inviato un referrer.
- Il tuo browser e il tuo sistema operativo, dall'header User-Agent, e le tue preferenze linguistiche, da Accept-Language. Un link privo di lingua, per esempio un /plane-crash condiviso, viene risolto a una delle lingue compilate usando quell'header.
Cloudflare tratta tutto questo in quanto nostro fornitore di hosting e conserva i propri log delle richieste secondo tempi propri. Non ne ricaviamo statistiche di visualizzazione delle pagine. Likelier non imposta cookie. Non c'è pubblicità, non c'è alcun identificatore pubblicitario e non c'è tracciamento tra siti, e nulla viene venduto o ceduto a chiunque per scopi di marketing. Leggere una pagina non costruisce nulla su di te e non viene analizzato in alcun modo. Evitiamo però di allargare la cosa fino a negare seccamente la profilazione per l'intero sito, perché /calibrate ti invita a descriverti, e questo merita una risposta vera e non una sola parola. Quella risposta è più sotto.
Quando fai una ricerca
La ricerca si svolge in tre fasi nel tuo browser, e la terza fase ha bisogno di un vettore che solo un modello può produrre. Perciò, quando una query si stabilizza, il testo va al nostro server, che lo inoltra a Google perché venga trasformato in quel vettore, e nel nostro database viene scritta una riga. La riga contiene:
- Un hash SHA-256 della query, ridotta a minuscolo e con gli spazi normalizzati. Il testo in sé non viene conservato.
- Quanti risultati sono stati restituiti.
- Quali fasi di ordinamento sono state eseguite, e se fra queste c'era la fase vettoriale.
- Quanto è durata la ricerca, in millisecondi.
- Il percorso della pagina da cui hai cercato, per esempio /en/risks.
Quella riga non contiene né indirizzo IP né identificatore di sessione. Fuori dalla riga, però, ogni ricerca accettata fa avanzare un contatore per la limitazione della frequenza in Workers KV, la cui chiave contiene i primi otto byte di uno SHA-256 non salato del tuo indirizzo IP, e quel contatore scade 24 ore dopo essere stato scritto. Le righe di ricerca vengono cancellate 90 giorni dopo essere state scritte, da una pulizia che si innesca sul traffico successivo anziché su un orologio, per cui un periodo molto tranquillo può lasciare una riga in archivio un po' più a lungo. E non ti diremo che l'hash è anonimo: una query breve e comune può essere ricostruita provando frasi candidate, calcolandone l'hash e confrontandolo, quindi considera queste righe come pseudonime.
Quando usi /calibrate
Calibrate ti chiede di descrivere una situazione con parole tue, il che ne fa l'unico punto del sito in cui puoi scrivere qualcosa che ti riguarda. Quel testo va al nostro server, che lo passa a un nostro Cloudflare Worker, il server MCP di Likelier, per cercare nel dataset. Per cercare, quel Worker manda il tuo testo a Google perché venga trasformato in un vettore. Se la pagina mostra anche una breve sintesi generata, il tuo testo va a Google una seconda volta dentro un prompt rivolto a un modello generativo, e la risposta che torna resta nella cache edge di Cloudflare per 24 ore sotto una chiave derivata da un hash del tuo testo. Il testo non lo conserviamo. Conserviamo:
- Un prefisso di 12 caratteri di un hash SHA-256 di ciò che hai scritto, il rischio a cui lo abbiamo associato, se la richiesta è stata rifiutata o non ha trovato nulla, e la versione del dataset che ha risposto.
- Un nonce casuale che identifica la sessione di pagina, emesso al caricamento della pagina e valido per dieci minuti. È ciò che lega un successivo clic di feedback alla calibrazione a cui appartiene.
- Un hash SHA-256 del tuo indirizzo IP combinato con la data e con un segreto in nostro possesso, usato per riconoscere invii ripetuti nell'arco di una giornata. Quando quel segreto non è configurato, il campo resta vuoto anziché essere riempito con un valore più debole.
- La lingua della tua interfaccia e, se ne premi uno, quale pulsante di feedback hai premuto o quale fornitore di AI esterno hai scelto. Scegliere un fornitore apre il sito di quella società con la tua domanda negli appunti, e in certi casi nel link stesso, per cui da quel momento il testo è nelle sue mani, sotto la sua informativa e non sotto la nostra.
Queste righe vengono cancellate 90 giorni dopo essere state scritte, con la stessa pulizia innescata dal traffico che vale per le righe di ricerca. La stessa finestra e lo stesso trattamento valgono per la valutazione che puoi lasciare dopo che un assistente AI ha risposto usando il nostro server MCP: seguire quel link di valutazione registra il tuo voto, quale strumento ha prodotto la risposta, la versione del dataset e lo stesso hash dell'IP con la data, e nient'altro. Una frase breve produce un hash che si può ricostruire per tentativi e ricalcolo, esattamente come per la ricerca, quindi nemmeno questi sono dati anonimi. Se questo sia profilazione è una domanda legittima, perché l'articolo 4, punto 4), del GDPR comprende il trattamento automatizzato usato per valutare aspetti personali di qualcuno e nomina fra questi la salute e il comportamento, che è vicino a ciò che potresti scrivere qui. Quello che la pagina fa davvero è più stretto. Le tue parole selezionano voci che esistono già, e il numero che vedi è il valore pubblicato per una popolazione e non un valore calcolato su di te; al modello che scrive il breve riassunto è vietato ricalcolare o estrapolare qualsiasi probabilità, benché possa scegliere quale dei fattori pubblicati della voce meriti una menzione alla luce della tua descrizione. L'elenco dei fattori personali accanto al risultato è l'elenco proprio di quella voce, lo stesso che sta sulla sua pagina pubblica e lo stesso per chiunque ci arrivi, e questo sito non ci manda né età, né sesso, né anamnesi da confrontare con quell'elenco, per cui ogni fattore vi compare come non segnalato. Un assistente AI che passa dal nostro server MCP può invece trasmettere una fascia d'età, un sesso o un'anamnesi che gli hai dichiarato, e allora i fattori la cui formulazione corrisponde vengono spuntati per quella singola risposta e non vengono registrati. Il cursore che permette di provare quei fattori su una voce gira interamente nel tuo browser e non manda nulla da nessuna parte. Nulla si accumula: non conserviamo attributi che ti riguardano né un profilo in cui metterli, ogni richiesta si risolve per conto proprio, e il nonce da dieci minuti lega un clic di valutazione a una calibrazione e non una persona a una storia. Su di te non viene presa alcuna decisione, quindi l'articolo 22 del GDPR non entra in gioco. La descrizione onesta è: reperimento di informazioni con una domanda personale allegata, e se preferisci non allegarne una, le stesse voci si leggono navigando o cercando, senza descriverti affatto.
Chi lo tratta, e dove
Il testo che scrivi arriva a Google, ed è, di tutta questa pagina, la cosa che più vale la pena rileggere due volte. Una query di ricerca va al modello di embedding gemini-embedding-2 per essere trasformata in un vettore a 768 dimensioni per l'ordinamento. Una situazione di calibrate va allo stesso modello di embedding attraverso il nostro Worker MCP. Una situazione di calibrate prosegue anche verso un modello generativo, gemini-3.5-flash-lite salvo diversa configurazione del deployment, dentro un prompt che porta con sé anche il testo recuperato dal dataset, ogni volta che la pagina genera una sintesi. A nessuna di queste chiamate alleghiamo un nome, un account, un cookie o un identificatore, e poiché è il nostro server a effettuarle, Google vede la nostra infrastruttura anziché il tuo indirizzo IP. Il testo, però, è tuo, ed esce davvero dai nostri sistemi. Google lo tratta secondo il documento « Google Privacy Policy ».
Cloudflare
Cloudflare non è la rete davanti al sito. È il sito: il posto dove il codice gira e dove sta quasi tutto ciò che conserviamo. Pages serve l'HTML, le Functions eseguono gli endpoint API, D1 contiene le tabelle descritte sopra, Workers KV contiene i contatori per la limitazione della frequenza, Analytics Engine riceve un punto dato per ogni chiamata API in cui registra l'endpoint, lo stato HTTP e la latenza, senza IP e senza testo, R2 serve l'indice di ricerca che il tuo browser scarica e lo snapshot del dataset che il Worker MCP legge, la cache edge conserva le sintesi generate, e Workers Logs raccoglie le righe di errore strutturate emesse dai nostri endpoint e le tiene per qualche giorno. Il server MCP di Likelier è un Cloudflare Worker separato che gestiamo noi. Tutto questo gira su Cloudflare come nostro responsabile del trattamento, secondo il documento « Cloudflare Privacy Policy ». La nostra configurazione non fissa alcuna regione, quindi il trattamento può avvenire fuori dallo Spazio economico europeo.
Cosa il sito salva sul tuo dispositivo
- theme: la combinazione di colori che hai scelto, scritta solo quando usi l'interruttore.
- likelier:recent:consent:v1 e likelier:recent:v1: la tua risposta alla domanda sulla cronologia di lettura, e la cronologia stessa. Nella cronologia non viene scritto nulla finché non dici di sì, dire di no cancella quanto già presente, e nessuno dei due valori viene mai inviato a un server.
- likelier-coffee-dismiss, likelier-coffee-supporter e pwa-install-dismissed-at: l'annotazione che hai chiuso l'invito a sostenere il progetto o l'invito a installare l'app, così il sito smette di chiedertelo.
- Valori che vivono solo finché non chiudi la scheda: una copia in cache dell'elenco delle curiosità, il conteggio delle pagine lette in questa sessione, l'annotazione che hai scelto una lingua, e una posizione di scorrimento trasportata attraverso un cambio di lingua.
- Nessuno di questi è un cookie, nessuno viene letto da un server, e nessuno ti identifica da un sito all'altro. Cancellare i dati del sito nel tuo browser li rimuove tutti.
Chi è responsabile
Likelier è gestito dalla Polonia da Krzysztof Gluszczyk, che è il titolare del trattamento di tutto quanto qui descritto. Per qualsiasi punto di questa informativa, scrivi a contact@creatiwi.ai .
Base giuridica
Le righe di ricerca, le righe di calibrate e le metriche delle API sono trattate sulla base del legittimo interesse, articolo 6, paragrafo 1, lettera f) del GDPR: abbiamo bisogno di sapere quali argomenti cercano i lettori, dove il dataset ha lacune e se gli endpoint vengono prosciugati. I contatori per la limitazione della frequenza e gli hash dell'IP con la data poggiano sulla stessa base per un interesse più ristretto, cioè mantenere sostenibile un'API non autenticata e a consumo. L'invio del tuo testo a Google è necessario per eseguire la ricerca o la calibrazione che hai chiesto, articolo 6, paragrafo 1, lettere b) e f). Non sosteniamo che nulla di tutto questo sia anonimo. Un valore derivato dal tuo indirizzo IP, e un hash di una frase che hai scritto, sono dati pseudonimi, e secondo il considerando 26 i dati pseudonimi restano dati personali quando qualcuno dispone di ciò che serve a risalire all'originale. Noi ne disponiamo.
Il salvataggio sul tuo dispositivo è una questione a parte, e i cookie non sono il criterio giusto per valutarla. Poiché operiamo dalla Polonia, la norma applicabile è l'articolo 399 della Prawo komunikacji elektronicznej, la legge polacca sulle comunicazioni elettroniche in vigore dal 10 novembre 2024, che ha sostituito l'articolo 173 della vecchia Prawo telekomunikacyjne ed è l'attuazione polacca dell'articolo 5, paragrafo 3, della direttiva ePrivacy. Ciò che vi rileva è archiviare informazioni nella tua apparecchiatura terminale, oppure accedere a informazioni che vi sono già archiviate, che ciò che viene archiviato sia un cookie o no e che si tratti o no di dati personali. Inoltre sta accanto al GDPR e non dentro di esso, perciò il legittimo interesse invocato sopra non prende qui il posto del consenso, e ogni voce qui sotto deve giustificarsi da sé. Due cose qui sono davvero necessarie per qualcosa che hai chiesto tu e sono quindi salvate senza consenso: la combinazione di colori che hai selezionato e, una volta che le hai risposto, la tua risposta alla domanda sulla cronologia di lettura, che esiste proprio perché la domanda non ti venga riproposta. La cronologia di lettura in sé non è necessaria, dato che le pagine si vedono in modo identico senza di essa, quindi non viene scritto nulla finché non acconsenti e il rifiuto cancella ciò che c'è. Le annotazioni di chiusura degli inviti a sostenere il progetto e a installare l'app sono salvate senza chiedertelo, sul presupposto che ricordarsi un «smettila di chiedermelo» serva a te più che a noi. Se la vedi diversamente, cancellare i dati del sito le rimuove e gli inviti tornano.
I tuoi diritti
Hai i diritti previsti dagli articoli da 15 a 22 del GDPR: accesso, rettifica, cancellazione, limitazione, portabilità e opposizione al trattamento fondato sul legittimo interesse. Esercitarli qui è scomodo più che impossibile, e vale la pena spiegare come. Di te non abbiamo né un account né un nome, quindi un indirizzo email da solo non individua le tue righe. Possiamo invece confrontare ciò che effettivamente conserviamo: dicci all'incirca quando hai fatto una ricerca o usato calibrate e che cosa hai scritto, e possiamo ricalcolare l'hash e cancellare le righe corrispondenti. Se puoi dirci quale indirizzo IP hai usato e in che giorno, possiamo ricalcolare anche l'hash con la data e confrontare pure quello, finché il segreto che gli sta dietro resta invariato. Scrivi a contact@creatiwi.ai e risponderemo entro un mese. Puoi anche presentare reclamo a un'autorità di controllo; in Polonia è il Presidente dell'Ufficio per la protezione dei dati personali, UODO.