Что мы собираем и когда
Когда вы читаете страницу
На этом сайте не загружается ни аналитический, ни отслеживающий скрипт, и чтение страницы не создаёт ни одной строки ни в одной нашей базе данных. Происходит обычная выдача страниц: Cloudflare отдаёт страницу, и запрос доходит до его серверов, неся с собой то, что несёт любой HTTP-запрос.
- Ваш IP-адрес.
- Адрес запрошенной страницы и адрес страницы, с которой вы пришли, если браузер отправил реферер.
- Ваш браузер и операционную систему, из заголовка User-Agent, и языковые предпочтения, из Accept-Language. Ссылка без языка в адресе, например присланная /plane-crash, разрешается в один из собранных языков по этому заголовку.
Cloudflare делает это как наш хостинг-провайдер и ведёт собственные журналы запросов по собственному расписанию. Мы не извлекаем из них статистику просмотров. Likelier не устанавливает никаких cookies. Здесь нет рекламы, рекламных идентификаторов и межсайтового отслеживания, и ничего не продаётся и не передаётся кому-либо для маркетинга. Чтение страницы ничего о вас не выстраивает и вообще никак не анализируется. Но мы не растягиваем это до плоского отрицания профилирования по всему сайту, потому что /calibrate предлагает вам описать себя, а это заслуживает настоящего ответа, а не одного слова. Такой ответ ниже.
Когда вы ищете
Поиск работает в вашем браузере в три этапа, и третьему этапу нужен вектор, который умеет создать только модель. Поэтому, когда запрос устоялся, текст уходит на наш сервер, тот передаёт его в Google для превращения в этот вектор, а в нашей базе данных записывается одна строка. Строка содержит:
- Хеш SHA-256 запроса, приведённого к нижнему регистру и с нормализованными пробелами. Сам текст не сохраняется.
- Сколько результатов вернулось.
- Какие этапы ранжирования отработали и был ли среди них векторный этап.
- Сколько занял поиск, в миллисекундах.
- Путь страницы, с которой вы искали, например /en/risks.
В этой строке нет ни IP-адреса, ни идентификатора сессии. Зато вне строки каждый принятый поиск увеличивает счётчик ограничения частоты в Workers KV, в ключе которого лежат первые восемь байт несолёного SHA-256 от вашего IP-адреса, и такой счётчик истекает через 24 часа после записи. Строки поиска удаляются через 90 дней после записи, уборкой, которая едет на позднейшем трафике, а не по часам, поэтому очень тихий период может оставить строку на месте чуть дольше. И мы не станем утверждать, что хеш анонимен: короткий распространённый запрос восстанавливается перебором фраз-кандидатов с их хешированием и сравнением, так что считайте эти строки псевдонимизированными данными.
Когда вы пользуетесь /calibrate
Calibrate просит описать ситуацию своими словами, и потому это единственное место на сайте, где вы можете напечатать что-то о себе. Этот текст уходит на наш сервер, а тот передаёт его нашему Cloudflare Worker, серверу Likelier MCP, чтобы искать по набору данных. Для поиска этот Worker отправляет ваш текст в Google для превращения в вектор. Если страница показывает ещё и короткий сгенерированный вывод, ваш текст уходит в Google второй раз, внутри запроса к генеративной модели, а полученный ответ лежит 24 часа в пограничном кеше Cloudflare под ключом, выведенным из хеша вашего текста. Сам текст мы не храним. Мы храним:
- Двенадцатисимвольное начало хеша SHA-256 от напечатанного вами, сопоставленный с ним риск, признак того, что запрос был отклонён или ничего не нашёл, и версию набора данных, которая ответила.
- Случайный одноразовый идентификатор сессии страницы, выдаваемый при её загрузке и действующий десять минут. Именно он связывает более поздний клик по оценке с той калибровкой, к которой он относится.
- Хеш SHA-256 от вашего IP-адреса вместе с датой и известным нам секретом, служащий для распознавания повторных отправок в течение суток. Когда этот секрет не настроен, поле остаётся пустым, а не заполняется более слабым значением.
- Язык интерфейса и, если вы куда-то нажмёте, какая кнопка оценки была нажата или какой сторонний поставщик ИИ выбран. Выбор поставщика открывает сайт этой компании с вашим вопросом в буфере обмена, а иногда и в самой ссылке, так что с этого момента текст обрабатывает она по своей политике, а не по нашей.
Эти строки удаляются через 90 дней после записи, той же уборкой на трафике, что и строки поиска. То же окно и то же обращение распространяются на оценку, которую вы можете оставить после того, как ИИ-ассистент ответит через наш сервер MCP: переход по ссылке оценки записывает вашу оценку, то, какой инструмент дал ответ, версию набора данных и тот же датированный хеш IP-адреса, и больше ничего. Короткая фраза даёт хеш, который восстанавливается перебором и повторным хешированием, ровно как при поиске, так что и это не анонимные данные. Профилирование ли это, вопрос справедливый: статья 4(4) GDPR охватывает автоматизированную обработку, служащую оценке личных аспектов человека, и называет среди них здоровье и поведение, а это близко к тому, что вы можете здесь напечатать. То, что страница делает на самом деле, уже. Ваши слова выбирают записи, которые уже существуют, а число, которое вы видите, это опубликованная величина для популяции, а не величина, вычисленная о вас; модели, которая пишет короткое резюме, запрещено пересчитывать и экстраполировать любую вероятность, хотя она может выбрать, о каком из опубликованных факторов записи стоит упомянуть в свете вашего описания. Список личных факторов рядом с результатом это собственный список этой записи, тот же, что и на её открытой странице, и тот же для каждого, кто туда попал, а сайт не передаёт нам ни возраста, ни пола, ни истории, с которыми его можно было бы сопоставить, поэтому каждый фактор в нём помечен как не отмечено. ИИ-ассистент, работающий через наш сервер MCP, может передать возрастную группу, пол или историю, которую вы ему назвали, и тогда факторы с подходящей формулировкой отмечаются ради этого одного ответа и нигде не записываются. Ползунок, позволяющий примерить эти факторы на странице записи, работает целиком в вашем браузере и никуда ничего не отправляет. Ничего не накапливается: мы не держим ни ваших признаков, ни профиля, куда их можно было бы вписать, каждый запрос обслуживается сам по себе, а десятиминутный одноразовый идентификатор связывает клик по оценке с одной калибровкой, а не человека с историей. Никакого решения в отношении вас не принимается, поэтому статья 22 GDPR не задействована. Честное описание такое: поиск с приложенным личным вопросом, а если прикладывать его вы не хотите, те же записи читаются просмотром сайта или поиском, без всякого описания себя.
Кто это обрабатывает и где
Текст, который вы печатаете, доходит до Google, и это то раскрытие на этой странице, которое стоит прочитать дважды. Поисковый запрос уходит в модель эмбеддингов gemini-embedding-2, чтобы превратиться в 768-мерный вектор для ранжирования. Описание ситуации из Calibrate уходит в ту же модель эмбеддингов через наш Worker MCP. Описание ситуации из Calibrate уходит вдобавок и в генеративную модель, gemini-3.5-flash-lite, если развёртывание не указывает другую, внутри запроса, несущего также извлечённый текст набора данных, всякий раз, когда страница показывает вывод. Ни к одному из этих вызовов мы не прикладываем ни имени, ни учётной записи, ни cookie, ни идентификатора, и, поскольку их делает наш сервер, Google видит нашу инфраструктуру, а не ваш IP-адрес. Текст, однако, ваш, и он действительно покидает наши системы. Google обрабатывает его согласно документу « Google Privacy Policy ».
Cloudflare
Cloudflare не сеть перед сайтом. Cloudflare и есть сайт: там выполняется код и там лежит почти всё, что мы храним. Pages отдаёт HTML, Functions выполняют конечные точки API, D1 держит описанные выше таблицы, Workers KV держит счётчики ограничения частоты, Analytics Engine принимает одну точку данных на вызов API с конечной точкой, HTTP-статусом и задержкой, без IP и без текста внутри, R2 отдаёт поисковый индекс, который скачивает ваш браузер, и снимок набора данных, который читает Worker MCP, пограничный кеш держит сгенерированные выводы, а Workers Logs собирает структурированные строки ошибок, которые выдают наши конечные точки, и хранит их несколько дней. Сервер Likelier MCP работает как отдельный Cloudflare Worker, который ведём мы. Всё это работает на Cloudflare как на нашем обработчике, согласно документу « Cloudflare Privacy Policy ». Наша конфигурация не закрепляет регион, поэтому обработка может происходить за пределами Европейской экономической зоны.
Что сайт хранит на вашем устройстве
- theme: выбранная вами цветовая схема, записывается только когда вы пользуетесь переключателем.
- likelier:recent:consent:v1 и likelier:recent:v1: ваш ответ на вопрос об истории чтения и сама история. В историю ничего не пишется, пока вы не согласитесь, отказ удаляет то, что там уже есть, и ни одно из этих значений никогда не отправляется на сервер.
- likelier-coffee-dismiss, likelier-coffee-supporter и pwa-install-dismissed-at: пометка о том, что вы закрыли просьбу о поддержке или предложение установки, чтобы сайт перестал спрашивать.
- Значения, которые живут только до закрытия вкладки: сохранённая копия списка любопытных фактов, счётчик страниц, прочитанных за сессию, пометка о том, что язык уже выбран, и позиция прокрутки, переносимая при смене языка.
- Ничто из этого не является cookie, ничто не читается сервером и ничто не опознаёт вас между сайтами. Очистка данных сайта в браузере удаляет их все.
Кто отвечает
Likelier ведёт из Польши Кшиштоф Глущик, и он же выступает контролёром данных для всего, что здесь описано. Пишите на contact@creatiwi.ai по любому вопросу из этой политики.
Правовое основание
Строки поиска, строки Calibrate и метрики API мы обрабатываем на основании законного интереса, статья 6(1)(f) GDPR: нам нужно знать, какие темы ищут читатели, где у набора данных пробелы и не вычерпывают ли конечные точки. Счётчики ограничения частоты и датированные хеши IP-адресов опираются на то же основание при более узком интересе, который состоит в том, чтобы неаутентифицированный и тарифицируемый API оставался посильным по стоимости. Отправка вашего текста в Google необходима для выполнения поиска или калибровки, о которых вы попросили, статья 6(1)(b) и (f). Мы не утверждаем, что хоть что-то из этого анонимно. Значение, выведенное из вашего IP-адреса, и хеш напечатанной вами фразы представляют собой псевдонимизированные данные, а по пункту 26 преамбулы псевдонимизированные данные остаются персональными данными, когда у кого-то есть то, что нужно для их обращения. У нас это есть.
Хранение на вашем устройстве регулируется отдельно, и cookies здесь не критерий. Поскольку мы работаем из Польши, применимой нормой является статья 399 Prawo komunikacji elektronicznej, польского закона об электронных коммуникациях, действующего с 10 ноября 2024 года, который заменил статью 173 прежнего Prawo telekomunikacyjne и является польской имплементацией статьи 5(3) Директивы о конфиденциальности в электронных коммуникациях. Значение в ней имеет хранение информации в вашем оконечном оборудовании или обращение к информации, уже там сохранённой, вне зависимости от того, cookie это или нет и являются ли эти сведения персональными данными. К тому же норма стоит рядом с GDPR, а не внутри него, поэтому законный интерес, названный выше, не заменяет здесь согласия, и каждый пункт ниже должен оправдать себя сам. Две вещи здесь действительно необходимы для того, о чём вы попросили, и потому хранятся без согласия: выбранная вами цветовая схема и, как только вы ответите, ваш ответ на вопрос об истории чтения, который существует для того, чтобы этот вопрос не задавали вам снова. Сама история чтения необходимой не является, поскольку страницы выглядят без неё точно так же, поэтому ничего не пишется, пока вы не согласитесь, а отказ удаляет то, что есть. Записи о закрытии просьбы о поддержке и предложения установки хранятся без спроса, из соображения, что запоминание «перестаньте меня спрашивать» служит скорее вам, чем нам. Если вы читаете это иначе, очистка данных сайта их удалит, а подсказки вернутся.
Ваши права
У вас есть права по статьям 15–22 GDPR: доступ, исправление, удаление, ограничение обработки, переносимость и возражение против обработки, опирающейся на законный интерес. Воспользоваться ими здесь неудобно, но не невозможно, и стоит сказать, как именно. У нас нет ни учётной записи, ни имени для вас, поэтому один только адрес электронной почты ваших строк не найдёт. Сопоставить мы можем по тому, что у нас действительно есть: сообщите примерно, когда вы искали или пользовались Calibrate и что печатали, и мы пересчитаем хеш и удалим совпавшие строки. Если вы можете назвать IP-адрес, которым пользовались, и день, мы пересчитаем датированный хеш и сопоставим также по нему, пока стоящий за ним секрет остаётся прежним. Пишите на contact@creatiwi.ai , и мы ответим в течение месяца. Вы также можете подать жалобу в надзорный орган; в Польше это Председатель Управления по защите персональных данных, UODO.