Bỏ qua đến nội dung
Likelier

Chính sách quyền riêng tư

Những gì chúng tôi ghi lại, và vì sao


Chúng tôi ghi lại những gì, và khi nào

Khi bạn đọc một trang

Trang web này không nạp bất kỳ tập lệnh phân tích hay theo dõi nào, và việc đọc một trang không ghi dòng nào vào bất kỳ cơ sở dữ liệu nào của chúng tôi. Điều thực sự xảy ra chỉ là việc phục vụ web thông thường: Cloudflare chuyển trang tới bạn, và yêu cầu đó đến máy chủ của họ kèm theo những thứ mà mọi yêu cầu HTTP đều mang theo.

  • Địa chỉ IP của bạn.
  • Địa chỉ của trang bạn yêu cầu, và trang bạn đến từ đó nếu trình duyệt của bạn gửi kèm nguồn giới thiệu.
  • Trình duyệt và hệ điều hành của bạn, lấy từ tiêu đề User-Agent, cùng tùy chọn ngôn ngữ của bạn, lấy từ Accept-Language. Một liên kết không có ngôn ngữ trong đó, chẳng hạn một /plane-crash được chia sẻ, sẽ được phân giải về một trong các ngôn ngữ đã dựng sẵn dựa trên tiêu đề đó.

Cloudflare xử lý việc đó với tư cách nhà cung cấp lưu trữ của chúng tôi và giữ nhật ký yêu cầu của riêng họ theo lịch của riêng họ. Chúng tôi không rút số liệu lượt xem trang ra từ đó. Likelier không đặt cookie nào. Không có quảng cáo, không có mã định danh quảng cáo và không có theo dõi xuyên trang, và không có gì được bán hay chuyển cho ai vì mục đích tiếp thị. Việc đọc một trang không dựng nên điều gì về bạn và hoàn toàn không được phân tích. Tuy vậy chúng tôi không kéo dài điều đó thành một lời phủ nhận phẳng lì về lập hồ sơ cho cả trang web, bởi /calibrate mời bạn tự mô tả mình, và điều ấy xứng đáng có một câu trả lời thực sự chứ không phải một chữ. Câu trả lời ấy nằm bên dưới.

Khi bạn tìm kiếm

Tìm kiếm chạy qua ba giai đoạn ngay trong trình duyệt của bạn, và giai đoạn thứ ba cần một vectơ mà chỉ một mô hình mới tạo ra được. Vì vậy khi một truy vấn ổn định lại, phần văn bản được gửi tới máy chủ của chúng tôi, máy chủ chuyển tiếp nó sang Google để biến thành vectơ đó, và một dòng được ghi vào cơ sở dữ liệu của chúng tôi. Dòng đó chứa:

  • Mã băm SHA-256 của truy vấn, đã chuyển về chữ thường và chuẩn hóa khoảng trắng. Bản thân văn bản không được lưu.
  • Có bao nhiêu kết quả trả về.
  • Những giai đoạn xếp hạng nào đã chạy, và giai đoạn vectơ có nằm trong số đó hay không.
  • Tìm kiếm mất bao lâu, tính bằng mili giây.
  • Đường dẫn của trang mà từ đó bạn tìm kiếm, ví dụ /en/risks.

Dòng đó không mang địa chỉ IP và không mang mã định danh phiên. Tuy nhiên, ngoài dòng đó, mỗi lượt tìm kiếm được chấp nhận sẽ đẩy một bộ đếm giới hạn tần suất trong Workers KV, với khóa chứa tám byte đầu của một mã băm SHA-256 không thêm muối từ địa chỉ IP của bạn, và bộ đếm ấy hết hạn 24 giờ sau khi được ghi. Các dòng tìm kiếm bị xóa 90 ngày sau khi được ghi, bằng một đợt quét chạy ăn theo lưu lượng đến sau chứ không theo đồng hồ, nên một quãng thật vắng khách có thể khiến một dòng nằm lại lâu hơn đôi chút. Chúng tôi cũng sẽ không nói với bạn rằng mã băm là ẩn danh: một truy vấn ngắn và phổ biến có thể được khôi phục bằng cách băm thử các cụm từ ứng viên rồi so sánh, nên hãy xem các dòng này là dữ liệu biệt danh hóa.

Khi bạn dùng /calibrate

Calibrate đề nghị bạn mô tả một tình huống bằng lời của chính bạn, và điều đó khiến nó là nơi duy nhất trên trang web mà bạn có thể gõ điều gì đó về bản thân. Phần văn bản ấy được gửi tới máy chủ của chúng tôi, máy chủ chuyển nó sang một Cloudflare Worker của chúng tôi, tức máy chủ Likelier MCP, để tìm trong bộ dữ liệu. Để tìm, Worker đó gửi văn bản của bạn sang Google nhằm biến thành một vectơ. Nếu trang còn hiển thị một đoạn kết luận ngắn do máy tạo ra, văn bản của bạn được gửi sang Google lần thứ hai, nằm trong một câu lệnh gửi tới một mô hình sinh, và câu trả lời quay về được giữ trong bộ nhớ đệm biên của Cloudflare trong 24 giờ dưới một khóa suy ra từ mã băm của văn bản đó. Chúng tôi không giữ phần văn bản. Chúng tôi giữ:

  • Một tiền tố 12 ký tự của mã băm SHA-256 từ những gì bạn gõ, rủi ro mà chúng tôi khớp với nó, việc yêu cầu có bị từ chối hay không khớp được gì hay không, và phiên bản bộ dữ liệu đã trả lời.
  • Một số dùng một lần ngẫu nhiên để nhận biết phiên trang, được cấp khi trang tải xong và có hiệu lực trong mười phút. Nó chính là thứ gắn một cú nhấp phản hồi về sau với lần calibrate mà cú nhấp đó thuộc về.
  • Một mã băm SHA-256 từ địa chỉ IP của bạn kết hợp với ngày tháng và một khóa bí mật mà chúng tôi giữ, dùng để nhận ra các lần gửi lặp lại trong cùng một ngày. Khi khóa bí mật đó chưa được cấu hình, trường này để trống chứ không được điền bằng một giá trị yếu hơn.
  • Ngôn ngữ giao diện của bạn và, nếu bạn nhấn, nút phản hồi nào bạn đã nhấn hoặc nhà cung cấp AI bên ngoài nào bạn đã chọn. Chọn một nhà cung cấp sẽ mở trang của chính công ty đó với câu hỏi của bạn nằm trong bảng nhớ tạm, và trong một số trường hợp nằm ngay trong liên kết, nên từ điểm đó trở đi văn bản thuộc về họ và được xử lý theo chính sách của họ chứ không phải của chúng tôi.

Các dòng này bị xóa 90 ngày sau khi được ghi, theo cùng đợt quét ăn theo lưu lượng như các dòng tìm kiếm. Cùng khoảng thời gian ấy và cùng cách xử lý ấy áp dụng cho đánh giá mà bạn có thể để lại sau khi một trợ lý AI trả lời qua máy chủ MCP của chúng tôi: đi theo liên kết đánh giá đó sẽ ghi lại mức đánh giá của bạn, công cụ nào đã tạo ra câu trả lời, phiên bản bộ dữ liệu, và cùng mã băm IP kèm ngày tháng đó, và không gì khác. Một cụm từ ngắn cho ra mã băm có thể khôi phục bằng cách đoán rồi băm lại, hệt như với tìm kiếm, nên chỗ này cũng không phải dữ liệu ẩn danh. Đây có phải lập hồ sơ hay không là một câu hỏi chính đáng, vì Điều 4(4) GDPR bao trùm việc xử lý tự động dùng để đánh giá các khía cạnh cá nhân của một người, và nêu tên sức khỏe cùng hành vi trong số đó, vốn rất gần với những gì bạn có thể gõ ở đây. Điều trang này thực sự làm thì hẹp hơn thế. Lời của bạn chọn ra những mục đã có sẵn, và con số bạn thấy là giá trị đã công bố cho một quần thể chứ không phải giá trị tính ra về riêng bạn; mô hình viết đoạn tóm tắt ngắn bị cấm tính lại hay ngoại suy bất kỳ xác suất nào, dù nó có thể chọn xem yếu tố đã công bố nào của mục ấy đáng nhắc đến trước mô tả của bạn. Danh sách các yếu tố cá nhân bên cạnh kết quả là danh sách của chính mục đó, đúng như trên trang công khai của nó và giống nhau với mọi người ghé tới, còn trang web này không gửi cho chúng tôi tuổi, giới tính hay tiền sử nào để đối chiếu với danh sách ấy, nên mọi yếu tố ở đó đều hiện là không đánh dấu. Một trợ lý AI làm việc qua máy chủ MCP của chúng tôi thì có thể chuyển tiếp nhóm tuổi, giới tính hoặc tiền sử mà bạn đã nói với nó, và khi đó những yếu tố có cách diễn đạt trùng khớp sẽ được tích cho riêng câu trả lời ấy và không được ghi lại. Thanh trượt cho phép bạn thử các yếu tố đó trên trang một mục chạy hoàn toàn trong trình duyệt của bạn và không gửi gì đi đâu cả. Không có gì tích tụ lại: chúng tôi không giữ thuộc tính nào về bạn, cũng không có hồ sơ nào để đặt chúng vào, mỗi yêu cầu được trả lời riêng lẻ, và mã nonce mười phút chỉ buộc một cú nhấp phản hồi vào một lần hiệu chỉnh chứ không buộc một con người vào một lịch sử. Không có quyết định nào được đưa ra về bạn, nên Điều 22 GDPR không được kích hoạt. Cách mô tả trung thực là: truy xuất thông tin kèm theo một câu hỏi cá nhân, và nếu bạn không muốn kèm theo, vẫn có thể đọc chính những mục ấy bằng cách duyệt hoặc tìm kiếm mà không mô tả gì về mình.

Ai xử lý dữ liệu, và ở đâu

Google

Văn bản bạn gõ có đến Google, và đó là điều trên trang này đáng đọc lại hai lần nhất. Một truy vấn tìm kiếm được gửi tới mô hình nhúng gemini-embedding-2 để biến thành một vectơ 768 chiều dùng cho việc xếp hạng. Một tình huống calibrate được gửi tới cùng mô hình nhúng đó thông qua Worker MCP của chúng tôi. Một tình huống calibrate còn đi tiếp tới một mô hình sinh, là gemini-3.5-flash-lite trừ khi bản triển khai đặt khác, nằm trong một câu lệnh mang theo cả phần văn bản lấy ra từ bộ dữ liệu, mỗi khi trang hiển thị một đoạn kết luận. Chúng tôi không đính kèm tên, tài khoản, cookie hay mã định danh nào vào bất kỳ lệnh gọi nào trong số này, và vì máy chủ của chúng tôi là bên thực hiện chúng, Google nhìn thấy hạ tầng của chúng tôi chứ không phải địa chỉ IP của bạn. Tuy vậy, văn bản là của bạn, và nó thực sự rời khỏi hệ thống của chúng tôi. Google xử lý văn bản đó theo tài liệu “ Google Privacy Policy ”.

Cloudflare

Cloudflare không phải là lớp mạng đứng trước trang web. Nó chính là trang web: nơi mã chạy và nơi cất giữ gần như mọi thứ chúng tôi lưu. Pages phục vụ phần HTML, Functions chạy các điểm cuối API, D1 chứa các bảng mô tả ở trên, Workers KV chứa các bộ đếm giới hạn tần suất, Analytics Engine nhận một điểm dữ liệu cho mỗi lệnh gọi API, ghi lại điểm cuối, trạng thái HTTP và độ trễ, không có IP và không có văn bản trong đó, R2 phục vụ chỉ mục tìm kiếm mà trình duyệt của bạn tải về cùng bản chụp bộ dữ liệu mà Worker MCP đọc, bộ nhớ đệm biên giữ các đoạn kết luận đã sinh ra, còn Workers Logs thu các dòng lỗi có cấu trúc do các điểm cuối của chúng tôi phát ra và giữ chúng trong vài ngày. Máy chủ Likelier MCP là một Cloudflare Worker riêng do chúng tôi vận hành. Tất cả những thứ đó chạy trên Cloudflare với vai trò bên xử lý dữ liệu của chúng tôi, theo tài liệu “ Cloudflare Privacy Policy ”. Cấu hình của chúng tôi không ghim vùng nào, nên việc xử lý có thể diễn ra bên ngoài Khu vực Kinh tế châu Âu.

Trang web lưu gì trên thiết bị của bạn

  • theme: bảng màu bạn đã chọn, chỉ được ghi khi bạn dùng nút chuyển.
  • likelier:recent:consent:v1 và likelier:recent:v1: câu trả lời của bạn cho câu hỏi về lịch sử đọc, và bản thân lịch sử đó. Không có gì được ghi vào lịch sử cho tới khi bạn đồng ý, việc từ chối sẽ xóa những gì đã có, và cả hai giá trị này không bao giờ được gửi tới máy chủ.
  • likelier-coffee-dismiss, likelier-coffee-supporter và pwa-install-dismissed-at: một ghi chú rằng bạn đã tắt lời mời ủng hộ hoặc lời mời cài đặt, để trang web thôi hỏi nữa.
  • Những giá trị chỉ tồn tại cho tới khi bạn đóng thẻ: một bản sao trong bộ nhớ đệm của danh sách mẩu tin, số trang đã đọc trong phiên này, một ghi chú rằng bạn đã chọn ngôn ngữ, và vị trí cuộn trang được mang theo qua một lần đổi ngôn ngữ.
  • Không thứ nào trong số này là cookie, không thứ nào được máy chủ đọc, và không thứ nào nhận diện bạn xuyên các trang web. Xóa dữ liệu trang web trong trình duyệt sẽ gỡ bỏ tất cả chúng.

Ai chịu trách nhiệm

Likelier được vận hành từ Ba Lan bởi Krzysztof Gluszczyk, người kiểm soát mọi thứ được mô tả ở đây. Về bất kỳ điểm nào trong chính sách này, hãy viết thư tới contact@creatiwi.ai .

Cơ sở pháp lý

Các dòng tìm kiếm, các dòng calibrate và số liệu API được xử lý trên cơ sở lợi ích hợp pháp, Điều 6(1)(f) GDPR: chúng tôi cần biết người đọc tìm những chủ đề nào, bộ dữ liệu còn thiếu ở đâu, và các điểm cuối có đang bị vắt kiệt hay không. Các bộ đếm giới hạn tần suất và các mã băm IP kèm ngày tháng dựa trên cùng cơ sở đó cho một lợi ích hẹp hơn, là giữ cho một API không cần đăng nhập và có tính phí theo lượt ở mức chi trả được. Việc gửi văn bản của bạn sang Google là cần thiết để thực hiện đúng lượt tìm kiếm hoặc lượt calibrate mà bạn yêu cầu, Điều 6(1)(b) và (f). Chúng tôi không tuyên bố rằng bất kỳ phần nào trong số này là ẩn danh. Một giá trị suy ra từ địa chỉ IP của bạn, và một mã băm của cụm từ bạn đã gõ, là dữ liệu biệt danh hóa, và theo Lời nói đầu 26, dữ liệu biệt danh hóa vẫn là dữ liệu cá nhân khi có người nắm giữ thứ cần thiết để đảo ngược nó. Chúng tôi nắm giữ thứ đó.

Việc lưu trữ trên thiết bị của bạn là một câu chuyện riêng, và cookie không phải là thước đo cho nó. Vì chúng tôi vận hành từ Ba Lan, quy định điều chỉnh là Điều 399 của Prawo komunikacji elektronicznej, luật truyền thông điện tử Ba Lan có hiệu lực từ ngày 10 tháng 11 năm 2024, thay thế Điều 173 của Prawo telekomunikacyjne cũ và là văn bản Ba Lan thi hành Điều 5(3) của Chỉ thị ePrivacy. Điều được xét ở đó là việc lưu thông tin trong thiết bị đầu cuối của bạn, hoặc truy cập thông tin đã lưu sẵn ở đó, bất kể thứ được lưu có phải cookie hay không và bất kể đó có phải dữ liệu cá nhân hay không. Quy định ấy cũng đứng cạnh GDPR chứ không nằm trong GDPR, nên lợi ích hợp pháp nêu ở trên không thay thế được sự đồng ý ở đây, và từng mục bên dưới phải tự biện minh cho mình. Hai thứ ở đây thực sự cần thiết cho điều chính bạn đã yêu cầu nên được lưu mà không cần sự đồng ý: bảng màu bạn đã chọn, và, một khi bạn trả lời, câu trả lời của bạn cho câu hỏi về lịch sử đọc, thứ tồn tại để câu hỏi ấy không được đặt ra với bạn lần nữa. Bản thân lịch sử đọc thì không cần thiết, vì các trang vẫn hiển thị y hệt khi không có nó, nên không có gì được ghi cho tới khi bạn đồng ý và việc từ chối sẽ xóa những gì đang có. Các ghi chú tắt lời mời ủng hộ và lời mời cài đặt được lưu mà không hỏi, theo lập luận rằng ghi nhớ “đừng hỏi tôi nữa” là phục vụ bạn chứ không phải chúng tôi. Nếu bạn nhìn nhận khác, việc xóa dữ liệu trang web sẽ gỡ chúng đi và các lời mời sẽ quay lại.

Quyền của bạn

Bạn có các quyền nêu tại Điều 15 đến Điều 22 GDPR: truy cập, đính chính, xóa, hạn chế xử lý, di chuyển dữ liệu, và phản đối việc xử lý dựa trên lợi ích hợp pháp. Thực hiện các quyền đó ở đây là bất tiện chứ không phải bất khả thi, và cũng đáng nói rõ là bằng cách nào. Chúng tôi không giữ tài khoản nào và không giữ tên nào của bạn, nên một địa chỉ email đơn lẻ không tìm ra được các dòng của bạn. Thứ chúng tôi có thể đối chiếu là chính những gì chúng tôi thực sự giữ: hãy cho chúng tôi biết khoảng thời gian bạn đã tìm kiếm hoặc dùng calibrate và bạn đã gõ gì, chúng tôi có thể tính lại mã băm và xóa những dòng khớp với nó. Nếu bạn cho chúng tôi biết địa chỉ IP bạn đã dùng và vào ngày nào, chúng tôi cũng có thể tính lại mã băm kèm ngày tháng và đối chiếu theo đó, chừng nào khóa bí mật đằng sau nó chưa thay đổi. Hãy viết thư tới contact@creatiwi.ai và chúng tôi sẽ trả lời trong vòng một tháng. Bạn cũng có thể khiếu nại tới một cơ quan giám sát; ở Ba Lan đó là Chủ tịch Cục Bảo vệ Dữ liệu Cá nhân, UODO.

Đã xem gần đây trên thiết bị này