← Все статьи

“Cloud of thought”: cara membangun memori pengguna yang menyatukan orang-orang dan tidak kehilangan privasi

“Cloud of thought”: cara membangun memori pengguna yang menyatukan orang-orang dan tidak kehilangan privasi

Secara singkat tentang hal utama (BLUF)

Mengingat pengguna adalah tugas ganda: menghubungkan orang dengan pemikiran mereka memang berguna, tetapi satu kebocoran akan membunuh kepercayaan pada produk selamanya. Kami menunjukkan bagaimana lapisan “Awan Pikiran” disusun, mengapa kegagalan-penutupan lebih penting daripada yang terlihat, dan saluran pengungkapan mana yang lebih ketat dibandingkan saluran lainnya.

Tentang produk itu sendiri -"Awan Pikiran" di NeuralSpace— kami telah memberi tahu Anda: sistem mengumpulkan apa yang diketahui tentang Anda dan, dengan persetujuan bersama, menyatukan orang-orang yang memiliki minat yang sama (“Saya mencari pemodel 3D” ↔ “Saya membuat 3D”). Di sini - tentangsisi teknik: Bagaimana mencegah kebocoran memori pengguna yang berguna. Hal ini ternyata lebih menarik daripada fitur itu sendiri.

Masalah dasar ganda

Saya menginginkan dua hal sekaligus, dan keduanya saling bertentangan:

  1. Profil kaya.Untuk menyatukan orang-orang, Anda perlu mengetahui faktanya: apa yang dia lakukan, apa yang dia cari, apa yang dia tawarkan.
  2. Privasi secara default.Tidak ada yang setuju bahwa korespondensinya akan dipublikasikan. Kebocoran = hilangnya kepercayaan dan pelanggaran 152-FZ.

Implementasi yang naif (“ayo kumpulkan semuanya dan mulai pertandingan”) langsung mematahkan poin 2. Arsitektur yang baik dibangun di sekitargagal-ditutup: Ditutup secara default, diungkapkan hanya dengan persetujuan eksplisit, dan diverifikasi pada tingkat kode, bukan “kami berjanji.”

Lapisan

Fail-closed: facts without consent are not physically included in the profile, rather than “entered and hidden”
Gagal-ditutup: fakta tanpa persetujuan tidak dimasukkan secara fisik ke dalam profil, melainkan “dimasukkan dan disembunyikan”

1. Mengumpulkan fakta.Dua sumber: fakta struktural (jenis generasi, aktivitas - impersonal) dan ekstraksi dari korespondensi obrolan. Yang kedua adalah yang paling sensitif, jadi terjaga keamanannyasaklar pengalih memori obrolan terpisahpada pengguna. Mematikannya - ekstraksi dari korespondensi tidak terjadi sama sekali. Penting: gerbang iniBukanterikat dengan langganan fitur berbayar - privasi tidak boleh dijual.

2. Kategori dilarang.Permintaan pengumpulan sistemtidak termasukkategori sensitif di bawah 152-FZ (pandangan kesehatan, politik dan agama, dll.) - kategori tersebut tidak akan luput dari perhatian, meskipun muncul dalam percakapan. Ini bukan filter posting, tapi aturan selama tahap ekstraksi.

3. Kecocokan persetujuan ganda.Dua orang memiliki kepentingan yang sama - sistemBukanmenampilkan kontak secara otomatis. Dia menawarkan perkenalan kepada kedua belah pihak; kontak terbuka hanya ketikakeduanyasepakat. Ini melindungi terhadap skenario “permintaan obrolan saya muncul pada orang asing bersama dengan nomor telepon saya”.

4. Pengecualian untuk deklarasi eksplisit.Poin halus. Jika seseorang sendiri, di depan umum, dalam obrolan mengatakan "Saya menjual layanan, siapa pun yang membutuhkannya, tulis @nick" - meminta persetujuan untuk kedua kalinya tidak masuk akal, dia sudah memberikannya. Kontak yang diizinkan secara publik tersebut diakui secara terpisah dan segera diungkapkan kepada pihak yang berkepentingan. Kontak dikenali secara luas (telegram dengan dan tanpa @, telepon dalam format apa pun, tautan), tapikondisi pengungkapan- tepatnya izin publik yang eksplisit, dan bukan hanya adanya kontak dalam teks.

Mengapa gagal-tertutup lebih penting daripada yang terlihat

Godaannya adalah membuat perlindungan dengan tanda “tampilkan/jangan tampilkan” di tingkat antarmuka. Ini salah: bug apa pun di logika UI = bocor. Kami melakukannya secara berbeda -fakta yang tidak ada persetujuannya tidak disertakan secara fisik dalam profilpada tahap perakitannya. Tidak ada kesepakatan - teks permintaan dan referensi dalam surat dan pencocokanjangan memukul sama sekali, dan bukan “mereka sampai di sana, tapi kami menyembunyikannya.” Perbedaannya mendasar: dalam kasus pertama, cek yang terlupakan = kebocoran, dalam kasus kedua - hanya kurangnya data.

Aturan yang akan kami berikan kepada siapa pun yang membangun sistem seperti ini adalah:default - tertutup, pengungkapan - tindakan positif pengguna, verifikasi - sedekat mungkin dengan sumber data, bukan ke layar.

Saluran pengungkapan - dengan tingkat keparahan yang bervariasi

  • Dalam obrolan, atas permintaan pengguna itu sendiri - fakta impersonal dan petunjuk publik lebih mudah diakses: orang itu sendiri yang bertanya.
  • Surat proaktif(sistem itu sendiri menulis "ada kecocokan") - lebih ketat, hanya dengan berlangganan dan persetujuan ganda.

Logikanya sederhana: semakin sedikit pengguna yang mengharapkan pengungkapan, semakin tinggi standar persetujuannya.

Intinya

Hal tersulit di sini bukanlah pembelajaran mesin, tapidisiplin aliran data. Jika Anda membuat rekomendasi atau mencocokkan data pengguna, menarik untuk mendiskusikan di mana Anda melakukan pemeriksaan izin. Anda dapat melihat apa yang diketahui sistem tentang Anda di bagian tersebutpribadi.

Fail-closed: facts without consent never enter the profile, instead of entering and being hidden
Gagal-ditutup: fakta tanpa persetujuan tidak pernah masuk ke profil, malah masuk dan disembunyikan

Pertanyaan yang sering diajukan (FAQ)

Pertanyaan: Bagaimana cara mendapatkan hasil terbaik dari jaringan saraf?
Jawaban: Gunakan petunjuk rinci (deskripsi) dalam bahasa Inggris, atur gaya dan detail adegan.

Pertanyaan: Apakah bahan-bahan ini dapat digunakan untuk tujuan komersial?
Jawaban: Ya, konten yang dihasilkan sepenuhnya milik Anda.