SUMATERA UTARA — Proton merilis alat gratis bernama AI Paper Trail yang menganalisis ekspor riwayat obrolan dari ChatGPT atau Claude untuk menunjukkan seberapa banyak data pribadi yang kita serahkan ke chatbot. Alat ini berjalan di atas Lumo, model bahasa milik Proton yang mengklaim langsung menghapus data pengguna tanpa menyimpannya. Hasilnya sering mengejutkan, bahkan menaksir nilai iklan seseorang dalam angka ribuan dolar.
Proton, perusahaan di balik layanan email terenkripsi, menawarkan AI Paper Trail sebagai cara bagi pengguna untuk melihat sendiri jejak data yang mereka tinggalkan di chatbot. Caranya sederhana: pengguna mengunggah file ekspor riwayat obrolan dari ChatGPT atau Claude, lalu alat ini menyusun profil lengkap berdasarkan isi percakapan tersebut. Proses analisis berjalan di Lumo, model bahasa yang dikembangkan Proton dengan pendekatan privasi berbeda dari platform besar.
AI Paper Trail membaca data dari ekspor obrolan yang biasanya bisa diunduh pengguna melalui pengaturan akun masing-masing platform. Setelah diunggah, alat ini memecah isi percakapan ke dalam beberapa kategori seperti latar belakang keuangan, kondisi kesehatan, hubungan keluarga, hingga kebiasaan kerja. Kategori-kategori itu kemudian dirangkum menjadi satu profil yang menggambarkan siapa pengguna berdasarkan apa yang pernah mereka tanyakan ke chatbot.
Proton mengklaim Lumo tidak menyimpan log percakapan setelah proses selesai dan tidak melatih modelnya dengan data pengguna. Klaim ini menjadi pembeda utama dibanding platform besar yang umumnya memanfaatkan data untuk pelatihan model atau iklan bertarget.
Dalam pengujian langsung oleh TechRadar, profil yang dihasilkan jauh lebih rinci dari perkiraan awal. Laporan tersebut mencantumkan bagian "Latar Belakang Keuangan" yang memuat informasi sensitif yang tidak pernah disebutkan secara eksplisit oleh pengguna. Ada juga kategori "Batasan Kesehatan" yang melacak perubahan kondisi kesehatan selama berbulan-bulan, termasuk cedera dan fasilitas medis yang pernah dihubungi.
Satu bagian berlabel "Keluarga" ternyata berisi informasi yang dikarang, menegaskan bahwa model bahasa besar masih bisa berhalusinasi. Meski demikian, tingkat akurasi profil secara keseluruhan dinilai cukup tinggi. Laporan bahkan memberi rating "mudah" untuk diprofilkan dan menetapkan "nilai iklan" dalam angka empat digit dolar AS, lengkap dengan daftar sektor yang bersedia membayar untuk menjangkau pengguna tersebut.
Eamonn Maguire, Director of Engineering di Proton, menjelaskan bahwa banyak informasi terbentuk bukan dari pengungkapan langsung. "Bahkan ketika pengguna tidak pernah mengungkapkan fakta tertentu secara langsung, hal itu sering kali bisa diperkirakan dari pola interaksi mereka — perkiraan usia, kisaran pendapatan, tingkat pendidikan, atau kecenderungan politik," ujarnya kepada TechRadar.
Gaya penulisan dan nada bicara juga ikut berperan. Keduanya bisa mengungkap profil sosial ekonomi hingga kondisi psikologis, termasuk tingkat stres, suasana hati, dan momen-momen rentan. Data semacam ini punya nilai jual nyata bagi perusahaan yang ingin menargetkan iklan.
Incogni merilis peringkat privasi data 2026 yang menilai 13 platform AI berdasarkan risiko privasi yang mereka timbulkan. Bogan Popescu, Senior Communications Manager di Incogni, menyebut penilaian ini bukan soal platform paling ramah privasi, melainkan platform mana yang paling tidak invasif.
Meta AI, Gemini, dan Copilot menempati posisi terburuk. Incogni menyoroti kebijakan privasi yang mencakup banyak produk sekaligus sehingga sulit diketahui bagian mana yang berlaku untuk chatbot. Platform seperti Mistral Vibe mencatat risiko lebih sedikit, tetapi tetap melatih model dengan dataset publik tanpa mengungkap asal datanya secara rinci.
ChatGPT berada di posisi setelah Vibe sebagai platform yang relatif paling tidak invasif. Namun temuan ini tidak sepenuhnya melegakan. Investigasi 404Media pekan sebelumnya mengungkap bahwa manusia benar-benar membaca prompt pengguna untuk memperbaiki model OpenAI.
Menghapus percakapan mungkin jadi langkah pertama yang terlintas, tetapi tidak menyelesaikan masalah sepenuhnya. Salinan data tetap tersimpan di log cadangan, sistem pemulihan bencana, log server, dan infrastruktur pihak ketiga seperti layanan cloud atau moderasi konten.
Yang paling krusial adalah artefak turunan. "Yang terakhir itu paling penting," kata Maguire. Jika sebuah percakapan sudah berkontribusi pada model yang dilatih, embedding, atau analisis agregat sebelum dihapus, menghapus percakapan setelahnya tidak membatalkan apa yang sudah dipelajari model tentang pengguna.
Menonaktifkan opsi pelatihan percakapan juga tidak menyelesaikan persoalan. Pengaturan platform bisa tetap menyimpan percakapan, file yang diunggah, informasi akun, dan pola penggunaan untuk periode panjang. Incogni menemukan tidak ada platform yang saat ini memungkinkan pengguna menghapus data yang sudah terlanjur dipakai melatih model.
Para ahli menyarankan pengguna mempertimbangkan efek kumulatif dari setiap percakapan, bukan memperlakukan tiap prompt sebagai interaksi terpisah. Asumsikan apa pun yang diketik bisa dilihat orang lain. Popescu menambahkan bahwa agen berbahaya, baik manusia maupun AI, bisa membajak percakapan kapan saja.
Beralih ke layanan AI dengan perlindungan privasi lebih kuat menjadi opsi paling aman. Lumo dari Proton mengklaim tidak menyimpan log percakapan setelah diproses, memakai enkripsi zero-access untuk riwayat obrolan tersimpan, dan tidak melatih model dengan percakapan pengguna. Ada juga xPrivo yang bersifat open-source dan Internxt yang menyimpan seluruh obrolan secara lokal di perangkat.
Jika tetap memakai platform besar, Popescu menyarankan memakai versi browser ketimbang aplikasi mobile. Aplikasi sering meminta lebih banyak data perangkat dan membagikannya ke pihak ketiga. Ia juga berharap ada regulasi "hak untuk dilupakan" yang bisa diverifikasi sebagai standar, meski kemungkinannya belum terlihat dalam waktu dekat.