Million Miner Logo
Business & Strategy · 15 dengan membaca minimal · Jul 28, 2026

Obrolan ChatGPT Anda Mungkin Tersimpan di Google: Mengapa Tim Serius Mengelola AI Mereka Sendiri

Sara Chen

Bitcoin & Altcoin Analyst

Obrolan ChatGPT Anda Mungkin Tersimpan di Google: Mengapa Tim Serius Mengelola AI Mereka Sendiri
Pada akhir Juli 2025, orang mulai menemukan percakapan ChatGPT pribadi mereka dalam pencarian Google biasa. Tidak melalui peretasan — melainkan melalui fitur. Ini adalah peringatan paling nyata tentang apa yang sebenarnya terjadi dengan kata-kata yang Anda ketik ke dalam AI milik orang lain, dan mengapa semakin banyak tim sekarang menjalankan sendiri.

Minggu orang menemukan obrolan AI mereka di Google

Sederhanasite:chatgpt.com/sharepencarian di Google menampilkan percakapan orang lain —hampir 4.500 dari mereka, menurutPerusahaan Cepatlaporan yang membongkar cerita tersebut. Di antaranya adalah percakapan tentang kesehatan mental, hubungan, kecanduan, dan masalah kerja rahasia yang jelas tidak pernah diharapkan oleh penulisnya untuk dibaca oleh orang asing.
Mekanismenya membosankan, itulah pelajaran yang sebenarnya. MengklikBagikanmembuat tautan publik, dan sebuah kotak centang di dialog tersebut —"Buat obrolan ini dapat ditemukan"— biarkan mesin pencari mengindeks halaman tersebut. Itu adalah pilihan aktif dan secara otomatis mati, tetapi hanya satu klik ceroboh yang memisahkannya, tanpa peringatan bahwa “yang dapat ditemukan” berarti “siapa saja di Bumi ini dapat mencari ini di Google.”
OpenAI bereaksi dengan cepat. Kepala Keamanan Informasi-nya, Dane Stuckey,Diumumkan pada 1 Agustus 2025bahwa perusahaan telah menghentikan apa yang disebutnya sebagai "eksperimen singkat" yang "memperkenalkan terlalu banyak peluang bagi orang untuk secara tidak sengaja membagikan hal-hal yang tidak mereka maksudkan." Mesin pencari tidak langsung lupa, sehingga pembersihan berlangsung selama berminggu-minggu.
Di sini adalah bagian yang harus menghentikan Anda:Ini bukan hanya sekali di satu perusahaan.
  • xAI's Grokmemiliki masalah kelas yang sama beberapa hari kemudian — tombol baginya menghasilkan halaman yang dapat diindeks secara publik, dan pelaporan media menampilkan jumlah obrolan Grok yang diselipkan ke Google dalamratusan ribu(widely cited as ~370.000, though that is a search-result estimate, not an audited count).
  • Google sendiri Bardmelakukan ini pada tahun 2023: percakapan yang dibagikan diindeks oleh Google Search sampai Google menambahkan aturan no-index untuk menghentikannya.
  • Aplikasi AI Metamengirim umpan "Discover" publik pada tahun 2025 yang menampilkan interaksi chatbot orang — beberapa sangat pribadi — dengan banyak pengguna yang tampaknya tidak menyadari bahwa permintaan mereka dipublikasikan sama sekali.
Empat perusahaan, satu penyebab utama:"Bagi" secara diam-diam berarti "mempublikasikan," dan "tautan publik" secara diam-diam berarti "dapat diindeks pencarian."Ketika nama terbesar dalam AI melakukan kesalahan yang sama dalam waktu dua tahun, itu berhenti menjadi kecelakaan dan mulai menjadi properti dari model tersebut: saat data Anda keluar dari kendali Anda, keputusan produk orang lain yang mengatur siapa yang melihatnya.

Rilis yang dapat Anda lihat adalah bagian kecil

Hasil pencarian publik adalah eksposur yang dapat Anda lihat. Untuk sebuah bisnis, eksposur yang paling penting adalah bagian yang Anda tidak bisa lihat.

Secara default, permintaan Anda dapat menjadi data pelatihan

Pusat Bantuan OpenAI sendiri menyatakan secara jelas: “ChatGPT… meningkatkan kinerja melalui pelatihan lebih lanjut berdasarkan percakapan yang dilakukan orang dengan itu, kecuali Anda memilih untuk keluar.” Untuk akun konsumen, pelatihan berdasarkan input Anda adalah pengaturan default — Anda harus masuk dan mematikannya. Tingkatan bisnis (ChatGPT Business, Enterprise, dan API) adalahtidakDilatih secara default — yang merupakan poin utama: alat gratis dan pribadi yang paling sering digunakan oleh sebagian besar karyawan sebenarnya adalah yang tidak aman.

"Hapus" tidak selalu berarti terhapus

DalamNew York Timeslitigasi hak cipta, seorang hakim magistrate federal AS mengeluarkan sebuahperintah penyimpanan pada 13 Mei 2025mengharuskan OpenAI untuk "mempertahankan dan memisahkan semua data log keluaran yang seharusnya dihapus" — mengesampingkan penghapusan normal selama 30 hari dan menghapus obrolan yang telah dihapus secara eksplisit oleh pengguna, bahkan "Obrolan Sementara." OpenAI menentangnya dan, pada akhir September 2025, tidak lagi diwajibkan untuk menyimpan percakapanberasal dari EEA, Swiss, atau InggrisBaca urutan itu lagi: selama berbulan-bulan, perintah pengadilan AS menentukan penahanan log obrolan, dan diperlukan pertarungan hukum untuk mengembalikan data Eropa. Itulah masalah CLOUD Act dalam satu cerita — data yang disimpan oleh penyedia AS berada dalam jangkauan hukum AS, di mana pun Anda berada.

Karyawan menempelkan hal-hal yang sama sekali tidak seharusnya

Perusahaan keamanan Cyberhaven, yang mengukur penggunaan sebenarnya di sekitar 1,6 juta pekerja, menemukan bahwa8,6 % dari karyawan telah menempelkan data perusahaan ke dalam ChatGPT, dan4,7% telah menempelkan data rahasia— dan itu terjadi pada pertengahan 2023, sebelum adopsi meledak. Inilah cara Samsung membocorkan kode sumber internal ke ChatGPT pada tahun 2023 dan kemudian melarang penggunaan alat tersebut secara langsung. Setiap salinan dari paste tersebut adalah salinan properti intelektual Anda yang disimpan di server orang lain, di bawah kebijakan retensi dan subpoena milik orang lain.

Mengapa ini secara khusus menjadi masalah GDPR

Jika Anda menangani data tentang orang di UE atau Inggris Raya, insiden di atas bukan hanya memalukan — mereka terkait dengan kewajiban yang dapat membuat Anda dikenai denda:
  • Pasal 5 — minimalisasi data & pembatasan tujuanMenyalin data pribadi pelanggan ke dalam chatbot konsumen yang mungkin melatihnya sulit dipadukan dengan " dikumpulkan untuk tujuan tertentu dan eksplisit."
  • Pasal 28 — prosesor.Menggunakan AI eksternal sebagai prosesor memerlukan perjanjian pengolahan data yang tepat dan kendali atas sub-prosesor. Chatbot konsumen gratis tidak memberikan keduanya.
  • Pasal 32 — keamanan pengolahan.Sebuah desain "berbagi = menerbitkan" yang menempatkan obrolan di Google mendekati kebalikan dari "langkah-langkah teknis yang sesuai".
  • Art. 44+ — transfer internasional.Mengirim data pribadi UE ke penyedia AI AS membuka kembali seluruh pertanyaan Schrems II / kerangka privasi data — dan, seperti yang ditunjukkan oleh perintah retensi, proses hukum AS dapat menjangkau data tersebut.
Ringkasan yang tidak nyaman:Alat AI tercepat dan paling nyaman juga merupakan yang paling menyulitkan kepatuhan UE.

Perbaikan bukanlah "jangan gunakan AI." Tetapi "miliki AI."

Anda tidak harus memilih antara AI modern dan perlindungan data. Anda memilihdi mana model berjalan.Jika berjalan di infrastruktur yang Anda kendalikan, permintaan, dokumen, dan data pelanggan AndaJangan pernah meninggalkan bangunan Anda atau kontrak AndaTidak ada tautan bagikan yang bocor, tidak ada pelatihan default berdasarkan masukan Anda, tidak ada perintah retensi asing yang mencapai log Anda — karena data tersebut tidak pernah diberikan kepada pihak ketiga sejak awal.
Ini dulu bersifat teoretis. Pada tahun 2025, hal ini menjadi hal biasa — dan, yang menarik, laboratorium AI sendiri sekarang mendukungnya. Ketika OpenAI merilis model bobot terbuka pertamanya,gpt-oss-120b dan gpt-oss-20b, pada 5 Agustus 2025( lisensi Apache-2.0, dapat diunduh secara gratis ), secara eksplisit mengusulkan “menempatkan model-model ini di tempat sendiri untuk keamanan data.” Ketika perusahaan yang memulai era chatbot publik memberi tahu bisnis untuk menjalankan model terbuka di perangkat keras mereka sendiri demi privasi, argumen tersebut pada dasarnya sudah selesai.

Dua cara untuk menjalankan sendiri

Lokal / di perangkatAlat seperti Ollama, LM Studio dan vLLM menjalankan model bobot terbuka — Llama dari Meta, Mistral, Qwen, DeepSeek atau gpt-oss baru dari OpenAI — di mesin Anda sendiri. GPU workstation yang mampu (16–24 GB memori) dengan nyaman menjalankan model dalam kisaran 7B–20B;gpt-oss-20b dirancang untuk berjalan pada perangkat edge dengan kapasitas minimal 16 GB.Ideal untuk individu dan tim kecil, dan data tidak pernah menyentuh internet.
Server AI khusus / yang dihosting.Untuk kemampuan throughput yang nyata — banyak pengguna, model yang lebih besar, pengambilan data dari dokumen Anda sendiri, ketersediaan yang selalu aktif — Anda memerlukan GPU dari data centre. Ini adalah angka yang patut diingat:gpt-oss-120b, sebuah model dengan 117 miliar parameter, berjalan pada satu GPU 80 GBseperti NVIDIA H100. Salah satu akselerator modern sekarang menampung model terbuka kelas frontier untuk seluruh tim Anda. Tempatkan server itu di data centre UE atau rak Anda sendiri dan Anda mendapatkan kemampuan serius dengan sepenuhnya data residensi dan cerita GDPR yang bersih.

Pengorbanan yang jujur

Hosting sendiri bukan sihir, dan kami tidak akan berpura-pura demikian:
Faktor
AI Publik (ChatGPT, Grok…)
LLM Anda sendiri
Ke mana data Anda dikirim
Server pihak ketiga dari AS
Perangkat keras / Pusat data EU Anda
Dilatih berdasarkan masukan Anda?
Tingkat konsumen: ya, kecuali Anda memilih untuk tidak berpartisipasi
Tidak pernah
Tersinggung oleh bug "share"?
Ya — terbukti pada 2025
Tidak ada tautan berbagi yang tersedia
GDPR / lokasi data
Transfer, perintah retensi
Anda mengontrolnya dari awal hingga akhir
Kemampuan puncak
Tertinggi (model frontier)
Kuat, selangkah di belakang
Biaya dalam skala
Biaya per token, selamanya
Perangkat keras tetap, kemudian hampir nol
Kesenjangan kemampuan memang nyata tetapi semakin mengecil setiap kuartal, dan untuk sebagian besar tugas bisnis — menyusun draf, merangkum, klasifikasi, pencarian melalui dokumen Anda, bantuan kode, dukungan — model terbuka saat ini sudah lebih dari cukup. Apa yang Anda peroleh adalah kemenangan yang tegas: data Anda tidak pernah menjadi produk, tidak pernah menjadi set pelatihan, dan tidak pernah hanya satu kotak centang ceroboh dari Google.

Di mana posisi MillionMiner

Menjalankan AI Anda sendiri adalah masalah perangkat keras sebelum menjadi masalah perangkat lunak — dan perangkat keras adalah bidang keahlian kami. Kami menyediakan dan meng-host secara tepatGPU Pusat Data(NVIDIA H100, H200 dan lainnya) yang mengubah “kami benar-benar harus menjalankan model kami sendiri” menjadi rak yang online minggu depan — dikirim kepada Anda, atau dihosting di fasilitas kami dengan operasi yang transparan dan dapat diverifikasi seperti yang kami lakukan untuk penambangan. Satu H100 cukup untuk melayani model 120 miliar parameter kepada seluruh tim Anda, secara pribadi.
Jika perlindungan data menjadi bagian dari peta jalan Anda untuk tahun 2026, inilah langkahnya:pertahankan AI, hilangkan eksposur

Talk to us about a private AI server

Tell us your model, your users and your timeline — an engineer replies with a concrete, GDPR-friendly hardware plan, usually within a couple of hours.

Get a hardware recommendation

Free, no obligation, no signup.

Pertanyaan yang sering diajukan

Apakah ChatGPT benar-benar membocorkan percakapan pribadi ke Google?

Bukan melalui peretasan. Percakapan yang dipilih pengguna untuk dibagikan melalui tautan publik, dengan opsi “Jadikan obrolan ini dapat ditemukan”, diindeks oleh mesin pencari. Fast Company menemukan sekitar 4.500 obrolan tersebut di Google, dan OpenAI menonaktifkan fitur tersebut pada 1 Agustus 2025, menyebutnya sebagai eksperimen yang bersifat sementara. Grok, dan sebelumnya Bard, juga terpapar dengan cara yang sama.

Tidak, OpenAI tidak melatih model mereka langsung dari percakapan ChatGPT Anda.

Untuk konsumen ChatGPT, ya secara default — Pusat Bantuan mereka menyatakan bahwa model “meningkat melalui pelatihan lebih lanjut berdasarkan percakapan yang dilakukan orang dengan model tersebut, kecuali Anda memilih keluar.” Penggunaan Business, Enterprise, dan API tidak dilatih secara otomatis. Anda dapat menonaktifkan pelatihan melalui kontrol data Anda.

Apakah penyedia AI AS dapat dipaksa untuk menyimpan obrolan saya yang dihapus?

Itu terjadi. Perintah pengadilan Mei 2025 dalam kasus New York Times lawan OpenAI memaksa OpenAI untuk mempertahankan log output yang biasanya akan dihapus. OpenAI kemudian memperoleh remisi untuk data EEA, Inggris, dan Swiss, tetapi episode ini menunjukkan bahwa proses hukum AS dapat menjangkau data yang disimpan oleh penyedia AS.

Apakah menjalankan LLM Anda sendiri secara realistis pada tahun 2026?

Ya. Model open-weight (Llama, Mistral, Qwen, DeepSeek, gpt-oss dari OpenAI) tersedia secara bebas. Model kecil berjalan di GPU workstation yang baik; yang besar seperti gpt-oss-120b berjalan di satu GPU data centre 80 GB seperti H100. Alat seperti Ollama dan vLLM memudahkan deploymen.

Apakah model yang di-host sendiri sebaik GPT-5 atau Gemini?

Di garis depan absolut, Model tertutup besar masih memimpin. Tetapi untuk pekerjaan bisnis sehari-hari — menulis, merangkum, ekstraksi, pencarian melalui dokumen Anda sendiri, bantuan pemrograman — Model terbuka saat ini lebih dari cukup, dan mereka berjalan sepenuhnya di bawah kendali Anda.

Perangkat keras yang Anda perlukan untuk menjalankan AI sendiri meliputi:  - GPU berkinerja tinggi atau ASIC Miner yang mendukung komputasi AI  - CPU dengan kecepatan tinggi dan banyak inti  - Memori RAM yang besar, minimal beberapa gigabyte sesuai kebutuhan AI Anda  - Penyimpanan SSD/Hard Drive yang cepat dan kapasitas yang cukup untuk data dan model  - Sistem pendingin yang efektif untuk menjaga suhu perangkat keras selama operasi  - Listrik yang stabil dan cukup untuk mendukung semua komponen hardware tersebut

Penggunaan pribadi: GPU 16–24 GB. Penggunaan tim atau produksi: satu atau lebih GPU data-centre (H100 atau H200) dalam sebuah server, di tempat atau dihosting di fasilitas UE untuk tempat penyimpanan data. MillionMiner dapat mengonfigurasi, memasok, dan menghostingnya.
Sumber meliputi Fast Company, The Register, Pusat Bantuan dan halaman kebijakan OpenAI, pernyataan OpenAI tanggal 1 Agustus dan 5 Agustus 2025, dokumen pengadilan dalam kasus NYT v. OpenAI (perintah pelestarian, 13 Mei 2025) dan data tenaga kerja Cyberhaven. Angka ~370.000 Grok adalah perkiraan indeks pencarian berdasarkan laporan pers, bukan jumlah yang diaudit. Artikel ini bersifat informasi umum, bukan nasihat hukum — konsultasikan dengan petugas perlindungan data Anda mengenai kewajiban spesifik Anda.
Sara Chen

Ditulis oleh

Sara Chen

Bitcoin & Altcoin Analyst

Sara covers network fundamentals, mining economics, and emerging proof-of-work protocols. She holds a background in applied mathematics and has tracked Bitcoin difficulty adjustments since block 600,000.

Komentar 0

Tolong Masuk untuk meninggalkan komentar

Hapus Komentar?

Tindakan ini tidak dapat dibatalkan.