The great personal data training pipeline

Bu belge, orijinal İngilizce metnin makine çevirisidir. Bu çeviri ile orijinal İngilizce sürüm arasında herhangi bir çelişki olması durumunda, İngilizce sürüm geçerli olacaktır. İngilizce orijinal metni oku


Büyük kişisel veri eğitim hattı

2026-09-24 · Alex Wall, AIGP, CIPM, CIPP/US, CIPP/E, FIP, PLS, CISSP

Bir perşembe günü saat 16:40. Onaylı asistan sınırına ulaştı, sözleşmeler konusunda güvendiği model değil ya da sözleşmenin bulunduğu sürücüye erişemiyor. Son teslim tarihi değişmedi ve kendisinden "AI Native" olması bekleniyor. Bu yüzden sözleşmeyi kişisel ChatGPT hesabına yapıştırıyor ve otuz saniye sonra anlaşılır bir incelemeye ve bir karara ulaşıyor.

Bu hikayedeki hiç kimse bir şeyin sızdırıldığını düşünmüyor ve bu tamamen makul bir yapay zeka kullanımı. Bence bu, sektördeki en büyük veri hattı ve hizmet şartlarındaki birkaç küçük kelime üzerinden işliyor.

İki kural kitabı

OpenAI varsayılan olarak kurumsal müşterilerin verileriyle model eğitmez; ancak ChatGPT kullanan bireyler için "içeriğinizi modellerimizi eğitmek için kullanabilir." Anthropic, "bu ayar açık olduğunda" bireysel kullanıcı sohbetleriyle model eğitir; kurumsal ve API kullanımı ise bundan muaftır. Avrupa dışında, Google'ın ücretsiz geliştirici API'si aldığı verilerle model eğitirken, ücretli olan eğitmez. xAI işi daha da ileri götürüyor: AB ve Birleşik Krallık dışındaki bazı bölgelerde, Grok'u giriş yapmadan kullanırsanız model eğitiminden hiçbir şekilde çıkamazsınız.

Tüketici tarafı yalın bir önermeye dayanır: Yazan kişi yazdıklarının sahibidir ve bunları paylaşmayı kabul etmiştir. OpenAI'ın şartları, kullanıcıların bunları sağlama konusunda her türlü hakka sahip olduğunu "beyan ve taahhüt etmelerini" gerektirir.

Sorun şu ki, söz konusu sözleşme işverenin gizli bilgisidir ve içindeki isimler de müşterinin kişisel verileridir. İkisi de hiçbir şeyi onaylamadı ve veriler artık buluttaki devasa saklama sinek kağıdına yapışıp kaldı. İşten çıkarılma korkuları, daha hızlı teslim beklentileri ve "Yapay Zekâya Uyumlu" görünme baskısı sistematik ve sürekli bir teknik veri ihlali yarattı: Müşteri güveninin ve yazılı şirket politikasının ihlali.

Aklama döngüsü

Tüketici şartları altında; yapıştırdığı metin, bu metin üzerinde nasıl çalıştığı ve vardığı sonuçların tümü eğitim verisi haline gelebilir. Şirketi daha sonra kurumsal sürümü satın aldığında, kaynağı temizlenmiş, bir fikir sunta levhası gibi yeniden kullanılmış ve kullanıcı başına lisansla satılan bu öğrenimi geri alır. Kişisel ve ticari şartlar arasındaki bu ayrım, gizli ve kişisel veriler için bir aklama döngüsüdür ve kimsenin dikkat etmediği bir ticari sır vektörüdür. Üstelik bir maliyeti de vardır: IBM, her beş kuruluştan birinde gölge yapay zeka kaynaklı bir ihlal yaşandığını ve yoğun gölge yapay zeka kullanımının faturaya 670.000 dolar eklediğini ortaya koydu.

Bir politika sızıntıyı neden durduramaz?

Netskope, iş yerinde üretken yapay zeka kullananların %47'sinin kişisel yapay zeka uygulamalarını tercih ettiğini, buna karşın her on kuruluştan dokuzunun en az bir yapay zeka uygulamasını zaten engellediğini ortaya koyuyor. Yine de bu durum yaşanıyor; çünkü onaylanmış araçta tek bir şey eksik: kişinin tercih ettiği model ya da işin bağlı olduğu dosyaya, depoya veya sisteme erişim. Yapay zeka için ödeme yapan şirketlerin yer aldığı Zapier anketinde, kişisel hesap kullanıcılarının %53'ü kendi araçlarını tercih ettiğini ve %33'ü şirketin sağladığı aracın ihtiyaçlarını karşılamadığını belirtti. Engellemek, kopyala-yapıştır işlemini yalnızca bir telefona taşır.

Aklama döngüsünü ne kapatır?

Laboratuvarların kötü niyetli olduğunu düşünmüyorum. Bu gri alan neredeyse herkesin işine yarıyor: çalışanlar işi tamamlıyor, işverenler çıktıyı alıyor, laboratuvarlar ise veriyi elde ediyor. Bu anlaşmada eksik olan tek taraf, verinin asıl sahibi.

Bu döngüyü kapatacak olan şey, insanların zaten kendi istekleriyle seçeceği onaylı bir araçtır. Caiioo'yu bu yüzden geliştirdim.

Önde gelen tüm modelleri ve kendi donanımınız üzerindeki açık modelleri çalıştırır. Model değiştirmek bir arabanın motorunu değiştirmek gibidir: sohbetleriniz, dosyalarınız ve ayarlarınız olduğu gibi kalır.

Yapay zekayı işinize taşır. Dosyalara, e-postalara ve takvimlere fazladan bir buluta yüklenmeden kendi cihazınızdan erişilir ve sohbetler uçtan uca şifreli olarak senkronize edilir; böylece bunları yalnızca kendi cihazlarınız okuyabilir.

Ve her bir isteğin nereye gittiğini gösterir. Güven Sınırı (Trust Boundary), verilerinizi hangi yapay zeka şirketlerinin aldığını ve şartlarının neye izin verdiğini listeler; tek bir anahtarla verileriniz üzerinden eğitim yapabilecek tüm sağlayıcılar reddedilebilir. Bir şirketin kağıt üzerindeki politikasını herkes için geçerli kurallara dönüştürebilmesi amacıyla aynı kontrolleri inşa ediyoruz.

Caiioo'yu başlattım çünkü yetkinliğe, özerkliğe ve güvenliğe değer veriyorum. Bir kazanan seçmek ya da tek bir yapay zeka şirketine bağımlı olmak istemiyorum; ortada zaten fazlasıyla güç tekelleşmesi var. Şirketlerin bu araçları kullanması, verilerini koruması ve bağımsız kalması gerekiyor.