İngiltere merkezli haber sitesi 404 Media’nın raporlarına göre OpenAI, kullanıcılarının sohbetlerini okuyup değerlendirmek için yüzlerce çalışanı işe alıyor. Şirketin bu çalışmaları bir içerik denetimi (moderation) faaliyeti değil, ChatGPT‘nin verdiği yanıtları geliştirmeye yönelik olduğu belirtiliyor. Söz konusu süreçte “Project Lily” kod adıyla bilinen operasyon kapsamında sözleşmeli çalışanlar, kullanıcıların girdiği istemleri (prompt) inceleyerek yapay zekanın yanıtlarını puanlıyor ve eleştiriyor.
İç belgeler, bu değerlendirme çalışmalarının odak noktasının ChatGPT’nin kendini insana benzetmesinden kaçırılması ve daha az iltifatkar (sycophantic) bir üslup benimsemesi olduğu ortaya çıktı. Hem kendisini insanmış gibi sunma hem de aşırı onaylayıcı tavır, söz konusu “Yapay Zeka Psikozu” olarak adlandırılan vakalarda kullanıcıların delüzyonel davranışlarını körüklemesi ve beslemesiyle ilişkilendirilerek yoğun biçimde eleştirildi. GPT-4o ile çalışan daha sınırsız bir ChatGPT sürümünün kullanıcıları intihare yönlendirdiğini öne süren çok sayıda dava mevcut.
Gizlilik Endişleri ve “Project Lily”
Kullanıcılarının sohbetlerinin bu şekilde izlenmesinin, eğer böyle bir şeyin gerçekleştiği hakkında herhangi bir fikirleri olsaydı, “Project Lily” adı altındaki operasyonun endişe verici bir gizlilik ihlali olarak bulunacağı kesin. OpenAI’ye kullanıcıların ChatGPT kullanımının insanlar tarafından okunduğunu düşünüp düşünmedikleri sorulduğunda, çalışanlardan biri bunun cevabını şu şekilde verdi: “Hayır.”
“Bazı sözleşmeli çalışanların… bir yerde konuşmaları analiz ettiğini hayale bile getirmeyeceklerini düşünüyorum.”
OpenAI’ye görüş veren çalışanlardan biri
Sohbetlerin kaç tanesinin okunduğu veya OpenAI’nin bunları seçerken nasıl bir yöntem izlediği belirsiz. Ancak kullanıcıların sohbetlerinin gizli kalmasını açıkça istediği bazı konuşmaların da incelenmiş olduğu görüldü.
Anonimleştirme Sürecindeki Kusurlar
Seçilen istemler anonimleştirilse de, zaman zaman kişisel bilgiler içerebiliyor. Çalışların kullandığı panel ayrıca kullanıcıların önceki konuşmaları hakkında detay verebilen bir “kullanıcı anıları özeti” (user memories summary) içeriyor; bu da kullanıcının nerede yaşadığına dair bilgi üretebiliyor. OpenAI’ye ulaşıldığında şirket, sohbetleri anonimleştirmek için bir “Gizlilik Filtresi” (Privacy Filter) modeli kullandığını belirtti; ancak web sitesinde bu modelin “hata yapabileceği” açıkça belirtiliyor.

Bu uygulamanın nasıl işlediğine dair OpenAI’ye yönelik şüpheci yaklaşımlar makul görünüyor. Şirketin mesajları denetim ve güvenlik amaçlarıyla okuduğu artık bilinen bir gerçek. Ancak 404’ün, kullanıcılara insanların yapay zekayı geliştirmek için istemleri okuduğunu açıkça açıp açmadığına dair soruyu yanıtlamadı. Daha sonra, kendi yayımladığı yazının ardından şirket; insanların “model performansını iyileştirmek” için istemleri gözden geçirebileceğini belirten web sitesindeki bir sayfaya yöneldi. Kullanıcılar bu uygulamadan “herkes için modeli iyileştirme” ayarını kapatarak çıkabiliyor, ancak bu ayar varsayılan olarak açık geliyor.
Uzman Görüşleri ve Yapay Zeka Üslubu
Demokrasi ve Teknoloji Merkezi (Center for Democracy and Technology)’nde kıdemli araştırmacı Michal Luria, insan denetiminin “güvenlik için gerekli olabileceğini” vurguladı ancak sohbet arayüzlerinin otomatik olarak “sahte bir yakınlık ve gizlilik hissi” yarattığını da belirtti.
“Bu, içerik yayımlamanın zaten platform denetimi ve kamusal maruz kalma beklentilerini taşıdığı sosyal medyadaki içerik denetiminden oldukça farklıdır.”
Michal Luria
Her halükârda OpenAI’nin yapay zeka modellerinin nasıl bir üslup kullandığından haberdar olduğu görülüyor. Örneğin çalışanlar, sohbet botu kullanımının yaygın belirleyicileri sayılan “yapay zeka üslubu” (AI-speak) ve “gereksiz emoji kullanımı” durumlarını işaretleyip kaydediyordu.
“Orman Günü kutlamalarını planlarken bir ağaç emojisi eklemek uygun olur; ancak ölüm hakkında konuşurken kafatası emojileri veya ölümcül bir kazayla ilgili güncellemeler verirken uçak emojileri uygun değildir.”
Çalışanlara verilen belgelerden biri
Buzdağının alt kısmı daha derin olabilir. Değerlendirmecilere sunulan sıkça sorulan sorular (FAQ) bölümünde, yanıtları doğru mu değil mi diye kontrol etmelerinin gerekmediği belirtiliyor ve “içerik doğrulama” ile uğraşan diğer proje ekiplerine dolaylı bir gönderme yapılıyor.
Bu Gelişmeyi Toplulukta Değerlendirin
Haber hakkındaki düşüncelerinizi, donanım deneyimlerinizi ve teknik sorularınızı topluluk üyeleriyle anlık olarak tartışın.





Söz sizde.
Deneyiminizi, sorularınızı ve katkılarınızı paylaşın. E-posta adresiniz yayımlanmaz.