Ana sayfa→Yapay Zekâ
Yapay Zekâ

OpenAI, Çin merkezli Moonshot AI ile ilişkilendirilen aktörlerin gizli akıl yürütme verilerini çıkarma kampanyasını ifşa etti.

OpenAI , Çin merkezli Moonshot AI ile ilişkilendirildigi iddia edilen aktörlerin kendi modellerinin gizli akıl yürütme (reasoning) verilerini çıkarmaya...

User Avatar
Sayarbilgi Teknoloji ServisiEditör
3 dk okuma
Yayın:

OpenAI, Çin merkezli Moonshot AI ile ilişkilendirildigi iddia edilen aktörlerin kendi modellerinin gizli akıl yürütme (reasoning) verilerini çıkarmaya yönelik organize bir kampanya başlattığını açıkladı. Şirketin 28 Temmuz’da yayımladığı açıklamaya göre, Temmuz ayında başlayan ve 16 bin çıkarma isteğinin 4 binden fazla hesap üzerinden gönderildiği tahmin edilen faaliyet, 28 Temmuz’a kadar tamamen etkisiz hale getirildi.

Açıklamada, faaliyetin 1 Temmuz’da “düşük hacimde” başladığı, ardından 24 ve 25 Temmuz’da “yüksek hacimli patlamalarla” devam ettiği belirtildi. Toplamda 16 bin isteğin bir çıkarma örüntüsü kullanılarak yapıldığı kaydedildi. OpenAI, faaliyetin çıkarma girişiminde bulunduğunu ancak bunun “zorunlu olarak başarılı olmadığınu”, kampanyanın ise 28 Temmuz’a kadar tamamen kesintiye uğratıldığınu belirtti.

Gizli akıl yürütme verileri nedir?

OpenAI’ya göre gizli akıl yürütme, modelin bir görevi çözerken kullandığı “dahili kayıt” anlamına gelir ve bu veri zincirinin düşünce sürecini (chain of thought) gizlemek için şifrelenir. İstemciye şifreli bir blok olarak teslim edilen bu veriler, istemcinin her istekle aynı bloğu geri göndermesi sayesinde sağlayıcının bunu saklaması gerekmez.

Açıklamada, muhalefetli bilimselleştirme (adversarial distillation) terimi de model çıktılarının veya akıl yürütmesinin bir modeli eğitmek ya da geliştirmek için “sistematik ve yetkisiz kullanımı” olarak tanımlandı. Açıklamaya göre faaliyetin bu yöntemlerden birini kullandığı, şifreli akıl yürütmenin bir konuşmadan alınarak başka bir modelde çözülmeye çalışıldığı aktarıldı.

Bu bağlamda şifrelemenin kırılmadığını, saklanan kullanıcı görüşmelerine doğrudan erişim olmadığını ve hiçbir veritabanının ele geçirilmediğini teyit ediyoruz. Açıklamada başarı oranına dair bir ölçü verilmediği, hangi modellerin hedef alındığına dair netlik bulunmadığı veya hesapların kaçının Moonshot ile ilişkilendirildiğine dair kesin bilgi paylaşılmadı.

OpenAI

Güvenlik önlemleri ve açıkların kapatılması

OpenAI, sorunu çözmek için bir yolu kapatarak zaten başka bir kullanıcının şifreli akıl yürütmesine sahip olan biri tarafından bu verinin tekrar oynatılıp içeriğinin geri kazanılmasını engelledi. Şirket ayrıca akıl yürütme ortaya çıkarabilecek akış çıktılarını tespit edip durdurmak için kontroller ekledi ve gizli akıl yürütmenin kullanıcılar, çalışma alanları, kuruluşlar ve model aileleri arasındaki korumasını güçlendirdi. Ayrıca üçüncü taraf sağlayıcılarla çalışarak hizmetlerinden geçen hesapların etkisiz hale getirilmesine katkı sağladı.

Bağımsız araştırmacılar da “sorumlu ifşa” yoluyla OpenAI’ya ilgili çapraz model ve konuşma sıkıştırma açıklarını bildirdi. Şirket, araştırmacıların bulduğu saldırı yollarının gerçek olduğunu teyit etti. 10 Ağustos tarihli “Stealing Reasoning Traces from Proprietary LLM APIs” başlıklı makale, açıklamada açıkça bağlantılı olarak verildi.

SayarBilgi sitesini Google’da tercih edilen kaynak olarak seç

Araştırmacılar OpenAI, Anthropic ve Google’ı test ederken, bir önder modelin şifreli akıl yürütmesini buna karşılık gelen daha zayıf bir modele besledi ve bu model onu düz metne dönüştürdü. Araştırmacılar testlerini Temmuz başında gerçekleştirdi ve sağlayıcıların raporlarını kabul etmesinin ardından aynı saldırıları “başlatamadıklarını” belirtti.

Sektördeki benzer tehditler

OpenAI bu tür tehditleyle yalnızca karşılaşmıyor. Bu ayın başlarında Anthropic’in “Detecting and countering misuse of AI: September 2026” başlıklı raporu, Moonshot’un neredeyse 300 bin müşteri isteğini 5.380 sahte hesaptan oluşan bir vekil (proxy) ağı üzerinden Anthropic’e ilettiği on günlük tek bir dönemi detaylandırdı. Rapor aynı zamanda Moonshot’un Claude’ın akıl yürütme imzalarını kaydettiğini ve yeni oturumlarda Claude’tan bu imzaları tam akıl yürütme izlerine dönüştürmesini istediğini, Anthropic’in bunu “oturumlar arası replay saldırıları” olarak adlandırdığını aktardı.

OpenAI Başkanı Greg Brockman, Temmuz ayında Moonshot’un Kimi K3’ün bilimselleştirmeden oluşturulduğunu reddettiği sırada, Moonshot’un OpenAI’nın modellerini bilimselleştirip bilinselleştirmediğini söylemenin “çok erken” olduğunu belirtmişti.

Son durum ve sonraki adımlar

OpenAI’nın bir sonraki adımı, ortaklar tarafından barındırılan dağıtımların ilk taraf araçlarıyla aynı korumaya sahip olduğundan emin olmak. Araç çıktı saldırılarını önlemek için ek kontroller gerekiyor. Şirket bulgularını Frontier Model Forum’a ve hükümet bilgi paylaşım kanallarına paylaştı; “taşınabilir veya replay edilebilir akıl yürütme örneğini destekleyen sistemler ilgili risklerle karşılaşabilir” uyarısında bulundu.

Şirket, önder modeller iyileşirken ve saldırılar onları ucuz şekilde taklit etmek için daha yol ararken bilimselleştirme girişimlerinin giderek daha karmaşık hale gelmesini bekliyor. Bu girişimlere karşı korunma çalışmaları sürüyor.

İlginizi Çekebilir: Daimon Robotics, IROS 2026’da Fiziksel AI için Dokunsal Zeka Altyapısını Sergiledi →
Kaynak: Tomshardware ↗
🚀 SayarBilgi Topluluğu

Bu Gelişmeyi Toplulukta Değerlendirin

Haber hakkındaki düşüncelerinizi, donanım deneyimlerinizi ve teknik sorularınızı topluluk üyeleriyle anlık olarak tartışın.

🚀 Yapay Zeka & Gelecek Odası →
Forumda sor / tartış
TOPLULUĞUN SESİ

Söz sizde.

1 yorum

Deneyiminizi, sorularınızı ve katkılarınızı paylaşın. E-posta adresiniz yayımlanmaz.

Sohbete katıl

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir

Yorumunuz yayımlanmadan önce onay bekleyebilir.

BİR SONRAKİ OKUMA

Merak etmeye devam

Tümünü gör ↗

Neyi merak ediyorsun?

En az 3 karakter yazın.

Keşfet