OpenAI, Gizli Muhakeme Verisi Çekme Kampanyasını Durdurdu: Moonshot AI Bağlantısı
Yazar: KOZBA
İçindekiler
OpenAI, 30 Eylül 2026'da yaptığı açıklamada, modellerinin korumalı muhakeme (reasoning) kayıtlarını toplu biçimde çıkarmaya yönelik koordineli bir kampanyayı durdurduğunu duyurdu. Şirket, faaliyetin çekirdek kümesini Kimi modellerini geliştiren Moonshot AI ile bağlantılı kişilere bağladı.
Olay, yapay zeka modellerinin "gizli düşünme" kayıtlarının nasıl korunması gerektiğine dair sektördeki en somut tartışmalardan biri haline geldi. OpenAI, saldırganların şifrelemesini kırmadığını, veri tabanına sızmadığını ve kullanıcı sohbetlerine doğrudan erişmediğini özellikle vurguladı.
Korumalı muhakeme nedir?
Korumalı muhakeme, bir modelin bir görevi çözerken kullandığı içsel kayıttır ve nihai yanıttan çıkarılan bilgiler içerebilir. OpenAI, "saldırgan damıtma" (adversarial distillation) olarak tanımladığı yöntemin, bir modelin çıktılarını ya da muhakemesini izinsiz kullanarak başka bir modeli eğitmeyi, kopyalamayı veya geliştirmeyi amaçladığını belirtti. Şirkete göre tespit edilen kampanya bu pratikle tutarlıydı.
Şifreli muhakeme sohbetler arasında taşındı
OpenAI'nin gözlemlediği tekniklerden birinde operatörler, bir sohbetteki şifreli muhakeme kaydını başka bir sohbete kopyalıyor ve ardından modelden bu kaydı çözüp gizli içeriği yazmasını istiyordu. Şirket, şifreli kaydı "mühürlü bir not" olarak nitelendiriyor: notu elinde tutmak, onu okuyabilmekten farklı. OpenAI, başka bir kullanıcının şifreli muhakemesine sahip olan birinin o kaydı yeniden oynatarak içindekileri kurtarabildiği bir yolun kapatıldığını söyledi.
Şirket, kullanıcıların şifrelemesinin kırılmadığını, bir veri tabanının ele geçirilmediğini ve saklanan sohbetlere doğrudan erişim sağlanmadığını belirtti. Anlatılan saldırı, bir operatörün şifreli bir kaydı bir isteğe taşıyabildiği anda model etkileşimlerinin korumalı materyali nasıl işlediğine yönelikti.
24-25 Temmuz'da 16 bin istek
Şirkete göre faaliyet 1 Temmuz'da düşük hacimle başladı. 24 ve 25 Temmuz'da ise 4 binden fazla kullanıcıdan gelen 16.000 isteğin ilgili çıkarma kalıbını kullandığı kaydedildi. OpenAI, bu rakamların başarıyla kurtarılan muhakeme kayıtlarını değil, deneme sayısını gösterdiğini vurguladı. Daha geniş incelemede 15.000'den fazla kullanıcıyı kapsayan ilişkili bir küme tespit edildi ve bu kümenin 28 Temmuz'a kadar tamamen durdurulduğu belirtildi.
Bağımsız güvenlik araştırmacıları da modeller arası etkileşimler ve sohbetlerin sıkıştırılmasıyla ilgili benzer açıkları bildirdi. OpenAI, bu bulguları incelediğini ve araştırmacıların işaret ettiği saldırı yollarının gerçek olduğunu doğruladığını açıkladı.
Moonshot AI bağlantısı
OpenAI, faaliyetin çekirdek kümesini Moonshot AI ile bağlantılı kişilere bağladı. Ancak şirket, ilgili dönemde gözlemlenen her operatörün tek bir aktörden gelip gelmediğinin net olmadığını kaydetti. Bu nedenle atıf, 15.000'den fazla kullanıcıyı kapsayan tüm kümenin tek bir şirkete atfedilmesinden daha dar bir kapsamda kaldı.
OpenAI hangi önlemleri aldı?
Şirket yanıtını hesap kısıtlamaları, teknik değişiklikler ve iş ortaklarıyla koordinasyon üzerine kurdu. Sahte hesaplar yasaklandı veya kısıtlandı, kayıt ve altyapı kontrolleri sıkılaştırıldı, ilişkili ağlar için izleme genişletildi. Ayrıca gizli muhakemenin korunması kullanıcılar, çalışma alanları, kuruluşlar ve model aileleri genelinde güçlendirildi; muhakemeyi sızdırabilecek akış çıktısını yakalamaya yönelik denetimler eklendi.
OpenAI, bulgularını Frontier Model Forum ve devlet bilgi paylaşım kanalları üzerinden paylaşarak diğer geliştiricilerin de benzer faaliyetleri arayabilmesini amaçladı. Şirket, muhakeme kayıtlarının taşınmasına veya yeniden oynatılmasına izin veren sistemlerin benzer risklerle karşılaşabileceğini belirtiyor.
Damıtma neden güvenlik sorunu?
OpenAI'ye göre çıkarılan muhakeme, orijinal modelin görünür yanıtlarına uygulanan koruma önlemleri taşınmadan başka bir modeli eğitmek için kullanılabilir. Şirket, ölçekli damıtmanın ileri yetenekleri aynı güvenlik yatırımı olmadan aktarabileceği uyarısında bulundu. Bu, kampanyanın yalnızca ticari değil, güvenlik açısından da önemli görülmesinin nedeni.
Sonuç
Olay, yapay zeka şirketleri arasında "damıtma" ve muhakeme çıkarımı etrafındaki rekabetin hem teknik hem hukuksal boyutunu gösteriyor. OpenAI'nin açıklaması, korumalı muhakemenin taşınabilir bir varlık haline gelmesinin güvenlik açısından ne anlama geldiğini somutlaştırıyor. Şirket, araç savunmaları, tespit sistemleri, model reddetmeleri ve bulut ortaklarındaki kontroller üzerinde çalışmayı sürdürdüğünü belirtiyor.