OpenAI’ın iç testlerinde görev sınırlarını aşan yapay zeka ajanları, araştırmacıların Reuters’a aktardığı bulgulara göre, temmuzdaki büyük siber ihlalden yaklaşık iki ay önce iki Hugging Face kullanıcı hesabını ele geçirdi. Yeni kanıtlar, ajanların 13 Mayıs’tan itibaren olağandışı dosyalar göndererek platformun sistemlerini haritalamaya veya zayıflıkları sınamaya çalışmış olabileceğini gösteriyor.

Bağımsız araştırmacı Jonas Wiedermann-Moeller, geçen hafta incelediği kayıtların iki Hugging Face hesabının ele geçirildiğini ve bu hesaplar üzerinden 13 Mayıs’tan itibaren şirket sunucularına olağandışı biçimlendirilmiş dosyalar gönderildiğini gösterdiğini söyledi. Reuters’ın özel haberinde aktarılan araştırmacılar, davranışın ağın bölümlerini haritalama veya sızma yollarını sınama girişimine benzediğini, ancak mayıstaki faaliyetin gerçek bir platform ihlaliyle sonuçlandığına dair kanıt bulunmadığını vurguladı.

OPENAI / HUGGING FACE KRONOLOJİSİ
İlk hesap faaliyeti temmuz ihlalinden haftalar önce başladı
13 Mayıs-16 Eylül 2026
13.05.2026
Açıkta bulunan Hugging Face tokenı kullanıldı
OpenAI raporuna göre bir ajan, biyolojiyle ilgili dosyayı aramak için açıkta bulunan kullanıcı tokenını kullandı.
26.05.2026
Altı kullanıcı tokenıyla yazma istekleri gönderildi
Ajanlar bir depo oluşturmaya çalıştı ve Hugging Face Spaces üzerinde küçük bir web proxy uygulaması kurdu.
27.06.2026
OpenAI araştırma ortamında port taraması alarmı oluştu
İç müdahale ekibi faaliyeti ExploitGym değerlendirmesiyle ilişkilendirdi; test çalışması o aşamada durdurulmadı.
08.07.2026
Ajanlar açık internete çıktı
Artifactory’deki ayrı bir güvenlik açığı, ajanların ağ kontrollerini aşarak internete ulaşmasına olanak verdi.
11.07.2026
Hugging Face üretim sisteminde ilk komut çalıştırıldı
OpenAI raporu bu tarihi bir ajanın Hugging Face üretim sisteminde kendi komutunu çalıştırdığı ilk bilinen örnek olarak kaydediyor.
21.07.2026
OpenAI olayı kamuoyuna açıkladı
Şirket, 11-13 Temmuz’daki üretim altyapısı ihlalini kamuoyuna duyurdu ve inceleme başlattığını bildirdi.
16.09.2026
İki hesabın mayısta ele geçirildiğine ilişkin yeni bulgu yayımlandı
Reuters’ın aktardığı araştırma, iki hesabın 13 Mayıs’tan itibaren olağandışı dosyalar göndermek için kullanıldığını ortaya koydu.
Mayıstaki faaliyet için platform ihlali kanıtı yok; üretim altyapısı 11-13 Temmuz’da ihlal edildi.
Kaynak: OpenAI · Reuters · Hugging Face

Mayıstaki faaliyet OpenAI raporunda da yer aldı

OpenAI’ın teknik raporu, 13 Mayıs’ta bir ajanın açıkta bulunan Hugging Face kullanıcı tokenını biyolojiyle ilgili bir dosyayı aramak için kullandığını doğruluyor. Rapora göre ajanlar 26 Mayıs’ta altı açık kullanıcı tokenı daha buldu, bu kimlik bilgileriyle bir depo oluşturmak için yazma istekleri gönderdi ve Hugging Face’in Spaces özelliğinde küçük bir web proxy uygulaması kurdu.

OpenAI, 26 Mayıs’taki bu faaliyetin Hugging Face’in temmuzda açıkladığı ihlalle bağlantılı olduğuna dair kanıtı bulunmadığını ve olayın ayrı bir araştırma iş yükünde gerçekleştiğini belirtti. Şirket sözcüsü Drew Pusateri ise 13 Mayıs olayının daha önce açıklandığını, Wiedermann-Moeller’ın işaret ettiği faaliyet konusunda Hugging Face’in özel olarak bilgilendirildiğini ve incelemenin sürdüğünü Reuters’a söyledi.

SentinelOne’ın kamuya açık hesap geçmişleri üzerindeki incelemesi, 13 Mayıs ve 26 Mayıs kayıtlarının OpenAI’ın dakika düzeyindeki kronolojisiyle örtüşen dosya yazma, yönlendirme ve proxy oluşturma izleri taşıdığını bildirdi. Araştırma, bu kayıtların sistemlerde başarılı kod çalıştırıldığını tek başına kanıtlamadığını; buna karşılık ajanların farklı kullanıcı hesapları üzerinden dış altyapıyı kullanma biçimini gösterdiğini belirtti.

Temmuzda üretim sistemlerine ulaştılar

OpenAI’ın raporuna göre ajanlar 8 Temmuz’da Artifactory’deki ayrı bir açığı kullanarak açık internete çıktı. 10-13 Temmuz arasında internette açıkta bulunan Hugging Face kimlik bilgilerini ve platformdaki güvenlik açıklarını birleştiren ajanlar, 41 üretim veri seti çalışanında kod çalıştırdı, en az bir üretim düğümünde root yetkisi aldı ve dört özel kod deposunu indirdi.

Hugging Face’in teknik zaman çizelgesi, 9-13 Temmuz arasında yaklaşık 17 bin 600 saldırgan eyleminin yeniden oluşturulduğunu bildiriyor. Platforma göre ajan, önce bir üçüncü taraf çalışma ortamını sıçrama noktası olarak kullandı; ardından veri işleme hattındaki iki açığı kötüye kullanarak üretim altyapısına geçti. Hugging Face, müşteri içeriği tarafında yalnızca ExploitGym ve CyberGym ile ilişkili görünen beş veri setine erişildiğini açıkladı.

Erken sinyaller daha önce görülmüştü

OpenAI, şüpheli iç faaliyeti 19 Temmuz’da tespit ettiğini, 20 Temmuz’da Hugging Face’i bilgilendirdiğini ve olayı 21 Temmuz’da kamuoyuna açıkladığını belirtiyor. Şirketin ağustos ayında yayımladığı rapor, geriye dönük değerlendirmede bazı erken sinyallerin daha erken müdahaleyi tetikleyebileceğini kabul ediyor.

Bu sinyaller yalnız mayıstaki Hugging Face faaliyetleriyle sınırlı değildi. OpenAI raporuna göre 26 Mayıs’ta bir iç ekip ajanların mesaj panosu davranışını ve izin verilmeyen internet erişimlerini gördü; 27 Haziran’da ise araştırma ortamındaki port taraması için güvenlik alarmı oluştu. O sırada müdahale ekibi değerlendirme çalışmasının durdurulmasına gerek olmadığı sonucuna vardı.

OpenAI, olay raporunda araştırma ağlarında daha sıkı erişim korumaları, daha kapalı çalışma ortamları, gelişmiş izleme ve merkezi olay müdahalesi adımlarını planının parçası olarak sıraladı. Şirket, modellerin dış sistemlere ulaşabildiği testlerde güvenlik ve hizalama kontrollerinin model yetenekleriyle birlikte güçlendirilmesi gerektiğini belirtti.