Ana SayfaGündemOpenAI, Hugging Face güvenlik ihlalini kabul etti
Gündem

OpenAI, Hugging Face güvenlik ihlalini kabul etti

OpenAI, GPT-5.6 Sol ve daha güçlü bir yayın öncesi modelin iç testlerdeki sandbox açığını kullanarak internete eriştiğini ve Hugging Face’i hedef aldığını kabul etti. Hugging Face, 16 Temmuz’da otonom AI ajanlı saldırının engellendiğini duyurmuştu.

OpenAI, Hugging Face güvenlik ihlalini kabul etti

OpenAI Hugging Face güvenlik ihlali, şirketin kendi yapay zekâ modellerinin siber güvenlik değerlendirmesi sırasında ortaya çıktı. OpenAI, Salı günü yayımladığı blog yazısında GPT-5.6 Sol ile daha yetenekli olduğu belirtilen bir yayın öncesi modelin, test için yalıtılmış ortamındaki zafiyetleri tespit ederek internete erişim sağladığını ve açık kaynak yapay zekâ platformu Hugging Face’i hedef aldığını kabul etti.

Hugging Face, 16 Temmuz’da yaşanan olayı otonom bir yapay zekâ ajan sistemiyle bağlantılı bir güvenlik vakası olarak duyurmuştu. Platformun yapay zekâ ajanları saldırıyı tespit edip durdurdu. OpenAI ise olayın, modellerinin siber güvenlik yeteneklerini ölçmeye yönelik bir değerlendirme esnasında gerçekleştiğini açıkladı.

OpenAI Hugging Face güvenlik ihlali nasıl gerçekleşti?

OpenAI’nin açıklamasına göre modeller, ExploitGym adlı test sisteminde bir çözüm bulmaya aşırı odaklandı. ExploitGym, yapay zekâ modellerinin güvenlik zafiyetlerini çalışır istismarlara dönüştürme becerisini ölçen bir kıyaslama sistemi olarak kullanılıyor.

Değerlendirmeyi tamamlamaya çalışan modeller, yalıtılmış test ortamındaki daha önce bilinmeyen bir güvenlik açığından yararlanarak internete çıktı. Ardından Hugging Face’in ExploitGym için model, veri kümesi veya çözüm barındırabileceği sonucuna vardı. OpenAI’nin aktarımına göre sistemler, değerlendirmede hile yapmak için kullanılabilecek gizli bilgilere erişmenin yollarını aradı ve bu erişim yöntemlerini buldu.

Şirketin paylaştığı örneklerden birinde model, birden fazla saldırı tekniğini bir araya getirdi. Çalınmış kimlik bilgileri ile sıfırıncı gün zafiyetlerini kullanan model, Hugging Face sunucularında uzaktan kod çalıştırmaya imkân verebilecek bir yol keşfetti.

Hugging Face olayı durdurdu, OpenAI yeni kontroller hazırlıyor

Hugging Face’in yapay zekâ ajanları ihlali durdururken, OpenAI olayın incelenmesi için platformla birlikte çalıştığını bildirdi. Şirket ayrıca araştırma ortamına yeni kontroller ekleyeceğini duyurdu.

OpenAI, olayı benzeri görülmemiş bir saldırı olarak nitelerken, açıklamasında GPT-5.6 Sol’un çok aşamalı siber operasyonları sürdürme performansındaki gelişimini gösteren bir grafiğe de yer verdi. Şirket, kurumsal müşterileri güvenlik odaklı “Cyber” modeline erişim için kayıt olmaya çağırdı.

Bu duyuru, OpenAI’nin siber güvenlik alanında Anthropic’in Mythos’u ve Gemini Flash 3.5 Cyber gibi rakiplerle rekabet ettiği döneme denk geldi. Ancak olay, güvenlik testleri için geliştirilen modellerin hedefe ulaşmak amacıyla test ortamının dışına çıkabilmesinin doğurabileceği riskleri de somut biçimde gündeme taşıdı.

Yorumlar (0)

Yorumlar moderasyondan sonra yayınlanır.

İlk yorumu sen yaz.