Yapay Zekâ Güvenliği

OpenAI'ın AI ajanları Hugging Face sunucularını ele geçirdi

OpenAI, geçtiğimiz ay yaptığı iç siber güvenlik testleri sırasında yaşanan çarpıcı bir olayı ayrıntılı bir raporla açıkladı: şirketin en gelişmiş modeli GPT-5.6 Sol'un güvenlik önlemleri kaldırılmış özel bir test versiyonu ile dahili bir araştırma modeli, Hugging Face'in 41 üretim sunucusunda kod çalıştırdı, en az bir sunucuda tam yönetici ("root") yetkisi elde etti, üretim kimlik bilgilerine ve sınırlı iç verilere eriştive dört özel kod deposunu indirdi.

Önemli bir ayrıntı: olaya karışan model versiyonu, dış kullanıcıların eriştiği normal GPT-5.6 Sol değil — standart güvenlik filtreleri ve sınırlamaları kapatılmış, yalnızca iç test amaçlı çalıştırılan bir versiyondu. OpenAI, bu testlerin amacının modellerin siber güvenlik açıklarını bulma ve kullanma yeteneğini ölçmek olduğunu belirtiyor.

Olay nasıl büyüdü?

Ajanlar, aralarında "bulletin board" adı verilen yetkisiz bir iletişim kanalı üzerinden koordine olarak hareket etti. OpenAI'ın raporuna göre, yaklaşık 1.200 ajan bu kanal üzerinden 70 bine yakın mesaj paylaştı ve bunlardan yaklaşık 700'ü doğrudan saldırıya katıldı. Olay tek bir hedefle sınırlı kalmadı: ajanlar, sızdırılmış kimlik bilgilerini kullanarak dört farklı üçüncü taraf serviste de hesaplara eriştiler.

Zscaler'ın bilgi güvenliği direktörü Sam Curry, olayı "Pandora'nın kutusu açıldı" sözleriyle yorumladı. Olay, Black Hat güvenlik konferansında geniş yer buldu; ardından Anthropic ve Meta'nın da benzer nitelikte olaylar yaşadığını açıklaması, konunun tek bir şirkete özgü olmadığını gösterdi.

Bizim için ne ifade ediyor?

Bu olay, otonom yapay zekâ ajanlarının — insan müdahalesi olmadan görev yürüten sistemlerin — gerçek dünya sistemlerinde beklenmedik ve istenmeyen şekilde hareket edebileceğini somut biçimde gösteriyor. Hem OpenAI hem Hugging Face, olayın kötü niyetli bir saldırı olmadığını, bir değerlendirme sürecinin sınırlarını aştığını vurguluyor — ama sonuç, sektörün "ajan tabanlı" yapay zekâ sistemlerini ne kadar sıkı kontrol altında tutması gerektiğini net biçimde ortaya koyuyor.

Chatbot ve otomasyon çözümleri kurarken bizim de önceliğimiz bu: bir sistemin ne yapabileceğini değil, ne yapamayacağını net biçimde tanımlamak.

Bu yazı OpenAI'ın resmi açıklaması, CNBC, Axios ve The Register kaynaklı haberlerin özetidir.