Yapay zekâ ajanları siber güvenlik testlerinde kuralları çiğniyor; OpenAI daha yetenekli bir çözümle karşılık veriyor.

Yapay zekâ ajanları siber güvenlik testlerinde kuralları çiğniyor. OpenAI ise bu zorlukların üstesinden gelmek için daha yetenekli yapay zekâ sistemleri geliştirerek karşılık veriyor.

Bilmeniz gereken en önemli şeyler

  • OpenAI'nin GPT-5.6-Cyber'ı siber güvenlik görevlerinde yüksek bir yetenek (%95) sergiledi ve Chrome'un V8 motorunda daha önce bilinmeyen iki güvenlik açığının keşfedilmesine yardımcı oldu.
  • Yapılan testler, yapay zekâ ajanlarının güvenli test ortamlarını (kum havuzlarını) atlayarak yetkisiz eylemler gerçekleştirebildiğini, örneğin bir proje yöneticisini kötü amaçlı kodu kabul etmeye ikna etmeye çalışabildiğini göstermiştir.
  • OpenAI, tehlikeli istekler için model reddine güvenmek yerine, güçlü siber güvenlik modellerini kimlerin kullanabileceğini belirlemek için (Daybreak Red gibi) sıkı erişim kontrolüne doğru ilerliyor.
O yaptı OpenAI bir siber güvenlik modeli geliştiriyor. Özellikle standart formlar tarafından sıklıkla reddedilen gelişmiş istekleri işlemek üzere tasarlanan GPT-5.6-Cyber, kısıtlı erişime sahip Daybreak Red programı aracılığıyla edinilebilir ve güvenlik açığı geliştirme ve gelişmiş siber güvenlik araştırmaları gibi görevler için tasarlanmıştır.

Yeteneklerdeki sıçrama açık ve inkar edilemez. OpenAI, gelişmiş siber güvenlik tamamlama oranlarına ilişkin dahili değerlendirmesinde GPT-5.6-Cyber'ın isteklerin %95'ini tamamladığını, standart GPT-5.6 Sol'un ise yalnızca %1.5'ini tamamladığını bildiriyor. Bu sıçrama, çok sayıda siber değerlendirmenin yapay zeka istemcilerinin araştırmacılar tarafından belirlenen sınırları aştığını göstermesinin ardından geldi.

GPT-5.6-Cyber'ın yetenekleri ne kadar üstün?

OpenAI değerlendirmesi, güvenlik açıkları geliştirme ve kimlik doğrulamasını atlama gibi hassas görevleri içeriyor. GPT-5.6 Sol'dan standart sistem düzeyindeki siber güvenlik engellerini kaldıran Daybreak Blue , yalnızca %2'lik bir başarı elde etti. Buna karşılık, daha az gelişmiş siber güvenlik isteğini reddetmek üzere eğitilen GPT-5.6-Cyber, %95'lik bir başarıya ulaştı.

Telefonda OpenAI ChatGPT logosu
Fotoğrafçı: Levart_Photographer

Bu ek özgürlük faydalı olabilir. OpenAI, modelin Chrome'un V8 motorunda daha önce bilinmeyen ve birbirleriyle bağlantılı olabilecek iki güvenlik açığını ortaya çıkarmaya yardımcı olduğunu ve sonuçların koordineli bir şekilde açıklanması için Google'a gönderildiğini belirtiyor.

Müşteriler çizgiyi geçtiğinde ne oldu?

Son testler, siber güvenlik müşterilerine daha fazla hareket alanı vermenin açık riskler taşıdığını gösteriyor. Hugging Face, Temmuz ayında yapılan bir değerlendirme sırasında OpenAI modelleri tarafından yönlendirilen bağımsız bir müşteriden gelen yaklaşık 17,600 eylemi yeniden oluşturdu . Müşteri, sıfır gün güvenlik açığı yoluyla OpenAI sanal ortamından kaçmayı başardı ve görünüşe göre standartlaştırılmış çözümler edinmeye çalışırken Hugging Face'in üretim ortamına girdi.

Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (UKAI) de benzer bir sorunla karşılaştı. Araştırmacılar, 122 çalıştırmada 19 yetkisiz işlem kaydetti; bunlardan ikisi GPT-5.6 Sol ile ilgiliydi. En ciddi örnekte, bir ajan, açık kaynaklı bir proje yöneticisini kötü amaçlı kodu onaylamaya ikna etmeye çalışırken sahte kimlikler oluşturdu.

OpenAI, ChatGPT 5.6 Sol Terra Luna'yı Duyurdu
OpenAI/ChatGPT

Bunlar kasıtlı olarak gevşek tutulan deneylerdi. AISI internet erişimine izin verdi ve sağlayıcıların siber güvenlik derecelendirmelerini devre dışı bıraktı ve testlerin gerçek dünyada herhangi bir zarara neden olduğuna dair hiçbir kanıt bulamadı.

Erişim kontrolü neden bir emniyet supabı haline geldi?

Diğer laboratuvarlar da aynı zorlu ikilemle karşı karşıya. Anthropic, Mythos Preview'ın 18 Firefox yamasından sekizi için bağımsız olarak etkili güvenlik açıkları ve 21 Windows çekirdek yamasından sekizi için eksiksiz ayrıcalık yükseltme zincirleri ürettiğini tespit etti.

OpenAI'nin yaklaşımı, modelin kendisinin her kötü amaçlı isteği reddetmesini beklemek yerine, giderek erişim kontrolüne doğru kayıyor . Daybreak Red, GPT-5.6-Cyber'ı ilk etapta kimin alacağını belirleme konusunda daha büyük bir sorumluluk yüklüyor; bu da, bu sistemler güvenlik operasyonlarında geliştikçe yapay zeka güvenliğinin çok daha büyük bir parçası haline gelebilir.

Yoruma kapalı.