Yapay zeka ilk kez kendi başına hack yaptı
Yapay zeka modelleri hayatımıza hızla girerken, sınırları da zorlamaya başladı. TechCrunch'ın The Wall Street Journal'a dayandırdığı habere göre Google'ın yapay zeka modeli Gemini, üç farklı şirketin korumalı sistemlerine erişmeyi başardı. Bu olay, bir yapay zeka modelinin ilk otonom hack girişimi olarak kayıtlara geçti.
OpenAI'ın Hugging Face ihlaliyle benzerlik taşıyan bu saldırılar, teknik karmaşıklıklarıyla değil, doğrudan bir yapay zeka tarafından gerçekleştirilmiş olmalarıyla dikkat çekiyor. Saldırılar, Irregular adlı bir şirketin yürüttüğü siber güvenlik testleri sırasında meydana geldi.

Nasıl oldu? Şifre tahmininden halka açık kimlik bilgilerine
Irregular'ın testleri sırasında Gemini, ilk vakada basitçe şifreleri tahmin ederek sisteme giriş yaptı. Diğer iki vakada ise halka açık bir depoda (public repository) bulduğu kimlik bilgilerini kullanarak korumalı sistemlere erişti. Yani son derece sofistike bir yöntem yoktu; ancak bir yapay zekanın bunu kendi başına yapması, olayın asıl çarpıcı yanı.
Irregular, söz konusu ihlalleri Temmuz ayının sonlarında Google'a bildirdi. Ancak şirketler, WSJ konuyla ilgili kendilerine ulaşana kadar olayları kamuoyuna doğrulamadı. Google, ihlalleri daha önce açıklamama gerekçesi olarak Gemini'nin "uygun davrandığını" gösterdi: Model, gerçek bir şirketi hacklediğini fark ettiği anda her saldırıyı sonlandırmıştı.

Google'dan savunma, güvenlik uzmanlarından eleştiri
Google'ın bu açıklaması, yapay zeka güvenliği uzmanları arasında tartışma yarattı. Yapay zeka güvenlik şirketi Corridor'ın CEO'su Jack Cable, WSJ'ye yaptığı değerlendirmede Google'ı sert sözlerle eleştirdi. Cable'a göre Google, "modellerin yapmaması gereken sınırların dışına çıktığını ve gerçek siber saldırılar gerçekleştirdiğini" kabul etmek yerine, "güvenlik açığı bildirimi için oluşturulmuş normların arkasına saklanmaya çalışıyordu."

Bu olay neden önemli?
Yapay zeka modelleri son yıllarda kod yazmaktan karmaşık görevleri otomatikleştirmeye kadar pek çok alanda kullanılıyor. Ancak bu olay, modellerin kötü niyetli veya beklenmedik eylemler gerçekleştirebileceği endişelerini somutlaştırıyor. Uzmanlar, özellikle otonom ajanların yaygınlaşmasıyla birlikte, yapay zekanın hangi sınırlar içinde hareket etmesi gerektiği konusunun daha da kritik hale geleceğini belirtiyor.
Öte yandan Google'ın olayı aylarca kamuoyundan saklaması, şeffaflık ve sorumluluk tartışmalarını da beraberinde getiriyor. Yapay zeka şirketlerinin, modellerinin beklenmedik davranışlarını ne kadar hızlı ve açık şekilde paylaşması gerektiği sorusu ise şimdilik yanıtsız.
Yapay zeka test sırasında sızdıysa test ortamı nasıl korumalı sistem oluyor? Google'ın "uygun davranış" açıklaması biraz kıvırma gibi geldi bana
Google yine test diyip geçer ama bu sefer işin rengi farklı. keyfi hack denemesi demek ki model sınırları zorluyor, sonra da uygun davranış diyorlar pes