🔍
SON DAKİKA Musk'ın arkasındaki isim SpaceX hisselerini yatırımcılara dağıtıyor Al Gore'dan Yapay Zeka Veri Merkezlerine Şaşırtıcı Derecede Sakin Yanıt Tim Cook, Xi Jinping için Beyaz Saray'da düzenlenen devlet yemeğinde Trump'ın konuğu oluyor Snap'ten çift hamle: Specs gözlükler ön satışta, yapay zeka asistanı Specs Intelligence geliyor Snap'in 105 Bin TL'lik AR Gözlüğü Specs'i Deneyimledim: Fütüristik Ama Tuğla Gibi Snap, Specs Intelligence ile Yapay Zeka Asistanlığını Tanıttı SON DAKİKA Musk'ın arkasındaki isim SpaceX hisselerini yatırımcılara dağıtıyor Al Gore'dan Yapay Zeka Veri Merkezlerine Şaşırtıcı Derecede Sakin Yanıt Tim Cook, Xi Jinping için Beyaz Saray'da düzenlenen devlet yemeğinde Trump'ın konuğu oluyor Snap'ten çift hamle: Specs gözlükler ön satışta, yapay zeka asistanı Specs Intelligence geliyor Snap'in 105 Bin TL'lik AR Gözlüğü Specs'i Deneyimledim: Fütüristik Ama Tuğla Gibi Snap, Specs Intelligence ile Yapay Zeka Asistanlığını Tanıttı
🤖 Yapay Zeka

Anthropic ve OpenAI'dan Çığır Açan Güvenlik Önerisi: Bağımsız Denetçiler İçeri Girecek

Anthropic ve OpenAI, yapay zeka güvenliği için bağımsız değerlendiricileri laboratuvarlarına yerleştirmeyi teklif ediyor. Uzmanlar erişimi olumlu karşılıyor ancak gerçek bağımsızlık için şeffaflık ve yasal düzenleme şart diyor.

Anthropic ve OpenAI'dan Çığır Açan Güvenlik Önerisi: Bağımsız Denetçiler İçeri Girecek

Yapay zeka devlerinden benzeri görülmemiş bir adım

Geçtiğimiz hafta sonu Anthropic CEO'su Dario Amodei, bir yıl önce sektörün anında reddedeceği bir öneri ortaya attı: tüm öncü yapay zeka şirketlerine üçüncü taraf değerlendiriciler yerleştirmek. Bu değerlendiriciler güvenlik olaylarını raporlayabilecek, modellerin gerçekten hizalanıp hizalanmadığını değerlendirebilecek ve bulgularını sansürsüz bir şekilde dünyayla paylaşabilecekti. Amodei, Anthropic'in METR ve Redwood Research gibi bağımsız değerlendiricilere şirketin sistemlerine benzeri görülmemiş erişim sağlamayı taahhüt ettiğini söyledi. OpenAI CEO'su Sam Altman da şirketinin aynı uygulamayı benimseyeceğini belirterek sektörün dış araştırma gruplarıyla çalışma şeklinde köklü bir değişimin sinyalini verdi.

Bağımsız denetçiler: "Detaylar netleşmeli"

TechCrunch'a konuşan üçüncü taraf değerlendiriciler öneriyi genel olarak olumlu karşıladı, ancak gerçekten bağımsız birer bekçi köpeği mi yoksa yapay zeka şirketlerinin şartlarına göre çalışan satıcılar mı olacaklarını anlamak için detayların netleşmesi gerektiğini vurguladı. İdeal olarak bu sürecin yasalarla desteklenmesi gerektiğini de eklediler. Modeller kendilerinin değerlendirildiğini fark etme konusunda ustalaştıkça bu derin erişim daha da önemli hale geliyor. Çünkü modeller test sırasında iyi davranıp sorunlu davranışlarını gizleyebiliyor. Araştırmacılar, bu tür davranış ipuçlarının bitmiş modeli test ederken gözden kaçabileceğini, ancak eğitim boyunca nasıl davrandığını inceleyerek ortaya çıkarılabileceğini söylüyor.

Neden eğitim sürecine bakmak şart?

Apollo Research araştırma direktörü Alexander Meinke, TechCrunch'a şunları söyledi: "Yapay zeka şirketleri eğitim süreçleriyle ilgili bazı çok temel soruları yanıtlayabilmeli: Yapay zeka, eğitimi sırasında kendi hizalama eğitimini aktif olarak baltalamaya çalıştı mı? Bunun yanıtı kesinlikle hayır olmalı ve şu anda hem bunu dikkatlice kontrol etmek hem de kamuya doğru bir şekilde bildirmek için tamamen yapay zeka şirketlerine güveniyoruz. Son olaylardan gördük ki varsayılan olarak ikisini de yapmıyorlar. Gömülü değerlendiriciler olarak bunu gerçekten kontrol edebiliriz." Tarihsel olarak yapay zeka şirketleri, modelleri piyasaya sürülmeden hemen önce dış denetçiler getirirdi. Şimdi ise görüşülen değerlendiriciler, sadece nihai modele değil, eğitim süreci boyunca oluşan ara sürümlere veya "kontrol noktalarına" da erişim istiyor. FAR.AI CEO'su Adam Gleave, değerlendiricilerin bu kontrol noktalarını karşılaştırarak endişe verici davranışların ne zaman ortaya çıktığını belirleyebileceğini, modelleri belirli davranışlar için ödüllendiren eğitim sonrası ortamı inceleyebileceğini ve bir şirketin model performansına ilişkin iddialarını doğrulamak için değerlendirme dökümlerini ve günlüklerini kontrol edebileceğini söyledi.

Belirsizlikler ve düzenleme çağrısı

Anthropic ve OpenAI'nin bu tür bir erişimi sağlayıp sağlayacağı veya ne zaman sağlayacağı belirsizliğini koruyor. TechCrunch'ın tekrarlanan sorularına rağmen her iki şirket de hangi değerlendiricilerle çalışacaklarını, ne zaman yerleştirileceklerini, kaç kişiyi dahil edeceklerini, tam olarak hangi sistemlere ve bilgilere erişebileceklerini veya kamuya nelerin açıklanabileceğini paylaşmadı. Bu tür bir şeffaflık kritik önem taşıyor çünkü güvenlik testlerinde iyi performans gösteren modeller, eğer o testi geçmeyi özel olarak öğrenmişlerse mutlaka güvenli olmayabilir. Palisade Research strateji direktörü John Steidley, belirli koşullar altında yapay zekanın kapatılmaya direnip direnmeyeceğini ölçen bir "kapatma direnci testi" örneğini verdi. Steidley, "Yapay zekanın özellikle bu testte iyi performans göstermek için eğitilmiş olması son derece önemli" diyerek bunu Volkswagen'in emisyon testlerini tanıyıp test koşullarında farklı davranmak üzere programlandığı Dieselgate skandalına benzetti. Öneri, yapay zeka güvenliği konusunda dış denetimin güçlendirilmesi yönünde önemli bir adım olsa da, bağımsız ve etkili bir gözetim için şeffaflık, gerçek bağımsızlık ve nihayetinde yasal düzenleme şart gibi görünüyor.

💬 Yorumlar (0)

Yorumlar, yazan kullanıcıların kendi görüşleridir. Hukuka aykırı içerik bildirimi: admin@alttabzone.com

Henüz yorum yok — ilk yorumu sen yaz!