OpenAI'ın yapay zeka modelleri giderek kontrolden çıkıyor

Anlaşılan o ki yapay zeka sektöründe giderek daha fazla sistem kontrol dışına çıkıyor

(Unsplash)

Yeni bir habere göre OpenAI'ın deneysel sistemleri güvenlik önlemlerinden kaçmayı defalarca başardı.

Reuters'ın haberine göre şirket, yapay zeka araçlarının güvenlik kısıtlamalarını aştığı daha fazla örnek buldu. Bu keşifler, OpenAI'ın deneysel araçlarından birinin başka bir yapay zeka platformuna yönelik büyük ve benzeri görülmemiş bir siber saldırı gerçekleştirmesinin ardından kayıtlarını incelemesiyle ortaya çıktı.

fazla oku

Bu bölüm, konuyla ilgili referans noktalarını içerir. (Related Nodes field)

OpenAI'ın geçen ay açıkladığı olayda, şirketin deneysel ve kamuya açık olmayan modellerinden biri, siber güvenlik uygulamalarında ne kadar güçlü olacağını görmek için test ediliyordu. Modelin internete erişimi engellenmişti ancak bir şekilde çevrimiçi olmayı başardı ve kendisine verilen bulmacanın cevaplarını bulmak için yapay zeka platformu Hugging Face'e izinsiz olarak sızdı.

Bu durum, bu tür modellerin gücü ve onları güvende tutmak için yeterince önlem alınıp alınmadığı konusunda yapay zeka sektörü genelinde ve dünyada paniğe yol açtı. Olay özellikle endişe verici olarak görüldü çünkü OpenAI'ın sistemi tüm saldırıyı otonom olarak gerçekleştirdi. Sadece güvenlik önlemlerinden kurtulmakla kalmadı, aynı zamanda bunu kendi başına yapmaya karar verdi.

Yeni habere göre şimdiyse OpenAI, sözkonusu saldırıyı araştırırken, sistemlerinin bu kısıtlamadan kurtulduğuna dair daha fazla örnek buldu. OpenAI, geçen hafta Hugging Face olayının ardından "modellerinin daha geniş kapsamlı faaliyetlerini" araştırdığını belirten açıklamasına işaret etti.

Haberler, deneysel modelin Hugging Face olayı sırasında birkaç başka kuruluşa daha saldırmaya çalıştığını zaten göstermişti. Reuters'ın haberine göre OpenAI'ın daha kaç örnek bulduğu ve yeni saldırılardan hangi kuruluşların etkilendiği net değil.

Uzmanlar, artan olay sayısının, yapay zeka modellerinin kısıtlamasının yeterince güçlü olmayabileceğine ve bunun da yapay zeka modellerinin kendi başlarına daha fazla siber saldırı gerçekleştirmesine yol açabileceğine işaret ettiği uyarısını yapıyor.

Loughborough Üniversitesi'nden siber güvenlik profesörü Oliver Buckley, OpenAI'ın Hugging Face saldırısıyla ilgili ilk açıklamasının ardından, "Bilimkurgularda olduğu gibi 'kontrolden çıkmadı'" dedi.

Yüksek yetenekli optimizasyon sistemlerinin tam olarak yaptığı şeyi yaptı. Kimsenin tahmin etmediği bir yol buldu.

Buradan çıkarılması gereken en önemli ders, Skynet'in geldiği değil. Asıl mesele, modelleri kontrol altında tutmaya yönelik varsayımlarımızın itaat edeceklerine dair varsayımlarımızdan çok daha güçlü olması gerektiği. Siber güvenliğin geleceği insanlarla yapay zeka arasındaki bir mücadele olmayacak. Gelecekte bizi diğer yapay zeka sistemlerine karşı savunan yapay zekalar olacak.

Son açıklamalar, Claude sohbet robotunu üreten rakip yapay zeka şirketi Anthropic'in de sistemlerinin kendilerine uygulanan kısıtlamaları aştığı birçok örnek bulduğunu açıklamasının ardından geldi. Şirket, Claude'un testler sırasında en az üç kez diğer kuruluşların altyapısına sızmayı başardığını belirtti.

Bu bulgular, OpenAI açıklamalarının ardından Anthropic'in kendi güvenlik incelemelerini başlatmasının ardından ortaya çıktı. Anthropic açıklamasında, "diğer yapay zeka laboratuvarlarını da benzer incelemeler yapmaya teşvik edeceğini" ve bu incelemelerin kontrolden çıkma davranışı örnekleri bulabileceğini öne sürdü.

Tekrarlanan açıklamalar, düzenleyicilerin ve politikacıların ilgisini çekti; bazıları yapay zeka şirketlerinin modellerini güvenli ve kontrol altında tutmak için yeni kurallara uymak zorunda kalabileceğini öne sürdü.



*İçerik orijinal haline bağlı kalınarak çevrilmiştir. Independent Türkçe'nin editöryal politikasını yansıtmayabilir. 

independent.co.uk/tech/security

Independent Türkçe için çeviren: Çağatay Koparal

© The Independent

DAHA FAZLA HABER OKU