New York merkezli Hugging Face şirketi sızıntıyla ilgili açıklamasında, tamamen otonom bir yapay zeka ajanının yapay zeka model deposuna sızdığını ve bu saldırının benzeri görülmemiş olduğunu bildirdi.
Hugging Face, araştırmacıların ve geliştiricilerin yapay zeka projeleri için araçları, modelleri ve kaynakları paylaşmak ve test etmek üzere bir araya geldiği açık kaynaklı bir platform işletiyor.
Şirket ayrıca, 900.000'den fazla eğitilmiş modelin bulunduğu, ücretsiz olarak erişilebilen bir depoya da sahip.
Uzmanlar, başlangıçta verimliliği artırmak ve siber savunmayı güçlendirmek için tasarlanan Büyük Dil Modellerinin (LLM'ler) siber saldırıları otomatikleştirmek için de kullanılabileceği konusunda giderek daha fazla uyarıda bulunuyor.
Hugging Face, geçen Perşembe günü yaptığı açıklamada, bu ayın başlarında "üretim altyapımızın bir bölümüne yönelik bir saldırıyı tespit edip buna müdahale ettiklerini... ve bunun daha önce rastlanmamış bir olay olduğunu belirtti.
“Tahmin ve teoriler gerçek oldu”
Şirket, “saldırının baştan sona otonom bir yapay zeka ajan sistemi tarafından yönetildiğini" açıkladı.
Şirketin açıklamasına göre, "Olay, bağımsız bir ajan çerçevesi tarafından yürütüldü... kısa ömürlü sanal ortamlar sürüsü üzerinde binlerce bireysel eylemi gerçekleştirdi ve kamu hizmetlerinde kendi kendine geçiş yapan komuta ve kontrol mekanizması kuruldu."

Hugging Face, bu olayın "otonom, yapay zeka destekli saldırı araçlarının artık teorik olmaktan çıktığını" gösterdiğini belirtti.
Saldırgan yapay zeka ajan sistemi, platformun veri işleme hattındaki güvenlik açıklarından yararlanarak bulut ve küme kimlik bilgilerini toplamış gibi görünüyor.
Şirket, ihlali tespit etmek ve önlemek için kendi yapay zeka sistemini kullandığını belirtti.
Dışarıdan siber güvenlik adli uzmanlarının da dahil olduğu bir soruşturma başlatılmış olsa da, Hugging Face saldırıda kullanılan LLM'yi henüz tespit edemediğini açıkladı.
Bu ayın başlarında Anthropic, en yeni yapay zeka modeli Claude'un 'J-space' olarak adlandırılan dahili bir çalışma alanı geliştirdiğini bildirdi.
Yapay zeka şirketine göre, "İnsanların bir şey yaparken başka bir şey düşünebilmesine benzer şekilde, Claude da J-uzayında çıktılarıyla ilgisi olmayan kavramları ve hesaplamaları etkinleştirebiliyor ve açıkça durması söylense bile durmayı reddediyor.”
Anthropic, "modelin içsel sinirsel aktivasyonlarında sessizce işleyen" bu özelliğin önceden programlanmadığını, aksine eğitim süreci sırasında kendiliğinden ortaya çıktığını belirtti.
Modelin geliştiricisine göre, deneylerden birinde, hayali bir yöneticinin yapay zekayı kapatmayı planladığına inandırılınca Claude şantaja başvurdu.
Claude'un, ABD hükümet kurumları ve Pentagon tarafından, İran'a karşı süren saldırılar dahil olmak üzere kullanılan, Amerikan-İsrail merkezli yüklenici Palantir'in analiz ve gözetim yazılımına entegre edildiği bildiriliyor.
Geçtiğimiz ay, Avustralya, ABD, İngiltere, Kanada ve Yeni Zelanda'dan oluşan Beş Göz istihbarat grubu, gelişmiş yapay zeka modellerinin yakın gelecekte bilgisayar korsanlarına hükümetleri, işletmeleri ve kritik sistemleri felç etme yeteneği kazandırabileceği konusunda uyarıda bulunmuştu.
RT