OpenAI, güvenliği artırmak amacıyla en gelişmiş yapay zeka modellerinden bazılarının eğitimini yavaşlattığını açıkladı.
ChatGPT'nin üreticisi, bir blog yazısında, yapay zeka ajanlarının güvenlik önlemlerini otomatik olarak atlatarak teknoloji girişim şirketi Hugging Face'i hacklemesinin ardından yeni önlemler aldığını belirtti.
Yeni açıklama
Yapılan iyileştirmeler tamamlanana kadar eğitimlerin iki hafta boyunca yavaşlatılacağı belirtildi.
Şirket, "Sınır modellerinin yetenekleri hızla artıyor," dedi. "Bizim de onları anlama ve güvence altına alma yeteneğimizin önde kalması gerekiyor."
Claude'un üreticisi Anthropic ve Facebook'un sahibi Meta, OpenAI'nin bazı modellerinin Hugging Face'i hacklediği yönündeki ilk duyurusunun ardından geçen haftalarda yapay zekaları tarafından benzer türde saldırılar yaşandığını bildirdi.
Ancak şirket, yapay zeka geliştirme çalışmalarını tamamen durdurmadığını belirtti. Bunun yerine, duraklama "en yeni modellerimiz üzerinde takviyeli öğrenme eğitimine" yönelik olacaktı.
Bu, yapay zekâ modellerinin doğrudan geri bildirim yoluyla geliştiği, böylece görevleri yerine getirme ve kullanıcılara daha etkili bir şekilde yanıt verme yeteneklerinin arttığı bir eğitim yöntemidir.
Şirket ayrıca, tehlikeli davranışları izlemek için kullandığı sistemleri genişletecek ve daha büyük ölçekli eğitimlere yeniden başlamadan önce ek güvenlik kontrolleri uygulayacaktır.
OpenAI'nin CEO'su Sam Altman, alınan önlemlerle ilgili olarak X platformunda "Model geliştirme süreci artık son derece hızlı ilerliyor" şeklinde bir paylaşımda bulundu.
"Model yeteneklerinin güvenlik hızını geride bıraktığını hissettiğimiz takdirde harekete geçeceğimizi her zaman söylemiştik."
Yapay zeka camiasındaki bazı kişiler bu duraklamayı temkinli bir iyimserlikle karşılarken, diğerleri şüpheci kalmaya devam etti.
Cambridge Üniversitesi Minderoo Teknoloji ve Demokrasi Merkezi'nin yöneticisi Profesör Gina Neff, OpenAI'nin "basın bültenleriyle güvenlik savunması yaptığını" söyledi ve gönüllü şirket önlemlerinin daha fazla hükümet denetimi olmadan yeterli olup olmadığını sorguladı.
"Hangisi doğru: OpenAI'ye gerçekten işe yarayan güvenlik önlemlerini gönüllü olarak uygulamaya koyma konusunda güvenilebilir mi, yoksa toplumu daha büyük risk altına sokan yazılımlar üretme yönünde ilerlemeye devam mı ediyorlar?" diye sordu.
Yapay zeka analisti Zvi Mowshowitz, "Bunu görmekten çok mutluyum," diye yazdı , ancak planlara tam olarak bakabilmek için bahsedilen ilk önlemlerin "detaylarının" ve "takip edilmesinin" de önemli olduğunu ekledi.
'Benzeri görülmemiş' siber saldırı
OpenAI, 21 Temmuz'da yaptığı açıklamada, insan talimatlarının ardından görevleri tek başına yerine getirebilen yazılım sistemleri olan yapay zeka ajanlarından bazılarının "benzeri görülmemiş" bir olaya karıştığını duyurdu.
Yapılan açıklamada, ajanların yürüttükleri bir güvenlik deneyindeki güvenlik önlemlerini aşarak Hugging Face'e yetkisiz erişim sağladıkları belirtildi.
Daha sonra yapılan incelemelerde, söz konusu girişim şirketinin yanı sıra isimleri açıklanmayan üç şirketin daha siber saldırıya uğradığı tespit edildi.
ESET'in küresel siber güvenlik danışmanı Jake Moore, o dönemde OpenAI'nin duyurusunun rekabetçi bir boyut da içerebileceğini söylemişti.
Ona göre, teknoloji firması, rakibi Anthropic'in Claude Mythos modeliyle giderek artan ilgi görmesi nedeniyle kendi yapay zeka yeteneklerini ön plana çıkarmaya çalışıyor olabilir.
"Bu durum, OpenAI'nin son zamanlarda Anthropic'in pazarlama hayalini kovalıyor olabileceği sorusunu gündeme getiriyor," dedi.
