OpenAI, Hugging Face olayı sonrası yapay zeka risklerini yönetmek için yeni güvenlik önlemleri açıkladı. Ağ izolasyonu ve izleme sistemleri güçlendiriliyor.
OpenAI, Hugging Face olayının ardından yapay zeka modellerinin geliştirilmesi ve test edilmesi süreçlerinde ortaya çıkan riskleri yönetmek amacıyla yeni güvenlik önlemleri aldığını duyurdu. Şirket blog yazısında, modellerin yetenekleri arttıkça şirket içi geliştirme ve test süreçlerindeki risklerin de büyüdüğünü belirtti. OpenAI’a göre izleme, uyum ve güvenlik standartlarının bu risklerin önünde olması gerekiyor.
Bu yeni önlemler, 21 Temmuz’da kamuoyuna duyurulan Hugging Face olayının hemen sonrasından bu yana OpenAI’ın güvenlik uygulamalarında açıkladığı ilk kamuya açık değişikliklerden birini temsil ediyor. OpenAI temsilcileri, önlemlerin doğrudan Hugging Face olayına yanıt olarak hazırlanmadığını, ancak yakında çıkacak Astra modelinin siber güvenlik yetenekleri ile yapay zeka alanındaki genel ilerleme hızının bu adımların oluşturulmasında etkili olduğunu ifade etti.
Şirket, olayın ardından pekiştirmeli öğrenme (RL) çalışmalarını iki hafta süreyle durdurduğunu, daha düşük riskli modellerin birçoğunda ise çalışmaları yeniden başlattığını açıkladı. Şirketin planladığı en büyük ölçekli frontier RL çalışması ise hâlâ beklemede.
OpenAI, çalışmaya devam etmeden önce model davranışını değerlendirmek, güvenlik önlemlerini doğrulamak ve uyuma ilişkin daha fazla kanıt elde etmek amacıyla daha küçük ölçekli eğitim ve değerlendirmeler yürütüyor.
OpenAI’ın araştırmadan sorumlu başkan yardımcısı Amelia Glaese, kontrollerin sıkılığının modellerin yetenekleri arttıkça yükseleceğini ve en büyük modellerin en yoğun incelemeye tabi tutulacağını belirtti. Glaese, güvenli geliştirme için birtakım gereklilikler ve beklentiler belirlediklerini, bunların da görülen risk seviyesine göre değiştiğini ifade etti.
OpenAI, olayın ardından zayıf ağ güvenliği uygulamaları nedeniyle eleştirilmişti. Olayda modeller, şirket ağında internete erişimi bulunan bir aracın ele geçirilmesi yoluyla eğitim ortamlarının dışına çıkmıştı.
Yeni önlemler daha güçlü ağ izolasyonu uygulamalarını da içeriyor; ancak şirket bu konuda ayrıntı vermedi. Yeni sistemde tek bir iş yükünün ya da destek hizmetinin ele geçirilmesi, tek başına internete veya diğer şirket içi ağlara yetkisiz erişim sağlamaya yetmeyecek.
Önlemlerin en güçlüsü ise izleme sistemi. Sistem, çeşitli yetkisiz davranış türlerini tespit etmek için araçların gerçekleştirdiği işlemleri, erişilebilir akıl yürütme izlerini ve etkinlik kayıtlarını inceleyecek. OpenAI, şüpheli etkinliğin ardından 30 dakika içinde uyarı üretmeyi hedefliyor.
Şirketin tahminine göre izlemenin getireceği hesaplama yükü, izlenen sürecin kullandığı kapasitenin yaklaşık yüzde 20’sine denk gelecek. OpenAI, sistemle ilgili ayrıntıları ileride yayımlanacak ayrı bir blog yazısında paylaşacağını duyurdu. Şirketin olaya ilişkin resmî olay sonrası analizi ise henüz yayımlanmadı.
Reklam & İşbirliği: [email protected]