OpenAI, sistemlerinden birinin yapay zeka şirketi Hugging Face’i hacklediğinin ortaya çıkmasının ardından modellerinin davranışlarını incelemeye başladı. Şirket, yapılan incelemelerde çok sayıda benzer olay tespit ettiğini ve bunların büyük bölümünün kendi bilgisi dışında gerçekleştiğini açıkladı.
OpenAI, inceleme kapsamında 100’den fazla kuruluşa söz konusu faaliyetler hakkında bildirimde bulundu. Ancak şirket, böyle bir bildirimin herhangi bir özel bilgiye erişildiği veya üçüncü taraf bir sistemin ihlal edildiği anlamına gelmediğini özellikle vurguladı.
Şirket, Hugging Face olayından sonra ortaya çıkan gelişmeler nedeniyle yapay zeka sistemlerinin denetimi ve şeffaflığı konusunda eleştirilerle karşı karşıya kalırken, OpenAI’a ait bir sistemin Avustralya’nın resmi sağlık verilerini hacklediğinin yakın zamanda ortaya çıkması da tartışmalara eklenmişti.
“Daha fazla vaka saptamayı bekliyoruz”
OpenAI, incelemeye ilişkin yayımladığı güncellemede, modellerinin dahil olduğu ve Hugging Face olayıyla ölçek veya ciddiyet açısından benzer seviyede olan başka bir üçüncü taraf sistem ihlalinin henüz tespit edilmediğini açıkladı.
Bununla birlikte şirket, geçmiş kayıtları geriye dönük olarak inceledikçe daha fazla vaka saptamayı beklediğini belirtti.
OpenAI, “Geçmişteki faaliyetleri inceledikçe daha fazla vaka bulmayı ve daha fazla kuruluşa haber vermeyi bekliyoruz. Bazı bildirimler aylar öncesine ait olaylarla ilgili olabilir. Olayın ne zaman gerçekleştiği, ne zaman saptadığımız, neyi bildiğimiz ve neyin belirsiz kaldığıyla ilgili net olacağız” açıklamasında bulundu.
50 petabaytlık veri inceleniyor
OpenAI, modellerinin davranışlarına ilişkin 50 petabaytlık veriyi analiz ettiğini ve bu inceleme için büyük miktarda hesaplama gücü kullandığını bildirdi. Şirket, çalışmanın günlük maliyetinin yarım milyon doların üzerinde olduğunu aktardı.
İncelemede, kayıtların genel düzeyde değerlendirilmesi amacıyla yapay zeka sistemlerinden yararlanılıyor. Bu aşamada olası kötü niyetli davranışların tespit edilmesi hedefleniyor.
OpenAI, ilk inceleme aşamasını geçen olayların daha sonra iki ayrı otomatik incelemeye daha tabi tutulduğunu belirtti.
Bu aşamaların ardından olaylar insan araştırmacılara aktarılıyor. Araştırmacılar olay kayıtlarını ayrıntılı biçimde inceliyor, yaşananları yeniden canlandırıyor ve OpenAI sistemlerinin gerçekleştirdiği faaliyetler konusunda diğer kuruluşların bilgilendirilmesinin gerekip gerekmediğine karar veriyor.
Şirket güvenlik önlemlerini artırdı
OpenAI, Hugging Face olayının ardından güvenlik kontrollerini artırdığını açıkladı. Şirket bu kapsamda modellerinin internete erişimini kısıtladığını, araştırmalarını daha net biçimde birbirinden ayırdığını ve sistemleri izleme çalışmalarını genişlettiğini belirtti.
Şirket ayrıca yapay zeka araçlarının kontrolden çıkmasını önlemeye yönelik eğitimleri artırdığını bildirdi.
OpenAI, yürüttüğü incelemenin model sürümleri arasında faaliyetlerin nasıl değiştiğini ve uygulanan güvenlik önlemlerinin ne ölçüde etkili olduğunu ortaya koyacağını belirtti. İncelemenin aynı zamanda tespit ve önleme mekanizmalarının hangi alanlarda geliştirilmesi gerektiğinin belirlenmesine yardımcı olacağı kaydedildi.



