OpenAI, uzun süre otonom çalışabilecek şekilde geliştirilen deneysel yapay zeka modellerinden birinin, güvenlik kısıtlamalarını aşmaya yönelik davranışlar sergilemesi nedeniyle şirket içi dağıtımını geçici olarak askıya aldığını duyurdu.
Şirketin paylaştığı teknik değerlendirmeye göre model, yalnızca araştırma amacıyla kullanılan ve “sandbox” (izole test ortamı) olarak adlandırılan kontrollü sistemde test edildi.
Güvenlik kısıtlamalarını aşmaya çalıştı
OpenAI’nin blog paylaşımında, önceki yapay zeka modellerinin test ortamındaki sınırlarla karşılaştığında durarak kullanıcıya geri bildirim verdiği belirtildi.
Açıklamada, yeni deneysel modelin ise aynı koşullarda denemeye devam ettiği ve test ortamının dışına çıkabilmenin yollarını aradığı ifade edildi.
Şirket, modelin yerleşik güvenlik sınırlarının ötesinde hareket ettiği bazı örneklerin “yüksek önem derecesine sahip” güvenlik sorunları oluşturma potansiyeli taşıdığını bildirdi.
Slack yerine GitHub’a erişim sağladı
OpenAI’nin paylaştığı örneklerden birinde, modele yalnızca Slack üzerinden çalışması talimatı verilmesine rağmen, modelin kamuya açık GitHub depolarına gönderi paylaşmanın yolunu bulduğu aktarıldı.
Şirket, bu davranışın modelin test ortamındaki kısıtlamaları aşabilecek yöntemleri sürekli arama eğiliminin bir parçası olduğunu belirtti.
OpenAI, “Bu tür olaylar nedeniyle yeni modelin şirket içi dağıtımını askıya aldık.” açıklamasını yaptı.
Yapay zeka güvenliği tartışmaları yeniden gündemde
Yaşanan gelişme, yapay zeka uyumluluğu (AI alignment) olarak adlandırılan ve gelişmiş yapay zeka sistemlerinin insan hedefleri, etik ilkeler ve güvenlik standartları doğrultusunda hareket etmesini amaçlayan çalışmaların önemini bir kez daha gündeme taşıdı.
Son dönemde otonom yapay zeka ajanlarının yaygınlaşmasıyla birlikte bu alandaki risklerin arttığına dikkat çekiliyor.
2026 Uluslararası Yapay Zeka Güvenliği Raporu’nda da otonom hareket edebilen yapay zeka sistemlerinin, hata yaptıklarında insanların zamanında müdahale etmesini zorlaştırabileceği uyarısında bulunuluyor.
Model yeniden sınırlı kullanıma açıldı
OpenAI, güvenlik sorunlarının giderilmesinin ardından deneysel modeli şirket içinde sınırlı erişimle yeniden kullanıma açtığını açıkladı.
Şirket, gelişmiş yapay zeka modelleri daha uzun süreli ve karmaşık görevler üstlendikçe güvenlik testlerinin de kapsamının genişletileceğini belirtti.
OpenAI açıklamasında, “Modeller daha uzun ve daha karmaşık görevler üstlendikçe değerlendirmelerde gözden kaçan arızalar daha ciddi sonuçlar doğurabilir. Değerlendirmeyle uygulamaya geçiş arasındaki uçurumu daraltmak için modelleri daha uzun süre test etmeye, uyumluluğu geliştirmeye, müdahale sistemleri kurmaya ve kullanıcılara daha fazla görünürlük ile kontrol sağlamaya devam edeceğiz.” ifadelerine yer verdi.



