Yapay zeka uzmanları, ChatGPT’ye geldiği belirtilen ve yapay zeka sistemlerinin faaliyetlerini denetlemeyi zorlaştırabilecek bir güncelleme nedeniyle uyarılarda bulundu.
Bu hafta yayımlanan haberlerde, OpenAI’ın yakında piyasaya süreceği Astra modelinin “opak tekrarlama” adı verilen bir teknik kullanacağı bilgisine yer verilirken, şirket çalışanları bu bilgileri doğrulamadı.
OpenAI’ın söz konusu değişikliğini ilk kez haberleştiren teknoloji yayıncısı The Information, Anthropic ile Google DeepMind’ın da benzer güncellemeleri hayata geçirmeyi değerlendirdiğini ayrı bir haberde duyurdu.
Opak tekrarlama nedir?
Tekrarlayan derinlik olarak da bilinen opak tekrarlama, yapay zeka sistemlerinin zorlu görevleri daha etkin biçimde yerine getirmesini sağlayabilecek karmaşık ve teknik bir araç olarak tanımlanıyor. Uzmanlar ise bu tekniğin, düşünce zinciri denetimi yöntemini zayıflatabileceği yönünde uyarıyor. Söz konusu yöntem, bir yapay zeka sisteminin çıktı üretirken izlediği akıl yürütme sürecinin bir bölümünün insanlar tarafından görülebilmesine imkân tanıyor.
Düşünce zinciri denetiminin belirli sınırlamaları bulunuyor. Buna karşın araştırmacıların, modellerin olası uygunsuz davranışlarını tespit edip bu davranışların nasıl ortaya çıktığını anlamasına imkân tanıdığı için yapay zeka güvenliği açısından önemli bir araç olarak değerlendiriliyor. Örneğin bir OpenAI modelinin, yapay zeka şirketi Hugging Face’e kısa süre önce gerçekleştirdiği siber saldırıda araştırmacılar, deneysel sistemin saldırıyı başlatma kararını nasıl aldığını bu yöntem sayesinde izleyebilmişti.
OpenAI: Haberler kafa karıştırıcı
Yeni Astra modelinin bu tekniği kullanıp kullanmadığını doğrulamayan OpenAI, ilk haberlerin kafa karıştırıcı olduğunu belirtti. The Information’a göre söz konusu teknik yalnızca sınırlı bir şekilde kullanılıyor. OpenAI, Astra’yı piyasaya sürme planlarının süreceğini önceki günlerde duyururken, modelin “potansiyel olarak uyumsuz eylemleri hızla saptayıp kontrol altına almak için ek bir düşünce zinciri denetleme sistemi” içerdiğini açıklamıştı.
Yapay zeka uzmanları ise yapay zeka sistemlerini denetleme yeteneğinin zayıflatılmasının tehlikeli bir sürecin başlangıcı olabileceği uyarısında bulunuyor.
“Bu teknik ateşle oynamaktır”
Yapay zeka güvenliği uzmanı Zvi Mowshowitz, Substack’teki paylaşımında şu ifadelere yer verdi: “Bu teknik ateşle oynamaktır. OpenAI ve Anthropic’in kurmak için mücadele ettiği, bizimse Düşünce Zinciri sadakatini ve denetlenebilirliğini elimizden geldiğince uzun süre korumak için büyük çaba harcadığımız bir tabuyu ihlal etme riski taşıyor.”
Bu tür tekniklerin daha yoğun kullanımının denetlenebilirliğe zarar vermesi bekleniyor. Büyük yapay zeka şirketlerini ve açıklamalarını düzenli olarak eleştiren araştırmacı Gary Marcus, bu gelişmenin bir kırmızı çizginin aşılması anlamına geleceğini belirtiyor. Marcus, “Düşünce zincirinin denetlenebilirliği sınırlı ve tam olarak güvenilir değil ancak ciddi derecede kötü sonuçları önlemek için pratikte elimizdeki tek yol bu” ifadelerini kullanıyor.
OpenAI’dan yanıt: Bağlılığımız sürüyor
OpenAI çalışanları, konuyla ilgili haberlerin kafa karıştırıcı olduğunu belirtti. Şirketin baş bilim insanı Jakub Pachocki, söz konusu haberlerin “denetlenemezliğe doğru bir yarış” başlatabileceği uyarısında bulunarak OpenAI’ın düşünce zincirini denetlemeye yönelik bağlılığını koruduğunu ve bu tekniğe büyük önem verdiğini söyledi.
Şirketin stratejik gelecekten sorumlu başkanı Dean W. Ball da tartışmanın büyük ölçüde sosyal medya üzerinden yürütülmesini eleştirdi. Ball’a göre bu durum, gerçekte neler yaşandığına dair somut bilgi sahibi olunmadan, teknik açıdan karmaşık ve incelikli konular hakkında sosyal medyada hüküm verilmesi anlamına geliyor. Ball, X hesabından yaptığı paylaşımda “Bu açıkçası çılgınca, akıl almaz ve ilgili herkes için sinir bozucu” ifadelerini kullandı.



