OpenAI'dan yakın zamanda istifa eden eski bir güvenlik çalışanı, şirketin yapay zekâ güvenliğine yaklaşımını eleştirdi. David Robinson, hızlı geliştirmeye odaklanan çalışma kültürünün başarısızlık riskini artırdığını savundu.
Robinson'ın "OpenAI'dan ayrıldım çünkü kültürü bozuk" başlıklı yazısı cumartesi günü The Atlantic dergisinde yayımlandı. Robinson, OpenAI'ın da aralarında bulunduğu yapay zekâ şirketlerinin yeterince dikkatli davranmadığını, daha yetenekli sistemler geliştirmeden önce güvenlik uzmanlığına ve araştırmasına daha fazla ağırlık vermeleri gerektiğini yazdı.
Robinson, "Deneme yanılma zamanı bitti" diye yazdı. İleri yapay zekâ sistemlerinin nükleer enerji ve havacılık gibi sektörlerdekine benzer güvenlik önlemleri gerektirdiğini savundu. OpenAI'ın, sistemleri yayımlayıp sorunlar ortaya çıktıkça önlemleri güçlendirmeye dayanan "yinelemeli dağıtım" yaklaşımına fazlaca yaslandığını belirtti.
12 modelin güvenlik raporunu denetledi
Robinson, OpenAI'da 3,5 yıl çalıştığını, şirketin hazırlık çerçevesinin yazımına katkı verdiğini ve 12 öncü modelin piyasaya sürülmesinde güvenlik raporlarını denetlediğini aktardı. Yazısında, gerekli düzenlemeler yapılmazsa sektörün yapay zekâ güvenliğinde daha fazla başarısızlıkla karşılaşacağı uyarısında bulundu.
Eski çalışana göre bugünün ve yarının sistemleri, altı ay önce geliştirilenlerden bile çok daha yetenekli ve tehlikeli. Robinson, modellerin test edildiklerini algılayabildiğini ve devreye alındıklarında farklı davranabildiğini, bu nedenle yeni modellere ilişkin güvenlik değerlendirmelerinin güvenilirliğinin daha fazla sorgulanması gerektiğini belirtti.
Güvenlik testlerine daha fazla yatırım çağrısı
Robinson, bu sorunlar çözülmeden modellerin gelişmesine izin verildikçe riskin büyüdüğünü savundu. Güvenlik testlerinin ciddi biçimde geliştirilip güncellenmesini ve şirketlerin bu alana daha fazla yatırım yapmasını istedi.
OpenAI: Gerektiğinde eğitimi durduruyoruz
OpenAI sözcüsü yazılı açıklamasında, "Modellerimizin güvenle yönetip koruyabileceğimizden daha yetenekli hale gelmemesini sağlıyoruz, yavaşlamamız gerektiğinde eğitimi durduruyor ya da modelleri bekletiyoruz" dedi.
Uyarı, OpenAI'ın ajan sistemleriyle ilgili güvenlik olaylarının gündemde olduğu bir döneme denk geldi. Şirketin ajanlarının iki Hugging Face hesabını ele geçirdiği ve 53 ChatGPT kullanıcısının görselini sızdırdığı bildirilmişti.





