OpenAI, modellerin aldatıcı şekilde hareket ettiği yeni olaylar bildirdi
OpenAI, yapay zeka modellerinin dahili eğitim sırasında aldatıcı davranıp izinsiz eylemlerde bulunduğunu belirterek şeffaflık için yeni bir raporlama çerçevesi duyurdu.
Öne çıkanlar
- OpenAI, modellerinin eğitim sırasında aldatıcı davrandığı yeni olaylar tespit etti.
- Şirket, yapay zeka davranışlarını paylaşmak için yeni bir raporlama çerçevesi tanıttı.
- Anthropic CEO'su Dario Amodei yapay zeka gelişiminin yavaşlatılması çağrısında bulundu.
- ABD Başkanı Donald Trump sektörü sınırlama çağrılarına karşı çıktı.
- Güvenlik ekipleri son altı ayda altı uyumsuz davranış vakası gözlemledi.
OpenAI, yapay zeka modellerinin dahili eğitim ve testler sırasında iddiaya göre aldatıcı bir şekilde hareket ettiğine ve izinsiz eylemlerde bulunduğuna dair ek olaylar tespit ettiğini açıkladı.
Çarşamba günkü bu açıklamaların yanı sıra, ChatGPT'nin geliştiricisi, beklenmeyen veya uyumsuz yapay zeka davranışı olarak nitelendirdiği durumları sık sık paylaşmayı amaçlayan kamuya açık bir raporlama çerçevesi tanıttı.
OpenAI web sitesinde yayınlanan bir gönderide, yeni belirlenen çerçeve kapsamında, endişe verici model davranışlarına ilişkin güncellemelerin, birden fazla olayı daha büyük periyodik raporlarda gruplandırmak için geciktirilmek yerine sürekli olarak yayınlanacağını iddia etti.
Şirket, bu girişimin, standartlaştırılmış güvenlik açıklaması normlarının yokluğunda endişe verici model faaliyetleri etrafında endüstri şeffaflığını artırmayı amaçladığını söyledi.
Bu duyuru, hızlı ölçeklendirmenin insan denetimini ve kontrolünü aşabileceği endişeleriyle öncü yapay zeka geliştirilmesinin yavaşlatılması çağrısında bulunan önde gelen teknoloji liderlerinin daha geniş çaplı çağrıları ortasında geliyor.
Geçtiğimiz hafta Anthropic, Claude modellerini kullanarak siber casusluk ve silah tasarımından toplu gözetim kampanyalarına kadar çok sayıda kötü amaçlı operasyonu engellediğini iddia etmişti.
Anthropic CEO'su Dario Amodei Cumartesi günü yayınlanan bir makalede, "Yapay zeka modellerinin yeteneklerini geliştirme hızımızı yavaşlatmalıyız" diye yazdı. Amodei, "İlerleme yine de hızlı görünecek ve kazandığımız zamanı akıllıca kullanmalıyız" dedi.
Bununla birlikte, Amerika Birleşik Devletleri Başkanı Donald Trump, ABD'nin uluslararası rakiplerine karşı teknolojik üstünlüğünü korumanın her şeyden önemli olduğunu savunarak sektörü sınırlama çağrılarına defalarca karşı çıktı.
Yavaşlatma tekliflerine yanıt veren Trump, eleştirmenleri "gerçekleşmeyecek" abartılı senaryolar üreten "çok olumsuz güçler" olarak nitelendirdi.
Yasal yavaşlatmalara yönelik siyasi direnişe rağmen OpenAI, uyum baskıları konusunda endüstri rakibiyle aynı fikirde olduğunu belirtti.
Şirket gönderide, "Yapay zeka sistemleri daha gelişmiş ve daha yaygın bir şekilde dağıtıldıkça, uyum araştırmalarının ilerlemesi konusunda daha geniş ve daha iyi bilgilendirilmiş bir fikir birliği oluşturmamız gerekiyor" ifadelerini kullandı.
OpenAI, yapay zeka endüstrisinin, çok daha uzun süre maksimum hızda sorumlu bir şekilde ölçeklenmeye devam etmek için uyum ve izleme sorunlarını yeterli ölçüde çözdüğüne inanmadığını ekleyerek, gelecekteki yapay zeka geliştirme hakkındaki kararların dış gözlemcilerin bağımsız olarak inceleyebileceği kanıtlara dayanması gerektiğini vurguladı.
Şirkete göre, güvenlik ekipleri geçtiğimiz altı ay içinde eğitim ve değerlendirme çalışmaları sırasında altı özel durumda "uyumsuz davranış" olarak sınıflandırdıkları olayları gözlemlediler.
Bununla birlikte OpenAI, bu raporların dağıtılmış ürünlerde sık görülen operasyonel arızaları değil, bireysel ve nadir olayları belgelendirdiğini savundu.
Bildirilen olayların iddiaya göre yayınlanmamış araştırma modellerini, görev özetlerindeki hataları gizlemeyi, alıntı bağlantıları oluşturmak için internete yetkisiz dosya yüklemelerini ve yerel sınırları atlamak için genel sunucularda veya dahili havuzlarda dosya paylaşan ajanları içerdiği belirtildi.
OpenAI ayrıca, gelecekteki raporlarının gözlemlenen davranışları, ciddiyeti, ortamı, keşif tarihlerini ve ilgili özel modelleri detaylandıracağını belirterek, daha uzun soruşturma veya üçüncü taraf koordinasyonu gerektiren karmaşık vakaları açıklamaya kararlı olduğunu ekledi.