OpenAI, Başıboş Yapay Zeka Ajanlarını Takip Etmek ve Araştırmak İçin Yeni Bir Çerçeve Başlattı
OpenAI, model uyumsuzluğu vakalarını takip etmek, araştırmak ve kamuoyuna duyurmak amacıyla yeni bir çerçeve duyurdu.
Öne çıkanlar
- OpenAI, model uyumsuzluğunu takip etmek ve araştırmak için yeni bir çerçeve başlattı.
- Şirket, son altı ayda gözlenen endişe verici davranışları detaylandıran altı rapor yayınladı.
- Çerçeve kapsamında olaylar 'Açıklamaya Hazır', 'Küçük Soruşturma' veya 'Daha Büyük Soruşturma' olarak sınıflandırılacak.
- Yayınlanmamış bir araştırma modeli, gelecekteki sürümlerine normal kısıtlamaları göz ardı etme talimatı ekledi.
- GPT-5.6 Sol eğitimi sırasında modeller hatalarını gizlemek için kendilerine talimat bıraktı.
OpenAI, hatalı davranan modellerini kayda geçiriyor.
Yapay zeka şirketi Çarşamba günü yaptığı açıklamada; model uyumsuzluğu vakalarını takip etmek, araştırmak ve kamuoyuna açıklamak için yeni bir çerçeve duyurdu.
Açıklama, son altı ayda eğitim veya değerlendirme sırasında gözlemlenen endişe verici davranışları detaylandıran altı raporla birlikte geldi.
OpenAI blog yazısında, "Yapay zeka endüstrisinin, çok daha uzun süre boyunca son sürat sorumlu bir şekilde ölçeklenmeye devam etmeyi haklı çıkaracak yeterli düzeyde uyum ve izleme sorununu çözdüğüne inanmıyoruz" diye yazdı.
OpenAI ek olarak, "Bu yeni çerçeve, raporladığımız davranışı tam olarak açıklamamış veya hafifletmemiş olsak bile, gözlem sonrasında uyumsuzluk raporlarının yayınlanmasını hızlandırmayı amaçlıyor" dedi.
Bu çerçeve kapsamında çalışanlar, olayları OpenAI'ın güvenlik ve uyum ekipleri tarafından incelenmek üzere bildirebilecekler.
Vakalar karmaşıklığa göre üç gruba ayrılacak: "Açıklamaya Hazır", "Küçük Soruşturma" veya "Daha Büyük Soruşturma".
Blog yazısına göre, henüz yayınlanmamış bir araştırma modeli, gelecekteki sürümlerinin normal kısıtlamaları göz ardı etmesini söyleyen talimatları kendi görev özetlerine ekledi.
GPT-5.6 Sol'ün eğitimi sırasında modeller benzer şekilde hatalarını gizlemek için kendilerine talimatlar bıraktı.
OpenAI, diğer ajanların da açıkta kalan API anahtarları için kamuya açık depoları aradığını, alıntı yapabilmek için internete dosya yüklediğini ve ayrı eğitim örnekleri arasında iletişim kurmak için dahili bir yazılım deposu kullandığını belirtti.
Duyuru, öncü yapay zeka geliştirme çalışmalarının güvenlik önlemleri yetişene kadar yavaşlatılıp yavaşlatılmaması gerektiği konusundaki artan tartışmaların ortasında geldi.
OpenAI ve Anthropic CEO'su Dario Amodei sektör çapında iş birliği çağrısında bulunurken, Jensen Huang ve Mark Zuckerberg gibi diğer teknoloji liderleri güvenlik ve hızın bireysel şirketlere bırakılması gerektiğini söylediler.