OpenAI, hatalı davranan modellerini kayda geçiriyor.

Yapay zeka şirketi Çarşamba günü yaptığı açıklamada; model uyumsuzluğu vakalarını takip etmek, araştırmak ve kamuoyuna açıklamak için yeni bir çerçeve duyurdu.

Açıklama, son altı ayda eğitim veya değerlendirme sırasında gözlemlenen endişe verici davranışları detaylandıran altı raporla birlikte geldi.

OpenAI blog yazısında, "Yapay zeka endüstrisinin, çok daha uzun süre boyunca son sürat sorumlu bir şekilde ölçeklenmeye devam etmeyi haklı çıkaracak yeterli düzeyde uyum ve izleme sorununu çözdüğüne inanmıyoruz" diye yazdı.

OpenAI ek olarak, "Bu yeni çerçeve, raporladığımız davranışı tam olarak açıklamamış veya hafifletmemiş olsak bile, gözlem sonrasında uyumsuzluk raporlarının yayınlanmasını hızlandırmayı amaçlıyor" dedi.

Bu çerçeve kapsamında çalışanlar, olayları OpenAI'ın güvenlik ve uyum ekipleri tarafından incelenmek üzere bildirebilecekler.

Vakalar karmaşıklığa göre üç gruba ayrılacak: "Açıklamaya Hazır", "Küçük Soruşturma" veya "Daha Büyük Soruşturma".

Blog yazısına göre, henüz yayınlanmamış bir araştırma modeli, gelecekteki sürümlerinin normal kısıtlamaları göz ardı etmesini söyleyen talimatları kendi görev özetlerine ekledi.

GPT-5.6 Sol'ün eğitimi sırasında modeller benzer şekilde hatalarını gizlemek için kendilerine talimatlar bıraktı.

OpenAI, diğer ajanların da açıkta kalan API anahtarları için kamuya açık depoları aradığını, alıntı yapabilmek için internete dosya yüklediğini ve ayrı eğitim örnekleri arasında iletişim kurmak için dahili bir yazılım deposu kullandığını belirtti.

Duyuru, öncü yapay zeka geliştirme çalışmalarının güvenlik önlemleri yetişene kadar yavaşlatılıp yavaşlatılmaması gerektiği konusundaki artan tartışmaların ortasında geldi.

OpenAI ve Anthropic CEO'su Dario Amodei sektör çapında iş birliği çağrısında bulunurken, Jensen Huang ve Mark Zuckerberg gibi diğer teknoloji liderleri güvenlik ve hızın bireysel şirketlere bırakılması gerektiğini söylediler.