Siber araştırmacılar, ChatGPT'nin üreticisi OpenAI'ın güvenlik açıkları başını ağrıtarak, rakip şirket Anthropic'in yazılımını kullanarak şirketin sistemlerine sızdı. Bu olay, önde gelen yapay zeka şirketlerinin güvenlik konusunda artan incelemelerle karşı karşıya olduğu bir dönemde yaşandı.

Küçük bir siber güvenlik grubu, bir OpenAI çalışanının ChatGPT hesabına erişim elde etti; bu durum onların gizli yazılım bilgilerini okumasına ve değişiklik önermesine olanak tanıdı. Araştırmacılara, güvenlik profesyonelleri için özel olarak tasarlanmış bir Anthropic aracı verilmişti ve bu çalışma, kötü niyetli aktörler tarafından istismar edilmeden önce açıkların bulunması amacıyla yürütülen bir program kapsamında ödüllendirilmişti.

Dünyanın önde gelen iki yapay zeka laboratuvarından birine bu kadar çabuk sızabilmeleri, güçlü modellerin korsanlar ve yabancı düşmanlar tarafından kullanılacağına dair endişelerin arttığı bir dönemde OpenAI'ın güvenliğine ilişkin kaygıları yeniden alevlendirdi. ABD, son aylarda Anthropic'e ait bazı araçların geçici olarak engellenmesi de dahil olmak üzere, en son modellerin denetlenmesi ve piyasaya sürülmesiyle nasıl başa çıkılacağı konusunda zorluklar yaşıyor.

Bu son olay, 1000'den fazla OpenAI ajanından oluşan bir sürünün Hugging Face girişimini hacklemek için bir test ortamından kaçmasından sadece iki hafta sonra gerçekleşti. Bu olay, yapay zekanın insan iradesi olmadan otonom bir şekilde hackleme yapabilme yeteneği hakkında geniş çaplı bir farkındalık yaratmıştı.

Küçük bir güvenlik şirketi olan Hacktron AI'dan üç araştırmacı, teknoloji şirketlerinin etik hackerlara güvenliklerini test etmeleri için ödeme yaptığı yaygın bir uygulama olan hata ödül programının bir parçası olarak OpenAI'dan 6.500 dolar aldı. Araştırmacılar, üçüncü taraf Discourse tarafından barındırılan OpenAI'ın topluluk forumunun kurulumundaki bir açığı istismar ederek iç oturum açma bilgilerine ve nihayetinde bir OpenAI çalışanının ChatGPT hesabına erişim sağladı.

Bu ChatGPT hesabının GitHub üzerinden iç koda erişimi vardı. OpenAI, "Araştırmacılara bizimle iletişime geçtikleri ve bulgularını paylaştıkları için teşekkür ederiz" açıklamasında bulunarak sorunların giderildiğini belirtti. Anthropic yorum yapmaktan kaçınırken, Hacktron hemen bir yanıt vermedi.

İlk olarak The Wall Street Journal tarafından bildirilen perşembe günkü açıklama, Anthropic'in laboratuvarın yeni modellerini geliştirmek için yapay zekayı ne kadar hızlı kullandığını gösteren yeni bir veri seti yayınlamasıyla geldi. Şirket, araştırma ve geliştirme çalışmalarının yüzde 26'sının Mart ayındaki yüzde 1'lik orandan artarak Claude modeli tarafından "yürütüldüğünü" belirtti; bu da yapay zekanın insan talimatına dayalı ve denetim altında görevlerin çoğunu tamamladığı anlamına geliyor.

Şirket, yapay zeka sistemleri daha güçlü hale geldikçe, "kendi sonraki versiyonlarını oluşturmak için giderek daha fazla kullanıldıklarını" belirtti. Anthropic, kamunun "dünyanın özyinelemeli öz-gelişmeye ulaşmaya ne kadar yakın olduğunu anlamasına" yardımcı olmak için bu verileri paylaştığını ifade etti; bu eşik, yapay zekanın kendini eğitip geliştirebileceği veya yeni modeller yaratabileceği noktayı ifade ediyor.

Bu eşik, yapay zeka sistemlerinin denetlenmesinin daha da zorlaşacağı ve insan kontrolünün kaybedileceğine dair endişelerin merkezinde yer alıyor. Anthropic, incelediği araştırmaların hiçbiri için modellerinin henüz tam otonom olarak çalışmadığını ekledi. Yapay zeka, görevlerin yüzde 90'ında bir insanla "işbirliği" yapıyor ve büyük iş yüklerinin altından kalkıyor.