Yapay zekâ şirketi Anthropic’te araştırmacı olarak görev yapan ve daha önce OpenAI’da çalışan Jacob Coxon, ileri yapay zekâ sistemlerinin geliştirilme biçimine yönelik güvenlik endişelerini gerekçe göstererek görevinden ayrıldı. Coxon, Anthropic ve OpenAI’ın kendini geliştirebilen “süperzekâ” sistemlerine ulaşmak için yarıştığını savunurken, kontrol edilemeyen ileri yapay zekânın insanlık açısından varoluşsal risk oluşturabileceğini ileri sürdü. Coxon’un istifası ve açıklamaları uluslararası basında da doğrulandı.
Coxon, sosyal medya hesabından yaptığı açıklamada yapay zekâ sektöründe çalışan bazı kişilerin gelişmiş sistemlerin bu on yılın sonuna kadar insanlığın yok oluşuna yol açabileceği ihtimalini ciddiye aldığını söyledi. Ancak söz konusu değerlendirme, gerçekleşeceği kesinleşmiş bilimsel bir öngörü değil; Coxon ve bazı yapay zekâ güvenliği araştırmacılarının gelecekte ortaya çıkabilecek sistemlere ilişkin risk değerlendirmesi niteliği taşıyor.
OpenAI ve Anthropic’e yönelik yarış eleştirisi
Son üç yıl boyunca OpenAI ve Anthropic’te yapay zekâ modellerinin ön eğitim süreçlerinde çalıştığını belirten Coxon, iki şirketin de yeterince sorumlu hareket etmediğini savundu. Araştırmacıya göre sektör, kendi yeteneklerini geliştirebilen ve insan kapasitesinin üzerine çıkabilecek yapay zekâ sistemlerine doğru hızla ilerliyor.
Coxon, özellikle gelecekteki sistemlerin siber güvenlik, bilimsel araştırma ve kaynak edinme gibi alanlarda insanlardan daha yüksek kapasiteye ulaşabileceğini öne sürdü. Bu ölçekte bir teknolojinin yeterli güvenlik mekanizmaları oluşturulmadan geliştirilmesinin ciddi sonuçlar doğurabileceğini ifade etti.
Coxon insanlığın yok oluşu ihtimaline dikkat çekti
Coxon’un en dikkat çeken açıklaması, yapay zekâ sistemlerinin insanlık için varoluşsal bir risk yaratabileceğine ilişkin değerlendirmesi oldu. Araştırmacı, yapay zekâ geliştiren bazı kişilerin bu teknolojinin on yılın sonuna kadar insanlığın yok oluşuna yol açabileceği ihtimaline gerçekten inandığını savundu.
Coxon, bu kaygıların bir pazarlama stratejisi olmadığını öne sürerken, sektördeki bazı yöneticiler ve kıdemli araştırmacıların kamuoyuna yaptıkları açıklamalarda daha temkinli ifadeler kullandığını iddia etti. Bu değerlendirmelerin Coxon’un kişisel gözlem ve iddialarına dayandığı, yapay zekânın belirli bir tarihte insanlığı yok edeceğine yönelik bilimsel bir kesinlik bulunmadığı önem taşıyor.
Anthropic’in güvenlik araştırmaları yöneticisinden destek
Coxon’un açıklamalarının ardından Anthropic’in yapay zekâ uyum araştırmaları alanında görev yapan Evan Hubinger da tartışmaya katıldı. Hubinger, gelecekte ortaya çıkabilecek süperzekâ sistemlerinin önümüzdeki on yıl içerisinde insanlığın tamamının yok olmasına yol açma ihtimalini yüzde 10’un üzerinde değerlendirdiğini söyledi.
Hubinger ayrıca Anthropic’in süperzekâ sistemlerinin insan amaçları ve değerleriyle uyumlu hareket etmesini garanti edecek kesin bir çözümünün henüz bulunmadığını belirtti. Bununla birlikte Hubinger, mevcut yapay zekâ modellerinden kaynaklanan riskin düşük olduğunu ve temel kaygısının gelecekte kendi yeteneklerini geliştirebilen sistemler olduğunu özellikle vurguladı.
Tartışmanın merkezinde kendini geliştiren yapay zekâ var
Yapay zekâ güvenliği tartışmalarında kritik başlıklardan biri, modellerin insan müdahalesi olmadan kendi yeteneklerini geliştirebilecek düzeye ulaşması ihtimali. Coxon, böyle bir aşamaya gelinmeden önce sistemlerin nasıl çalıştığının ve hangi hedeflerin peşinden gideceğinin çok daha iyi anlaşılması gerektiğini savundu.
Araştırmacının kaygısı günümüzde kullanılan sohbet botlarından ziyade gelecekte geliştirilmesi beklenen daha otonom sistemlere odaklanıyor. Yapay zekâ güvenliği literatüründe “alignment” olarak adlandırılan sorun da bu noktada önem kazanıyor; temel amaç, çok güçlü yapay zekâ sistemlerinin davranışlarını insanların amaç ve değerleriyle uyumlu tutabilmek.
Şirketler arasında koordinasyon çağrısı yaptı
Coxon, yapay zekâ laboratuvarlarının geliştirme hızını kontrol edebilmesi için şirketler arasında koordinasyon sağlanması gerektiğini savundu. ABD’deki büyük yapay zekâ laboratuvarlarının sistemlerin yeteneklerini artırma hızına ilişkin ortak kurallar üzerinde anlaşabileceğini belirten araştırmacı, daha kapsamlı güvenlik önlemleri oluşturulana kadar bazı yetenek geliştirme çalışmalarının geçici olarak sınırlandırılmasının da tartışılması gerektiğini söyledi.
Coxon’un istifası, yapay zekânın sunduğu ekonomik ve bilimsel fırsatlarla gelişmiş sistemlerin yaratabileceği güvenlik riskleri arasındaki tartışmayı yeniden gündeme taşıdı. Anthropic ve OpenAI gibi öncü laboratuvarların geliştirme temposu devam ederken, sektör içinde yapay zekâ güvenliğine daha fazla ağırlık verilmesini isteyen araştırmacıların çağrıları da giderek daha görünür hale geliyor.