Anthropic araştırmacısı: Yapay zekanın insanlığı yok etme ihtimali yüzde 10’dan fazla

Anthropic’te yapay zeka güvenliği ve risk analizi çalışmalarını yöneten kıdemli bir araştırmacı yaptığı açıklamada, şirket içindeki pek çok kişinin yapay zekanın insanlığın tamamını yok edebileceğine inandığını söyledi. Araştırmacı ayrıca, şirketin çabalarına rağmen yapay zekanın hedeflerini insanlığın hedefleriyle uyumlu hale getirme sorununu çözme konusunda henüz doğru yolda olmadığını belirtti.

Bu açıklamalar, başka bir araştırmacının şirketten istifa ederek Anthropic’i sorumlu davranmamakla suçlamasının ardından geldi. Öne çıkanlar • Anthropic’te Alignment Science Lead (Alignment Bilimi Lideri) olarak görev yapan Evan Hubinger, X’te yaptığı paylaşımda kendisinin ve meslektaşlarının “yapay zekanın tüm insanları öldürebileceğine gerçekten inandığını” söyledi ve gelecek on yıl içinde bunun gerçekleşme ihtimaline ilişkin kendi tahminini yüzde 10’un üzerinde olarak açıkladı. • Hubinger, şirketin “elinden gelenin en iyisini yapmaya çalıştığını” ancak henüz “süperzeka için alignment” sorununu çözmeye yönelik bir plana sahip olmadığını ve bunu başaracağı konusunda “açıkça doğru yolda” bulunmadığını söyledi. • Hubinger’ın paylaşımı, başka bir Anthropic araştırmacısı olan Jacob Coxon’ın yapay zeka güvenliği konusundaki endişeleri nedeniyle şirketten istifa ettiğini duyurduğu X paylaşım dizisine yanıt olarak geldi. • OpenAI ve Anthropic’te ön eğitim araştırmaları üzerinde çalıştığını söyleyen Coxon, rakip şirketlerin “kendi kendini geliştiren süperzekaya doğru doğrudan yarışarak ve hayatlarımızı kumara yatırarak” sorumlu davranmadığını savundu. • Şirketten ayrılan araştırmacı, yapay zeka geliştiren insanların bunun “2030'un sonuna kadar hepimizi öldürebileceğine” inandığını ve bunun bir “pazarlama gösterisi” olmadığını belirtti. • Hubinger, vahim uyarısının ardından yaptığı bir başka paylaşımda Anthropic’in son risk raporuna atıfta bulunarak mevcut modellerin oluşturduğu tehdidin düşük olduğunu söyledi ve ekledi: “Benim endişelendiğim şey, daha önce de söylediğimiz gibi düşündüğümüzden daha hızlı gerçekleşen kendi kendini geliştirme sonucunda süperzekanın ortaya çıkması.” Anthropic araştırmacısının istifası Wall Street Journal, insanlık için tehdit oluşturabilecek kendi kendini geliştiren yapay zeka sistemleri geliştirme yönündeki baskıyla ilgili endişeleri nedeniyle Coxon’ın Anthropic’ten ayrıldığını ilk olarak bildirdi.

Coxon Journal’a dünyanın, “gelecek yılın sonuna gelindiğinde işlerin şimdiden kontrolden çıkabileceği en agresif senaryoların birçoğuna” doğru ilerlediğine inandığını söyledi. Coxon X paylaşımlarında OpenAI ve Anthropic’teki çalışma deneyimlerini karşılaştırdı ve ChatGPT’nin geliştiricisi olan şirketteki çalışanların “medeniyet açısından söz konusu olan risklerin boyutunu derinlemesine içselleştirmediğini” belirtti.

Coxon, Anthropic’te risklerin “çok iyi anlaşıldığını” ancak şirketin “ilk ulaşan olma yarışına kilitlendiğini” söyledi. Bunun nedeninin ise “başka hiç kimsenin sorumlu davranmayacağına inanmaları ve bu nedenle risklere rağmen bunu kendilerinin yapmak zorunda olduklarını düşünmeleri” olduğunu ifade etti.

Arka plan Bu uyarı ve istifa, bazı önde gelen yapay zeka araştırmacıları ve yöneticilerinin gelişmiş yapay zeka çalışmalarının yavaşlatılması yönündeki çağrılarının arka planında geldi. “Pacing the Frontier” başlıklı bir bildiri, Anthropic’in kurucu ortakları Dario Amodei ve Jared Kaplan, OpenAI Baş Bilim İnsanı Jakub Pachocki, Meta AI baş bilim insanı Shengjia Zhao ve diğer bazı önde gelen yapay zeka isimleri tarafından temmuz ayında imzalandı.

Bildiride, “Yapay zekanın potansiyelini gerçekleştirebilmek için sektör, hükümet ve genel olarak toplumun ortaya çıkan riskleri ele almak, güvenlik önlemleri geliştirmek ve denetimi güçlendirmek için zaman kazanma seçeneğine ihtiyaç duyabileceği” belirtildi. Ancak şirketlerin bunu tek taraflı olarak yapmaları konusunda yoğun rekabet baskısıyla karşı karşıya oldukları konusunda uyarıda bulunuldu.

Bildiri, ABD hükümetini “otomatikleştirilmiş yapay zeka geliştirmesinin öncü sınırını bilinçli bir şekilde yavaşlatmak için gerekli teknik ve yönetişim araçlarını geliştirmeye yönelik uluslararası bir çabayı” desteklemeye çağırdı. Pazar günü yayımladığı bir blog yazısında Pachocki de benzer uyarıları yineledi ve “hiçbir laboratuvarın alignment ve izleme sorununu, çok daha uzun bir süre boyunca maksimum hızda ölçeklendirmeye sorumlu bir şekilde devam edebilecek kadar yeterli düzeyde çözmüş olduğuna” inanmadığını belirtti.

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir