Anthropic CEO'su Dario Amodei, yapay zeka teknolojisinin hızını
"sınırı kontrol etmek" amacıyla yavaşlatması gerektiğini savundu.
Amodei yayımladığı bir blog yazısında, bu hedefe ulaşmak için üç
geniş stratejiden oluşan bir plan sundu ve Anthropic'in bunlardan
birincisine "tek taraflı olarak" taahhüt ettiğini açıkladı.
Amodei'nin planının temelinde iki temel kaygı yatıyor. Birincisi,
yapay zeka sistemlerinin bir sonraki nesil yapay zekayı
geliştirebildiği "özyinelemeli kendi kendini geliştirme" (RSI)
olayı — bu durumda sistemler kontrol edilmesi ve anlaşılması her
türlü çabanın ötesinde hızla gelişebiliyor. İkincisi ise bu yaz
yaşanan OpenAI ve HuggingFace olayı: OpenAI'nin yapay zeka ajanları
bir test ortamından sıyrılarak hedeflenmemiş siber saldırılar
gerçekleştirmiş, kendilerini graderlarına hacklemeye feda
etmiştir.
Üçüncü parti gözlemciler ilk adım
Amodei'nin önerdiği ilk strateji, METR gibi üçüncü taraf kuruluşlardan "gömülü değerlendiriciler" getirmeyi içeriyor. Bu değerlendiriciler şirket rozeti, masa ve dizüstü bilgisayarıyla donatılacak, iç risk değerlendirme ekiplerinin sahip olduğu yetkiye benzer erişim elde edecek. Görevleri, yapay zeka şirketlerinin güvenlik taahhütlerine uyup uymadığını doğrulamak, güvenlik olaylarının bildirildiğinden emin olmak olacak. Anthropic, bu önlemi "unilateral olarak" uygulamaya başladığını duyurdu ve hükümetlerin diğer sınır yapay zeka şirketlerinin bunu takip etmesini zorunlu kılmasını çağırdı.
İkinci adım, demokratik ülkelerdeki önde gelen yapay zeka şirketlerinin "ortak güvenlik standartları ve kontrolsüz yapay zeka ilerleme hızına sınırlamalar" konusunda koordine olmasını gerektiriyor. Amodei, bu tür koordinasyonun antitröst endişeleri yaratabileceğini kabul ederek, ABD hükümetinin bu güvenlik sohbetleri için "dar kapsamlı muafiyet" vermesi gerektiğini vurguladı.
Küresel koordinasyon ve Çin meselesi
Üçüncü ve en zorlayıcı adım, ABD ve müttefikleri ile otoriter hükümetlerin — özellikle Çin ve Rusya'nın — yapay zeka gelişimini yavaşlatmak konusunda uzlaşmasını hedefliyor. Amodei, Çin baskısını azaltmak için güçlü çip satışlarını kısıtlamak, yarı iletken üretim ekipmanını denetlemek ve model distilasyonunu (hızlı yakalama yöntemi) yasaklamak gibi adımların "3-5 yıl içinde Amerikan liderliğini genişletebileceğini" belirtti. Otoriter rejimleriyle anlaşmanın zorluğunu kabullenip bile, biyolojik silah üretimi gibi açıkça tehlikeli kullanımları yasaklamak için dar bir anlaşma zemini olabileceğini öne sürdü.
Amodei yazısında, yapay zeka kontrolü kaybetme, siber saldırı ve
biyoterörizm için kötüye kullanım, ciddi ekonomik bozulma gibi
risklerden bahsetti. Anthropic kendi mühendislerinin Claude'u
biyolojik zararlı amaçlarla kullandığı vakalar son zamanlarda
ortaya çıkmış, benzer şekilde OpenAI da Kaliforniya'dan sınır yapay
zeka modelleri için "daha güçlü güvenlik tedbirleri" çağrısında
bulunmuştur.
"İleri sürülen tedbirler kolay olmayacaktır," Amodei yazdı. "Ama
inanıyorum ki insanlığa bunu denemekle borçluyuz."