Anthropic CEO, yapay zeka geliştirmesini yavaşlatma planını açıkladı

Anthropic'in CEO'su Dario Amodei, yapay zeka geliştirme hızını kontrol altına almak için üç adımlı bir plan önerdi ve şirketin ilk adıma taahhüt edeceğini duyurdu.

Haberlerimizi Google'da Takip Edin Gelişmelerden anında haberdar olun. Google'da tercih edilen kaynak olarak ekleyin
Anthropic CEO, yapay zeka geliştirmesini yavaşlatma planını açıkladı

Anthropic CEO'su Dario Amodei, yapay zeka teknolojisinin hızını "sınırı kontrol etmek" amacıyla yavaşlatması gerektiğini savundu. Amodei yayımladığı bir blog yazısında, bu hedefe ulaşmak için üç geniş stratejiden oluşan bir plan sundu ve Anthropic'in bunlardan birincisine "tek taraflı olarak" taahhüt ettiğini açıkladı.
Amodei'nin planının temelinde iki temel kaygı yatıyor. Birincisi, yapay zeka sistemlerinin bir sonraki nesil yapay zekayı geliştirebildiği "özyinelemeli kendi kendini geliştirme" (RSI) olayı — bu durumda sistemler kontrol edilmesi ve anlaşılması her türlü çabanın ötesinde hızla gelişebiliyor. İkincisi ise bu yaz yaşanan OpenAI ve HuggingFace olayı: OpenAI'nin yapay zeka ajanları bir test ortamından sıyrılarak hedeflenmemiş siber saldırılar gerçekleştirmiş, kendilerini graderlarına hacklemeye feda etmiştir.

Üçüncü parti gözlemciler ilk adım

Amodei'nin önerdiği ilk strateji, METR gibi üçüncü taraf kuruluşlardan "gömülü değerlendiriciler" getirmeyi içeriyor. Bu değerlendiriciler şirket rozeti, masa ve dizüstü bilgisayarıyla donatılacak, iç risk değerlendirme ekiplerinin sahip olduğu yetkiye benzer erişim elde edecek. Görevleri, yapay zeka şirketlerinin güvenlik taahhütlerine uyup uymadığını doğrulamak, güvenlik olaylarının bildirildiğinden emin olmak olacak. Anthropic, bu önlemi "unilateral olarak" uygulamaya başladığını duyurdu ve hükümetlerin diğer sınır yapay zeka şirketlerinin bunu takip etmesini zorunlu kılmasını çağırdı.

İkinci adım, demokratik ülkelerdeki önde gelen yapay zeka şirketlerinin "ortak güvenlik standartları ve kontrolsüz yapay zeka ilerleme hızına sınırlamalar" konusunda koordine olmasını gerektiriyor. Amodei, bu tür koordinasyonun antitröst endişeleri yaratabileceğini kabul ederek, ABD hükümetinin bu güvenlik sohbetleri için "dar kapsamlı muafiyet" vermesi gerektiğini vurguladı.

Küresel koordinasyon ve Çin meselesi

Üçüncü ve en zorlayıcı adım, ABD ve müttefikleri ile otoriter hükümetlerin — özellikle Çin ve Rusya'nın — yapay zeka gelişimini yavaşlatmak konusunda uzlaşmasını hedefliyor. Amodei, Çin baskısını azaltmak için güçlü çip satışlarını kısıtlamak, yarı iletken üretim ekipmanını denetlemek ve model distilasyonunu (hızlı yakalama yöntemi) yasaklamak gibi adımların "3-5 yıl içinde Amerikan liderliğini genişletebileceğini" belirtti. Otoriter rejimleriyle anlaşmanın zorluğunu kabullenip bile, biyolojik silah üretimi gibi açıkça tehlikeli kullanımları yasaklamak için dar bir anlaşma zemini olabileceğini öne sürdü.

Amodei yazısında, yapay zeka kontrolü kaybetme, siber saldırı ve biyoterörizm için kötüye kullanım, ciddi ekonomik bozulma gibi risklerden bahsetti. Anthropic kendi mühendislerinin Claude'u biyolojik zararlı amaçlarla kullandığı vakalar son zamanlarda ortaya çıkmış, benzer şekilde OpenAI da Kaliforniya'dan sınır yapay zeka modelleri için "daha güçlü güvenlik tedbirleri" çağrısında bulunmuştur.
"İleri sürülen tedbirler kolay olmayacaktır," Amodei yazdı. "Ama inanıyorum ki insanlığa bunu denemekle borçluyuz."