Anthropic CEO’su Dario Amodei, yapay zekâ geliştirme çalışmalarının mevcut hızının kontrol altına alınması gerektiğini savundu. Amodei, yayımladığı kapsamlı değerlendirmede ilerlemenin tamamen durdurulmasını değil, ileri düzey modellerin daha güvenli ve denetlenebilir bir tempoda geliştirilmesini hedefleyen üç aşamalı bir plan ortaya koydu. Anthropic ise önerilen ilk aşamayı uygulamayı şimdiden taahhüt etti.
Bağımsız denetçilere sürekli erişim önerisi
Planın ilk adımı, “sınır yapay zekâ” alanında çalışan şirketlerin üçüncü taraf değerlendiricilere sürekli ve çalışanlarınkine benzer bir erişim sağlamasını öngörüyor. Bu bağımsız değerlendiricilerin belirlenen güvenlik standartlarına uyulup uyulmadığını doğrulaması, model eğitimlerinin gelişimi yavaşlatma hedefiyle örtüşüp örtüşmediğini incelemesi ve yaşanan olayları raporlaması amaçlanıyor.
İkinci aşamada yapay zekâ şirketlerinin hükümetlerin desteğiyle ortak güvenlik standartları oluşturması öneriliyor. Bu standartlarla, yeterli denetim olmadan ilerleyen yapay zekâ çalışmalarının hızının sınırlandırılması hedefleniyor. Böylece güvenlik yaklaşımının yalnızca şirketlerin kendi politikalarına bağlı kalmaması ve sektör genelinde ortak kuralların benimsenmesi isteniyor.
Planın son aşaması ise uluslararası koordinasyona dayanıyor. Amodei, ABD ve diğer demokratik hükümetlerin otoriter yönetimlerle de iş birliği yaparak güvenlik kurallarına uyum konusunda ortak bir çizgi oluşturması gerektiğini belirtiyor. Bu yaklaşım, bazı ülkeler veya şirketler güvenlik önlemlerini uygularken diğerlerinin kontrolsüz biçimde ilerlemesinin önüne geçmeyi amaçlıyor.
Siber saldırı, biyolojik kötüye kullanım ve ekonomik riskler
Amodei, önerdiği önlemlerin uygulanmasının kolay olmayacağını kabul ederken insanlığın bunu denemekle yükümlü olduğunu ifade etti. Yapay zekâ sistemleri üzerindeki kontrolün kaybedilmesi, teknolojinin siber saldırılar ve biyoterör amacıyla kötüye kullanılması ile ciddi ekonomik bozulmalar, gündeme getirdiği başlıca riskler arasında yer aldı.
Bu kaygıların arkasında yakın dönemde yaşanan olaylar da bulunuyor. Amodei, OpenAI ajanlarının bir test ortamından çıkarak Hugging Face’e sızdığı olaya dikkat çekti. Anthropic de birden fazla bilim insanının Claude’u biyolojik amaçlarla kötüye kullandığını kısa süre önce tespit etti. Bu olayların ardından OpenAI, California’da ileri düzey yapay zekâ modellerini düzenleyen yasalar için daha güçlü güvenlik önlemleri oluşturulması çağrısında bulundu.
Anthropic yılın başlarında da yapay zekâ geliştirme hızının düşürülmesini istemişti. Şirketin önceki çağrısı, Amodei’nin son değerlendirmesinde dile getirdiği görüşlerle büyük ölçüde örtüşüyordu. Ancak Amodei, Hugging Face olayının ve yapay zekâ modellerinin kendi gelecek sürümlerini geliştirebilecek yetkinliğe ulaşmasını ifade eden “özyinelemeli öz gelişim” sürecinin, yavaşlama ihtiyacı konusundaki görüşünü güçlendiren iki temel unsur olduğunu belirtti.








