Anthropic, biyolojik silah geliştirmek amacıyla Claude yapay zeka modelini kullanmaya çalışmış olabilecek hesapları engellediğini açıkladı. Şirket, bu bulguları kamuoyuyla paylaşarak, giderek daha güçlü dijital asistanların insanlığın yok oluşuna yol açma potansiyeline ilişkin yapay zeka uzmanlarının uyarılar yayınlamasından yalnızca birkaç gün sonra yürüttüğü soruşturmanın sonuçlarını duyurdu.
Öne çıkanlar
• Anthropic yayımladığı raporda, Claude’dan bilimsel araştırma fonu başvurusu hazırlamaya yardımcı olmasını isteyen bir talebi engellediğini söyledi. Söz konusu fonun, sivrisineklerle bulaşan chikungunya virüsü üzerinde genetik değişiklik araştırmalarına aktarılması planlanıyordu.
• Anthropic’e göre fon başvurusu, ölüm oranı çok düşük olan ancak uzun süreli eklem ve kas ağrılarına neden olan virüsün daha zararlı hale getirilmesini amaçlıyordu. Şirket bununla birlikte, benzer araştırmaların virüse karşı aşı veya tedavi geliştirilmesinde de kullanılabileceğini aktardı.
• Ancak araştırma, virüsü daha tehlikeli hale getirmek için de kullanılabilirdi. Anthropic, proje sivil araştırmacıların katılımını öngörüyor gibi görünse de araştırmanın bir askeri araştırma enstitüsünde yürütülmesinin planlandığını belirterek, projenin göründüğü kadar zararsız olmadığı kanaatine vardı.
• Anthropic, olaya dahil olmuş olabilecek kurumların veya araştırmacıların isimlerini ya da bağlantılarını açıklamadı. Şirket, bağlantılı tüm hesapları yasakladığını, bölgesel engellemelerini aşmak için kullanılan aktarım ağlarını kapattığını ve elde ettiği bulguları yapay zeka laboratuvarları ile ABD hükümetiyle paylaştığını belirtti.
• Anthropic raporunda, “Bu araştırma materyallerinin varlığından, araştırma girişiminin yalnızca bir fon başvurusuyla sınırlı olmadığı sonucunu çıkarıyoruz” ifadelerine yer verdi. Şirket, “Bu faaliyet kümesiyle bağlantılı olduğunu tespit ettiğimiz hesapları engelliyoruz ve araştırma bulgularımızı, söz konusu aktörlerin Anthropic hizmetlerini kötüye kullanmasını tespit edip önlemeye yönelik yeni tedbirlere dahil etmeye devam ediyoruz” dedi.
Arka plan
Eski bir OpenAI ve Anthropic çalışanı ile halen Anthropic’te görev yapan bir çalışan, bu hafta yapay zekanın gelecek 10 yıl içinde insanlığın yok olmasına yol açabileceğini belirtti. Anthropic’te yapay zeka işlevlerini insan hedefleri ve değerleriyle uyumlu hale getirme çalışmalarını yöneten Evan Hubinger, gelişmelerin hızla artan bu tempoda devam etmesi halinde 10 yıl içinde “yapay zekanın tüm insanları öldürebileceği” ihtimalinin yüzde 10’dan fazla olduğuna kişisel olarak inandığını söyledi.
Hubinger’ın bu tahmini, kısa süre önce Anthropic’ten ayrılan şirket araştırmacısı Jacob Coxon’ın bir paylaşımına yanıt olarak yapılmıştı. Coxon, yapay zeka şirketlerinin “kendini geliştiren süperzekaya doğru hızla ilerleyerek ve hayatlarımızla kumar oynayarak” sorumlu davranmadığını öne sürmüştü. Coxon ayrıca yapay zeka alanında çalışan araştırmacıların, teknolojinin “2030'a kadar hepimizi öldürebileceğine” inandıklarını ve yaptığı açıklamaların bir “pazarlama gösterisi” olmadığını söylemişti.
Coxon ve Hubinger’ın paylaşımları, ABD'li yetkililerin “Yapay Zeka Acil Kapatma Anahtarı Yasası” çıkarılması yönünde çağrılarda bulunmasına yol açtı. Vermont Senatörü Bernie Sanders, süperzekayı yasaklayacak ve yapay zeka geliştirme çalışmalarına ara verecek bir yasa tasarısı sunma sözü verdi. ABD Başkanı Donald Trump ise ABD’de yapay zeka geliştirilmesinin güçlü bir destekçisi oldu. ABD’deki toplulukları veri merkezi inşaatlarını kabul etmeye teşvik etti ve Çin’e karşı yürütülen yapay zeka yarışını destekledi.