Anthropic, yayımladığı "Detecting and Countering Misuse of AI" başlıklı raporda, kendi yapay zeka modellerinin biyolojik silah üretimine katkı sağlayabilecek araştırmalarda kullanılmasını engellediğini duyurdu. Şirkete göre son sekiz ay içinde, bulaşıcı hastalıklar üzerine araştırma yapmak için Claude sohbet botunu kullanan birkaç hesap yasaklandı.

Raporda aktarılan beş vakanın her birinde Anthropic, araştırmacıların yasaklı ülkelerden birinin hükümeti ya da ordusuyla bir şekilde bağlantılı olduğundan şüphelendi; bazı durumlarda ise kullanıcılar konumlarını veya kimliklerini gizlemek için bilinçli adımlar attı. Şirket araştırmacıların hangi ülkelerde bulunduğunu açıklamadı. Anthropic'in kullanım koşulları, Çin, İran ve Rusya dahil birkaç bölge dışındaki tüm kullanıma izin veriyor.

Örneklerden birinde araştırmacılar, sivrisineklerle bulaşan ve insanlarda şiddetli ağrı ile ateşe yol açan chikungunya virüsünün nasıl tekrar tekrar mutasyona uğratılacağını inceleyecek bir hibe başvurusunu tamamlamak için üçüncü taraf bir platform üzerinden Claude'dan yararlanmaya çalıştı. Anthropic, bir askeri enstitüde yürütülecek bu araştırmanın canlı hayvanlarda virüsü giderek daha bulaşıcı hale getirmeyi amaçladığını ve araştırmacıların tüm girişimlerini engellediğini belirtti.

Başka bir vakada bir araştırmacı, onaylanmış insan vakalarında tarihsel olarak yaklaşık %50 ölüm oranına sahip olan kuş gribini memeliler için daha virülan ve zararlı hale getirme çalışmasında Claude'dan destek aldı. Anthropic'e göre bu araştırmacı yalnızca Claude'un en zayıf model sınıfından yardım alabildi ve bu yardım büro işleriyle sınırlı kaldı.

Anthropic ne buldu, ne bulamadı?

Şirket, bir bilim insanının teknolojisini kötü niyetle kullanmaya çalıştığına dair somut bir örnek bulmadığını açıkça belirtti. Bu kullanım senaryolarının aşı ya da hastalıklara çare geliştirme gibi faydalı bilimsel araştırmaların parçası olabileceğini de ekledi. Buna rağmen Anthropic, ihtiyatlı davranmayı tercih ederek hesapları kapattı.

Rapor, "Biyolojik kötüye kullanım, öncü yapay zeka modellerinin en ciddi risklerinden biri" değerlendirmesini yapıyor. "Yapay zeka modellerinin bir gün mevcut patojenleri daha tehlikeli hale getirmeye ya da tamamen yeni patojenler yaratmaya yardımcı olacak yetenek seviyesine ulaşabileceği uzun süredir bir endişe kaynağı. Doğru güvenlik önlemleri olmadan bu tür yetenekler felaket sonuçlar doğurabilir."

Belge, önlemler uygulansa bile zarar verme niyetinde olanların bu önlemleri nasıl aşacakları konusunda daha da ustalaştığını ve meşru bilim görüntüsünü bunun için kullandığını kabul ediyor. Rapora göre gelişmiş tehdit aktörleri, sağlayıcıların tehlikeli kullanımları tespit etmeye çalıştığının farkında ve biyolojinin çift kullanımlı doğasından yararlanarak araştırmaları hakkında bir tür "makul inkar edilebilirlik" yaratıyor.

Rapor, teknolojinin kötü niyetli başka kullanımlarını da sıralıyor: Çin, İran ve Mali gibi hükümetlerin Claude'u gazeteciler ve muhalifler hakkında bilgi toplamak için kullandığı, bazı aktörlerin ise hackleme kampanyaları yürütmek, kimlik hırsızlığı operasyonlarını otomatikleştirmek ve kötü amaçlı yazılım üretmek için modelden yararlandığı belirtiliyor.

Anthropic, raporu yayımlayarak diğer geliştiricilerin kendi platformlarında benzer kalıpları tanımasına, hükümetlere ve sivil topluma yeni tehditlerin nasıl şekillendiğine dair daha net bir görüş sunmaya ve kolektif savunmaları güçlendirmeye katkı sağlamayı umduğunu ifade etti.

Neden önemli

Rapor, yapay zeka güvenliği tartışmasının merkezini model yeteneklerinden çıkarıp kullanımın tespiti ve engellenmesine kaydırıyor. Anthropic'in kendi anlatımına göre savunma tarafı, saldırganların meşru bilim görüntüsü ardına saklanması nedeniyle yapısal bir dezavantaj taşıyor: şirket, kötü niyet kanıtı bulamadığı durumlarda bile hesapları kapatmayı seçtiğini söylüyor. Bu, öncü model sağlayıcılarının hem araştırma özgürlüğü hem de biyogüvenlik arasında karar vermek zorunda kaldığı bir alan yaratıyor.

Tartışmanın siyasi ayağı da aynı hafta içinde hareketlendi. Senatör Bernie Sanders ve Temsilci Greg Casar tarafından açıklanan ve insan bilişini aşan "süper zeka" yapay zeka geliştirilmesini kalıcı olarak yasaklamayı, sektörü düzenleyecek federal bir kurum kurulana kadar ileri yapay zeka geliştirmesini duraklatmayı öneren yasa tasarısına, Data for Progress'in anketine göre ABD'deki muhtemel seçmenlerin %68'i destek veriyor.

Casar, Anthropic'in kendi kullanıcılarını potansiyel biyolojik silah üretiminden alıkoymak zorunda kalmasının düzenleme ihtiyacını gösterdiğini savundu: "Şu anda kitle imha silahlarını engellemek için yapay zeka şirketlerinin gönüllü davranmasına güveniyoruz. Gönüllü olarak." Casar'a göre Kongre'nin yapması gereken açık: biyolojik veya nükleer silah üretimi gibi felaket düzeyinde yapay zeka kullanımlarını yasaklamak.

Bu tablo, gönüllü güvenlik taahhütleri ile bağlayıcı düzenleme arasındaki gerilimin önümüzdeki dönemde yapay zeka politikasının ana ekseni olacağını gösteriyor. Sağlayıcıların kendi platformlarında uyguladığı tespit ve engelleme mekanizmaları, düzenleyici çerçevenin hem teknik referansı hem de siyasi gerekçesi haline geliyor.