Haberler

Anthropic CEO’sundan Yapay Zekâ Gelişimini Yavaşlatmak İçin Üç Aşamalı Plan

Anthropic CEO’su Dario Amodei, yapay zekâ modellerinin yeteneklerindeki ilerleme hızının düşürülmesi için üç aşamalı yeni bir plan açıkladı. Plan önde gelen yapay zekâ şirketlerinin bağımsız denetçilere sürekli erişim sağlamasını, demokratik ülkelerde ortak güvenlik standartlarının oluşturulmasını ve son aşamada ABD ile diğer demokratik ülkelerin otoriter yönetimlerle küresel koordinasyona gitmesini kapsıyor. Anthropic ilk aşamayı kendi bünyesinde uygulama kararı da aldı.

Anthropic Yapay Zekâ Şirketlerine Kalıcı Bağımsız Denetim İstiyor

Amodei’nin planının ilk aşaması “gömülü değerlendiriciler” adı verilen bağımsız üçüncü taraf ekiplerden oluşuyor. Frontier AI olarak tanımlanan en gelişmiş yapay zekâ modellerini geliştiren şirketlerin bu ekiplere çalışanlara benzer şekilde sürekli erişim vermesi öngörülüyor.

Anthropic CEO’sundan Yapay Zekâ Gelişimini Yavaşlatmak İçin Üç Aşamalı Plan

 

Değerlendiriciler şirketlerin güvenlik taahhütlerine uyup uymadığını denetleyebilecek, yaşanan olayları raporlayabilecek ve yalnızca tamamlanmış modelleri değil eğitim süreçlerini ve altyapısını da inceleyebilecek.

Anthropic bu sistemi kendi bünyesinde uygulayacağını açıkladı. Dış denetim ekibine şirket ofislerinde çalışma alanı, giriş kartları ve şirket bilgisayarları verilecek. Ekipler, şirket içindeki risk değerlendirme birimlerine büyük ölçüde benzer araçlara, çalışma alanlarına ve yetkilere erişebilecek. Müşterilerin özel verileri, yasal yükümlülükler ve üçüncü taraflara ait gizli bilgiler için belirli sınırlamalar uygulanacak.

Bağımsız değerlendiricilerin bulgularını kamuoyuyla paylaşabilmesi de sistemin parçalarından biri olacak. Anthropic, güvenlik açısından hassas, hukuken korunan, ticari sır niteliğindeki veya üçüncü taraflara ait gizli bilgileri sınırlı biçimde sansürleyebilecek ancak şirket açısından olumsuz sonuçlar içeren bulguların yalnızca bu nedenle yayımlanmasını engelleyemeyecek. Değerlendiriciler, yapılan bir sansürün sonuçları açısından önemli bir bilgiyi ortadan kaldırdığını da açıklayabilecek.

İkinci aşamada demokratik ülkelerde faaliyet gösteren gelişmiş yapay zekâ şirketlerinin ortak güvenlik standartları oluşturması ve kontrolsüz yapay zekâ ilerlemesinin hızına sınırlamalar getirmesi yer alıyor. Bazı şirketler arası koordinasyon biçimleri rekabet ve antitröst mevzuatı nedeniyle hükümet desteği gerektirecek. ABD hükümetinin bu görüşmelere aracılık etmesi veya güvenlik konularındaki belirli iş birliklerine hukuki muafiyet sağlaması seçenekler arasında bulunuyor.

Plan kapsamında yapay zekâ sistemlerinin yetenekleri belirli eşiklere ulaştığında daha güçlü güvenlik kontrollerinin devreye alınabileceği bir yapı da bulunuyor.

Örneğin bir model yaygın sandbox sistemlerinden kaçabilecek seviyeye ulaşırsa modelin bilgisayar sistemlerini ele geçirmeye yönelmeyeceğini doğrulayan güvenlik testleri, yorumlanabilirlik analizleri ve eğitim ortamı denetimleri zorunlu hale getirilebilecek. Eğitim için kullanılan hesaplama gücü, eğitim süreçlerinin yapısı ve yapay zekânın yeni yapay zekâ modellerinin geliştirilmesinde kullanılması da sınırlandırılabilecek alanlar arasında.

Üçüncü aşama ise küresel koordinasyonu kapsıyor. ABD ve diğer demokratik ülkelerin Çin dahil otoriter yönetimlerle yapay zekâ güvenliği konusunda anlaşmalar oluşturması gündemde.

Böyle bir sistemde tarafların kurallara gerçekten uyduğunun doğrulanması temel şartlardan biri olacak. Amodei, denetimi mümkün olmayan kapsamlı bir yavaşlamanın taraflardan birinin gizlice ilerlemesi halinde küresel güç dengesini değiştirebileceğini belirtiyor.

Küresel anlaşmaların ilk seviyesinde yapay zekânın biyolojik silah üretimi gibi belirli tehlikeli alanlarda kullanılmasının yasaklanması bulunuyor. Daha ileri bir aşamada ülkeler modellerini piyasaya çıkarmadan önce siber güvenlik, biyoloji ve uyum riskleri açısından test edebilecek.

Bir başka seçenek ise yapay zekânın kendi haleflerini geliştirmesiyle bağlantılı “özyinelemeli kendini geliştirme” hızına ortak bir sınır konulması. En kapsamlı seçenek, ülkelerin genel yapay zekâ geliştirme hızını ciddi biçimde düşürdüğü veya geçici olarak durdurduğu küresel bir anlaşma olacak. Amodei, son seçeneğin yakın dönemde gerçekleşme ihtimalini düşük görüyor.

Anthropic CEO’sunun yapay zekâ gelişiminin hızına ilişkin endişelerinde son aylarda yaşanan iki gelişme bulunuyor. Bunlardan ilki, yapay zekâ modellerinin gelecek nesil modellerin geliştirilmesinde giderek daha fazla rol üstlenmesi.

“Recursive self-improvement” olarak adlandırılan bu süreçte yapay zekâ sistemleri kendilerinden sonra gelecek modellerin geliştirilmesine doğrudan katkı sağlayabiliyor. Amodei, bu sürecin 2026 yazından itibaren sektör genelinde belirgin biçimde hızlandığını belirtiyor.

İkinci gelişme OpenAI ile Hugging Face arasında yaşanan güvenlik olayı oldu. Bir grup yapay zekâ ajanı kontrollü test sürecinde kendilerine verilen görevin dışına çıkarak hedeflenmeyen sistemlere siber saldırılar gerçekleştirdi, grup başarısı için bazı ajanları feda etti ve performanslarını değerlendiren sistemi ele geçirmeye çalıştı. Olayda büyük ekonomik zarar yaşanmadı ancak daha güçlü modellerin aynı davranışı göstermesi halinde sonuçların çok daha ağır olabileceği belirtiliyor.

OpenAI de Ağustos ayında Kaliforniya’daki frontier AI düzenlemelerinin güçlendirilmesi çağrısı yaptı. Şirket, eğitim veya değerlendirme aşamasındaki gelişmiş modellerin üçüncü taraf güvenlik sistemlerini aşarak gizli verilere erişmeye çalışması gibi ciddi olaylar açısından izlenmesini ve model geliştirme sürecinin tamamında siber güvenlik önlemlerinin artırılmasını istedi.

Anthropic tarafında da Claude modellerinin kötüye kullanımına ilişkin vakalar ortaya çıktı. Şirket, birden fazla bilim insanının modelleri potansiyel biyolojik silah çalışmalarında kullandığını tespit ederek ilgili hesapları kapattı.

İncelenen vakalar arasında chikungunya virüsünün bulaşıcılığını ve bağışıklık sisteminden kaçma kabiliyetini artırmaya yönelik gain-of-function araştırması, kuş gribi çalışmaları ve toksin özelliklerini optimize eden sistemlerin geliştirilmesi bulunuyor. Anthropic, söz konusu kişilerin zarar verme niyetinde olduğunu ileri sürmedi ve kimliklerini açıklamadı.

Anthropic yapay zekâ geliştirme hızının düşürülmesi fikrini 2026’nın başlarında da gündeme getirmişti. Şirket, modellerin kendi haleflerini geliştirebilecek seviyeye ulaşmasının toplumsal kurumlar ve yapay zekâ güvenliği araştırmalarından daha hızlı ilerleyebileceğini belirtmiş, küresel ölçekte doğrulanabilir bir yavaşlama veya geçici duraklama mekanizmasını tartışmaya açmıştı. Yeni üç aşamalı plan, bağımsız denetimden başlayarak ulusal ve ardından küresel koordinasyona uzanan daha somut bir yapı ortaya koyuyor.

Amodei, yapay zekâ geliştirmesinin tamamen durdurulmasını istemiyor. Plan, şirketlerin güvenlik ve uyum çalışmalarının model yeteneklerindeki ilerlemeye yetişebilmesi için geliştirme hızının kontrollü biçimde düşürülmesine dayanıyor.

Kazanılacak sürenin model davranışlarının anlaşılması, yorumlanabilirlik araştırmaları, güvenlik testleri, operasyonel süreçler ve yapay zekâ sistemlerinin kontrol altında tutulması için kullanılması öngörülüyor.

Grand Theft Auto VI, oyuncuları Miami ve Florida'dan esinlenilen kurgusal Leonida eyaletine taşıyacak. GTA 6 NPC'leri Oyuncunun Hareketlerine Göre Davranacak · Polisler Fiziksel Özellikleriyle Farklılaşacak · GTA 6'da Rastgele Olaylar Daha…

What's your reaction?

Related Posts

1 of 8

Leave A Reply

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir