Claude Okulu
← Tüm haberler
Anthropic · 26 Temmuz 2026 · TR

Açık ağırlıklı modeller hakkındaki pozisyonumuz

Anthropic CEO'su Dario Amodei açık ağırlıklı modeller hakkında konuşuyor

Açık ağırlıklı modeller hakkındaki pozisyonumuz

Anthropic CEO'su Dario Amodei tarafından yazılan bir yazı

Son günlerde, özellikle Çin'den gelen modeller olmak üzere, açık ağırlıklı modeller hakkında yoğun tartışmalar yaşanıyor. Haberlere göre bazı ABD yetkililer, ABD şirketlerinin Çin kaynaklı açık ağırlıklı modelleri kullanmasını yasaklamayı düşünüyor. Buna karşılık, birçok teknoloji şirketi açık ağırlıklı modelleri destekleyen bir mektup imzaladı ve bazı kişiler Anthropic'in işini korumak için açık ağırlıklı modelleri yasaklamak istediğini iddia ettiler. Daha önceki yazılarımı okuyanlar bilir ki, ben bu tür yasaklamaları yararlı bir önlem olarak görmüyorum, fakat şüphe olmamak üzere açıkça belirtmek istiyorum: Anthropic hiçbir zaman açık ağırlıklı modellerin yasaklanması için lobi yapmamıştır.

Tehliekli yetenekler taşımayan açık ağırlıklı modeller bir kamusal malıktır: bunları çalıştırmak için gerekli işlem gücü dışında herhangi bir maliyeti yoktur ve işletmeler, geliştiriciler ve araştırmacılara değer sağlarlar.

Korunmacı yasaklar benim en ciddi ulusal güvenlik endişelerimi çözmez. Özel olarak, iki kabus senaryosu hakkında endişe duyuyorum. Bunları altı ay önce Teknolojinin Ergenliği başlıklı yazımda ortaya koydum ve birçok yıldır bu konumları tutarlı bir şekilde korudum:

  1. Benim asıl endişem, otoriter hükümetlerin—sadece Çin Komünist Partisi (CCP) değil, ancak CCP açıkça en yetkin tehdit olsa da—ABD tarafından inşa edilenlerden daha güçlü yapay zeka modelleri inşa etmesi ve bunları kalıcı askeri üstünlük elde etmek ya da kendi halklarının inanılmaz bir şekilde derin baskısını uygulamak için kullanması riskidir. Bu endişe ABD hükümeti içinde yaygın olarak paylaşılır: Başkan Yardımcısı Vance geçen yıl Paris'te "otoriter rejimlerin yapay zekayı çalmış ve askeri, istihbarat ve gözetim yeteneklerini güçlendirmek için kullanmış olduğu" uyarısında bulundu ve İstihbarat Topluluğu'nun 2026 Yıllık Tehdit Değerlendirmesi "diğer küresel güçlerin yapay zekada sağlam ilerleme ABD ekonomik rekabet gücü ve ulusal güvenlik avantajlarına meydan okuduğunu" buldu. Bu modellerin açık ağırlıklarla yayınlanıp yayınlanmadığı irrelevant'tır ve kuşkusuz ABD işletmeleri tarafından kullanılıp kullanılmadığı da irrelevant'tır. Gerçekten, en tehlikeli model, gizli bir şekilde eğitilen ve yalnızca Halk Kurtuluş Ordusu'na insansız hava araçlarında kullanılmak üzere ve Devlet Güvenlik Bakanlığı'na gözetim ve baskı için teslim edilen bir model olabilir.
  1. Benim ikincil endişem, güçlü yapay zeka modellerinin siber saldırılar veya biyolojik saldırılar gerçekleştirmek için kötüye kullanılması ve ciddi hizalama sorunları olabilmesi riskidir. Açık ağırlıklı modeller—Çin'den gelse ya da başka bir yerden gelse—potansiyel olarak kapalı modellere göre daha yüksek bir risk sunarlar, çünkü bunlara korkuluğu uygulamak veya kullanımlarını izlemek çok zordur ve ağırlıklar yayınlandıktan sonra geri çekilemez. Ancak bu modelleri ABD işletmeleri tarafından kullanmayı yasaklamak bu riski çözmez, çünkü kötü niyetli aktörlerin meşru ABD işletmeleri olması olası değildir. Bu, ABD yapay zeka şirketlerini rekabetten korur, ancak bu hiçbir zaman benim hedefim olmamıştır.

Bu endişeleri gidermek için, ben ben ve Anthropic tutarlı bir şekilde savunduğum aşağıdaki üç önlemi desteklerim:

  • Güçlü çipleri veya çip üretim ekipmanını Çin'e satmamalıyız ve bu çiplere erişim elde etmek için kullanılan yoğun kaçakçılık ve geçici çözümlere karşı harekete geçmeliyiz. Çin'in sınırlı yerli üretim kapasitesi vardır ve bu nedenle ölçeklendirme yasaları nedeniyle Çin ABD çipleri olmadan ABD'den daha güçlü modeller inşa edemez. Bu tehdit #1'i engellemenin en verimli ve doğrudan yoludur ve Çin'in eğittiği modelleri ABD yasalarının erişim alanı dışında tutarak, bunun dolaylı olarak tehdit #2'de de yardımcı olur.
  • Endüstriyel ölçekte distilasyon operasyonlarını bastırmalıyız. Distilasyon, modelləri sıfırdan eğitmekten çok daha hesaplama açısından verimli bir işlemdir. Çin'in sahip olduğu çip sayısının normalde sağlayacağından çok daha iyi modeller inşa etmesini sağlar ve böylece kısmen çip yasağından kaçınır. Distilasyon, CCP'nin ABD'ye eşdeğer veya üstün yapay zeka yetenekleri elde etmesini sağlamaz, ancak Çin sınırını ABD sınırının birkaç ay içine getirebilir. Bu operasyonları gerçekleştiren şirketlerin çoğunun açık ağırlıklı modeller yayınlaması doğru—ancak açık ağırlıklar, operasyonların ABD'nin sınırını geçmek isteyen bir otoriter devlet tarafından destekleniyor olgusundan çok daha az ilgilidir. Bu davranışı caydırmak için politika müdahaleleri olmalıdır. Açık ağırlıklı modellere kapsamlı bir yasak ne doğru çözümdür ne de bizim talep ettiğimiz şeydir.
  • Tüm yeterince yetkin modeller, açık ve kapalı, zorunlu güvenlik testinden geçmelidir. Tehdit #2'yi ele almanın en iyi yolu, yayınlanmadan önce modelleri siber, biyolojik ve hizalama riskleri açısından test etmektir. Bu fikrin aslında konsensüse yakın olduğunu düşünüyorum: Trump yönetiminin son aylarda bu yönde hareket etmesinden ve yakın zamanda menşei veya açık olup olmayıp olmadığı ne olursa olsun en yetkin modellere uygulanacak ancak startuplar ve akademiden gelen daha az yetkin modelleri tamamen muaf tutacak endüstri önerilerinden mutlu oldum. Açık modellerin artan bir risiko taşıyıp taşımadığı ve bu riskin azaltılıp azaltılamayacağı, önceden karar vermek yerine testingden ortaya çıkması gereken bir şeydir—ve Anthropic'in modüler eğitim stratejileri hakkında yakın zamanda yaptığı araştırma da dahil olmak üzere açık ağırlıklı modellerin güvenliğini iyileştirmek için umut verici yöntemler olabilir. Etkili olmak için, testingin küresel olması gerekir; bu, CCP'nin de dahil edilmesi gerektiği anlamına gelir. Bunun aslında mümkün olabileceğini düşünüyorum: Teknolojinin Ergenliği'nde yazdığım gibi, yapay zeka biyolojik silahlarını önlemeye yönelik sınırlı işbirliği Çin'in çıkarına da uygun olduğu için mümkün olabilir.

Bu beni açık mektuba getiriyor. Birçok noktasında katılıyorum: açık ağırlıklar yapay zeka ekonomisine erişimi genişletir, en azından bazı kullanım durumları için rekabeti güçlendirir ve müşterilere daha fazla kontrol verir. Distilasyon hakkındaki endişeler, yukarıda açıkladığım aynı önlem aracılığıyla hedefli yasal ve ticari çerçevelerle ele alınmalıdır. Ancak mektubun açık ağırlıklı modellerin mutlaka korkuluğu geliştirmeyi kolaylaştırdığı veya geniş yeteneklere erişimin gözlemcileri saldırganlara göre daha çok yardımcı olduğu iddialarına katılmıyorum. Bana göre tersi olması en az o kadar olası görünüyor. Örneğin, biyoloji açısından güçlü saldırgan-savunma asimetrisine sahip olacağından endişe duyuyorum; burada yeterince yetkin modeller, yaygın olarak mevcut malzemeler kullanarak pandemi düzeyindeki virüsleri hızla silahlı hale getirebilir, oysa bu ajanlardan savunma en iyi durumda çok yıllık bir operasyonel görevdir (Operation Warp Speed'de gördüğümüz gibi). Bunun gibi sorular, önceden varsayılmak yerine, katı ön yayın testinginin deneysel yollarla cevaplanmalıdır.

Özetlersem, ben ve Anthropic pozisyonumuz, bir kategori olarak açık ağırlıklı modellerin yasaklanması için lobi yapmamış ve yapmayız. Bunun yerine güçlü çipleri otoriter ellerin dışında tutmaya, endüstriyel ölçekte distilasyonu durdurmaya ve tüm yeterince yetkin modellerin—açık ve kapalı—güvenlik testini gerektirmeye odaklanmalıyız.

Çeviri Claude Haiku 4.5 ile otomatik yapılmıştır. Alıntı veya tam ifade gerekiyorsa orijinal makaleyi esas alın.