Cuma, 18 Eylül 2026Köşesiz. Yorumsuz. Sadece haber.

Anthropic, yapay zeka gelişim hızını ölçen üç yeni metriği açıkladı

Anthropic, yapay zeka gelişim hızını ölçen üç yeni metriği açıkladı

cnbc.com

WhatsAppXE-Posta

Yapay Zeka Gelişim Hızını Ölçen Üç Yeni Metrik

Yapay zeka şirketi Anthropic, gelişmiş modellerin kendi kendilerini geliştirme sürecini ve güvenlik denetimlerini takip etmek amacıyla üç temel ölçüt paylaştı. Şirket Üst Yöneticisi Dario Amodei’nin küresel yapay zeka yarışında koordineli bir yavaşlama çağrısı yapmasının ardından açıklanan veriler, sektörün geleceğine dair somut göstergeler sunuyor. Paylaşılan metodolojiler, yapay zeka destekli araştırma ve geliştirme oranlarını, otonom ajanların denetimini ve işlem gücü tahsisini kapsıyor.

Şirket yetkilileri, sınır modeller geliştiren laboratuvarların elindeki bilgiler ile kamuoyunun bildikleri arasındaki farkı kapatmayı hedeflediklerini açıkladı. Üretim süreçlerinin ölçülmesiyle birlikte yapay zeka sistemlerinin taşıdığı risklerin daha net görülebileceği vurgulandı.

Claude Modeli Araştırma İşlerinin Dörtte Birini Yürütüyor

Açıklanan ilk metriğe göre, şirketin en gelişmiş yapay zeka modeli Claude, model araştırma ve geliştirme süreçlerinde giderek daha etkin rol alıyor. Bağımsız otomasyon ölçeklerine dayanan verilere göre Claude, Ağustos 2026 itibarıyla şirket bünyesindeki Ar-Ge çalışmalarının yüzde 26’sına liderlik ediyor. Bu seviye, yapay zekanın insan gözetiminde yüksek seviyeli komutlarla karmaşık işleri uçtan uca tamamlayabildiği anlamına geliyor.

Veriler, Claude’un henüz hiçbir süreçte tam otonom çalışmadığını gösteriyor. Buna karşın, Ar-Ge faaliyetlerinin yüzde 90’ından fazlası insan ve yapay zeka iş birliğiyle yürütülüyor. Claude’un Ar-Ge süreçlerindeki liderlik payının Mart 2026’da yalnızca yüzde 1 seviyesinde bulunması, gelişme hızındaki artışı ortaya koyuyor.

Otuz Bin Otonom Ajan İçin Kesintisiz Denetim Sistemi

Paylaşılan ikinci ölçüt, sistemler üzerinde görev yapan yapay zeka ajanlarının denetim mekanizmalarını odağına alıyor. Ana dahili platformda aynı anda yaklaşık 30 bin yapay zeka ajanının araştırma ve mühendislik işleri yürüttüğü açıklandı. Bu ajanların olası tehlikeli eylemlerini önlemek için iki aşamalı denetim mimarisi uygulanıyor.

Çevrim içi izleyiciler, ajanların gerçekleştirdiği tüm eylemleri saniyeler içinde kontrol ederek model ağırlıklarının dışarı aktarılması gibi geri döndürülemez riskleri engelliyor. Ağustos 2026’da analiz edilen 1 milyardan fazla karardan yalnızca yüzde 0,002’si güvenlik duvarları tarafından engellendi. Çevrim dışı denetleyiciler ise uzun vadeli uyumsuzluk risklerini tespit etmek amacıyla haftalık bazda yaklaşık 100 bin işlem günlüğünü tarıyor.

Güvenlik Çalışmalarına Ayrılan İşlem Gücü Bütçesi

Üçüncü metrik kapsamında Temmuz 2026’daki bir haftalık dönemde kullanılan tüm işlem gücü kaynaklarının dağılımı incelendi. Yapılan analizde, yapay zeka Ar-Ge süreçlerine harcanan toplam işlem gücünün yaklaşık yüzde 6’sının doğrudan güvenlik araştırmalarına ayrıldığı belirlendi. Yapay zeka tarafından yürütülen Ar-Ge projelerinde ise bu oran yüzde 12 seviyesine yükseldi.

Hesaplamaların muhafazakar bir yaklaşımla yapıldığı ve doğrudan güvenlik filtrelerini içeren ayrıştırıcı sistemlerin bu bütçeye dahil edilmediği bildirildi. İşlem gücü tahsisinin şeffaf şekilde paylaşılması, ilerleyen dönemlerde yapay zeka laboratuvarlarının güvenlik taahhütlerini doğrulayabilmesi açısından kritik bir araç olarak görülüyor.

Bağımsız Denetçiler ve Sektörel Şeffaflık Çağrısı

Anthropic, ölçüm sonuçlarını doğrulamak ve güvenilirliği artırmak amacıyla bağımsız üçüncü taraf denetçileri kurum bünyesine dahil etmeyi planlıyor. Dışarıdan atanacak bu uzmanlar, dahili risk değerlendirme ekipleriyle aynı yetkilere sahip olarak güvenlik uygulamalarını doğrulayacak ve kilit metrikleri takip edecek.

Yapay zeka teknolojisinde koordineli yavaşlama önerisi sektör genelinde tartışılmaya devam ederken, diğer yapay zeka geliştiricilerinin de benzer verileri düzenli olarak açıklaması isteniyor. Sektördeki bazı liderler yavaşlama fikrine destek verirken, siyasi ve ticari çevrelerde bu öneriye karşı çıkan görüşler de bulunuyor.

Sıkça Sorulanlar

Anthropic'in açıkladığı üç yeni metrik neleri kapsıyor?

Yeni metrikler; yapay zekanın Ar-Ge süreçlerini ne kadar yürüttüğünü, otonom yapay zeka ajanlarının denetim mekanizmalarını ve işlem gücünün ne kadarının güvenlik araştırmalarına ayrıldığını kapsıyor.

Claude modeli Anthropic Ar-Ge çalışmalarının ne kadarına liderlik ediyor?

Claude, Ağustos 2026 itibarıyla Anthropic bünyesindeki Ar-Ge çalışmalarının yüzde 26'sına insan gözetimi altında liderlik etmektedir. Çalışmaların yüzde 90'ından fazlası ise insan ve yapay zeka iş birliğiyle yürütülmektedir.

Anthropic'in otonom ajan denetim sistemi nasıl çalışıyor?

Aynı anda çalışan yaklaşık 30 bin yapay zeka ajanı, gerçek zamanlı çevrim içi izleyiciler ve haftalık bazda işlem günlüklerini tarayan çevrim dışı denetleyicilerden oluşan iki aşamalı bir güvenlik mimarisiyle denetlenmektedir.

Yapay zeka Ar-Ge süreçlerinde güvenliğe ne kadar işlem gücü ayrılıyor?

Anthropic'in verilerine göre Ar-Ge için kullanılan toplam işlem gücünün yüzde 6'sı, yapay zeka tarafından yürütülen Ar-Ge projelerinde ise yüzde 12'si doğrudan güvenlik araştırmalarına ayrılmaktadır.

Çerez tercihleri