Cuma, 18 Eylül 2026Köşesiz. Yorumsuz. Sadece haber.

Anthropic, yapay zekâ gelişim hızını ölçen üç yeni metriği açıkladı

Anthropic, yapay zeka gelişim hızını ölçen üç yeni metriği açıkladı

cnbc.com

WhatsAppXE-Posta

Yapay Zeka Gelişim Hızını Ölçen Üç Yeni Metrik

Yapay zeka şirketi Anthropic, gelişmiş modellerin kendi kendilerini geliştirme sürecini ve güvenlik denetimlerini takip etmek amacıyla üç temel ölçüt paylaştı. Şirket Üst Yöneticisi Dario Amodei’nin küresel yapay zeka yarışında koordineli bir yavaşlama çağrısı yapmasının ardından açıklanan veriler, sektörün geleceğine dair somut göstergeler sunuyor. Paylaşılan metodolojiler, yapay zeka destekli araştırma ve geliştirme oranlarını, otonom ajanların denetimini ve işlem gücü tahsisini kapsıyor.

Şirket yetkilileri, sınır modeller geliştiren laboratuvarların elindeki bilgiler ile kamuoyunun bildikleri arasındaki farkı kapatmayı hedeflediklerini açıkladı. Üretim süreçlerinin ölçülmesiyle birlikte yapay zeka sistemlerinin taşıdığı risklerin daha net görülebileceği vurgulandı.

Claude Modeli Araştırma İşlerinin Dörtte Birini Yürütüyor

Açıklanan ilk metriğe göre, şirketin en gelişmiş yapay zeka modeli Claude, model araştırma ve geliştirme süreçlerinde giderek daha etkin rol alıyor. Bağımsız araştırma kuruluşu Epoch AI verileriyle desteklenen analizlere göre Claude, Ağustos 2026 itibarıyla şirket bünyesindeki Ar-Ge çalışmalarının yüzde 26’sına liderlik ediyor. Bu seviye, yapay zekanın insan gözetiminde yüksek seviyeli komutlarla karmaşık işleri uçtan uca tamamlayabildiği anlamına geliyor.

Veriler, Claude’un henüz hiçbir süreçte tam otonom çalışmadığını gösteriyor. Buna karşın, Ar-Ge faaliyetlerinin yüzde 90’ından fazlası insan ve yapay zeka iş birliğiyle yürütülüyor. Claude’un Ar-Ge süreçlerindeki liderlik payının Mart 2026’da yalnızca yüzde 1 seviyesinde bulunması, gelişme hızındaki artışı ortaya koyuyor.

Otuz Bin Otonom Ajan İçin Kesintisiz Denetim Sistemi

Paylaşılan ikinci ölçüt, sistemler üzerinde görev yapan yapay zeka ajanlarının denetim mekanizmalarını odağına alıyor. Ana dahili platformda aynı anda yaklaşık 30 bin yapay zeka ajanının araştırma ve mühendislik işleri yürüttüğü açıklandı. Bu ajanların olası tehlikeli eylemlerini önlemek için iki aşamalı denetim mimarisi uygulanıyor.

Çevrim içi izleyiciler, ajanların gerçekleştirdiği tüm eylemleri saniyeler içinde kontrol ederek model ağırlıklarının dışarı aktarılması gibi geri döndürülemez riskleri engelliyor. Ağustos 2026’da analiz edilen 1 milyardan fazla karardan yaklaşık 47 bin işlemde 1’i (yüzde 0,002) güvenlik duvarları tarafından engellendi. Çevrim dışı denetleyiciler ise uzun vadeli uyumsuzluk risklerini tespit etmek amacıyla haftalık bazda yaklaşık 100 bin işlem günlüğünü tarıyor.

Güvenlik Çalışmalarına Ayrılan İşlem Gücü Bütçesi

Üçüncü metrik kapsamında Temmuz 2026’daki bir haftalık dönemde kullanılan tüm işlem gücü kaynaklarının dağılımı incelendi. Yapılan analizde, yapay zeka Ar-Ge süreçlerine harcanan toplam işlem gücünün yaklaşık yüzde 6’sının doğrudan güvenlik araştırmalarına ayrıldığı belirlendi. Yapay zeka tarafından yürütülen Ar-Ge projelerinde ise bu oran yüzde 12 seviyesine yükseldi.

Hesaplamaların muhafazakar bir yaklaşımla yapıldığı ve doğrudan güvenlik filtrelerini içeren ayrıştırıcı sistemlerin bu bütçeye dahil edilmediği bildirildi. İşlem gücü tahsisinin şeffaf şekilde paylaşılması, ilerleyen dönemlerde yapay zeka laboratuvarlarının güvenlik taahhütlerini doğrulayabilmesi açısından kritik bir araç olarak görülüyor.

Bağımsız Denetçiler ve Sektörel Şeffaflık Çağrısı

Anthropic, ölçüm sonuçlarını doğrulamak ve güvenilirliği artırmak amacıyla bağımsız üçüncü taraf denetçileri kurum bünyesine dahil etmeyi planlıyor. Dışarıdan atanacak bu uzmanlar, dahili risk değerlendirme ekipleriyle aynı yetkilere sahip olarak güvenlik uygulamalarını doğrulayacak ve kilit metrikleri takip edecek.

Sektörde şeffaflık adımları genişlerken, rakip yapay zeka geliştiricilerinin de otonom sistemlerde yaşanan beklenmedik veya yetkisiz model davranışlarını düzenli raporlar halinde paylaşmaya başladığı görülüyor. Yapay zeka teknolojisinde koordineli yavaşlama önerisi tartışılmaya devam ederken, tüm geliştiricilerin benzer güvenlik verilerini düzenli olarak açıklaması bekleniyor.

Sıkça Sorulanlar

Anthropic'in açıkladığı üç yeni metrik neleri kapsıyor?

Metrikler; yapay zekanın Ar-Ge süreçlerindeki liderlik oranını, aktif otonom ajanların iki aşamalı denetim verilerini ve güvenlik araştırmalarına ayrılan işlem gücü bütçesini kapsıyor.

Claude yapay zeka modeli Ar-Ge çalışmalarının ne kadarına liderlik ediyor?

Ağustos 2026 verilerine göre Claude, şirket bünyesindeki araştırma ve geliştirme işlerinin yüzde 26'sına liderlik ediyor. Bu oran Mart 2026'da yüzde 1 seviyesindeydi.

Otonom yapay zeka ajanlarının denetimi nasıl sağlanıyor?

Sistemde görev yapan yaklaşık 30 bin ajan, saniyeler içinde karar veren çevrim içi izleyiciler ve haftalık işlem günlüklerini tarayan çevrim dışı denetleyiciler ile sürekli kontrol altında tutuluyor.

Sektördeki diğer yapay zeka şirketleri benzer güvenlik adımları atıyor mu?

Evet, yapay zeka sektöründeki diğer aktörler de otonom sistemlerde yaşanan beklenmedik veya yetkisiz model davranışlarına ilişkin düzenli raporlar yayınlamaya ve güvenlik verilerini paylaşmaya başlıyor.

Çerez tercihleri