Teknoloji

Anthropic açıkladı: Claude kendi yapay zeka araştırmalarının yüzde 26’sını yönetiyor

Adrian Kessler
Bizi Google'a ekleyin

Anthropic‘teki her dört yapay zeka araştırma görevinden biri artık Claude tarafından yönetiliyor. Claude’a bir yardımcı olarak atanmadı, sonrasında Claude tarafından incelenmedi — üst düzey bir komutla başlatılıp uçtan uca tamamlandı ve iş bittiğinde bir insan sonucu kontrol ediyor. Dokuz ay önce bu oran yüzde birin altındaydı.

Anthropic iki şey arasında bir çizgi çiziyor. Claude bir göreve liderlik ettiğinde, işin çoğunu bağımsız olarak halleder; bir denetçi, her adımı yönlendirmek yerine çıktıyı inceler. Bu, Claude’un işbirlikçi olarak hareket ettiği Anthropic’in toplam Ar-Ge’sinin yüzde doksanından farklı bir kategoridir — bir insan yönlendirir, Claude belirli kısımları halleder. Liderlik, daha zor bir sınıflandırmadır. Artık şirketin yaptığı tüm yapay zeka araştırmalarının yüzde 26’sını oluşturuyor; araştırmacıların bu görevlere harcayacakları zamana göre ağırlıklandırılıyor.

Ölçek somut. Anthropic’in dahili platformlarında yaklaşık 30.000 Claude ajanı eşzamanlı olarak çalışıyor; model eğitimi, değerlendirmeler, yorumlanabilirlik araştırmaları ve güvenlik analizi dahil olmak üzere işleri yürütüyor. Ağustos ayında bu ajanlar toplamda bir milyardan fazla karar aldı. Anthropic’in gerçek zamanlı izleme sistemleri, yürütmeden önce bunların yüzde 0,002’sini — yaklaşık her 47.000 eylemden biri — engelledi. Ardından çevrimdışı bir katman, inceleme için haftada yaklaşık 100.000 transkripti işaretledi ve yaklaşık 50’sini bir insana yükseltti.

Güvenliğin bu sistem içinde ölçülebilir bir bütçesi var. Temmuz ayındaki tek bir hafta boyunca, ajanları güvende tutmaya ayrılan iş, tüm yapay zeka araştırma ve geliştirme bilgi işleminin yüzde altısını ve yapay zeka odaklı Ar-Ge’nin kullandığı bilgi işlemin yüzde on ikisini tüketti. Anthropic, özel güvenlik sınıflandırıcılarını sayımdan hariç tutarak muhafazakar bir şekilde sınıflandırdığını söylüyor; bu da gerçek oranın daha da yüksek olduğunu gösteriyor.

Tüm bunların merkezinde epistemolojik bir sorun yatıyor. Claude’un Anthropic’in araştırmalarına katkısı kısmen Claude’un kendisi tarafından değerlendiriliyor. Bir Claude modeli Claude’un çalışmasını değerlendiriyor; gözetim rakamları yalnızca dahili bir platformu kapsıyor; ve bilgi işlem sınıflandırması, Claude modellerinin kendi çalıştırmalarını örnekleyip etiketlemesine dayanıyordu. Metodolojiyi bağımsız bir üçüncü taraf denetlemedi. Anthropic’in yayınladığı üç sayı kesin, ancak bunlar kendi kendine bildirilen kesinlikler — bu, doğrulanmış kesinlikten farklı bir şey.

Anthropic, sürece harici değerlendiriciler eklemeye başlayacağını söylüyor. Henüz isim yok, başlangıç tarihi yok ve diğer yapay zeka laboratuvarlarından karşılaştırılabilir bir açıklama yapılmadı. Yüzde 26’lık rakam, ulaştığı hızda, bir tavan değil, bir anlık görüntüdür.

Etiketler: , , , , ,

Bizi Google'a ekleyin

Tartışma

S kadar yorum var.