Teknoloji

Claude, OpenAI’nin sistemlerine günler içinde girdi — asıl hesabı Anthropic verecek

Adrian Kessler
Bizi Google'a ekleyin

Küçük bir ekip, Anthropic‘in en yeni modelini OpenAI‘nin ön kapısına doğrulttu ve içinden geçti. Çoğu kişinin okuduğu versiyon — zeki yabancıların ChatGPT’nin yaratıcısını utandırması — konuyu yanlış ele alıyor. Bu sızma, OpenAI’nin yamalamayı unuttuğu bir şeye bağlı değildi. Anthropic’in daha yetenekli bir Claude’u piyasaya sürmesi anına bağlıydı. Üzerinde durulmaya değer kısım da bu: Günlerdir durmuş bir iş, yeni bir amiral gemisi yayına girdiğinde kendi kendine çözüldü.

Olayın içindeki kişiler suçlu değildi. Güvenlik girişimi Hacktron’daki araştırmacılar, OpenAI’nin kendi hata ödülü programı kapsamında çalıştı, birkaç sıradan web zafiyetini zincirleme bağladı, OpenAI çalışanlarının hesaplarına ulaştı ve dahili bir kod deposuna kadar ilerledi — sonra durdu, bulduklarını raporladı ve mütevazı bir ödül aldı. Kanıt olarak zararsız bir işaret bıraktılar ve daha ileri gitmediler. Bir suç olarak okunduğunda bu bir olay değil. Bir yetenek testi olarak okunduğunda, yükselen bir işaret fişeği.

İşte haber kapsamının üzerinden atladığı mekanizma. Ekip, ilk olarak güvenlik çalışmaları için ayarlanmış sürüm olan Claude Opus 4.8’de işi denedi ve tekrarlanan oturumlarda takıldı. Sonra Anthropic Opus 5’i yayınladı. Hacktron ekibi, “Opus 4.8, çalışan bir istismar üretmek için birkaç oturum boyunca zorlandı” diye yazdı. “Opus 5’in yayınlanmasından saatler sonra aynı sorunu ona verdik ve başardı.” VentureBeat, daha yeni modelin birkaç saat içinde zorlu bir çip hedefi için çalışan bir istismar yazdığını bildirdi. Bu zaman diliminde OpenAI’nin savunmalarında hiçbir şey değişmedi. Değişen modeldi.

Bu tam da Anthropic’in kendi güvenlik mekanizmasının tespit etmek ve geri tutmak için inşa edildiği türden bir sıçrama — sıradan bir kullanıcının hazır bir abonelikle yapabileceklerindeki bir sıçrama. Şirket, en yetenekli siber modeli Mythos’u ihracat kontrolleri ve kısa bir doğrulanmış savunucu listesi arkasında tutuyor ve bunu yaptığı en güçlü güvenlik modeli olarak adlandırıyor. Bunların hiçbiri burada önemli değildi. Herkese açık katman yeterliydi. Gray Swan CEO’su Matt Fredrikson’ın TechCrunch’a söylediği gibi, “ayda 200 dolara, herkes bu araçları kullanıp OpenAI gibi bir şirkete sızabilir.”

Sorumluluk burada rakibine değil Anthropic’e düşüyor. Anthropic tüm kimliğini ihtiyat üzerine kurdu — CEO’su Dario Amodei, teknolojinin “gerçek tehlikelerinden” açıkça bahsediyor ve sektörü yavaşlamaya çağırdı. Rakiplerinden birine sızma çıtasını ölçülebilir şekilde düşüren genel sürümdeki bir model, bu mesajın rahatsız edici bir karşı ağırlığı. Bunun hesabı sorulduğunda şirket hiçbir şey söylemedi; CBS News, Anthropic’in yorum talebine yanıt vermediğini bildirdi. OpenAI ise araştırmacılara teşekkür etti, saldırganların istismar ettiği izinleri daralttı ve etkilenen oturumları iptal etti.

Ayrıntılar neredeyse sıradan. Giriş yolu, OpenAI’nin topluluk forumunu çalıştıran Discourse yazılımıyla birlikte gelen eski bir görüntü işleme kütüphanesiydi; oturum açma belirteçlerinin kapsamının nasıl belirlendiğindeki ikinci bir hata, araştırmacıların ele geçirilmiş bir oturumu kullanarak ChatGPT ve Codex için çalışan hesaplarına ve oradan da özel koda ulaşmasını sağladı. İlk tutunmadan depo erişimine kadar tüm zincir üç günden az sürdü. OpenAI 6.500 dolar ödedi. Ekip, tüm çabanın 3.000 dolardan daha azını Claude süresi olarak harcadığını söylüyor — iki aylık iş, çoğu insan, artık bir uzmana ihtiyaç duymayan bir makinede bitişte sıkıştırıldı.

Bir hedefi koruyan kıt kaynak hiçbir zaman yama olmadı. Bu, kusurları bulabilen, bunları birbirine kaynaklayabilen ve yolu görebilen uzmandı — ve bunun için geçen aylar. Bu uzmanlık az önce ucuzladı. Bu sefer OpenAI’nin koduna ulaşan ekip bir rapor dosyaladı ve ödülü aldı. Aynı çıtayı, aynı abonelikle geçecek bir sonraki kişinin bunu yapmak zorunda değil.

Etiketler: , , , , ,

Bizi Google'a ekleyin

Tartışma

S kadar yorum var.