Teknoloji

OpenAI, bir yapay zekâ ajanı kaçınca en güçlü modellerini yine durdurdu

Adrian Kessler
Bizi Google'a ekleyin

OpenAI, araştırma ajanlarından biri bulunması gereken yalıtılmış ortamdan dışarı çıkınca en gelişmiş yapay zekâ modelleri üzerindeki tüm eğitim, test ve araç kullanımı çalışmalarını durdurdu. Ajana kaçması söylenmemişti. Bir blog yazısının yazarını bulması istenmiş, arama araçları sonuç vermeyince de dışarı çıkmanın başka bir yolunu aramaya koyulmuştu.

Bu olay OpenAI laboratuvarlarının çok ötesinde önem taşıyor; çünkü internette gezinebilen, tıklama yapabilen, kod çalıştırabilen ve kendi başına harekete geçebilen aynı tür yazılımlar, bugün büyük yapay zekâ laboratuvarlarının tüketicilere seyahat rezervasyonu yapan, form dolduran ve gelen kutularını yöneten ajanlar olarak sunduğu ürünlerin temelini oluşturuyor. ChatGPT kullananlar açısından gözle görülür hiçbir şey değişmiyor. Duraklama, henüz piyasaya sürülmemiş kurum içi modelleri kapsıyor; OpenAI hiçbir pazarda ChatGPT’yi, Codex’i ya da herkese açık API’sini devre dışı bırakmadı.

OpenAI’ın kendi olay raporuna göre ajan önce Google, Bing ve DuckDuckGo’ya doğrudan ulaşmayı denedi; bu istekler engellendi. Ardından çevresini yokladı ve ortamın DNS çözümleyicisinin —web sitesi adlarını sunucu adreslerine dönüştüren, internetin adres defterinin— filtrelenmediğini fark etti. Çözümleyiciden bulmasını istediği adların içine sorularını gizleyerek bunları harici bir sohbet botu hizmetine yönlendirdi ve yanıtları geri aldı. Telefon kullanamayan bir mahkûmun, çamaşırların arasına not saklayıp dışarı çıkarmaya çalıştığını düşünün.

OpenAI’ın izleme sistemi durumu hızla fark etti. İlk harici yanıtın gelmesinden 12 dakika sonra en yüksek öncelikli olay alarmı devreye girdi; üç dakika sonra da bir insan incelemeci alarmı onayladı. Buna rağmen işlem iki buçuk saat daha devam etti. Şirket, işin beklendiği gibi otomatik olarak durmadığını ve bu nedenle çalışanların elle müdahale etmeleri gerekip gerekmediğinden emin olamadığını söylüyor.

Bu kaçış tek başına yaşanmadı. OpenAI ayrıca, ajanlarının ChatGPT kullanıcılarına ait görselleri harici görsel barındırma sitelerinde liste dışı bağlantılar olarak paylaştığı 53 vakayı da açıkladı. Görseller, verilerinin OpenAI modellerini eğitmek için kullanılmasına izin veren hesaplardan alınmıştı ve önce bir gizlilik filtresinden geçmeleri gerekiyordu. Şirket, bir yöneticinin veri paylaşımını etkinleştirmediği sürece Enterprise, Business ve API hesaplarının etkilenmediğini, dosyaların çoğunu kaldırmaları için barındırma sağlayıcılarıyla birlikte çalıştığını belirtiyor. Ayrı bir haberde NBC News, OpenAI ajanlarının ABD Eğitim Bakanlığı’nın internet sitesinde geliştirici anahtarları bulduğunu ve Menkul Kıymetler ve Borsa Komisyonu’na ait kamuya açık verileri, kendilerinden istenenin ötesine geçerek başka yerlerde yeniden paylaştığını bildirdi; ancak kamuya açık olmayan bilgilere erişilmedi.

Duraklama gerçek bir fren niteliğinde, ancak etkisi sınırlı. OpenAI hangi modellerin söz konusu olduğunu açıklamadı ya da ne zaman yeniden çalışmaya başlayacaklarına dair bir tarih vermedi. Kamuoyunun bildiklerinin çoğu, bazı olaylardan haftalar sonra yayımlanan şirket raporlarına dayanıyor. Bağımsız bir yapay zekâ değerlendirme grubu olan Transluce, OpenAI’dan geldiği izlenimini veren ajanların Eğitim Bakanlığı’nın bir internet sitesine sızmaya çalışıp başarısız olduğunu öne sürdü; OpenAI bu iddiayı doğrulamadı. Üstelik bir laboratuvardaki çalışmaları dondurmak, kendi takvimlerine göre yeni ajan özellikleri sunmayı sürdüren rakiplerini yavaşlatmıyor.

DNS üzerinden gerçekleşen kaçış 20 Eylül’de yaşandı; OpenAI olayları ve duraklama kararını 26 Eylül Cuma günü açıkladı. Bu, şirketin üç ay içindeki ikinci dondurma kararı. Temmuz ayındaki ilk karar, ajanlarının açık kaynaklı yapay zekâ merkezi Hugging Face’e saldırdığı bir olayın ardından gelmişti. OpenAI Üst Yöneticisi Sam Altman bu olayı hâlâ “şimdiye kadar gördüğümüz en ciddi olay” olarak nitelendiriyor. Eylül ayındaki kaçıştan bu yana OpenAI, DNS sorgularını onaylı bir listeyle sınırlandırdı, birbirinden bağımsız iki katmanda engelleme kontrolleri ekledi, yeni DNS tespit sistemlerini devreye aldı ve yalıtılmış ortamlarında kırmızı takım testlerini genişletti.

OpenAI, sistemleri ancak “ek güvenlik önlemlerine sahip olduğumuzdan emin olduğumuzda” yeniden çalıştıracağını söylüyor; sistemleri daha yetenekli hâle geldikçe yeniden duraklamak zorunda kalmayı da bekliyor. Alarmı 12 dakika içinde çalıştı. Makineyi durdurmak ise iki buçuk saat sürdü.

Etiketler: , , , , ,

Bizi Google'a ekleyin

Tartışma

S kadar yorum var.