OpenAI, Astra'nın hacklemeye yardım edebileceğini söylüyor. Yine de piyasaya sürüyor.
OpenAI, yeni modeli Astra'nın siber güvenlik yeteneği açısından şirketin "Kritik" dediği seviyeye ulaşan ilk model olduğunu yazan bir gönderi yayınladı. Açık konuşalım: bu model sistemlere sızma konusunda o kadar iyi ki şirket bunu yüksek sesle söylemek zorunda kaldı.
Şirketler genelde yazılımlarının sizin için ne yapabileceğini duyurur. Bu duyuru ise yazılımın size ne yapabileceğiyle ilgili. "Path to Astra: critical capabilities and frontier safeguards" başlıklı yazıda OpenAI, Astra'nın kendi Hazırlık Çerçevesi'ne (Preparedness Framework) göre Kritik siber güvenlik eşiğine ulaşan ilk modeli olduğunu söylüyor. Bu çerçeve, şirketin kendi modellerinin ne kadar tehlikeli olduğuna karar vermek için kullandığı iç kural kitabı.
Hazırlık Çerçevesi bir yasa değil. OpenAI'nin kendi ölçeği bu - OpenAI tarafından yazılmış, OpenAI tarafından uygulanmış. "Kritik" bu ölçeğin en üstü. Şirket modeli geri çekmek yerine, Astra'yı daha sıkı güvenlik önlemleriyle piyasaya sürdüğünü söylüyor.
Üzerinde durulması gereken kısım şu: Kritik seviyedeki bir siber yeteneği açık internetten ayıran şey, model piyasaya sürüldüğünde para kazanan aynı şirketin tasarladığı bir güvenlik önlemleri seti. Bu cümlede dışarıdan bir denetçi yok. Kaynak hiçbirinin adını vermiyor.
Hem hakem, hem de takımın sahibi.
Diğer yarısı daha sakin ama size daha faydalı: OpenAI bize, modellerin "kimlik avı e-postası yazabilir" seviyesinden çıkıp şirketin kendisinin kritik dediği bir bölgeye geçtiğini söylüyor. Güvenlik önlemleri her ne yakalarsa yakalasın, bu yetenek artık var ve kamuya açık şekilde tanımlanmış durumda. Bu tanım aynı zamanda bir hedef tahtası. Her güvenlik ekibi - ve karşı taraftaki herkes - artık hangi seviyede bir araçla karşı karşıya olduğunu biliyor.
Şifresini bir kez bile tekrar kullanmış herkesi ilgilendiriyor - yani hepimizi. Bu seviyedeki bir model korumalarının dışına sızarsa, ucuz saldırılar daha da ucuzlaşır: e-postanız, birikimlerinizi enflasyona karşı sakladığınız kripto borsası hesabınız, okumadan onayladığınız iki faktörlü doğrulama kodu. Bu durum şu anda kariyer seçen yirmili yaşlardaki insanları da doğrudan etkiliyor: on yıl boyunca "siber güvenlik" güvenli bir cevaptı, ve bu yazı, araçları üreten şirketin bu araçların kendi tehlike ölçeğinin en üstünde olduğunu yüksek sesle söylediği ilk an. O işin her iki tarafı - savunan da, saldıran da - az önce şekil değiştirdi.
OpenAI, Astra'nın daha sıkı güvenlik önlemleriyle piyasaya sürüldüğünü söylüyor. Yazı bu önlemlerin ayrıntılarını, kimin doğruladığını ya da başarısız olurlarsa ne olacağını belirtmiyor. Ne bir tarih var, ne dış denetim, ne de düzenleyici kurum adı. Dürüst cevap şu: izlenmesi gereken şey, OpenAI'nin güvenlik önlemlerinin işe yaradığına dair bir kanıt yayınlayıp yayınlamayacağı - ve yayınlayana kadar şirket dışından hiç kimse bunu kontrol edemez. Herhangi bir zaman çizelgesi verilmedi.
OpenAI testi yazdı, testi kendi verdi, testi kendi notladı ve modelinin en yüksek risk seviyesine ulaştığını duyurdu - sonra da piyasaya sürdü. Bunu alışılmadık bir dürüstlük olarak da okuyabilirsiniz, bir şirketin kendi hikayesinin önüne geçmesi olarak da. İkisi de aynı anda doğru olabilir. Asıl soru şu: Kritik seviyeye ulaşan ikinci şirket, kimse onu notlamazken ne yapacak?
Kaynaklar: OpenAI Blog, "Path to Astra: critical capabilities and frontier safeguards" (openai.com/index/path-to-astra)
OpenAI, yeni modelinin siber saldırılara yardım edebilecek 'kritik' seviyeye ilk ulaşan model olduğunu kendi ağzıyla itiraf etti - yani sistemlere sızmaya yardım edebilecek bir yapay zeka satışa çıkıyor ve onu sadece şirketin kendi iç kuralları frenliyor.
THE TELL’in yapay zekâ haber merkezi tarafından yazıldı. nasıl çalışıyoruz · düzeltmeler