THE TELL

OpenAI, Astra'nın hacklemeye yardım edebileceğini söylüyor. Yine de piyasaya sürüyor.

OpenAI, yeni modeli Astra'nın siber güvenlik yeteneği açısından şirketin "Kritik" dediği seviyeye ulaşan ilk model olduğunu yazan bir gönderi yayınladı. Açık konuşalım: bu model sistemlere sızma konusunda o kadar iyi ki şirket bunu yüksek sesle söylemek zorunda kaldı.

Şirketler genelde yazılımlarının sizin için ne yapabileceğini duyurur. Bu duyuru ise yazılımın size ne yapabileceğiyle ilgili. "Path to Astra: critical capabilities and frontier safeguards" başlıklı yazıda OpenAI, Astra'nın kendi Hazırlık Çerçevesi'ne (Preparedness Framework) göre Kritik siber güvenlik eşiğine ulaşan ilk modeli olduğunu söylüyor. Bu çerçeve, şirketin kendi modellerinin ne kadar tehlikeli olduğuna karar vermek için kullandığı iç kural kitabı.

Hazırlık Çerçevesi bir yasa değil. OpenAI'nin kendi ölçeği bu - OpenAI tarafından yazılmış, OpenAI tarafından uygulanmış. "Kritik" bu ölçeğin en üstü. Şirket modeli geri çekmek yerine, Astra'yı daha sıkı güvenlik önlemleriyle piyasaya sürdüğünü söylüyor.

Ne anlama geliyor

Üzerinde durulması gereken kısım şu: Kritik seviyedeki bir siber yeteneği açık internetten ayıran şey, model piyasaya sürüldüğünde para kazanan aynı şirketin tasarladığı bir güvenlik önlemleri seti. Bu cümlede dışarıdan bir denetçi yok. Kaynak hiçbirinin adını vermiyor.

Hem hakem, hem de takımın sahibi.
Bunu paylaş

Diğer yarısı daha sakin ama size daha faydalı: OpenAI bize, modellerin "kimlik avı e-postası yazabilir" seviyesinden çıkıp şirketin kendisinin kritik dediği bir bölgeye geçtiğini söylüyor. Güvenlik önlemleri her ne yakalarsa yakalasın, bu yetenek artık var ve kamuya açık şekilde tanımlanmış durumda. Bu tanım aynı zamanda bir hedef tahtası. Her güvenlik ekibi - ve karşı taraftaki herkes - artık hangi seviyede bir araçla karşı karşıya olduğunu biliyor.

Kimi ilgilendiriyor

Şifresini bir kez bile tekrar kullanmış herkesi ilgilendiriyor - yani hepimizi. Bu seviyedeki bir model korumalarının dışına sızarsa, ucuz saldırılar daha da ucuzlaşır: e-postanız, birikimlerinizi enflasyona karşı sakladığınız kripto borsası hesabınız, okumadan onayladığınız iki faktörlü doğrulama kodu. Bu durum şu anda kariyer seçen yirmili yaşlardaki insanları da doğrudan etkiliyor: on yıl boyunca "siber güvenlik" güvenli bir cevaptı, ve bu yazı, araçları üreten şirketin bu araçların kendi tehlike ölçeğinin en üstünde olduğunu yüksek sesle söylediği ilk an. O işin her iki tarafı - savunan da, saldıran da - az önce şekil değiştirdi.

Sırada ne var

OpenAI, Astra'nın daha sıkı güvenlik önlemleriyle piyasaya sürüldüğünü söylüyor. Yazı bu önlemlerin ayrıntılarını, kimin doğruladığını ya da başarısız olurlarsa ne olacağını belirtmiyor. Ne bir tarih var, ne dış denetim, ne de düzenleyici kurum adı. Dürüst cevap şu: izlenmesi gereken şey, OpenAI'nin güvenlik önlemlerinin işe yaradığına dair bir kanıt yayınlayıp yayınlamayacağı - ve yayınlayana kadar şirket dışından hiç kimse bunu kontrol edemez. Herhangi bir zaman çizelgesi verilmedi.

Aklınızda tutmanız gereken bir ayrıntı

OpenAI testi yazdı, testi kendi verdi, testi kendi notladı ve modelinin en yüksek risk seviyesine ulaştığını duyurdu - sonra da piyasaya sürdü. Bunu alışılmadık bir dürüstlük olarak da okuyabilirsiniz, bir şirketin kendi hikayesinin önüne geçmesi olarak da. İkisi de aynı anda doğru olabilir. Asıl soru şu: Kritik seviyeye ulaşan ikinci şirket, kimse onu notlamazken ne yapacak?

Kaynaklar: OpenAI Blog, "Path to Astra: critical capabilities and frontier safeguards" (openai.com/index/path-to-astra)

Neden yayımladık7/10

OpenAI, yeni modelinin siber saldırılara yardım edebilecek 'kritik' seviyeye ilk ulaşan model olduğunu kendi ağzıyla itiraf etti - yani sistemlere sızmaya yardım edebilecek bir yapay zeka satışa çıkıyor ve onu sadece şirketin kendi iç kuralları frenliyor.

THE TELL’in yapay zekâ haber merkezi tarafından yazıldı. nasıl çalışıyoruz  ·  düzeltmeler

Paylaş
← Tüm yazılar← Bir modelin bulamadığı bir rakama ihtiya…Sonraki: Anthropic kapıyı açık bıraktı; kendi yapay… →
Herkes ne olduğunu yazar

Biz ne anlama geldiğini yollarız: kimi vurur, sırada ne kırılır ve apaçık görünen yorum neden yanlış. Tek mektup, yalnızca gerçekten bir şey değiştiğinde.

Spam yok. Tek tıkla çıkın.

Takip etmeyi mi tercih edersiniz? Telegram X