Anthropic'in güvenlik başı, yok olma ihtimalini yüzde 10'un üzerinde gördü — ve planları olmadığını söyledi
Anthropic'in modellerinin kimseye zarar vermemesini sağlamakla görevli kişi, yapay zekânın önümüzdeki on yıl içinde insanlığı yok etme ihtimalinin yüzde 10'dan fazla olduğunu herkesin önünde söyledi. Ardından şirketinin buna karşı bir planı olmadığını ekledi.
Çoğu insan hâlâ yapay zekâyı, kendisiyle konuşan bir arama motoru gibi kullanıyor. Ama bu hafta, Atlantik'in iki yakasında da, bu teknolojiyi kuranlar ve ona para yatıranlar başka bir şey söyledi: bu teknoloji herkesi öldürebilir, ve işler kötüye giderse ne yapılacağına dair kimsenin bir planı yok.
Salı gecesi, Anthropic'te hizalama bilimi sorumlusu Evan Hubinger — hizalama, bir sistemin zarar vermemesini sağlama işi demek — teknolojinin önümüzdeki on yıl içinde 'tüm insanları öldürme' ihtimalinin yüzde 10'dan fazla olduğunu düşündüğünü yazdı. Şirketinin süper zekânın hizalı kalmasını garanti edecek bir planı olmadığını da söyledi. Bunu, 28 yaşındaki bir meslektaşı istifa ettikten sonra paylaştı.
Meslektaşı, Anthropic'te ve daha önce OpenAI'de çalışmış araştırmacı Jacob Coxon. İstifa ederken 'iki şirket de sorumlu davranmıyordu' dedi ve 'hayatlarımızla kumar oynuyorlar' diye ekledi. Asıl akılda kalması gereken kısım şu: Anthropic içinde risklerin gayet iyi bilindiğini söyledi. Sorun, şirketin 'oraya ilk varmak için bir yarışa kilitlenmiş' olmasıydı. Bilgisizlik değil. Hız.
Hikayenin tamamı tek cümlede bu: Herkes biliyor. Kimse duramıyor, çünkü durmak kaybetmek demek.
Aynı kalıba oturan ikinci bir ayrıntı daha var. Financial Times'a göre İngiltere hükümeti yetkilileri, Anthropic'in en yeni modeli Mythos 5.1'i, ülkenin Yapay Zeka Güvenlik Enstitüsü'ne yayın öncesi test için vermeyi reddetmesinden rahatsız oldu. Cabinet Office, modele yalnızca birkaç ABD kuruluşunun erişimi olduğunu doğruladı. Yani güvenlik sorumlusu felaket ihtimalinin onda birin üzerinde olduğunu söylüyor, ardından gelen model ise talep eden dış test kuruluşlarına gösterilmiyor. Şirketin bu tercihi neden yaptığını bilmiyoruz — Anthropic'ten yorum istendi, bir Cabinet Office sözcüsü ise enstitünün 'Anthropic dahil sektör ortaklarıyla yakın işbirliğine devam ettiğini' söyledi.
Odadaki herkes göğün düştüğü konusunda hemfikir değil. Oxford Internet Institute'tan Sandra Wachter, 'Terminatör senaryolarına' inanmadığını söyledi ve bunları zaten var olan sorunlardan — çevresel etki, dezenformasyon, işlerin yok olması — dikkat dağıtan bir unsur olarak nitelendirdi. Surrey Institute for People-Centred AI'dan Dr. Andrew Rogoyski ise tam tersi yönde daha ileri gitti: 'büyük hayal kırıklığı' dediği bir senaryo bekliyor — gelişmiş yapay zekânın, mevcut haliyle sürdürülemeyecek kadar pahalı ve yeterince faydasız çıkması. Bunların ikisi de, yüzde 10'luk sayıyla aynı anda doğru olabilir. Rahatsız edici kısım da bu.
Şu anda ne okuyacağına ya da hangi kariyere bel bağlayacağına karar veren herkes için: yapay zekâ kurallarına dair kavga bu yıl veriliyor, ve hangi yöne giderse gitsin, sen mezun olana kadar hangi işlerin var olacağını şekillendirecek. İşi zaten yazı, kod, destek ya da tasarıma dokunan herkes için — Wachter, işlerin yerini almasını gerçek ve acil sorunlardan biri olarak sayıyor, ve bu hikayede o şüpheci taraf. Ve bu sistemleri kuranların bir yerlerde saklı bir güvenlik planı olduğunu varsayan herkes için. Kendi hizalama sorumluları böyle bir planın olmadığını söylüyor.
Şimdi masada iki şey var ve ikisi de takip edilebilir. İşçi Partili milletvekili Alex Sobel, bu hafta parlamentoya yapay süper zekâ yaratılmasını yasaklamayı amaçlayan bir yasa tasarısı sundu. Ayrı olarak, İşçi Partili milletvekili Darren Jones, başbakan Andy Burnham'a ve BM ile OECD'nin başkanlarına 'süper zekânın düzenlenmiş ve güvenli gelişimi için çok uluslu bir antlaşma' talep eden bir mektup yazdı. ABD'de Bernie Sanders, Amerikalıların yüzde 81'inin politikacılarından harekete geçmesini istediğini gösteren bir ankete atıfla, Kongre'yi düzenleme yapmaya çağırdı. Bunların hiçbiri için bir tarih verilmedi. Anthropic'in Mythos 5.1'i ya da bir sonrakini İngiltere'nin Yapay Zeka Güvenlik Enstitüsü'ne sunup sunmayacağı, üçü arasında en küçük ve en net test.
Kampanyayı finanse eden Skype kurucusu Jaan Tallinn, yapay zekâ çalışanlarının yüzde 10-15'inin bu teknolojinin insanlığa layık bir halef olacağına inandığını tahmin ediyor. Ona oldukça tanınmış bir araştırmacının şöyle dediğini aktarıyor: 'Jaan, bunun için endişelenme. İnsanlar tek kullanımlık bir tür.' Yüzde 10'luk yok olma rakamını bunu aklında tutarak bir daha oku. Bu laboratuvarların içindeki tartışma sadece sonun ne kadar olası olduğuyla ilgili değil. Bazıları için mesele, sonun kötü olup olmadığı.
Kaynaklar: The Guardian, 9 Eylül 2026, 'AI could kill all humans in next decade, warn experts: but how seriously should we take them?' — Birleşik Krallık teknoloji editörü Robert Booth; içinde alıntılanan Financial Times.
Anthropic'in kendi güvenlik direktörü, yapay zekânın on yıl içinde tüm insanları yok etme ihtimalini kamuya açık şekilde yüzde 10'un üzerinde ilan etti — ve şirketin buna dair bir planı olmadığını itiraf etti; üstelik şirket yeni modelini yayın öncesinde İngiltere'nin güvenlik enstitüsüne vermeyi reddetti.
THE TELL’in yapay zekâ haber merkezi tarafından yazıldı. nasıl çalışıyoruz · düzeltmeler