Claude 358 yıllık bir problemi 11 günde bitirdi, insan ekip 2024'te başladı ve hâlâ bitiremedi
Anthropic, Claude'un bir bilgisayarın satır satır kontrol edebileceği şekilde 13 milyon satır kod yazarak Fermat'ın Son Teoremi'ni doğruladığını söylüyor. Aynı işin insan tarafından yürütülen versiyonunu yöneten matematikçi bu kodu okudu ve tuttuğunu söyledi.
1637'de Fransız matematikçi Fermat, bir kitabın kenarına şöyle bir not düştü: üç pozitif tam sayı alın, her birini 2'den büyük bir kuvvete yükseltin — ilk ikisinin toplamı asla üçüncüsüne eşit olmaz. Ardından elinde "gerçekten harika bir kanıt" olduğunu ama kenar boşluğunun buna yetmediğini yazdı. Sonra öldü. Matematikçiler ne demek istediğini çözmek için 358 yıl uğraştı.
Anthropic, Claude'un bu işi 11 günde, büyük ölçüde kendi başına bitirdiğini söylüyor. Bulmacayı yeniden çözerek değil — asıl kanıtı 1995'te İngiliz matematikçi Andrew Wiles bulmuştu — onu bir bilgisayarın adım adım, kimsenin sözüne güvenmeden doğrulayabileceği 13 milyon satır koda dönüştürerek. Bu, şimdiye kadar yazılmış en uzun matematik kanıtı.
Gözden kolayca kaçan kısım şu: bir matematik kanıtı, birbirine bağlı mantık adımlarından oluşan bir zincirdir ve bir halka kırılırsa ondan sonraki her şey değersizleşir. Yüzlerce sayfalık yoğun bir akıl yürütmenin içinde o tek kırık halkayı bulmak, başka matematikçilerin yıllarını alabilir. Bu, yavaş akademisyenlerle ilgili bir şaka değil — tam olarak bu teoremin başına geldi. Wiles çözümünü Haziran 1993'te üç derste açıkladı, sonra bir hakem içinde bir delik buldu. Eski öğrencisi Richard Taylor'la birlikte neredeyse bir yıl boyunca yamadı, pes etmenin eşiğine geldi ve düzeltilmiş 129 sayfalık versiyonu Mayıs 1995'te yayımladı.
Yani matematiğin bir güven sorunu var, ve bu sorun bilgisayarlardan çok daha eski. 1908'de Almanya'da geçerli ilk kanıt için konulan ödül — bugünün parasıyla kabaca 1-2 milyon dolar değerinde — ilk yılında tek başına 621 yanlış gönderi topladı. Birinin bunların hepsini okuması gerekiyordu.
Claude'un ürettiği şey, o okuyucuyu işin dışına çıkarıyor. Bir kanıtı formalleştirmek, onu öyle acı verecek kadar harfi harfine bir dile çevirmek demek ki bir kanıt asistanı — burada Lean — her tek adımı kendi başına, yargısız ve fikirsiz kontrol edebiliyor. Hiçbir insan 13 milyon satırı okuyamaz. Bir makine okuyabilir, ve okudu.
Sınır az önce kaydı. Bu, bir profesöre adım öneren bir yapay zeka değil. Bu işin kendisi, bitmiş ve kandırılamayan, pohpohlanamayan bir şey tarafından doğrulanmış.
Şu anda ne öğreneceğine karar veren herkes için: eskiden söylenen şuydu — makineler angaryayı yapar, insan sezgiyi elinde tutar. Burada makine, Imperial College London'da 2024'ten beri gönüllü bir matematikçi ekibinin uğraştığı işi aldı ve önce bitirdi. Ve hayatında birine 'uzmana güven yeter' denmiş herkes için — bir teşhis, bir sözleşme, bir denetim. Bu hikâyedeki asıl ilginç fikir, bir bilgisayarın matematik yapması değil. Sonucun, kimsenin itibarına ihtiyaç duymadan, herkesin kendi makinesiyle yeniden kontrol edebileceği bir makbuzla gelmesi.
Imperial College London'dan matematikçi Kevin Buzzard, 2024'te insan projesini başlatan kişi, Claude'un kanıtını çoktan inceledi ve matematiğin en temel mantık kurallarından başka hiçbir şey kullanmadan tuttuğunu doğruladı. Kendi projesine şimdi ne olacağı, başka birinin bu kontrolü bağımsız olarak yeniden yapıp yapmayacağı kaynakta belirtilmiyor. Herhangi bir takvim verilmedi.
Fermat, elinde harika bir kanıt olduğunu ama yazacak yer olmadığını söylemişti. Claude'un yeri vardı — 13 milyon satır — ve 11 gün yetti. Matematikçiler artık Fermat'ın kanıtının hiç işe yarayıp yaramadığından şüphe ediyor, çünkü kısmen Wiles'ın versiyonu Fermat'ın yaşadığı dönemde var olmayan matematiğe dayanıyor. Sorun hiçbir zaman kenar boşluğu değildi.
Kaynaklar: Decrypt, "AI Just Solved a 350-Year-Old Math Problem By Writing the Longest Proof Ever," 5 Eylül 2026; Anthropic (@AnthropicAI) paylaşımı, 4 Eylül 2026.
İlk kez bir makine, insanın doğrulayamayacağı ama bir bilgisayarın doğrulayabileceği bir kanıtı tek başına ortaya çıkardı — bu da 'yapay zeka ipucu verir' ile 'yapay zeka bilim insanının işini yapar' arasındaki sınırı değiştiriyor.
THE TELL’in yapay zekâ haber merkezi tarafından yazıldı. nasıl çalışıyoruz · düzeltmeler