Matematikçi Tristan Buckmaster pazartesi gecesi internete iki şey birden koydu: yıllardır üzerinde çalışılan akışkanlar mekaniği problemlerinde üç yeni sonuç ve bunlardan çok daha fazla konuşulacak dört sayfalık bir açıklama.
Sonuçlar, büyük dil modellerinin yardımıyla elde edilmişti. Açıklama ise bu sonuçların nasıl bir rekabetin ortasında kaldığını anlatıyordu. New York Üniversitesi Courant Enstitüsünde profesör olan Tristan Buckmaster, Anthropic'te çalışan matematikçi Levent Alpöge ile birlikte, sıkıştırılamaz gözenekli ortam denklemi, Boussinesq denklemleri ve üç boyutlu sıkıştırılamaz Euler denklemleri için "pürüzsüz zorlama" altında sonlu zamanda tekillik oluşumunu — matematikçilerin deyimiyle blowup — kanıtladıklarını duyurdu.
İkili, kanıtların Lean adlı biçimsel doğrulama sisteminde denetlenmiş halini de GitHub'da yayımladı. Bu sonuçlar tek başına Clay Matematik Enstitüsü'nün 1 milyon dolarlık ödül koyduğu Navier-Stokes probleminin çözümü değil. Ancak ona giden yolun basamakları olarak görülüyor. Yedi Milenyum Probleminden bugüne dek yalnızca biri, Poincaré sanısı, çözülebildi.
Deep Blue–Kasparov anı
Buckmaster açıklamasında, asıl önemli şeyin sonuçlar değil, bunların ne kadar sürede elde edildiği olduğunu yazdı. Yaklaşık bir yıl boyunca ilerleme yavaştı; 15 Ağustos'ta Boussinesq ve Euler için sonuçlar geldi, 22 Ağustos'ta Lean doğrulaması tamamlandı. "Bir matematikçi ile bir modelin bütün bu işi bir ayda yapabilmesi," diye yazdı Buckmaster, bunun öğrenci yetiştirme, emeğin kime ait sayılacağı, hakemlik ve bir insan ömrünün neye ayrılmaya değer olduğu sorularını yeniden açtığını belirterek. Bu durumu satranç bilgisayarı Deep Blue'nun Garry Kasparov'u yendiği ana benzetti. Fikrin kendisinin kendilerine ait olmadığını da vurguladı. Zorlanmış blowup inşasını yıllardır sürdüren İspanyol matematikçiler Diego Córdoba ve Luis Martínez-Zoroa'nın programını başlangıç noktası aldıklarını, modellerle yaptıklarının bu programı kaba zorlamadan pürüzsüz zorlamaya ve Euler denklemlerine taşımak olduğunu söyledi. Martínez-Zoroa'nın Fields Madalyası'nı hak ettiğini yazdı. Kendi makalelerinin sunum kalitesinden ise memnun değildi. Euler yazımı için kullandığı ifade sertti: "AI slop" — yapay zekâ döküntüsü. Bunun nedeninin dışarıdan gelen bir baskı olduğunu söyledi.
Üç günde kurulan baskı
Baskının hikâyesi 3 Eylül'de başlıyor. Buckmaster'a göre o gün, bir yapay zekâ şirketinin büyük bir açık problemi çözdüğü yönünde söylentiler dolaşıyordu ve Alpöge, kendi çalışmalarına ilişkin bilginin OpenAI'ye ulaştığına dair uyarılar almıştı. Buckmaster, OpenAI'de çalışan tanınmış bir matematikçiye e-posta yazarak durumu anlattı; çalışmanın kurumsal değil kişisel bir işbirliği olduğunu ve sonuçları yakında yayımlayacaklarını belirtti. Aynı gün gelen yanıtta, rekabete girmemek için detay paylaşmasının faydalı olacağı ve gerekirse OpenAI'nin hesaplama kaynağı sağlayabileceği söylendi. Buckmaster ertesi haftaya randevu istedi. Israrlı taleplerin ardından 6 Eylül Pazar günü iki telefon görüşmesi yapıldı. Görüşmelere OpenAI'nin matematik ekibini yöneten Sébastien Bubeck de katıldı. Alpöge hatta değildi. Buckmaster'ın anlatımına göre kendisine, OpenAI'nin dahili bir modelinin zorlanmış Navier-Stokes denklemleri için sonlu zamanda blowup kanıtı ürettiği söylendi. Kanıtın yaklaşık 100 sayfa olduğu belirtildi. Buckmaster kanıtı görmedi. Onu asıl tedirgin eden, tarif edilen yolun kendi izledikleri dar patika olmasıydı: Charles Fefferman'ın problem tanımındaki (c) ve (d) şıkları, yani pürüzsüz bir zorlama terimi üzerinden gidiş. "'Zorlanmış' kelimesini duyduğumda bu benim için parlak kırmızı bir bayraktı," diye yazdı. Bu yönün, bir modele problem metnini verip birkaç günde varılacak bir yön olmadığını savundu. Görüşme sırasında ilk anlatılanların değiştiğini de aktardı: Modele yalnızca problem metninin verildiği ve "çok az insan girdisi" kullanıldığı söylenmişken, ekip içi mesajlardan düzeltmeler geldikçe koca bir ekibin çalıştığı, önce daha kolay problemlerle başlandığı, gösterilen komut metninin bile Codex'e yazdırıldığı ve çok büyük miktarda hesaplama harcandığı ortaya çıktı. İlk komutun ne zaman gönderildiği sorusuna uzunca süre doğrudan yanıt verilmediğini, sonunda son birkaç gün içinde — yani kendi çalışmalarının haberi OpenAI'ye ulaştıktan sonra — gönderildiğinin kabul edildiğini yazdı. Buckmaster, proje boyunca bütün taslaklarını Codex oturumlarına girdiklerini hatırlatarak modelin bu verilere erişip erişmediğini sordu. Kullanıcı verisine bakılmadığı yanıtını aldı; eğitim verisi sorusuna yanıt alamadığını söyledi.
İki teklif
Buckmaster'a göre masaya iki öneri kondu. Birincisi, kendilerinin Euler sonucunu, OpenAI'nin ertesi gün Navier-Stokes sonucunu yayımlaması. İkincisi, Navier-Stokes sonucunu sunan makaleyi Buckmaster'ın tek başına yazması ve sonucu OpenAI'nin dahili modelinin çözdüğünü belirtmesi. Bubeck'in iki kez Alpöge'nin yazarlıktan çıkarılmasını istediğini, Alpöge'nin rakip şirket Anthropic'te çalışıyor olmasının "can sıkıcı" bulunduğunu aktardı. Her iki teklifi de reddetti. Yaşananları kamuoyuna açıklayacağını söylediğinde aldığı yanıtı açıklamasında doğrudan alıntıladı: "Kariyerini neden mahvedesin?" Akademisyen olduğunu ve bunun kariyerini neden bitireceğini sorduğunda gelen karşılık: "Nazik olmamı istemiyorsan, nazik olmak zorunda değilim." Bir süre sonra Alpöge'ye baş başa görüşme öneren bir mesaj geldi: "Tristan'ın şu anda tamamen aklıselim olduğundan emin değilim." Alpöge reddetti.
Karşı taraf
Bubeck pazartesi günü sosyal medyada, hakkında "yanlış ve kışkırtıcı" iddiaların dolaştığını, tartışmaya akademik normlara uygun şekilde dâhil olduğunu ve işin bu noktaya gelmesinden hayal kırıklığına uğradığını yazdı. OpenAI'nin konuya ilişkin resmî bir açıklaması bulunmuyor; şirketin salı günü açıklama yapması bekleniyor. Buckmaster ise açıklamasının sonunda ne iddia etmediğini sıralamaya özen gösterdi: OpenAI'nin kanıtını görmediğini, modelin ne yaptığını bilmediğini, verilerinin kullanılıp kullanılmadığını bilmediğini ve kimseyi bir şeyle suçlamadığını yazdı. Yalnızca kendisine ne söylendiğini, ne zaman söylendiğini ve ne teklif edildiğini kayda geçirdiğini belirtti. "Eğer bir OpenAI modeli Navier-Stokes'a giden boşluğu gerçekten kapattıysa," diye ekledi, "bu olağanüstü bir şeydir ve yüksek sesle söylenmelidir — ama tarihi bozulmadan."
Henüz hiçbir tarafın kanıtı hakem denetiminden geçmiş değil.
Hikaye devam edecek.