OpenAI, henüz kamuya sunulmayan bir yapay zekâ modelinin yüzlerce açık matematik problemine yönelik yeni çözümler ürettiğini açıkladı. Toplam 722 matematik makalesi yayımlanırken, sonuçların önemli bir bölümü bilgisayar tarafından denetlenebilen matematiksel kanıtlarla destekleniyor.
Yapay zekânın bilimsel araştırmadaki rolünde dikkat çekici yeni bir eşik ortaya çıktı. OpenAI, kurum içinde geliştirdiği henüz yayımlanmamış bir yapay zekâ modelinin açık matematik problemleri üzerinde ürettiği geniş bir araştırma koleksiyonunu kamuoyuna açtı.
6 Ekim’de yayımlanan koleksiyonda 722 matematik makalesi bulunuyor. Makaleler, birbirleriyle ilişkili sonuçları bir araya getiren 372 ayrı sonuç ailesi altında toplanıyor.
OpenAI, modeli değerlendirme sürecinde yaklaşık 4 bin matematik problemiyle karşı karşıya bıraktığını açıkladı. Bunlardan elde edilen ve yeterli bilimsel önem taşıdığı değerlendirilen sonuçlar daha sonra makalelere dönüştürüldü.
Bağımsız Advisory Group on Mathematics and Artificial Intelligence (AGMAI) ise yayımlanan koleksiyonun “yüzlerce açık probleme çözüm bildirdiğini” belirtiyor.
Kanıtların bir bölümü bilgisayar tarafından doğrulanabiliyor
Çalışmayı özellikle önemli kılan noktalardan biri, sonuçların yalnızca yapay zekânın yazdığı metinlerden oluşmaması.
Makalelerin önemli bir bölümünde matematiksel kanıtlar Lean adı verilen biçimsel kanıt sistemiyle ifade edildi. Lean, bir matematiksel ispatın mantıksal adımlarını bilgisayarın tek tek kontrol etmesini sağlıyor.
Dolayısıyla bu çalışmaların bir bölümünde yapay zekânın ortaya attığı sonucun yanında, kanıtın mantıksal geçerliliğini makineyle sınamaya olanak veren bir yapı da bulunuyor.
Ancak 722 makalenin tamamı Lean ile doğrulanmış değil. OpenAI, biçimsel doğrulaması bulunmayan bazı sonuçlarda sorunlar olabileceğini ve hatalar ortaya çıktıkça çalışmaların düzeltileceğini açıkça belirtiyor.
Yapay zekâ matematik araştırmacısına mı dönüşüyor?
Gelişmenin asıl önemi burada ortaya çıkıyor. Büyük dil modelleri birkaç yıl öncesine kadar ağırlıklı olarak mevcut matematik problemlerini çözme yetenekleriyle sınanıyordu.
Yeni çalışma ise yapay zekânın cevabı daha önce bilinmeyen araştırma problemleri üzerinde çalışarak yeni matematiksel sonuçlar üretmesi iddiasını çok daha büyük bir ölçeğe taşıyor.
OpenAI’ye göre modelin kabul edilen her bir sonucu üretmek için kullandığı hesaplama gücü, ortalama yaklaşık üç saatlik ChatGPT Pro düşünme sürecine eşdeğerdi.
Çalışmalar saf matematikten teorik bilgisayar bilimine ve matematiksel fiziğe kadar geniş bir alana yayılıyor.
Matematikçiler şimdi yüzlerce sonucu inceleyecek
Bununla birlikte yayımlanan 722 makaleyi, matematik dünyasının doğruladığı 722 yeni keşif olarak değerlendirmek doğru değil.
OpenAI’nin danıştığı bağımsız AGMAI grubu da bu konuda açık bir uyarıda bulunuyor: Çalışmaların kamuya açılması değerlendirme sürecinin sonu değil, başlangıcı.
Grup, sonuçların öneminin ve matematiksel doğruluğunun nihai değerlendirmesini ancak matematik topluluğunun yapabileceğini belirtiyor.
Dolayısıyla ortaya çıkan tablo iki yönlü: Yapay zekâ yüzlerce açık matematik problemine çözüm sunmuş durumda; şimdi matematikçiler bu çözümlerin hangilerinin gerçekten doğru, yeni ve önemli olduğunu belirleyecek.
Eğer sonuçların büyük bölümü bağımsız incelemelerden geçerse, çalışma yapay zekânın yalnızca insanların oluşturduğu bilgiyi işleyen bir araç olmaktan çıkıp yeni bilimsel bilgi üreten bir araştırma aracına dönüşmesinde önemli bir dönüm noktası olabilir.

