OpenAI'ın Yeni Modeli GPT-6 Astra Uzamsal Akıl Yürütmede Öne Çıkıyor

OpenAI tarafından geliştirilen GPT-6 Astra, robotik sistemlerin fiziksel dünyayı anlama ve nesnelerle etkileşime girme becerisinde önemli bir ilerleme kaydediyor. StationeryBench adı verilen yeni bir kıyaslama testinde, modelin karmaşık fiziksel görevleri yerine getirme kapasitesi Ai2'nin MolmoAct2 modeliyle karşılaştırıldı.
Test kapsamında her iki model de aynı çift kollu YAM robotlarını kullanarak 200 deneme gerçekleştirdi. Aynı testlerde MolmoAct2 hiçbir görevi tam olarak bitiremedi. Başarı puanı ortalamasında ise Astra 100 üzerinden 46 alırken, rakibi 12 puanda kaldı.
Cornell Üniversitesi ve Google DeepMind araştırmacısı Yoav Artzi, bu performansı uzamsal akıl yürütme alanında bir basamak değişimi olarak nitelendiriyor. Henüz yayımlanmamış olan REMAP kıyaslama testlerinde ise modelin insan seviyesine yakın bir doğruluk oranına ulaştığı gözlemlendi. Uzmanlar, bu gelişmenin arkasında modelin Blender sahneleri gibi yoğun miktarda 3D veriyle eğitilmiş olabileceği ihtimali üzerinde duruyor.
OpenAI, bu teknolojik ilerlemeleri uzun vadeli hedefi olan tüketici odaklı robotlar geliştirme stratejisi doğrultusunda kullanmayı planlıyor. Çalışmaya ait tüm veriler, videolar ve yazılım kodları ise GitHub üzerinden erişime açıldı.


