Deney, CozyBlaze kullanıcı adıyla bilinen bir yapay zekâ meraklısı tarafından gerçekleştirildi.
GPT-6 Astra’nın oyunu kontrol edebilmesi için değiştirilmiş bir SourcePauseTool ve Model Context Protocol tabanlı bir sistem kullanıldı.
Böylece model, basitleştirilmiş bir oyun simülasyonu yerine doğrudan Portal’ın üç boyutlu dünyasıyla etkileşime girdi.
Sistemde Astra’nın karar vermesi gereken anlarda oyun geçici olarak durduruldu.
Yapay zekâ bir sonraki hamlesini belirledikten sonra oyun yeniden çalıştırılarak seçilen hareket uygulandı.
Bu yöntemle modelin işlem süresi ile oyunun gerçek zamanlı fizik hesaplamaları arasındaki farkın deney üzerindeki etkisi azaltıldı.
Ham oynanış sürecinin yaklaşık 24 saat sürdüğü belirtilirken, bu süreç daha sonra yaklaşık iki saatlik bir gösterim videosuna dönüştürüldü.
Astra, Portal’ın bölümlerinde ilerleyerek çevresindeki nesneleri analiz etti, fizik tabanlı bulmacalarla etkileşime girdi ve oyunun finaline ulaşmayı başardı.
CozyBlaze’ın paylaştığı verilere göre Astra, oyunu tamamlayabilmek için yaklaşık 3.300 araç çağrısı yaptı.
API kullanımı üzerinden yapılan hesaplamada maliyetin 600 doların altında kaldığı belirtilirken, deneyin aylık 200 dolarlık Codex Pro aboneliği kapsamında gerçekleştirildiği aktarıldı.
CozyBlaze, çalışmanın resmi bir yapay zekâ benchmark testi olmadığını özellikle belirtiyor.
Buna rağmen daha önce tanımadığı bir 3D ortamda hareket eden ve fizik tabanlı bulmacaları çözmeye çalışan genel amaçlı bir modelin oyunu tamamlaması dikkat çekici.
Portal’ın yapay zekâ tarafından baştan sona oynanması, modellerin mekânsal muhakeme ve bağımsız karar verme konusunda geldiği noktayı göstermek açısından önemli bir deney olarak öne çıkıyor.