GPT-6 Astra, Portal görevini 24 saatte kendi başına başarıyla bitirdi!

GPT-6 Astra, Valve’ın klasik bulmaca oyunu Portal’ı yaklaşık 24 saatlik bir süreçte baştan sona tamamladı. Deneyde yapay zekâ, oyunun gerçek 3D versiyonunda ilerlerken herhangi bir rehber, walkthrough veya önceden hazırlanmış hareket dizisinden yararlanmadı. Astra’nın yaklaşık 3.300 araç çağrısı gerçekleştirdiği deney, yapay zekânın oyunlardaki problem çözme ve mekânsal muhakeme yeteneklerini gözler önüne serdi.

Deney, CozyBlaze kullanıcı adıyla bilinen bir yapay zekâ meraklısı tarafından gerçekleştirildi.

GPT-6 Astra’nın oyunu kontrol edebilmesi için değiştirilmiş bir SourcePauseTool ve Model Context Protocol tabanlı bir sistem kullanıldı.

Böylece model, basitleştirilmiş bir oyun simülasyonu yerine doğrudan Portal’ın üç boyutlu dünyasıyla etkileşime girdi.Sistemde Astra’nın karar vermesi gereken anlarda oyun geçici olarak durduruldu.

Yapay zekâ bir sonraki hamlesini belirledikten sonra oyun yeniden çalıştırılarak seçilen hareket uygulandı.

Bu yöntemle modelin işlem süresi ile oyunun gerçek zamanlı fizik hesaplamaları arasındaki farkın deney üzerindeki etkisi azaltıldı.Ham oynanış sürecinin yaklaşık 24 saat sürdüğü belirtilirken, bu süreç daha sonra yaklaşık iki saatlik bir gösterim videosuna dönüştürüldü.

Astra, Portal’ın bölümlerinde ilerleyerek çevresindeki nesneleri analiz etti, fizik tabanlı bulmacalarla etkileşime girdi ve oyunun finaline ulaşmayı başardı.CozyBlaze’ın paylaştığı verilere göre Astra, oyunu tamamlayabilmek için yaklaşık 3.300 araç çağrısı yaptı.

API kullanımı üzerinden yapılan hesaplamada maliyetin 600 doların altında kaldığı belirtilirken, deneyin aylık 200 dolarlık Codex Pro aboneliği kapsamında gerçekleştirildiği aktarıldı.CozyBlaze, çalışmanın resmi bir yapay zekâ benchmark testi olmadığını özellikle belirtiyor.

Buna rağmen daha önce tanımadığı bir 3D ortamda hareket eden ve fizik tabanlı bulmacaları çözmeye çalışan genel amaçlı bir modelin oyunu tamamlaması dikkat çekici.

Portal’ın yapay zekâ tarafından baştan sona oynanması, modellerin mekânsal muhakeme ve bağımsız karar verme konusunda geldiği noktayı göstermek açısından önemli bir deney olarak öne çıkıyor.

İLGİLİ HABERLER