OpenAI, yapay zekâ mimarisinde yeni bir dönemi başlatan amiral gemisi modeli GPT-6 Astra‘yı resmi olarak tanıttı. GPT-5 ailesinin son sürümü GPT-5.6 Sol’dan yaklaşık iki ay sonra sahneye çıkan yeni model; otonom bilgisayar kullanımı, karmaşık bilimsel problem çözümü ve siber güvenlik kabiliyetleriyle dikkat çekiyor. OpenAI Başkanı Greg Brockman lansmanla birlikte yaptığı açıklamada, Astra’nın yapay genel zekânın (AGI) fiili başlangıcı olarak kabul edilebileceğini ve sektörün artık resmen AGI çağına adım attığını ifade etti.
Otonom bilgisayar kullanımı: KiCad’den Blender ve Unreal Engine 5’e
Astra, yalnızca metin veya kod üreten bir sistem olmanın ötesine geçerek grafik arayüzleri insan gibi doğrudan kontrol edebilen gelişmiş bir bilgisayar operatörü (Computer-Using Agent) kimliği kazanıyor:
- Masaüstü ve Web Görevleri: CRM kayıtlarını güncelleme, form doldurma, takvim yönetimi, web araştırması yapıp bulguları doğrudan belgelere veya e-postalara dökme işlevlerini baştan sona tek başına yürütüyor.
- Mühendislik ve Tasarım Yetenekleri: KiCad üzerinde karmaşık bir devre şemasını doğrudan üretilebilir bir PCB kart tasarımına dönüştürebiliyor; Blender’da modellediği bir yapıyı Unreal Engine 5 içerisine aktararak içinde serbestçe gezilebilir interaktif bir 3D sahne haline getirebiliyor.
- Benchmark Performansı: OSWorld 2.0 testlerinde GPT-5.6 Sol’a göre %47 daha kısa sürede çok daha yüksek başarı sağlayan model, yenilenen Codex altyapısı sayesinde Mind2Web testinde görev tamamlama hızını 1,9 katına çıkardı.
Profesyonel iş akışları ve bağlam koruma mimarisi
Kurumsal ortamlardaki operasyonel verimlilik hedeflenerek eğitilen modelde önemli yapısal iyileştirmeler bulunuyor:
- Stil ve Şablon Uyumu: Şirket içi raporlama şablonlarına, kurumun resmi görsel ve edebi stiline harfiyen uyum sağlayarak doğrudan kullanıma hazır sunum, analiz ve elektronik tablo çıktıları üretiyor.
- Gereksiz Ayrıntılardan Arındırma: Yalnızca görevin neticesine etki eden kritik bağlamı kullanarak gereksiz bilgi kalabalığını çıktılardan eliyor.
- Araya Giren Talimat Dengesi: Çalışma sırasında kullanıcıdan gelen yeni yönlendirmeleri ana görevi unutmadan mevcut plana entegre edebiliyor; karar anlarında inisiyatif alarak rutin eksikleri tamamlıyor veya kritik durumlarda kullanıcıya soru yöneltiyor.
- Bağlam Pencereleri Arası Not Saklama: Codex ortamında uzun oturumlarda yaşanan bilgi kayıplarını önlemek için bağlam pencereleri arasında notları ve test çıktılarını aranabilir bir biçimde koruyan yeni bir deneysel hafıza katmanı sunuluyor.
Matematik, bilim ve siber güvenlikte kırılan rekorlar
Astra; FrontierMath Tier 4’te %98, ARC-AGI-3’te %99,9 ve ExploitBench’te %100 başarı oranı elde ederek sektör benchmarklarını baştan tanımladı:
- Sıfırıncı Gün (0-Day) Keşifleri: Bilinen yazılım açıklarını çalışan istismarlara dönüştürme testinde kusursuz (%100) skor alan Astra, Haziran-Ağustos 2026 dönemini kapsayan taze güvenlik açıklarında daha önce bilinmeyen iki kritik sıfırıncı gün açığını bizzat tespit etti (açıklar ilgili geliştiricilere bildirildi).
- Tersine Mühendislik (SRE-Bench): Kaynak kodsuz mantık çözümlemede görevlerin %88’ini tek denemede, %99,2’sini ise dört denemede çözerek GPT-5.6 Sol’un (%55,9 ve %68,7) oldukça önüne geçti.
- Kısıtlamalara Bağlılık: Yetki dışı görev dayatıldığında sınırları aşma oranı GPT-5.6 Sol’da %48 iken, güvenlik bariyerleri güçlendirilen Astra yapılan testlerde %0 kural ihlali gerçekleştirdi.
Güvenlik endişesi: “Opaque Recurrence” ve denetim zorluğu
Modelin düşünce süreçlerinin şeffaflığı konusunda ise araştırmacıları endişelendiren yeni bir mimari tartışma başladı:
- Gizli Yineleme (Opaque Recurrence): Astra’nın problemleri sıralı doğrusal adımlar yerine aynı sorgu üzerinde döngüsel olarak ele almasına imkân tanıyan “recurrent depth” tekniği, modelin geleneksel düşünce zinciri (Chain of Thought – CoT) izlerini azaltıyor.
- İzlenebilirlik Riski: Modelin dışarıya yansıyan yazılı düşünce adımlarının azalması, sistemin hatalı veya istenmeyen bir davranışı hangi mantıksal gerekçeyle sergilediğini denetlemeyi zorlaştırıyor. OpenAI bu riski kontrol etmek amacıyla modelin hareketlerini arka planda izleyen bağımsız denetim sistemleri kullanıyor.
Çıkış takvimi, abonelikler ve API fiyatlandırması
- Kullanıcı Erişimi: İlk aşamada seçili kurumsal iş ortaklarına sunulan model; kademeli olarak ChatGPT Plus, Pro, Business ve Enterprise abonelerine açılıyor. Pro ve Enterprise paketleri GPT-6 Astra Pro varyantına da erişebilecek.
- OpenAI API & Amazon Bedrock: Geliştiriciler modele
gpt-6-astraadıyla API üzerinden ve AWS Bedrock aracılığıyla erişebilecek. - API Fiyatlandırma Tarifesi:
- 1 Milyon Giriş (Input) Tokenı: 10 Dolar
- 1 Milyon Çıkış (Output) Tokenı: 50 Dolar
