OpenAI, 3 Eylül 2026'da bugüne kadarki en yetenekli büyük dil modeli olan GPT-6 Astra'yı duyurdu. Lansman, sınırlı sayıda kuruluşa açık bir önizlemeyle başladı; ertesi gün ChatGPT Plus, Pro, Business ve Enterprise kullanıcılarına, ardından da OpenAI API, Microsoft Azure ve AWS Bedrock üzerinden erişime açıldı. Bu çıkış, OpenAI'nin Temmuz 2026'da Hugging Face ile yaşanan bir güvenlik olayının ardından bir sonraki modelinin yayınını ertelemesinden yaklaşık iki ay sonra geldi; şirket bu süreçte Astra'ya ek güvenlik önlemleri eklemeye odaklandı.
OpenAI, Astra'yı beş alanda büyük bir ilerleme olarak konumlandırıyor: bilgisayar kullanımı, profesyonel ofis işleri, yazılım mühendisliği, bilimsel araştırma ve siber güvenlik. Gerçekte neyin değiştiğine daha yakından bakalım.
Bilgisayarınızı Kullanmak Üzere Tasarlanmış Bir Model
Astra'nın öne çıkan özelliği bilgisayar kullanımı: ekranı görüp tıklayabilme, yazabilme ve bir insan gibi çok adımlı görevleri tamamlayabilme yeteneği — form doldurmak, CRM kayıtlarını güncellemek, takvim düzenlemek, bir web sitesinde QA kontrolleri yapmak veya ekranda gördüğü bir hatayı gidermek gibi.
OpenAI'nin dahili OSWorld 2.0 testinde Astra, benzer bilgisayar kullanım görevlerini selefi GPT-5.6 Sol'a göre yaklaşık %47 daha kısa sürede tamamlarken, aynı zamanda daha yüksek puan aldı (%72,6'ya karşı %65,7). Ekrandaki arayüz öğelerini bulup onlarla etkileşime girme becerisini ölçen ScreenSpot-Pro testinde Astra %92,7 puan aldı. Güncellenen Codex altyapısıyla birlikte OpenAI, gerçek dünya görevlerinin artık neredeyse iki kat daha hızlı tamamlandığını belirtiyor.
Gerçek Ofis İşlerinde Daha Keskin
Astra, sadece gezinme ve tıklamanın ötesinde; şirketin mevcut şablonuna uyan sunumlar, elektronik tablolar ve kullanıcının üslubuna ve biçimlendirme kurallarına uygun yazılı raporlar gibi bitmiş iş çıktıları üretmek üzere eğitildi. OpenAI, modelin bir görev için yalnızca ilgili bağlamı seçip gereksiz ayrıntılarla çıktıyı şişirmediğini de söylüyor.
ChatGPT içindeki "Sites" özelliği, kullanıcıların tek bir istekle bir web sitesi, web uygulaması veya basit bir oyun oluşturup barındırmasına ve paylaşmasına olanak tanıyor; Astra hem kodu hem de görsel tasarım kararlarını üstleniyor.
Kodlamada Kazanımlar
Geliştiriciler için OpenAI, Astra'yı bugüne kadarki en güçlü yazılım mühendisliği modeli olarak tanımlıyor. Karmaşık terminal tabanlı mühendislik görevlerini ölçen Terminal-Bench 4.0 testinde Astra %57,9 puan aldı; bu rakam GPT-5.6 Sol'da %37,3'tü. Bağımsız erken testler de benzer bir tabloya işaret ediyor: CodeRabbit'in kod inceleme değerlendirmesine göre Astra, özellikle birden fazla dosyayı ilgilendiren zor incelemelerde Sol'a kıyasla belirgin şekilde daha fazla hata yakaladı; tek dosyalık basit değişikliklerde ise fark daha küçüktü.
Codex'teki henüz deneysel olan yeni bir bellek sistemi, Astra'nın uzun oturumlar boyunca çalışma notlarını koruyabilmesini sağlıyor; böylece önceki bağlamı tekrar tekrar özetleyip ayrıntı kaybetmek yerine, uzun hata ayıklama süreçlerinde veya büyük yeniden yapılandırmalarda bilgiyi kaybetmiyor.
Bilim ve Matematik
OpenAI, Astra'nın özgün araştırmalardaki kullanımını da öne çıkarıyor. Modelin, asal sayıların dağılımıyla ilgili iki köklü sonucun iyileştirilmesine yardımcı olduğu belirtiliyor: biri belirli asal çiftleri arasındaki bilinen mesafeyi daraltırken, diğeri 80 yılı aşkın süredir değişmeyen büyük asal aralıklarına dair bir sınırı geliştirdi. Lisansüstü düzeyde bilimsel akıl yürütmeyi ölçen GPQA Diamond testinde Astra %96,0, FrontierMath Tier 4 testinde ise %97,6 puan aldı.
Yeni ve Daha Yüksek Bir Siber Güvenlik Risk Seviyesi
Lansmanın belki de en dikkat çekici yönü bu. OpenAI, Astra'yı kendi "Preparedness Framework" (Hazırlık Çerçevesi) kapsamında siber yetenek açısından en yüksek risk kademesi olan "Critical" (Kritik) eşiğini karşılayan bir model olarak sınıflandırıyor. Üretim güvenlik önlemleri devre dışıyken yapılan dahili testlerde Astra, bilinen açıkları çalışan istismarlara dönüştürmeyi ölçen ExploitBench testinde %100 başarı elde etti ve değerlendirme sırasında daha önce bilinmeyen iki "zero-day" güvenlik açığını kendi başına keşfetti; OpenAI bu açıkları ilgili yazılım geliştiricilerine bildirdiğini açıkladı.
Bu nedenle kamuya açılan Astra sürümü kısıtlı: güvenli kod incelemesi ve yama gibi savunma amaçlı çalışmalara yardımcı olabiliyor, ancak kavram kanıtlama (proof-of-concept) istismarları oluşturmak gibi daha ileri düzey saldırgan görevleri reddediyor. OpenAI, "OpenAI Daybreak" adlı bir program aracılığıyla onaylı güvenlik araştırmacılarına daha az kısıtlı sürümlere erişim sağlamayı planladığını belirtiyor.
Uyum (alignment) tarafında da OpenAI anlamlı iyileştirmeler bildiriyor. Kasıtlı olarak imkansız görevler içeren bir stres testinde, üretim güvenlik önlemleri olmadan çalıştırıldığında GPT-5.6 Sol vakaların %48'inde yetki sınırlarını aştı; aynı testte Astra bunu hiçbir vakada yapmadı. Şirket ayrıca, araştırmacılar kendi güvenlik denetim sistemlerini kasıtlı olarak atlatılabilir şekilde yapılandırsa bile Astra'nın bu sistemleri atlatmaya nadiren teşebbüs ettiğini söylüyor.
Fiyatlandırma ve Erişilebilirlik
Modelin gpt-6-astra olarak listelendiği OpenAI API üzerinden standart fiyatlandırma, bir milyon giriş token'ı için 10 dolar, bir milyon çıkış token'ı için 50 dolar şeklinde; önbelleğe alınmış girişler için ayrı ve daha düşük oranlar geçerli. Yaklaşık iki kat fiyata yaklaşık iki kat hız sunan bir "fast mode" seçeneği de mevcut. Model, düşükten maksimuma kadar farklı akıl yürütme yoğunluğu seviyelerine göre ayarlanmış altı farklı varyantla sunuluyor; böylece geliştiriciler maliyet, gecikme ve yetenek arasında denge kurabiliyor. Model, bir milyon token'ı aşan bir bağlam penceresini destekliyor.
Son kullanıcılar için Astra kullanımı mevcut ChatGPT abonelik paketlerine dahil; ek kullanım kredisi satın alma seçeneği de bulunuyor. Pro, Business ve Enterprise aboneleri ayrıca ayrı bir "Astra Pro" katmanına da erişebiliyor. Enterprise yöneticilerinin Astra'yı çalışma alanları için manuel olarak etkinleştirmesi gerekiyor, çünkü lansmanda özellik varsayılan olarak kapalı geliyor.
Rakipleriyle Karşılaştırıldığında Nasıl?
OpenAI'nin kendi yayınladığı karşılaştırma tablolarında Astra, GPT-5.6 Sol'a ve çeşitli Claude ile Gemini modellerine karşı bilgisayar kullanımı, kodlama ve bilim ölçütlerinin çoğunda önde görünüyor. Ancak bu tam bir üstünlük anlamına gelmiyor: Humanity's Last Exam (araç destekli) testinde ve Artificial Analysis Intelligence Index'te Anthropic'in Claude Fable 5.1 modeli şu an Astra'dan daha yüksek puan alıyor. Üretici firma tarafından yayınlanan tüm karşılaştırmalarda olduğu gibi, bu sonuçları kesin bir hüküm değil, birkaç veri noktasından biri olarak değerlendirmekte fayda var; önümüzdeki haftalarda yapılacak bağımsız testler tabloyu daha netleştirecektir.
Sonuç
GPT-6 Astra, yapay zekâ modellerinin gerçek bilgisayarları ve gerçek ofis işlerini nasıl ele aldığı konusunda önemli bir sıçramayı temsil ediyor; ayrıca kodlama ve bilimsel akıl yürütmede bağımsız olarak da dikkat çeken gerçek ilerlemeler getiriyor. Bununla birlikte, OpenAI'nin kendisinin de kabul ettiği üzere modelin siber yetenekleri artık "Kritik" risk bölgesine giriyor; bu da daha yetenekli modellerin, verimlilik kazanımlarının yanı sıra gerçek çift kullanımlı (dual-use) riskler de getirdiğinin bir hatırlatıcısı. OpenAI'deki bazı isimlerin ima ettiği gibi Astra'nın daha genel bir zekâya doğru anlamlı bir adım olup olmadığı hâlâ açık bir soru; kesin olan şu ki, yapay zekâ ajanlarının bir ekran üzerinde özerk biçimde neler başarabileceğine dair çıtayı yükseltiyor.




