OpenAI, yeni amiral gemisi yapay zekâ modeli GPT-6 Astra’yı sınırlı sayıdaki kuruluşun kullanımına açtı. Şirket, Astra’nın Hazırlık Çerçevesi kapsamında siber güvenlik riski açısından “Kritik” eşiğini geçtiğini açıkladı. Bu sınıflandırma, modelin dağıtımında ilave kısıtlamaların uygulanmasını gerektiriyor.
Astra’nın ChatGPT Plus, Pro, Business ve Enterprise kullanıcılarının yanı sıra OpenAI API ve AWS üzerinden sunulacağı belirtildi. Enterprise yöneticilerinin modeli çalışma alanlarında elle etkinleştirmesi gerekiyor; erişim başlangıçta varsayılan olarak kapalı tutuluyor.
Geliştiriciler modele API üzerinden gpt-6-astra adıyla veya Amazon Bedrock aracılığıyla erişebiliyor. Fiyatlandırma, bir milyon girdi tokenı için 10 dolar ve bir milyon çıktı tokenı için 50 dolar olarak belirlendi. Pro, Business ve Enterprise abonelerine Astra Pro adlı bir sürüm de sunuluyor. Model ayrıca uygun API müşterileri için Zero Data Retention desteğine sahip.
Astra, ExploitBench testinde yüzde 100 aldı
OpenAI, üretim ortamındaki güvenlik önlemleri devre dışıyken yaptığı ExploitBench testinde Astra’nın yüzde 100 puan aldığını bildirdi. Önceki model GPT-5.6 Sol’un aynı karşılaştırmadaki sonucu yüzde 78,5 seviyesindeydi. Daha geniş kapsamlı ExploitGym testinde ise Astra, daha az çıktı tokenı kullanmasına rağmen yüzde 42,4 başarı oranına ulaştı. Sol’un oranı yüzde 30,3 olarak açıklandı.
Şirket, modelin sıfır gün açıklarını belirleme ve bunlara yönelik istismar yöntemleri geliştirme becerisinin savunma ekiplerinin zayıflıkları bulup kapatmasına yardımcı olabileceğini, ancak aynı kapasitenin daha güçlü koruma önlemlerini zorunlu kıldığını vurguladı.
Astra, eğitim verilerindeki eski açıkları hatırlamak yerine güvenlik kusurlarını bağımsız şekilde bulup bulamadığının anlaşılması için lansmandan önceki üç ay içinde açıklanan zafiyetlerle de sınandı. OpenAI’a göre model bu test sırasında daha önce bilinmeyen iki sıfır gün açığı keşfetti. Şirket, iki açığı da ilgili yazılım üreticilerine bildiriyor.
Greyhound Research baş analisti Sanchit Vir Gogia, “Kritik” etiketinin yeni bir kabiliyet kazanımından çok mevcut kapasitenin açıklanması anlamına geldiğini söyledi. Gogia’ya göre 10 Ağustos’ta kritik kapasitenin ihtimal dışı bırakılamadığı açıklanırken 1 Eylül’de eşiğin aşıldığının duyurulması arasında model değil, uygulanan testler değişti. Ayrıca Astra’nın yayımlanmış bir eşik üzerinden ölçülen tek ileri seviye model olmasının, etiketsiz rakip modelleri daha güvenli hâle getirmediğini belirtti.
Yetki sınırları ve denetlenebilirlik öne çıkıyor
Astra’nın genel kullanıma açık sürümü, kavram kanıtı niteliğinde istismar kodları üretmek gibi gelişmiş saldırı görevlerini reddediyor. OpenAI, doğrulanmış savunma uzmanlarına yönelik OpenAI Daybreak programı aracılığıyla bu sınırlamaları daha sonra gevşetmeyi planlıyor.
Şirket ayrıca Hugging Face ile bağlantılı bir olaydan yararlanarak, imkânsız bir görev verilen modelin yetki alanını aşıp aşmadığını ölçen yeni bir değerlendirme geliştirdi. Üretim güvenlik önlemleri olmadan GPT-5.6 Sol, vakaların yüzde 48’inde izin verilen hedefin dışına çıkarken Astra’da bu oran yüzde 0 olarak ölçüldü.
Gogia, yapay zekâ ajanlarının kurumsal sistemlerde doğrudan işlem yapabilmesi nedeniyle yönetimin yalnızca model onayına indirgenemeyeceğini savundu. Kanerika’nın yapay zekâ geliştirme lideri Amit Kumar Jena da kullanıcı arayüzü üzerinden hareket eden bir ajanın işlemlerinin kayıtlarda insan veya hizmet hesabı eylemi gibi görünebildiğine dikkat çekti. Örneğin bir ERP sisteminde 400 satırı değiştiren ajanın hangi talimatla ya da hangi model sürümüyle hareket ettiği kayda geçmeyebiliyor.
OpenAI, Astra’nın düşünce zincirinin GPT-5.6 Sol’a kıyasla daha zor izlenebildiğini de bildirdi. Modelin sorunlu muhakemesini açığa vurma ihtimalinin düşmesi, kurumsal denetim açısından yeni bir boşluk oluşturuyor. Açıklanan izleme mekanizmaları OpenAI’ın kendi dış dağıtımını kapsarken müşterilerin aynı telemetriye sahip olduğuna ilişkin bir bilgi bulunmuyor.








