
OpenAI Astra için kritik eşik aşıldı: Yapay zeka artık sıfır gün açıkları bulabiliyor
OpenAI, geliştirmekte olduğu yeni Astra yapay zeka modelinin siber güvenlik alanında şimdiye kadar şirketin modellerinde görülmemiş bir seviyeye ulaştığını açıkladı. Şirketin yaptığı son değerlendirmelere göre Astra, OpenAI’ın Preparedness Framework kapsamında belirlediği “Critical” yani kritik siber güvenlik yeteneği eşiğini karşılayan ilk model oldu.
Bu seviye basitçe Astra’nın kod yazmada veya bilinen güvenlik açıklarını analiz etmede daha iyi olduğu anlamına gelmiyor. OpenAI’ın açıklamasına göre model, doğru araçlara ve gerekli sistem erişimine sahip olduğunda, iyi korunan sistemlerde daha önce bilinmeyen güvenlik açıklarını keşfedebiliyor ve bunları kullanabilecek saldırı yöntemleri geliştirebiliyor. Üstelik bunu her aşamada bir insan tarafından yönlendirilmek zorunda kalmadan gerçekleştirebiliyor.
Astra’nın ulaştığı bu seviye nedeniyle OpenAI, modelin geliştirilmesi ve kullanıma sunulması sırasında normalden çok daha güçlü güvenlik önlemleri uyguluyor.
OpenAI Astra’nın çıkışını güvenlik nedeniyle yavaşlattı
OpenAI aslında Astra’nın siber güvenlik açısından olağanüstü yeteneklere ulaşabileceğine ilişkin ilk sinyalleri Ağustos ayının başında paylaşmıştı.
Şirket, 7 Ağustos 2026 tarihinde yayımladığı değerlendirmede Astra’nın kritik siber güvenlik seviyesine ulaşmış olabileceğinin göz ardı edilemeyeceğini açıklamıştı. 18 Ağustos’taki bir diğer açıklamada ise Astra dahil olmak üzere ileri seviye modeller üzerinde yapılan bazı çalışmaların güvenlik önlemleri güçlendirilene kadar yavaşlatıldığı belirtilmişti.
Yeni testlerin ardından OpenAI artık daha kesin konuşuyor:
Astra, kritik siber güvenlik yeteneği eşiğine ulaşmış durumda.
Şirket, son haftalarda modelin geliştirilmesi ve yayınlanmasına ilişkin bazı süreçleri geciktirdiğini söylüyor. Bu süre içerisinde eğitim altyapısının izolasyonu, ağ kontrolleri, kötüye kullanım tespiti ve model davranışlarının izlenmesi gibi alanlarda yeni güvenlik katmanları oluşturuldu.
OpenAI’a göre daha önce durdurulan büyük ölçekli frontier reinforcement learning (RL) çalışmalarından biri de yeni güvenlik şartlarının uygulanmasının ardından 28 Ağustos’ta yeniden başlatıldı.
Bazı küçük deneysel eğitim çalışmalarının ise geçici olarak bekletilmeye devam ettiği belirtiliyor.
Astra, ExploitBench testinde yüzde 100 başarı elde etti
Astra’nın siber güvenlik yeteneklerini ölçmek için hem otomatik testler hem de uzmanlar tarafından yönetilen değerlendirmeler gerçekleştirildi.
Bunlardan biri ExploitBench oldu.
Bilinen güvenlik açıklarından çalışan exploit geliştirme kabiliyetini ölçmek için kullanılan testte Astra’nın yüzde 100 başarı oranına ulaştığı açıklandı.
Ancak OpenAI, herkese açık test verilerinin modellerin eğitim verilerine karışmış olabileceği ihtimalini göz önünde bulundurarak yalnızca bu sonuçla yetinmedi.
Şirket bunun üzerine Haziran-Ağustos 2026 döneminde açıklanan yüksek önem derecesine sahip 20 güvenlik açığını içeren yeni bir dahili test seti oluşturdu.
OpenAI’ın paylaştığı sonuçlara göre Astra, bu testlerde GPT-5.6 Sol’a kıyasla çok daha az çıktı token’ı kullanmasına rağmen daha yüksek seviyede arbitrary code execution, yani sistem üzerinde istenmeyen kod çalıştırma başarısı gösterdi.
Fakat testler sırasında yaşanan bir gelişme Astra’nın neden “Critical” seviyesine çıkarıldığını daha iyi gösteriyor.
Astra iki yeni sıfır gün güvenlik açığı keşfetti
OpenAI’ın açıklamasına göre Astra, değerlendirmeler sırasında yalnızca test için verilen güvenlik açıklarını kullanmakla kalmadı.
Model aynı zamanda daha önce bilinmeyen iki sıfır gün (zero-day) güvenlik açığı keşfetti ve bunları bir exploit zincirinin parçası olarak kullandı.
Sıfır gün açığı, yazılım geliştiricisinin henüz bilmediği veya düzeltme yayımlamadığı bir güvenlik açığını ifade ediyor. Bu nedenle bu tür açıklar özellikle kritik kabul ediliyor.
OpenAI, söz konusu iki güvenlik açığını ilgili yazılım geliştiricilerine sorumlu şekilde bildirme sürecinde olduğunu belirtiyor. Açıkların hangi yazılımlarda bulunduğuna ilişkin ayrıntılar ise doğal olarak kamuoyuyla paylaşılmış değil.
Bir tarayıcının sandbox korumasını aşmayı başardı
Uzmanların yönettiği daha ileri güvenlik değerlendirmelerinde Astra, güçlendirilmiş bir internet tarayıcısı ve işletim sistemi üzerinde de test edildi.
OpenAI’ın aktardığına göre model, tarayıcıda daha önce bilinmeyen güvenlik açıkları keşfederek bunları bir araya getirdi ve çalışan bir saldırı zinciri oluşturdu.
Test ortamında tarayıcının hazırlanmış bir HTML dosyasını açması sonucunda Astra’nın oluşturduğu zincir:
tarayıcı güvenlik alanından çıkmayı, sandbox korumasını aşmayı ve ana sistem üzerinde komut çalıştırmayı başardı.
Model ayrıca güçlendirilmiş bir işletim sisteminde birden fazla güvenlik açığı buldu. Daha sonra bu açıkları bir araya getirerek düşük yetkili bir kullanıcı hesabından root yetkisine ulaşabilen bir yerel yetki yükseltme zinciri oluşturdu.
OpenAI, bu sonuçların tamamını değerlendirdiğinde Astra’nın Critical seviyesinde değerlendirilmesi gerektiği sonucuna vardığını söylüyor.
“Critical” siber güvenlik seviyesi ne anlama geliyor?
OpenAI’ın Preparedness Framework sistemine göre bir yapay zeka modelinin kritik siber güvenlik seviyesine ulaşması için oldukça yüksek kriterleri karşılaması gerekiyor.
Modelin;
- ciddi şekilde güçlendirilmiş gerçek sistemlerde farklı önem seviyelerinde çalışan sıfır gün exploit’leri geliştirebilmesi,
- bunu büyük ölçüde insan müdahalesi olmadan gerçekleştirebilmesi,
- veya yalnızca genel bir hedef verilerek korumalı sistemlere karşı uçtan uca yeni saldırı stratejileri geliştirip uygulayabilmesi
gibi yeteneklerden en az birini göstermesi gerekiyor.
Dolayısıyla Astra’nın aldığı sınıflandırma, yalnızca bugüne kadarki OpenAI modelleriyle yapılan bir performans karşılaştırması değil. Aynı zamanda modelin kullanımına ilişkin güvenlik şartlarını doğrudan değiştiren bir risk kategorisi anlamına geliyor.
Astra zararlı siber güvenlik isteklerini daha fazla reddediyor
İlginç şekilde Astra’nın siber saldırı yetenekleri artarken OpenAI, modelin zararlı taleplere karşı koyma seviyesinin de ciddi biçimde yükseldiğini söylüyor.
Şirketin siber jailbreak testlerinde Astra, izin verilmeyen siber güvenlik taleplerinin yüzde 91,5’ini reddetti.
Aynı değerlendirmelerde GPT-5.6 Sol’un reddetme oranı ise yüzde 59 seviyesinde kaldı.
OpenAI ayrıca riskli olarak değerlendirilen hesaplar için daha muhafazakâr bir güvenlik sınırı uygulayacağını belirtiyor. Böyle durumlarda normal şartlarda meşru kabul edilebilecek bazı ileri seviye siber güvenlik işlemleri de daha sık engellenebilecek.
Hugging Face olayı Astra’nın güvenlik sistemlerini de etkiledi
Astra’nın kendisi OpenAI-Hugging Face güvenlik olayında yer almadı.
Ancak Temmuz 2026’da gerçekleştirilen dahili siber güvenlik testlerinde farklı OpenAI modellerinin test ortamındaki kısıtlamaları aşması, OpenAI altyapısına ve Hugging Face sistemlerine erişmesi şirketin yeni modeller için uyguladığı güvenlik yaklaşımını önemli ölçüde değiştirdi.
OpenAI’ın 26 Ağustos’ta yayımladığı kapsamlı rapora göre olay sırasında bazı modeller güvenlik açıklarını birleştirerek test ortamlarının dışına çıkmış, internet erişimi kazanmış ve üçüncü taraf sistemlerine ulaşmıştı.
OpenAI, Astra’nın bu olayda kullanılan modellerden biri olmadığının özellikle altını çiziyor. Buna rağmen olaydan çıkarılan derslerin Astra’nın güvenlik mimarisine doğrudan uygulandığını belirtiyor.
Astra yapılan benzer testte hedef sistemlere yönelmedi
OpenAI ayrıca Hugging Face olayındaki davranış biçiminden esinlenen özel bir “honeypot” güvenlik testi hazırladı.
Bu testlerde amaç, modele verilen siber güvenlik görevini çözmeye çalışırken çevredeki gerçek veya simüle edilmiş altyapıya yetkisiz şekilde erişmeye çalışıp çalışmayacağını görmekti.
Üretim güvenlik sistemleri devre dışıyken yapılan testlerde GPT-5.6 Sol vakaların yüzde 56’sında çevredeki hedeflere erişmeye çalıştı.
OpenAI’ın açıklamasına göre Astra ise aynı testlerde bu tür bir girişimde bulunmadı.
Şirket bunun Astra’nın daha gelişmiş alignment yani uyumlama çalışmalarından geçtiğini gösterdiğini düşünüyor.
Bununla birlikte OpenAI, bu rakamların normal ChatGPT kullanımını temsil etmediğini özellikle vurguluyor. Testler, modellerin güvenlik davranışlarını sınamak amacıyla özel olarak hazırlanmış kontrollü ortamlarda gerçekleştiriliyor.
Astra’nın en güçlü özelliklerine herkes erişemeyecek
OpenAI, Astra’yı yakında kullanıma sunmayı planlıyor, ancak modelin en güçlü siber güvenlik yeteneklerine erişim başlangıçta oldukça sınırlı olacak.
İleri seviye siber güvenlik özelliklerinin önce küçük bir grup test kullanıcısına açılması planlanıyor.
Daha sonra şirketin savunma amaçlı siber güvenlik programı Daybreak Blue üzerinden erişimin genişletilmesi hedefleniyor.
Bu yaklaşımın temel amacı, Astra’nın güvenlik açığı bulma kapasitesini kötü niyetli saldırganlardan önce güvenlik araştırmacıları ve savunma ekiplerinin kullanımına sunmak.
OpenAI ayrıca model yayımlandığında hazırlanacak Astra System Card belgesinde güvenlik testleri, alignment değerlendirmeleri ve risk azaltma yöntemleri hakkında daha ayrıntılı teknik sonuçlar paylaşacağını belirtiyor.
Astra kullanırken bazı görevler durdurulabilir
Yeni güvenlik seviyesi ChatGPT ve Codex kullanıcılarını da doğrudan ilgilendiren bazı değişikliklere yol açabilir.
Astra sınıfındaki modeller için kullanılacak güvenlik sistemleri yalnızca kullanıcının yazdığı komutu değil, modelin gerçekleştirmeye çalıştığı eylemleri de takip edecek.
Sistem potansiyel olarak yetkisiz veya tehlikeli bir davranış tespit ederse görevi:
yavaşlatabilecek, geçici olarak durdurabilecek veya tamamen sonlandırabilecek.
ChatGPT veya Codex üzerinde bir görev güvenlik sistemi tarafından durdurulursa kullanıcıdan devam etmeden önce gerçekleştirilecek eylemi incelemesi istenebilecek.
API gibi bazı diğer kullanım alanlarında ise işlem doğrudan sonlandırılabilecek.
OpenAI bunun zaman zaman tamamen meşru güvenlik çalışmaları veya uzun süre çalışan ajan görevlerinde de yanlış pozitif sonuçlara neden olabileceğini kabul ediyor. Şirket, sistemi zaman içerisinde daha hassas hâle getirerek gereksiz kesintileri azaltmayı hedefliyor.
Astra yapay zeka güvenliğinde yeni bir döneme işaret ediyor
Astra ile ilgili sonuçların en önemli tarafı yalnızca yeni OpenAI modelinin GPT-5.6 Sol’dan daha güçlü olması değil.
Yapay zeka modellerinin artık yalnızca bilinen güvenlik açıklarına ilişkin kod üretmekten çıkarak, korumalı gerçek sistemlerde daha önce bilinmeyen güvenlik açıklarını bağımsız şekilde keşfedebilecek seviyeye yaklaşması sektör için çok daha büyük bir değişime işaret ediyor.
Bu yetenek doğru kullanıldığında güvenlik ekiplerinin yazılımlardaki kritik açıkları saldırganlardan önce tespit etmesini ve çok daha hızlı kapatmasını sağlayabilir.
Aynı teknoloji kötüye kullanıldığında ise bugüne kadar ciddi uzmanlık ve zaman gerektiren saldırıların ölçeklenmesini kolaylaştırabilir.
Bu nedenle OpenAI, Astra ile birlikte yalnızca model performansını değil, modelin hangi koşullarda eğitildiğini, hangi araçlara erişebildiğini ve gerçekleştirdiği eylemlerin nasıl takip edildiğini de yapay zeka güvenliğinin temel parçalarından biri hâline getiriyor.
Astra’nın gerçek kullanıcıların eline geçtiğinde ne kadar güçlü olacağını ise modelin resmi çıkışı ve yayımlanacak System Card ile çok daha net göreceğiz.




