Oyuncu

OpenAI GPT-6 Astra’yı duyurdu: Bilgisayarı kendi başına kullanabiliyor

GTA6
×

OpenAI GPT-6 Astra’yı duyurdu: Bilgisayarı kendi başına kullanabiliyor

Share this article


OpenAI, yeni nesil yapay zeka modeli GPT-6 Astra’yı duyurdu. Bilgisayar kullanımı, kodlama, web’de araştırma, siber güvenlik, bilimsel çalışmalar ve profesyonel iş akışlarında önemli performans artışları getiren model, uygulamalarla doğrudan çalışabiliyor, çok aşamalı görevleri yürütebiliyor ve uzun süren işlemlerde önceki modellerden daha hızlı hareket ediyor. GPT-6 Astra sınırlı sayıda kuruluşta kullanıma açıldı ve önümüzdeki günlerde ChatGPT Plus, Pro, Business ve Enterprise abonelerine sunulacak.

GPT-6 Astra ile bilgisayar kullanımı ve kodlama yetenekleri geliştirildi

GPT-6 Astra, ön eğitim, pekiştirmeli öğrenme ve hizalama çalışmalarının bir araya getirildiği yeni nesil model olarak geliyor. Model bilgisayar kullanımı, tarayıcı üzerinden çalışma, yazılım mühendisliği, siber güvenlik, bilim ve profesyonel görevlerde kullanılabiliyor. FrontierMath Tier 4 testinde yüzde 97,6, ARC-AGI-3’te yüzde 99,9 ve ExploitBench’te yüzde 100 sonuç elde edildi.

OpenAI GPT-6 Astra’yı duyurdu: Bilgisayarı kendi başına kullanabiliyor

Bilgisayar kullanımı GPT-6 Astra’nın en fazla geliştirilen alanlarından biri oldu. Model çevrim içi formları doldurabiliyor, CRM sistemlerindeki müşteri kayıtlarını güncelleyebiliyor, takvim düzenleyebiliyor, internet araştırması gerçekleştirebiliyor ve hazırladığı sonuçları e-posta veya doküman düzenleyicisine aktarabiliyor.

Bilimsel verileri analiz etme, grafik oluşturma, internet sitesi geliştirme ve oluşturduğu sitenin özelliklerini test etme gibi işlemler de doğrudan yürütülebiliyor. Yazılım kurulumu, uygulamaların test edilmesi ve ekranda görülen sorunların giderilmesi de desteklenen görevler arasında bulunuyor.

OpenAI GPT-6 Astra’yı duyurdu: Bilgisayarı kendi başına kullanabiliyor

OSWorld 2.0 testlerinde GPT-6 Astra yüzde 72,6 puana ulaşırken GPT-5.6 Sol yüzde 65,7 seviyesinde kaldı. Aynı simülasyonlarda Astra bir görevi ortalama yaklaşık 40 dakikada tamamlarken GPT-5.6 Sol için bu süre yaklaşık 75 dakika oldu. Codex tarafındaki güncellemelerle birlikte Mind2Web testinde görev tamamlama süresi mevcut GPT-5.6 Sol deneyimine kıyasla 1,9 kata kadar hızlandı.

Astra’nın bilgisayar kullanımındaki ilerleme diğer testlerde de görüldü. Agents’ Last Exam’de yüzde 59,3, ScreenSpot-Pro’da yüzde 92,7 ve OSWorld 2.0’da yüzde 72,6 sonuç kaydedildi. GPT-5.6 Sol aynı testlerde sırasıyla yüzde 53,6, yüzde 76,9 ve yüzde 65,7 puan aldı.

OpenAI GPT-6 Astra’yı duyurdu: Bilgisayarı kendi başına kullanabiliyor

Yeni model profesyonel çalışma ortamları için de özel olarak eğitildi. GPT-6 Astra, mevcut şablonları kullanarak belgeler, elektronik tablolar ve sunumlar hazırlayabiliyor. Belge içerisindeki yazım ve görsel stile uyum sağlayabiliyor, sunumlarda mevcut tasarım dilini koruyabiliyor ve uzun kaynaklardan yalnızca görev için gerekli bilgileri hazırlanan içeriğe taşıyabiliyor.

ChatGPT içerisindeki Sites özelliğiyle birlikte model, yalnızca verilen komut üzerinden internet siteleri, web uygulamaları ve oyunlar oluşturabiliyor, bunları barındırabiliyor ve paylaşabiliyor. Astra ayrıca Blender ile üç boyutlu model oluşturma ve modeli Unreal Engine 5 içerisinde gezilebilir bir sahneye dönüştürme gibi görsel ve teknik iş akışlarında kullanılabiliyor.

OpenAI GPT-6 Astra’yı duyurdu: Bilgisayarı kendi başına kullanabiliyor

Profesyonel görevleri ölçen AutomationBench testinde GPT-6 Astra yüzde 41,4 sonuç elde etti. GPT-5.6 Sol yüzde 18,1’de kaldı. CAD görevlerinin değerlendirildiği BenchCAD testinde Astra yüzde 95,9, GPT-5.6 Sol ise yüzde 83,3 puan aldı. Veri bilimi görevlerinde Astra yüzde 40,9’a ulaşırken önceki model yüzde 30,5 sonuç verdi.

Yazılım geliştirme tarafında Terminal-Bench 4.0 skoru GPT-5.6 Sol’daki yüzde 37,3 seviyesinden GPT-6 Astra’da yüzde 57,9’a yükseldi. DeepSWE v1.1 testinde yüzde 74,1, FrontierCode 1.1 Extended testinde yüzde 64,5 ve şirket içi veri tabanı taşıma testlerinde yüzde 63,9 sonuç elde edildi. Aynı veri tabanı testinde GPT-5.6 Sol yüzde 42,7 puan aldı.

OpenAI GPT-6 Astra’yı duyurdu: Bilgisayarı kendi başına kullanabiliyor

Codex içerisindeki uzun süreli görevler için de yeni bir bağlam sistemi devreye giriyor. Önceki modeller uzun oturumlarda bağlam penceresi dolduğunda yapılan çalışmaları özetleyerek sıkıştırıyordu. Bu süreç başarısız denemeler veya önceki teknik ayrıntıların kaybolmasına neden olabiliyordu.

Astra, bağlam pencereleri arasında not tutabiliyor ve daha önce kullanılan bağlam pencerelerini arayabiliyor. Böylece daha önceki mesajlarda veya araç çıktılarında bulunan bir gereksinime, kendi notlarına girmemiş olsa bile yeniden ulaşabiliyor. Deneysel özellik Codex yapılandırmasından etkinleştirilebiliyor ve önümüzdeki haftalarda Astra için varsayılan hale gelecek.

GPT-6 Astra, kullanıcı görev devam ederken yeni talimat verdiğinde de önceki görevin bağlamını koruyacak şekilde geliştirildi. Yeni bir gereksinim geldiğinde çalışmanın yönünü değiştirebiliyor ve araya giren soruları yanıtladıktan sonra ana göreve devam edebiliyor. Eksik bir bilginin sonucu ciddi şekilde değiştirmediği durumlarda mevcut bağlamı kullanabiliyor. Kritik bir karar gerektiğinde ise kullanıcıdan ek bilgi isteyebiliyor. Codex içerisinde bu soru asenkron olarak iletilirken model yanıta bağlı olmayan diğer işlemleri sürdürebiliyor.

Bilim ve matematik testlerinde de önemli performans artışları kaydedildi. Terminal-Bench Science 0.1’de GPT-6 Astra yüzde 64,6 puan alırken GPT-5.6 Sol yüzde 22,4’te kaldı. FrontierMath Tier 4’te yüzde 97,6 ve GPQA Diamond’da yüzde 96 sonuç elde edildi. HealthBench Professional testinde Astra yüzde 63,4 puana ulaştı.

Model, asal sayılar arasındaki aralıklarla ilgili iki matematik çalışmasına da katkı sağladı. Sonsuz sayıda asal sayı çiftinin birbirinden en fazla 240 uzaklıkta olduğunu gösteren mevcut sınır 186’ya indirildi. Astra ayrıca büyük asal sayı boşluklarıyla ilgili bir eşitsizlikte 80 yıldan uzun süredir değişmeyen bir terimin geliştirilmesine yardımcı oldu.

GPT-6 Astra aynı zamanda siber güvenlik alanında Kritik yetenek seviyesine ulaşan ilk OpenAI modeli oldu. Üretim güvenlik önlemleri olmadan gerçekleştirilen ExploitBench testinde yüzde 100 başarı elde edilirken GPT-5.6 Sol yüzde 78,5 sonuç verdi. ExploitGym’de Astra yüzde 42,4, GPT-5.6 Sol ise yüzde 30,3 başarı oranına ulaştı.

Haziran-Ağustos 2026 döneminde açıklanan daha yeni güvenlik açıklarından oluşturulan ayrı ExploitBench testinde Astra, GPT-5.6 Sol’dan daha yüksek kod çalıştırma başarısı elde etti. Model test sırasında daha önce bilinmeyen iki sıfırıncı gün güvenlik açığını keşfetti ve bunları bir saldırı zincirinde kullandı. Güvenlik açıklarının ilgili yazılım geliştiricilerine bildirim süreci başlatıldı.

SRE-Bench testinde model, kaynak koduna erişmeden yazılım ikili dosyalarını tersine mühendislikle inceleyen görevlerin yüzde 88’ini ilk denemede tamamladı. Dört denemeye izin verildiğinde başarı oranı yüzde 99,2’ye çıktı. GPT-5.6 Sol aynı testlerde yüzde 55,9 ve yüzde 68,7 sonuç verdi. Uzmanların gerçekleştirdiği ayrı değerlendirmelerde Astra, üretim güvenlik önlemleri kapalıyken güçlendirilmiş tarayıcılarda bilinmeyen açıklardan yararlanarak kod çalıştırabildi ve işletim sistemlerinde yetki yükseltme açıkları oluşturabildi.

Kullanıma sunulan sürümde bu yeteneklerin tamamına doğrudan erişilemiyor. Astra güvenli kod inceleme ve yama hazırlama gibi savunma odaklı görevlerde kullanılabilecek ancak güvenlik açıkları için çalışan proof-of-concept exploit oluşturma gibi daha gelişmiş işlemleri reddedecek. Daybreak programıyla güvenlik araştırmacılarına yönelik daha geniş savunma yetenekleri ilerleyen haftalarda açılacak.

Güvenlik tarafında modelin verilen yetki sınırları dışına çıkıp çıkmadığını ölçen yeni testler de gerçekleştirildi. Üretim korumaları bulunmayan GPT-5.6 Sol, tamamlanması zor veya imkânsız görevlerde yetkilendirilen hedefin dışına vakaların yüzde 48’inde çıktı. GPT-6 Astra aynı testte yüzde 0 oranında kaldı. Astra ayrıca Codex Auto-Review sistemi tarafından engellenen bir işlemi aşmaya çalışmadı.

Bununla birlikte modelin yazılı akıl yürütme sürecinin izlenebilirliği GPT-5.6 Sol’a kıyasla bazı testlerde geriledi. Astra, özellikle daha basit görevlerde daha az yazılı adımla sonuca ulaşabildiği için akıl yürütmesini takip etmek daha zor hale geldi.

Karmaşık görevlerde gerekli akıl yürütmeyi gizleme konusunda ise aynı durum görülmedi. Üretim ortamında modelin eylemleri ve akıl yürütme süreci ek izleme sistemleriyle kontrol edilecek; yetkisiz davranış şüphesi oluştuğunda görev otomatik olarak durdurulabilecek.

Bu güvenlik kontrolleri meşru işlemleri de zaman zaman duraklatabilecek. ChatGPT veya Codex içerisinde durdurulan bir işlem kullanıcı onayına sunulabilecek. API üzerinden çalışan görevlerde ise güvenlik sistemi devreye girdiğinde işlem sonlandırılacak.

GPT-6 Astra ilk olarak sınırlı sayıda kuruluşta kullanıma açılıyor. Model önümüzdeki günlerde ChatGPT Plus, Pro, Business ve Enterprise abonelerine, OpenAI API’ye ve AWS üzerinden kullanıcılara sunulacak.

Pro, Business ve Enterprise aboneleri ayrıca GPT-6 Astra Pro sürümüne erişebilecek. Enterprise yöneticilerinin Astra’yı çalışma alanlarında manuel olarak etkinleştirmesi gerekiyor ve özellik lansman sırasında varsayılan olarak kapalı geliyor.

API tarafında modelin adı gpt-6-astra olarak belirlendi. Standart kullanımda bir milyon giriş tokenı 10 dolar, bir milyon çıkış tokenı ise 50 dolar olarak ücretlendiriliyor. Önbelleğe alınmış girişlerin bir milyon tokenı 1 dolar, önbelleğe yazma ücreti ise 12,50 dolar. Fast Mode, standart işleme göre iki kata kadar daha yüksek hız sağlıyor ve standart fiyatın iki katına ücretlendiriliyor.

GPT-6 Astra, 1 milyon 50 bin tokenlık bağlam penceresine ve tek yanıtta en fazla 128 bin çıkış tokenına sahip. Modelin bilgi kesim tarihi 30 Nisan 2026. Metin ve görsel girdileri destekleyen Astra, web araması, dosya araması, kod çalıştırma, bilgisayar kullanımı, MCP, araç arama ve görsel oluşturma gibi araçlarla Responses API üzerinden çalışabiliyor. Model için fine-tuning desteği bulunmuyor.



Kaynak

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir