Gemini 4 Argon duyuruldu: İlk erişim siber savunma ortaklarıyla sınırlı
Google'ın yeni sınır modeli, genel kullanıma açılmadan önce kontrollü bir program içinde değerlendiriliyor.
OpenAI, Astra düzeyine yaklaşan iş performansını daha düşük fiyatla sunmayı hedefliyor. Şirketin ölçümleri, toplam görev maliyetinin önemini artırıyor.
Duyuru / olay tarihi:

OpenAI, 29 Eylül 2026'da GPT-6.1 Sol modelini duyurdu. Şirket, yeni sürümün kodlama, bilgisayar kullanımı ve profesyonel işlerde GPT-6 Astra'ya yaklaşırken standart giriş ve çıkış fiyatlarının beşte biriyle çalıştığını belirtiyor. Duyuru, yapay zekâ rekabetinde yalnızca en güçlü modeli geliştirme hedefinin değil, aynı işi daha erişilebilir maliyetle tamamlama yarışının da öne çıktığını gösteriyor.
API fiyatları milyon giriş belirteci için 2 dolar, önbelleğe alınmış giriş için 0,10 dolar ve çıkış için 10 dolar olarak açıklandı. Bu rakamlar tek başına bir projenin bütçesini vermiyor. Ajanın kaç kez denediği, hangi araçları kullandığı ve ne kadar çıktı ürettiği, faturanın gerçek büyüklüğünü belirleyen diğer unsurlar arasında yer alıyor.
OpenAI'nin model kartı güvenliği görev sınırları ve kullanıcı niyeti üzerinden ele alıyor. Şirketin ürün sayfasındaki başarı karşılaştırmaları ise kendi araştırma ortamından geliyor; her şirketin mevcut bilgisayarlarında aynı sonuçların alınacağı anlamına gelmiyor. Örneğin karmaşık bir yazılım deposunda yapılan test, küçük bir işletmenin teklif hazırlama sürecini otomatik olarak temsil etmiyor.
Yeni sürüm Work, Codex ve API üzerinden sunuluyor; normal Chat deneyimindeki erişimle aynı şey sayılmıyor. Bu ayrım, model adını görüp her kullanım alanında aynı kapasiteye ulaşacağını düşünen kullanıcı açısından önemli. Satın alınan planın yanında, modelin hangi arayüzde kullanılabildiği ve o arayüzün izinleri de sonucu değiştirebiliyor.
Örneğin bir teklif hazırlama denemesinde yalnızca düzgün yazılmış metne bakmak yeterli olmaz. Kaynaktaki fiyatların doğru aktarılıp aktarılmadığı, teslim şartlarının korunup korunmadığı ve eksik bilgi varsa bunun belirtilip belirtilmediği ayrı ölçülmelidir. Bu somut kontrol, genel model sıralamasını ekibin gündelik kararına çevirebilir. Şirketin kendi verisiyle kurduğu değerlendirme, model yükseltmelerinden sonra da aynı örnekler üzerinde tekrarlanarak gerçek ilerlemeyi görünür hale getirebilir.
Editoryal değerlendirmemiz şu: Daha düşük belirteç fiyatı, şirketlerin denemelerini genişletebilir; ancak yatırım kararını başarılı görev başına maliyetle vermek daha anlamlı. Bir müşteri raporu için kaynakları doğru okuyan ve düzeltme istemeyen ajan, daha ucuz olup işi yeniden yaptıran ajandan ekonomik olabilir. Hız, doğruluk ve denetim süresini aynı tabloda görmek gerekir.
Türkiye'de bir ekip bu değişimi değerlendirirken gerçek işlerinden küçük bir örnek kümesi hazırlayabilir. Aynı belge, hata düzeltmesi ve araştırma görevi farklı modellerde çalıştırılır; sonucun kullanılabilirliği ayrıca incelenir. Böyle bir karşılaştırma sağlayıcının geniş performans iddiasını yerel ihtiyaçla buluşturur. Maliyetin düşmesi fırsat yaratıyor, fakat doğru model seçimi yine işin ölçülmesini gerektiriyor.
Kaynak kontrolü: 2026-10-03. Metin yapay zekâ desteğiyle hazırlanmıştır.
■ MİZAN HABER