Grok 4.7 Tanıtıldı!

SpaceXAI, kodlama ve bilgiye dayalı profesyonel işlere odaklanan yeni yapay zeka modeli Grok 4.7’yi kullanıma sundu. Yeni model; özellikle saatler sürebilen karmaşık görevleri tamamlayabilme, kendi çıktısını değerlendirme ve güvenlik sınırlarını koruma yetenekleriyle öne çıkıyor.

Şirketin açıklamasına göre Grok 4.7, önceki nesle kıyasla daha büyük bir temel model üzerine geliştirildi. Model, daha zorlu görevler üzerinde daha uzun süreli pekiştirmeli öğrenme sürecinden geçirilerek uzun soluklu işlerde daha istikrarlı sonuçlar vermesi hedeflendi.

Grok 4.7’nin performans sonuçlarında da dikkat çekici bir artış görülüyor. Yazılım geliştirme görevlerini ölçen CursorBench 4.0 testinde model yüzde 46,3 başarı elde ederken, Grok 4.6’nın aynı testteki skoru yüzde 40,4 olarak açıklanmıştı. Uzun süreli terminal görevlerini değerlendiren Terminal-Bench 4.0’da ise başarı oranı yüzde 20,3’ten yüzde 38’e yükseldi.

Modelin yalnızca kodlama alanında değil, belge ve sunum hazırlama gibi profesyonel işlerde de geliştirildiği belirtiliyor. Şirket tarafından paylaşılan CursorBench 4.0 sonuçlarına göre Grok 4.7’nin görev başına ortalama maliyeti 4,69 dolar seviyesinde. Bu ölçütte modelin, karşılaştırmaya dahil edilen GPT-5.6 Sol ve Fable 5.1’in yüksek işlem gücü kullanan sürümlerinden daha düşük bir maliyetle çalıştığı ifade ediliyor.

Güvenlik önlemleri de geliştirildi

Grok 4.7 ile birlikte güvenlik tarafında da yeni bir koruma altyapısı devreye alındı. SpaceXAI, modelin zararlı talepleri reddetme ve güvenlik önlemlerini aşmaya yönelik girişimlere karşı direnç gösterme konusunda şimdiye kadarki en güçlü modellerinden biri olduğunu belirtiyor.

Şirketin HackerBench v0.3 testlerine göre Grok 4.7, riskli ve çift kullanımlı siber güvenlik istemlerinin yüzde 3,3’üne izin verirken, meşru güvenlik çalışmalarını mümkün olduğunca engellememeyi hedefliyor.

Birden fazla yapay zeka ajanı birlikte çalışabilecek

Grok 4.7, karmaşık görevlerin birden fazla yapay zeka ajanı arasında paylaştırılmasını sağlayan Grok Bot altyapısıyla da uyumlu olarak geliştirildi. Bu yapı sayesinde farklı ajanlar bir görevin parçalarını aynı anda yürütebiliyor. Ajanların birbirlerinin çıktısını kontrol edebilmesi ise sonuçların doğruluğunun denetlenmesine yardımcı oluyor.

Grok 4.7; Cursor, Grok Build ve Grok API üzerinden erişime açıldı. Modelin standart kullanım fiyatı milyon girdi token’ı başına 2 dolar, milyon çıktı token’ı başına ise 6 dolar olarak belirlendi. Bu fiyatlandırma Grok 4.6 ile aynı seviyede tutulurken, daha yüksek hız isteyen kullanıcılar için iki kat daha hızlı çalışan ve iki kat fiyatlandırılan bir seçenek de sunuluyor.

Şirketin paylaştığı performans verilerinin kendi değerlendirmelerine dayandığını da belirtmek gerekiyor. Bu nedenle sonuçlar, modeller arasındaki performans karşılaştırması yapılırken testlerin kapsamı ve kullanılan koşullarla birlikte değerlendirilmeli.

Bir cevap yazın

E-posta hesabınız yayımlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir