
SpaceXAI’den Uzun Süreli Görevler İçin Güçlendirilmiş Yapay Zeka: Grok 4.7 Tanıtıldı
SpaceXAI, özellikle kodlama ve bilgi odaklı profesyonel işler için geliştirdiği en yeni yapay zeka modeli Grok 4.7’yi gün yüzüne çıkardı. Firma, yeni modelde özellikle saatlerce sürebilen kompleks görevlerin başarımını artırmaya odaklanıyor.
Grok 4.7, selefi Grok 4.6’ya kıyasla daha gelişmiş ve büyük bir temel model üzerine inşa edildi. Aynı zamanda daha zorlu görevler üzerinde daha uzun süreli pekiştirmeli öğrenme süreci geçirerek uzun soluklu iş yürütme kabiliyetini geliştirmeyi hedefliyor. Bu sayede model, karmaşık ve uzun vadeli projelerde daha etkin performans sergiliyor.
SpaceXAI’nin yayımladığı testlere göre Grok 4.7, yazılım geliştirme yeteneklerini ölçen CursorBench 4.0 testinde %46,3 başarı oranına ulaştı. Bu oran, Grok 4.6’nın %40,4 olan skorundan anlamlı bir iyileşme gösteriyor. Ayrıca, uzun süreli terminal tabanlı görevlerin değerlendirildiği Terminal-Bench 4.0 testinde ise başarı oranı %20,3’ten %38’e yükseldi.
Bunun yanında Grok 4.7, belge ve sunum hazırlama gibi profesyonel işlerde de geliştirilmiş becerilere sahip. Test sonuçlarının SpaceXAI’nin kendi değerlendirmelerine dayandığını belirtmekte fayda var.
Modelin ekonomi performansı da dikkat çekici. CursorBench 4.0 testinde görev başına ortalama maliyet 4,69 dolar olarak ölçüldü. Bu maliyet, GPT-5.6 Sol ve Fable 5.1 gibi yüksek işlem gücü gerektiren modelleri geride bırakıyor.
Güvenlik açısından Grok 4.7, geliştirilmiş bir koruma altyapısıyla geliyor. Model, zararlı talepleri reddetme ve güvenlik sınırlarını aşmaya yönelik saldırılara direnme konusunda şimdiye kadarki en güçlü sürüm olarak tanımlanıyor. Örneğin, HackerBench v0.3 testinde riskli siber güvenlik isteklerinin sadece %3,3’üne izin verirken, yasal güvenlik çalışmalarını ise nadiren engelliyor.
Ayrıca Grok 4.7, karmaşık görevlerin birden fazla yapay zeka ajanına dağıtılmasını sağlayan Grok Bot altyapısıyla tam uyumlu çalışacak şekilde tasarlandı. Bu sayede ajanlar, farklı görevleri paralel yürütüp işlem süresini kısaltabiliyor ve birbirlerinin işlerini denetleyerek doğruluk oranını yükseltiyorlar.
Yeni model şu anda Cursor, Grok Build ve Grok API platformları üzerinden erişime açılmış durumda. SpaceXAI’nin bu gelişmiş yapay zeka modeli, kodlama ve karmaşık uzun süreli görevler alanında yeni standartlar belirlemeye aday görünüyor.
Kaynak: Webrazzi Yapay Zeka
