xAI تطلق Grok 4.5، أقوى نموذج لها، مع نافذة سياق 500,000 Token

أصدرت xAI نموذج Grok 4.5 في 8 يوليو، ووصفته بأنه أقوى نموذج لها حتى الآن. تم تدريبه على عشرات الآلاف من معالجات GPU Nvidia GB300 وبناؤه على نموذج أساسي جديد بمعامل 1.5 تريليون تسميه xAI V9، وهو الآن متاح في Grok Build، وعلى جميع خطط Cursor، وعبر وحدة تحكم API xAI.
ما يمكن للنموذج فعله
يدعم Grok 4.5 نافذة سياق 500,000 Token، بالإضافة إلى إدخال النصوص والصور، واستدعاء الدوال، والمخرجات الهيكلية، والبحث عبر الويب وX، وتنفيذ الكود، وعمق استدلال قابل للتكوين. تقدم xAI الخدمة بمعدل 80 Token تقريبًا في الثانية، وتقول الشركة إنها توفر ضعف كفاءة Token مقارنة بالنماذج المنافسة في المهام المماثلة — مما يعني أنها قادرة على إنتاج نتائج مكافئة مع استهلاك Token أقل، مما يقلل التكلفة الفعلية لمهمة معينة حتى قبل احتساب السعر المعلن.
تم تحديد التسعير بمبلغ 2 دولار لكل مليون Token إدخال و6 دولارات لكل مليون Token إخراج، مع خصم 0.50 دولار لكل مليون للإدخال المخبأ، ومعدلات أعلى بمجرد تجاوز الطلب 200,000 Token.
نتائج المعايير مع بعض التحفظات
تقدم xAI نموذج Grok 4.5 بشكل أساسي كنموذج للبرمجة والعمل العاملي (Agentic). في معيار SWE Marathon — وهو اختبار لمهام هندسة البرمجيات المستدامة متعددة الخطوات — سجل Grok 4.5 معدل حل 29.0% (Pass@1)، متقدمًا على Opus 4.8 من Anthropic بنسبة 26.0% ونموذج xAI السابق Fable بنسبة 24.0%. يتصدر النموذج أيضًا معياري DeepSWE 1.0 (62.0%) وTerminal-Bench 2.1 (83.3%).
ومع ذلك، فإن هذه الريادة ليست عالمية. من بين أربعة معايير اختارت xAI نشرها بالتزامن مع الإطلاق، يفوز Grok 4.5 في اثنين ويخسر اثنين أمام Opus 4.8 — وهو انقسام يشير إلى أن النموذج يمثل خطوة حقيقية إلى الأمام في مهام البرمجة المحددة وليس تحسينًا شاملًا على كل منافس في كل مهمة.
فجوة التوفر في الاتحاد الأوروبي
Grok 4.5 غير متاح بعد للمستخدمين الأوروبيين، سواء عبر منتجات xAI الخاصة أو من خلال وحدة تحكم API الخاصة بها. تقول xAI إن الوصول في الاتحاد الأوروبي متوقع في منتصف يوليو، دون تحديد تاريخ مؤكد. يضع هذا التأخير Grok 4.5 إلى جانب نمط إطلاق نماذج الذكاء الاصطناعي في عام 2026 حيث فصلت المراجعة التنظيمية — سواء كانت فحوصات الامتثال لقانون الذكاء الاصطناعي في الاتحاد الأوروبي أو عمليات مماثلة — تاريخ الإطلاق الأولي للنموذج عن توفره في أوروبا بأيام إلى أسابيع.
السياق التنافسي
يتزامن هذا الإصدار مع الأسبوع نفسه الذي تستكمل فيه OpenAI الإصدار التدريجي لعائلة GPT-5.6 (Sol, Terra, Luna)، ويضع ضغطًا على Anthropic، حيث لا يزال Opus 4.8 منافسًا في اثنين من المعايير الأربعة التي اختارتها xAI. بالنسبة للمطورين الذين يختارون بين نماذج البرمجة الرائدة، فإن الاستنتاج العملي هو أنه لا يوجد نموذج واحد يقود حاليًا عبر جميع المجالات — نتائج Grok 4.5 في SWE Marathon وTerminal-Bech تجعله خيارًا قويًا لمهام برمجة عامليه معينة، بينما لا يزال Opus 4.8 متقدمًا في المعايير التي لم يفز بها xAI.
Originally reported by xAI. Read the original article for additional details.
View original source