أخبار ar.wedoany.com، في 12 أغسطس، أطلقت شركة الذكاء الاصطناعي الأمريكية سبيس إكس إيه آي (SpaceXAI) الجيل الجديد من نموذجها الرائد Grok 4.6، مع تركيز خاص على تعزيز قدرات الوكلاء الذكيين طويلي الأمد، وتطوير البرمجيات، وأعمال المعرفة، وبناء التطبيقات التفاعلية. وقد أصبح النموذج متاحًا عبر Grok Build وCursor وواجهة برمجة تطبيقات سبيس إكس إيه آي، كما تم ربطه بمنصات الشركاء مثل OpenRouter وVercel وCloudflare.

يدعم Grok 4.6 إدخال النصوص والصور وإخراج النصوص، بنافذة سياق تبلغ 500 ألف رمز (Token)، كما يمكنه استدعاء الدوال، والبحث عبر الويب، والبحث في منصة X، وأدوات تنفيذ الأكواد البرمجية، ويدعم الإخراج المنظم. يمكن للمطورين استدعاء النموذج عبر واجهتي Responses API وChat Completions، مع إمكانية ضبط مستوى الاستدلال على أربع درجات: منخفض، ومتوسط، وعالٍ، وعالٍ جدًا، مع اعتماد وضع الاستدلال العالي افتراضيًا.
أوضحت سبيس إكس إيه آي أن Grok 4.6 يستهدف بشكل أساسي المهام المعقدة التي تتطلب تنفيذ خطوات متعددة متتالية، بما في ذلك البحث عبر مصادر متعددة، وتحليل المعلومات، ومعالجة قواعد الأكواد البرمجية الكبيرة، وتطوير النماذج الأولية للبرمجيات، وتوليد مخرجات الأعمال. مقارنةً بـ Grok 4.5، يقوم النموذج الجديد بمزيد من الاختبارات الذاتية والتحقق من النتائج في المهام الطويلة، كما عزز قدرته على الانتقال من الفكرة الأولية للمنتج إلى الإصدار الأولي من التطبيق التفاعلي.
فيما يتعلق بالتدريب، اعتمد Grok 4.6 عملية تدريب تكميلي أطول من الجيل السابق، وتضمنت البيانات المستخدمة بيانات مولّدة بواسطة النماذج للاستدلال والمفاهيم التقنية المتقدمة، بالإضافة إلى بيانات هندسية. بعد ذلك، استخدمت سبيس إكس إيه آي نموذج Grok 4.5 لإعادة توليد مسارات التعلم الخاضع للإشراف (Supervised Fine-Tuning Trajectories) التي تغطي مستويات مختلفة من شدة الاستدلال، وأطر الوكلاء الذكيين، ومجالات العلوم والهندسة والرياضيات وتطوير البرمجيات، مع تصفية سجلات التدريب التي تثير إشكاليات عبر فحوصات النماذج. كما خضع النموذج لتدريب بتعزيز التعلم (Reinforcement Learning) على مهام الوكلاء الذكيين في مجالات أعمال المعرفة، والبرمجة العامة، وتحسين النواة (Kernel Optimization)، وتطوير الويب، والتصميم بمساعدة الحاسوب.
وفقًا للبيانات التي نشرتها سبيس إكس إيه آي، حصل Grok 4.6 على 61 نقطة في مؤشر التحليل الاصطناعي للذكاء (Artificial Analysis Intelligence Index) الشامل، بزيادة 5 نقاط عن Grok 4.5 الذي حصل على 56 نقطة، معادلًا بذلك GPT-5.6 Sol، وبفارق نقطة واحدة عن Claude Fable 5. يجمع هذا المؤشر نتائج تسع اختبارات تشمل العلوم والبرمجة والخدمات المالية، غير أن نتائج الاختبارات تعكس بشكل أساسي أداء النموذج في ظل ظروف محددة، ولا يمكن اعتبارها معادلة مباشرة للقدرات في جميع سيناريوهات الأعمال الفعلية.
في اختبارات الوكلاء الذكيين وتطوير البرمجيات، حقق Grok 4.6 نسبة 69.9% في CursorBench 3.2، و65.9% في DeepSWE 1.1، و61.3% في اختبار FrontierCode 1.1 الموسع. كما بلغت نتيجة APEX-Agents 57.5%، متجاوزًا نسبة Grok 4.5 البالغة 47.1%؛ وفي اختبار AA-Briefcase الذي يقيس قدرات أعمال المعرفة المعقدة، حصل على 1577 نقطة، متفوقًا أيضًا على 1313 نقطة التي حققها الجيل السابق.
يبلغ السعر الأساسي لواجهة برمجة تطبيقات Grok 4.6 القياسية 2 دولار لكل مليون رمز إدخال، و0.5 دولار لكل مليون رمز إدخال مخزّن مؤقتًا (Cached Input)، و6 دولارات لكل مليون رمز إخراج. وعندما يتجاوز سياق الإدخال 200 ألف رمز، ستعتمد الشركة أسعارًا أعلى؛ كما توفر سبيس إكس إيه آي إصدارًا أسرع يبلغ سعره حوالي ضعف سعر الإصدار القياسي. وتقدم منصتا Grok Build وCursor ضعف حصة الاستخدام خلال الأسبوع الأول من إطلاق النموذج.
صرحت سبيس إكس إيه آي أن النموذج الجديد خضع لأوسع نطاق من اختبارات القدرات والسلامة قبل النشر في تاريخ الشركة، وستواصل إجراء اختبارات ما بعد النشر واختبارات أطراف ثالثة. ومع ذلك، فإن معظم بيانات الأداء التي نشرتها الشركة رسميًا مستمدة من اختبارات داخلية أو من نتائج معلنة من مطوري نماذج آخرين، ولا تزال بحاجة إلى مزيد من التحقق عبر تقييمات مستقلة والنشر الفعلي لدى المؤسسات.





















