
أطلقت SpaceXAI النموذج Grok 4.7، النسخة الجديدة من نموذج الذكاء الاصطناعي للبرمجة والعمل مع المعرفة وتنفيذ السيناريوهات الوكيلة المستمرة. قام المطورون بزيادة حجم النموذج الأساسي وتوسيع التعلم المعزز بإضافة مهام قد تستغرق عدة ساعات لحلها. كما حصل Grok 4.7 على آليات محسنة للتحقق من نتائجه الخاصة ودعم بيئة الوكيل Grok Bot. في اختبار CursorBench 4.0، حقق النموذج 46.3% مقابل 40.4% لـ Grok 4.6. في المهام التي تستغرق ساعات طويلة AA Briefcase، حقق النموذج 1657 نقطة Elo، بينما حصل الإصدار السابق على 1546. في EEBench ارتفع المؤشر من 53% إلى 64%، وفي Harvey Legal Agent Benchmark – من 15.8% إلى 19.6%. قدمت SpaceXAI هذه النتائج، لذا فهي تعكس اختبار الشركة المطورة.
أجرت Artificial Analysis قياسات إضافية. في مؤشر Intelligence Index، حصل Grok 4.7 على 46 نقطة، بزيادة نقطتين عن Grok 4.6. عند استخدامه مع Grok Build، حصل النموذج الجديد على 56 نقطة في Coding Agent Index مقابل 47 للنموذج السابق. في ترتيب النماذج التي تعمل في بيئاتها الوكيلة الخاصة، جاء Grok 4.7 في المركز الرابع. ومع ذلك، فإن زيادة النتائج تأتي مع زيادة في استهلاك الرموز: في وضع xhigh، أنتج النموذج في المتوسط حوالي 81,000 رمز مخرجات لمهمة معقدة مقابل حوالي 36,000 لـ Grok 4.6. بقيت نافذة السياق عند مستوى 500,000 رمز. يعمل النموذج مع النصوص والصور، ويشكل الإجابات في شكل نصي. تتوفر أربعة أوضاع للتفكير لإدارة الحسابات: low، medium، high، وxhigh.
لم تتغير تكلفة النسخة القياسية: عند سياق يصل إلى 200,000 رمز، تكلف معالجة مليون رمز مدخلات $2، المخزنة مؤقتًا – $0.50، والمخرجات – $6. بالنسبة للطلبات الأطول، تتضاعف التعريفات. في الوقت نفسه، أطلقت SpaceXAI النموذج Grok 4.7 Fast بسرعة توليد مضاعفة وتكلفة أعلى بمرتين؛ وهي متاحة حاليًا فقط في Cursor وGrok Build، دون الاتصال عبر API العام. كما أعلن المطورون عن إعادة تصميم نظام حماية النموذج. في HackerBench v0.3 الخاص بهم، تجاوز Grok 4.7 نسبة 3.3% من الطلبات الخطرة، وفي اختبار LatchBio للأمان البيولوجي حصل على 62.4%. وهكذا، تجمع النسخة الجديدة بين مؤشرات أعلى في عدد من الاختبارات وزيادة استهلاك الرموز في السيناريوهات المعقدة، مع الحفاظ على هيكل التعريفات الأساسي السابق.





