- 0
- 107 words
xAI نے Grok 4.7 متعارف کرایا: کوڈنگ اور علمی کام کے لیے مضبوط تر، مگر آزاد اسکورز پر ابھی درمیانی صف
اسلام آباد / کوپن ہیگن — ۲۲ ستمبر ۲۰۲۶ (PKT)۔ xAI نے Grok 4.7 جاری کر دیا ہے اور اسے کوڈنگ اور علمی کام (knowledge work) کے لیے اب تک کا سب سے قابل Grok قرار دیا ہے۔ ماڈل تقریباً ۲۱ ستمبر ۲۰۲۶ کو آیا، اور ڈویلپر ٹولز میں بھی نظر آنے لگا ہے—جبکہ آزاد اسکور کارڈز اسے فرنٹیئر صف کے بالکل سرے پر نہیں، بلکہ درمیانی درجے میں رکھتے ہیں۔
کمپنی کیا کہتی ہے
xAI کے اعلان کے مطابق Grok 4.7 کا بنیاد ماڈل Grok 4.6 سے بڑا ہے۔ کمپنی کا دعویٰ ہے کہ اس نے طویل reinforcement learning چلائی—یعنی مشکل مسائل حل کرنے پر ماڈل کو انعام دینے والا تربیتی مرحلہ—خاص طور پر ایسے کاموں پر جو کئی گھنٹے لے سکتے ہیں۔ xAI بہتر خود جانچ (self-verification)، مضبوط طویل سیاق (long context)، اور Grok Bot harness پر مقامی تربیت کا بھی ذکر کرتی ہے، تاکہ گفتگو اور ایجنٹ طرز کے کام بہتر ہوں۔
نئی safeguard stack بھی دعوے کا حصہ ہے۔ xAI اسے اب تک کا بہترین کیلیبریٹڈ حفاظتی نظام کہتی ہے۔ یہ کمپنی کے بیانات ہیں؛ باہر کی لیبز نے ابھی مکمل آزاد سیفٹی آڈٹ شائع نہیں کیا۔
قیمت اور دستیابی
قیمت Grok 4.6 جیسی رہی: فی ملین ان پٹ ٹوکن ۲ ڈالر اور فی ملین آؤٹ پٹ ٹوکن ۶ ڈالر سے شروع۔ تیز (fast) ویرینٹ بھی ہے جو آؤٹ پٹ رفتار دوگنا کرتا ہے مگر قیمت بھی دوگنی ہے۔ کمپنی کے مطابق Cursor، Grok Build، Grok API، تیسرے فریق کے کوڈنگ ہارنیسز اور کلاؤڈ پلیٹ فارمز پر دستیاب ہے۔
اس کے علاوہ GitHub کے ۲۱ ستمبر ۲۰۲۶ کے چینج لاگ میں کہا گیا کہ Grok 4.7 GitHub Copilot میں Pro، Pro+، Max، Business اور Enterprise پلانز پر رول آؤٹ ہو رہا ہے—VS Code، Visual Studio، JetBrains اور دیگر Copilot سطحوں پر۔ رول آؤٹ بتدریج ہے، GitHub نے واضح کیا۔
کمپنی کے بینچ مارکس (xAI کے مطابق)
xAI نے اپنا موازنہ جدول جاری کیا۔ CursorBench 4.0 پر—جو طویل کوڈنگ کاموں پر زور دیتا ہے—Grok 4.7 نے ۴۶.۳٪ اسکور کیا، جبکہ Grok 4.6 کا ۴۰.۴٪ تھا۔ Terminal-Bench 4.0 پر چھلانگ بڑی تھی: ۳۸.۰٪ بمقابلہ ۲۰.۳٪۔ برقی انجینئرنگ ٹیسٹ EEBench پر xAI نے ۶۴٪ بتایا۔ کئی گھنٹے کے دفتری کام اور کچھ پیشہ ورانہ ڈومین ٹیسٹوں میں بھی بہتری دکھائی گئی۔
یہ اعداد وینڈر کے ہیں۔ ان سے “۴.۶ سے بہتر” کا پیغام سمجھ آتا ہے—خاص طور پر CursorBench پر قیمت کے مقابل کارکردگی—مگر یہ تیسرے فریق کی جانچ کا متبادل نہیں۔
آزاد کوریج: درمیانی صف، چھت نہیں
متوازن خبرنگاری یہاں ضروری ہے۔ Artificial Analysis نے Intelligence Index پر Grok 4.7 کو ۴۶ دیا—Grok 4.6 سے بہتر—لیکن Claude Fable 5.1 اور GPT-6 جیسے لیڈرز کے پیچھے (The Decoder کے مطابق اسی انڈیکس پر تقریباً ۵۳)۔ Decrypt اور The Decoder دونوں نے اسے مضبوط قدم آگے قرار دیا، مگر کئی عوامی اشاریوں پر Anthropic اور OpenAI ماڈلز سے پیچھے۔
سادہ الفاظ میں: جو ڈویلپر پہلے سے Cursor، Copilot یا Grok API میں کام کرتے ہیں—اور جن کے لیے لاگت اور رفتار لیڈر بورڈ جتنی اہم ہیں—ان کے لیے Grok 4.7 زیادہ کارآمد لگتا ہے۔ آج کے آزاد چارٹس پر یہ بلامعارض فرنٹیئر لیڈر نہیں۔
خلاصہ
۲۰۲۶ کی اے آئی ٹولنگ دوڑ دیکھنے والے قارئین کے لیے Grok 4.7 ایک ہی قیمت پر اپ گریڈ ہے، واضح کوڈنگ ایجنٹ رخ اور وسیع تر تقسیم کے ساتھ۔ “۴.۶ سے بہتر” کے لیے کمپنی کے اپنے بینچز دیکھیں؛ Claude Fable 5.1 اور GPT-6 کے مقابل مقام کے لیے آزاد انڈیکس۔ دونوں باتیں ایک ساتھ درست ہو سکتی ہیں۔