×
Rows of illuminated server racks in a modern data center

xAI نے Grok 4.7 متعارف کرایا: کوڈنگ اور علمی کام کے لیے مضبوط تر، مگر آزاد اسکورز پر ابھی درمیانی صف

اسلام آباد / کوپن ہیگن — ۲۲ ستمبر ۲۰۲۶ (PKT)۔ xAI نے Grok 4.7 جاری کر دیا ہے اور اسے کوڈنگ اور علمی کام (knowledge work) کے لیے اب تک کا سب سے قابل Grok قرار دیا ہے۔ ماڈل تقریباً ۲۱ ستمبر ۲۰۲۶ کو آیا، اور ڈویلپر ٹولز میں بھی نظر آنے لگا ہے—جبکہ آزاد اسکور کارڈز اسے فرنٹیئر صف کے بالکل سرے پر نہیں، بلکہ درمیانی درجے میں رکھتے ہیں۔

کمپنی کیا کہتی ہے

xAI کے اعلان کے مطابق Grok 4.7 کا بنیاد ماڈل Grok 4.6 سے بڑا ہے۔ کمپنی کا دعویٰ ہے کہ اس نے طویل reinforcement learning چلائی—یعنی مشکل مسائل حل کرنے پر ماڈل کو انعام دینے والا تربیتی مرحلہ—خاص طور پر ایسے کاموں پر جو کئی گھنٹے لے سکتے ہیں۔ xAI بہتر خود جانچ (self-verification)، مضبوط طویل سیاق (long context)، اور Grok Bot harness پر مقامی تربیت کا بھی ذکر کرتی ہے، تاکہ گفتگو اور ایجنٹ طرز کے کام بہتر ہوں۔

نئی safeguard stack بھی دعوے کا حصہ ہے۔ xAI اسے اب تک کا بہترین کیلیبریٹڈ حفاظتی نظام کہتی ہے۔ یہ کمپنی کے بیانات ہیں؛ باہر کی لیبز نے ابھی مکمل آزاد سیفٹی آڈٹ شائع نہیں کیا۔

قیمت اور دستیابی

قیمت Grok 4.6 جیسی رہی: فی ملین ان پٹ ٹوکن ۲ ڈالر اور فی ملین آؤٹ پٹ ٹوکن ۶ ڈالر سے شروع۔ تیز (fast) ویرینٹ بھی ہے جو آؤٹ پٹ رفتار دوگنا کرتا ہے مگر قیمت بھی دوگنی ہے۔ کمپنی کے مطابق Cursor، Grok Build، Grok API، تیسرے فریق کے کوڈنگ ہارنیسز اور کلاؤڈ پلیٹ فارمز پر دستیاب ہے۔

اس کے علاوہ GitHub کے ۲۱ ستمبر ۲۰۲۶ کے چینج لاگ میں کہا گیا کہ Grok 4.7 GitHub Copilot میں Pro، Pro+، Max، Business اور Enterprise پلانز پر رول آؤٹ ہو رہا ہے—VS Code، Visual Studio، JetBrains اور دیگر Copilot سطحوں پر۔ رول آؤٹ بتدریج ہے، GitHub نے واضح کیا۔

کمپنی کے بینچ مارکس (xAI کے مطابق)

xAI نے اپنا موازنہ جدول جاری کیا۔ CursorBench 4.0 پر—جو طویل کوڈنگ کاموں پر زور دیتا ہے—Grok 4.7 نے ۴۶.۳٪ اسکور کیا، جبکہ Grok 4.6 کا ۴۰.۴٪ تھا۔ Terminal-Bench 4.0 پر چھلانگ بڑی تھی: ۳۸.۰٪ بمقابلہ ۲۰.۳٪۔ برقی انجینئرنگ ٹیسٹ EEBench پر xAI نے ۶۴٪ بتایا۔ کئی گھنٹے کے دفتری کام اور کچھ پیشہ ورانہ ڈومین ٹیسٹوں میں بھی بہتری دکھائی گئی۔

یہ اعداد وینڈر کے ہیں۔ ان سے “۴.۶ سے بہتر” کا پیغام سمجھ آتا ہے—خاص طور پر CursorBench پر قیمت کے مقابل کارکردگی—مگر یہ تیسرے فریق کی جانچ کا متبادل نہیں۔

آزاد کوریج: درمیانی صف، چھت نہیں

متوازن خبرنگاری یہاں ضروری ہے۔ Artificial Analysis نے Intelligence Index پر Grok 4.7 کو ۴۶ دیا—Grok 4.6 سے بہتر—لیکن Claude Fable 5.1 اور GPT-6 جیسے لیڈرز کے پیچھے (The Decoder کے مطابق اسی انڈیکس پر تقریباً ۵۳Decrypt اور The Decoder دونوں نے اسے مضبوط قدم آگے قرار دیا، مگر کئی عوامی اشاریوں پر Anthropic اور OpenAI ماڈلز سے پیچھے۔

سادہ الفاظ میں: جو ڈویلپر پہلے سے Cursor، Copilot یا Grok API میں کام کرتے ہیں—اور جن کے لیے لاگت اور رفتار لیڈر بورڈ جتنی اہم ہیں—ان کے لیے Grok 4.7 زیادہ کارآمد لگتا ہے۔ آج کے آزاد چارٹس پر یہ بلامعارض فرنٹیئر لیڈر نہیں۔

خلاصہ

۲۰۲۶ کی اے آئی ٹولنگ دوڑ دیکھنے والے قارئین کے لیے Grok 4.7 ایک ہی قیمت پر اپ گریڈ ہے، واضح کوڈنگ ایجنٹ رخ اور وسیع تر تقسیم کے ساتھ۔ “۴.۶ سے بہتر” کے لیے کمپنی کے اپنے بینچز دیکھیں؛ Claude Fable 5.1 اور GPT-6 کے مقابل مقام کے لیے آزاد انڈیکس۔ دونوں باتیں ایک ساتھ درست ہو سکتی ہیں۔

Sources

Leave a Reply

Your email address will not be published. Required fields are marked *

Author

watannews321@gmail.com

Related Posts

Packages on a warehouse conveyor belt

ایپل اسپیشل پراجیکٹس کے تجربہ کار نے گوداموں میں دو بازو والے روبوٹس کے لیے ۱۰۰ ملین ڈالر کے ساتھ ظہور کیا

حمزہ درباس نے ۲۰۲۴ میں Maven Robotics کی بنیاد رکھی جب پاس روبوٹ کا خاکہ ہی تھا۔ دو سال بعد سانتا کلارا...

Read out all
CERN computer centre server racks and monitors

۲۷ سال کی عمر میں تسنگ ہوا کے سب سے کم عمر اے آئی پروفیسر نے خود بہتر ہونے والے ماڈلز کے لیے قریب ۵۰ ملین ڈالر اکٹھے کیے

یونگ چاؤ چن نے ڈیپ مائنڈ والا راستہ چھوڑ کر بیجنگ میں Apex Intelligence قائم کی؛ شرط یہ ہے کہ چیٹ بوٹ...

Read out all
دیہی افریقہ میں شمسی توانائی تبدیلی لا رہی ہے — IAfrica76، CC0، وکی میڈیا کامنز۔

افریقہ نو فلٹر کی 2026 وائسز فار کلائمیٹ جسٹس گرانٹس: درخواستوں کی آخری تاریخ 25 ستمبر

افریقہ نو فلٹر کا پروگرام 15 سے 20 کہانی کاروں کو تربیت، رہنمائی اور چار ہزار امریکی ڈالر تک گرانٹ دے گا؛...

Read out all
استنبول باسفورس — جوزیپے میلو، CC BY 3.0، وکی میڈیا کامنز۔

ترکی میں ماحولیات پر توجہ: ہرانت دنک ایوارڈ اور ماحولیاتی صحافیوں کی سخت حقیقتیں

سوہیلا دوغان کے ہرانت دنک ایوارڈ نے کاز داغلاری کے ماحولیاتی دفاع کو نمایاں کیا، جبکہ یورپی اداروں کی دستاویزات ترکی کے...

Read out all
باکو کا منظرنامہ، آذربائیجان — برونو گیرن، CC BY-SA 2.0، وکی میڈیا کامنز۔

کوپ29 کے بعد آذربائیجان کے صحافی مشرقی شراکت داری نیٹ ورک کے ذریعے موسمیاتی تحقیقات گہری کر رہے ہیں

این-اوست کا موسمیاتی تحقیقاتی پروگرام آذربائیجان اور خطے کے صحافیوں کو یورپی سرپرستوں سے جوڑ کر توانائی، جنگلات اور موسمیاتی انصاف پر...

Read out all
مشرق وسطیٰ: ایران کا دعویٰ — امریکہ دوبارہ حملوں کی تیاری کر رہا ہے؛ قطر مذاکرات کی کوشش میں

مشرق وسطیٰ: ایران کا دعویٰ — امریکہ دوبارہ حملوں کی تیاری کر رہا ہے؛ قطر مذاکرات کی کوشش میں

مشرق وسطیٰ: ایران کا دعویٰ — امریکہ دوبارہ حملوں کی تیاری کر رہا ہے؛ قطر مذاکرات کی کوشش میں ایران کے مرکزی...

Read out all