GPT-6 Astra نے ARC-AGI-3 میں نئی تاریخ رقم کر دی، انسانی کارکردگی سے بھی زیادہ مؤثر

GPT-6 Astra نے ARC-AGI-3 بینچ مارک میں نمایاں کارکردگی کا مظاہرہ کیا
Facebook
X
LinkedIn
Pinterest
WhatsApp

GPT-6 Astra نے ARC-AGI-3 میں نئی تاریخ رقم کر دی، انسانی کارکردگی سے بھی زیادہ مؤثر

مصنوعی ذہانت کی دنیا میں ایک اہم پیش رفت کے طور پر OpenAI کے نئے ماڈل GPT-6 Astra نے ARC-AGI-3 بینچ مارک میں غیر معمولی کارکردگی کا مظاہرہ کرتے ہوئے انسانی کارکردگی کے معیار کو پیچھے چھوڑ دیا ہے۔

GPT-6 Astra نے ARC-AGI-3 Semi-Private بینچ مارک میں مختلف ٹیسٹنگ طریقوں کے تحت نمایاں نتائج حاصل کیے۔ Standard Harness کے ذریعے GPT-6 Astra نے 62.7 فیصد اسکور حاصل کیا، جبکہ Provider Adapter Harness میں ماڈل نے 99.9 فیصد تک اسکور ریکارڈ کیا۔

رپورٹ کے مطابق GPT-6 Astra کی ایک اہم خصوصیت صرف پیچیدہ مسائل کو حل کرنا نہیں بلکہ انہیں کم سے کم اقدامات کے ذریعے حل کرنا بھی رہی۔ ماڈل نے ARC-AGI-3 کے 96 فیصد لیولز میں انسانی شرکا کے درمیانی معیار کے مقابلے میں کم اقدامات استعمال کیے۔

ARC-AGI-3 کیا ہے؟

ARC-AGI-3 مصنوعی ذہانت کی صلاحیتوں کو جانچنے والا ایک جدید بینچ مارک ہے، جس میں AI ایجنٹس کو ایسے نئے اور غیر مانوس ماحول میں رکھا جاتا ہے جہاں انہیں واضح ہدایات فراہم نہیں کی جاتیں۔

ان ماحول میں AI کو خود مشاہدہ کرنا، تجربات کرنا، قوانین کو سمجھنا اور پھر مقصد حاصل کرنے کے لیے منصوبہ بندی کرنا ہوتی ہے۔

ARC-AGI-3 بنیادی طور پر AI کی چار اہم صلاحیتوں کا جائزہ لیتا ہے:

پاکستان میں متعارف کرائی گئی نئی 2027 ہونڈا CG 125 موٹر سائیکل
Atlas Honda نے 2027 Honda CG 125 کو نئے سلور رنگ اور اپڈیٹڈ گرافکس کے ساتھ متعارف کرادیا۔

Exploration: ماحول کے ساتھ تعامل کرتے ہوئے نئی معلومات حاصل کرنا۔

Modeling: مشاہدات کو ایک ایسے ماڈل میں تبدیل کرنا جو مستقبل کے حالات کی پیش گوئی کر سکے۔

Goal-setting: محدود اشاروں یا انعامات کی بنیاد پر مقصد کی شناخت کرنا۔

Planning and Execution: مقصد حاصل کرنے کے لیے مؤثر حکمت عملی تیار کرنا اور حالات کے مطابق اسے تبدیل کرنا۔

GPT-6 Astra نے غیر مانوس ماحول کو منطقی ماڈلز میں تبدیل کیا

رپورٹ کے مطابق GPT-6 Astra کی کارکردگی کا ایک انتہائی اہم پہلو یہ تھا کہ ماڈل نے نئے اور نامعلوم ماحول کو مختصر علامتی اور منطقی ماڈلز میں تبدیل کرنے کی صلاحیت دکھائی۔

Astra نے کھیل یا ماحول کے قوانین، اشیا کی پوزیشن، حرکت اور ممکنہ نتائج کو ایک قسم کے مختصر کوڈ نما نظام میں ترتیب دیا۔

ماڈل نے اپنے لیے ایک مخصوص مختصر علامتی زبان بھی تیار کی، جس کے ذریعے وہ ماحول کی موجودہ صورتحال، مختلف اشیا، ان کے باہمی تعلق اور اگلے اقدامات کو محفوظ رکھتا تھا۔

مثال کے طور پر Astra کسی ماحول میں موجود اشیا کی جگہ، کنٹرولز اور مطلوبہ اقدامات کو مختصر علامتی نوٹس کی شکل میں ترتیب دیتا اور پھر انہی معلومات کی بنیاد پر متعدد مراحل پر مشتمل منصوبہ بندی کرتا۔

یہ صلاحیت اس بات کی جانب اشارہ کرتی ہے کہ جدید AI ماڈلز صرف پہلے سے موجود معلومات کو دہرانے کے بجائے نئے ماحول کے لیے عارضی طور پر داخلی ورکنگ ماڈلز بھی تشکیل دے سکتے ہیں۔

انسانی کارکردگی کے مقابلے میں کم اقدامات

ARC-AGI-3 کے انسانی معیار کا تعین تقریباً 500 عام افراد کی کارکردگی کی بنیاد پر کیا گیا۔

ہر لیول کے لیے انسانی کارکردگی کا معیار ان افراد کے درمیانی Action Count کی بنیاد پر بنایا گیا جو کامیابی کے ساتھ متعلقہ ماحول یا گیم مکمل کرنے میں کامیاب ہوئے۔

GPT-6 Astra نے Provider Adapter Harness میں انسانی معیار سے بہتر کارکردگی دکھائی۔

آزاد کشمیر میں انٹرنیٹ بحالی، مختلف اضلاع میں انٹرنیٹ سروس کا آغاز
آزاد کشمیر میں انٹرنیٹ سروس کی مرحلہ وار بحالی شروع کردی گئی۔

اعداد و شمار کے مطابق Astra نے:

96 فیصد لیولز میں انسانی درمیانی معیار کے مقابلے میں کم اقدامات استعمال کیے۔

مزید یہ کہ ماڈل نے اوسطاً ہر لیول کو مکمل کرنے کے لیے انسانی شرکا کے مقابلے میں تقریباً 51.7 فیصد کم اقدامات کیے۔

ماہرین کے مطابق یہ نتیجہ خاص اہمیت رکھتا ہے کیونکہ AI کی صلاحیت کو صرف یہ دیکھ کر نہیں جانچا جا سکتا کہ وہ کسی مسئلے کو حل کر سکتا ہے یا نہیں، بلکہ یہ بھی ضروری ہے کہ اسے مسئلہ سمجھنے اور حل تک پہنچنے کے لیے کتنے تجربات اور اقدامات درکار ہوتے ہیں۔

مختلف Reasoning Levels پر نتائج

GPT-6 Astra نے مختلف Reasoning Effort Levels پر بھی نمایاں کارکردگی دکھائی۔

Standard Harness میں Astra کے زیادہ سے زیادہ Reasoning Level نے 62.7 فیصد اسکور حاصل کیا، جبکہ Provider Adapter Harness میں High Reasoning Level پر ماڈل نے 99.9 فیصد تک کامیابی حاصل کی۔

دلچسپ بات یہ ہے کہ بعض صورتوں میں زیادہ Reasoning Effort استعمال کرنے سے مجموعی لاگت بھی کم رہی کیونکہ ماڈل نے مسائل کو زیادہ مؤثر انداز میں حل کرتے ہوئے کم اقدامات اور کم Model Calls استعمال کیے۔

یہ نتائج ظاہر کرتے ہیں کہ بہتر استدلال صرف AI کی درستگی میں اضافہ نہیں کرتا بلکہ بعض حالات میں اس کی مجموعی کارکردگی اور وسائل کے استعمال کو بھی بہتر بنا سکتا ہے۔

Astra نے اپنی ضرورت کے مطابق Tools بھی تیار کیے

مزید جدید تجربات کے دوران GPT-6 Astra کو ایک Sandbox ماحول میں Custom Code استعمال کرنے کی سہولت دی گئی۔

اس ماحول میں Astra نے مختلف گیمز اور مسائل کے لیے خود مخصوص Tools تیار کیے۔

رپورٹ کے مطابق ماڈل نے بعض پیچیدہ ماحول کے لیے:

Board Parsers

Game-State Models

پاکستان میں ورچوئل اثاثوں کے لیے نیا لائسنسنگ نظام کا اجرا
پاکستان میں کرپٹو اور ورچوئل اثاثہ کاروبار کے لیے نیا لائسنسنگ نظام متعارف۔

Search Algorithms

Planning Systems

Persistent Notes تیار کیے۔

ایک مثال میں Astra نے ایک پیچیدہ Maze جیسے ماحول کو حل کرنے کے لیے مخصوص Software Components بنائے، جن کے ذریعے راستوں، حرکت کرنے والے مخالف عناصر اور ممکنہ نتائج کو ماڈل کیا گیا۔

تاہم ماہرین نے واضح کیا کہ ایسے تجربات میں AI کو اضافی Tools دستیاب تھے، جبکہ انسانی شرکا کو Code Interpreter یا اسی نوعیت کی سہولیات فراہم نہیں کی گئیں، اس لیے دونوں تجرباتی حالات کو براہ راست ایک جیسا نہیں سمجھا جا سکتا۔

دو مختلف Harnesses، دو مختلف نتائج

ARC-AGI-3 میں Standard Harness اور Provider Adapter Harness دو مختلف سوالات کے جواب دینے کے لیے استعمال کیے گئے۔

Standard Harness میں مختلف AI فراہم کنندگان کے ماڈلز کو تقریباً یکساں بنیادی ماحول فراہم کیا جاتا ہے تاکہ ان کی کارکردگی کا براہ راست موازنہ کیا جا سکے۔

دوسری جانب Provider Adapter Harness ماڈل کو اس کے فراہم کنندہ کی مخصوص Context Management صلاحیتوں سے فائدہ اٹھانے کی اجازت دیتا ہے۔

GPT-6 Astra کے معاملے میں Provider Adapter Harness کے ذریعے ماڈل اپنی Reasoning State اور طویل گفتگو یا مسئلے کے دوران معلومات کو زیادہ مؤثر انداز میں منظم کرنے میں کامیاب رہا۔

اسی وجہ سے Standard Harness میں 62.7 فیصد اسکور کے مقابلے میں Provider Adapter Harness میں بہترین نتیجہ 99.9 فیصد تک پہنچ گیا۔

کیا GPT-6 Astra کو AGI قرار دیا جا سکتا ہے؟

وزیراعظم شہباز شریف اسلام آباد میں گوگل کے دفتر کا افتتاح کرتے ہوئے
وزیراعظم شہباز شریف نے اسلام آباد میں گوگل کے نئے دفتر کا افتتاح کردیا۔

ARC-AGI کے ماہرین نے واضح کیا ہے کہ کسی ایک بینچ مارک میں اعلیٰ کارکردگی حاصل کرنا مصنوعی عمومی ذہانت یا AGI حاصل کرنے کا حتمی ثبوت نہیں ہے۔

اگرچہ GPT-6 Astra نے نئے ماحول کو سمجھنے، قوانین دریافت کرنے، علامتی ماڈلز بنانے اور مؤثر منصوبہ بندی کرنے میں نمایاں پیش رفت دکھائی ہے، تاہم ARC-AGI-3 کے ماحول محدود اور مخصوص نوعیت کے ہیں۔

یہ ماحول حقیقی دنیا کی پیچیدگی، غیر یقینی صورتحال اور کھلے اختیارات کی مکمل نمائندگی نہیں کرتے۔

رپورٹ میں کہا گیا ہے کہ GPT-6 Astra کی کارکردگی مصنوعی ذہانت میں عمومی مسائل حل کرنے کی صلاحیت کی جانب ایک اہم قدم ضرور ہے، لیکن اسے مکمل AGI قرار دینا قبل از وقت ہوگا۔

مصنوعی ذہانت کی اگلی نسل کی جانب اہم پیش رفت

GPT-6 Astra کے ARC-AGI-3 نتائج نے مصنوعی ذہانت کی تحقیق میں ایک نئی بحث کو جنم دیا ہے۔

ماڈل کی جانب سے نامعلوم ماحول کو سمجھنا، قوانین دریافت کرنا، معلومات کو مختصر علامتی شکل میں منظم کرنا اور انسانی معیار سے کم اقدامات کے ساتھ مسائل حل کرنا اس بات کی نشاندہی کرتا ہے کہ AI ماڈلز اب زیادہ پیچیدہ Agentic Intelligence کی طرف بڑھ رہے ہیں۔

ARC-AGI سیریز کا مقصد بھی یہی جانچنا ہے کہ مصنوعی ذہانت اور انسانی عمومی صلاحیتوں کے درمیان کتنا فرق باقی رہ گیا ہے۔

GPT-6 Astra کے نتائج سے یہ ضرور ظاہر ہوتا ہے کہ جدید AI ماڈلز نے بعض مخصوص Agentic Tasks میں انسانی کارکردگی کے معیار کو حاصل کرنے اور بعض معاملات میں اسے پیچھے چھوڑنے کی صلاحیت دکھانا شروع کر دی ہے۔

تاہم حقیقی دنیا کے پیچیدہ، غیر متوقع اور کھلے ماحول میں AI کی مکمل عمومی ذہانت کو جانچنے کے لیے مزید جدید بینچ مارکس اور تحقیق کی ضرورت اب بھی برقرار ہے۔

 
READ MORE FAQS”

GPT-6 Astra کیا ہے؟

GPT-6 Astra ایک جدید مصنوعی ذہانت کا ماڈل ہے جس نے ARC-AGI-3 جیسے پیچیدہ Agentic Intelligence بینچ مارک میں نمایاں کارکردگی دکھائی۔

ARC-AGI-3 کیا ہے؟

ARC-AGI-3 ایک ایسا بینچ مارک ہے جو AI کی نئی اور غیر مانوس ماحول میں دریافت، ماڈلنگ، مقصد کی شناخت اور منصوبہ بندی کی صلاحیت کو جانچتا ہے۔

GPT-6 Astra نے ARC-AGI-3 میں کیا اسکور حاصل کیا؟

GPT-6 Astra نے Standard Harness میں 62.7 فیصد جبکہ Provider Adapter Harness میں بہترین صورت میں 99.9 فیصد اسکور حاصل کیا۔

کیا GPT-6 Astra کو AGI قرار دیا جا سکتا ہے؟

نہیں، ARC-AGI-3 میں اعلیٰ کارکردگی کے باوجود اسے AGI حاصل کرنے کا حتمی ثبوت قرار نہیں دیا گیا۔ یہ مصنوعی ذہانت کی عمومی صلاحیتوں کی جانب ایک اہم پیش رفت ضرور ہے۔

وَأَقِيمُوا الصَّلَاةَ وَآتُوا الزَّكَاةَ وَركَعُوا مَعَ الرَّاكِعِينَ

فجر04:18 AM
طلوع آفتاب05:43 AM
ظہر12:07 PM
عصر03:43 PM
مغرب06:31 PM
عشاء07:56 PM
اے ایمان والو! اگر کوئی فاسق تمہارے پاس کوئی خبر لے کر آئے، تو خوب تحقیق کر لیا کرو، ایسا نہ ہو کہ تم کسی قوم کو نادانی میں نقصان پہنچا بیٹھو، پھر اپنے کیے پر پچھتاتے رہو۔  الحجرات: 6