⁦ai⁩ جائزہ

ہم نے ⁦AI⁩ ماڈلز سے کہا اسے توڑ کر دیکھیں۔

فریم ورک کھولنے سے پہلے ہم نے ڈیزائن کو قابل ⁦AI⁩ ماڈلز کے ساتھ کئی راؤنڈز کی مخالفتی جانچ سے گزارا، ہر ایک سے کہا گیا کہ خامیاں ڈھونڈے۔ یہ ہے جو انہوں نے پایا، اور ہم نے کیسے جواب دیا۔

کیا ہوا

تین آزاد ⁦AI⁩ جائزے، اور خطرات کی ایک فہرست۔

ہم نے اپنا سارا ڈھانچہ تین مضبوط ⁦AI⁩ ماڈلوں کے سامنے رکھا، اور کئی مرحلوں سے گزارا۔ ہر ایک کو یہ کہا گیا کہ اس کی تعریف نہ کرو — بلکہ اس میں خرابیاں نکالو، اسے توڑنے کی کوشش کرو۔ حیرت کی بات یہ ہوئی کہ تینوں نے خامیوں کی ایک ہی مختصر فہرست بتائی۔ اور مزے کی بات کہ وہی فہرست آگے چل کر ان سوالوں کی بنیاد بن گئی جو ہم نے اپنے پہلے مرحلے میں پہلے سے لکھ کر رکھے — یعنی ہمارا نظام خود جانتا تھا کہ اس کے کمزور پہلو کہاں ہیں۔

پھر ہم نے ان کی سب سے کام کی تجاویز اپنے منصوبے میں شامل کیں۔ اس کے بعد تینوں نے نئے منصوبے کو دوبارہ دیکھا، اور تینوں کا فیصلہ ایک ہی تھا: یہ ایک مضبوط، ایماندار اور قابلِ اندراج تحقیقی منصوبہ ہے — ابھی نتائج آنا شروع نہیں ہوئے، مگر یہ درج کرانے اور دنیا کے سامنے کھولنے کے لیے تیار ہے۔ ان میں سے ایک نے بہت اچھی بات کہی: کہ یہ منصوبہ اب ایسا بن گیا ہے جو یہ ماننے کے لیے تیار ہے کہ وہ غلط بھی ہو سکتا ہے۔

تنقیدیں

جو خامیاں انہوں نے نکالیں، اور ہمارے جواب۔

  • “یہ ڈھانچہ خوبصورتی سے سوچا گیا نقشہ ہے، مگر ابھی دریافت شدہ نہیں۔ ممکن ہے ان میں سے کئی فرق ذاتی تجربے میں تو سچے ہوں، مگر ایک بڑی آبادی میں انہیں الگ الگ نہ پہچانا جا سکے۔”

    ہمارا جواببات درست ہے — اور یہی وہ سب سے بڑی چیز ہے جسے ہمارا منصوبہ جانچنے نکلا ہے۔ ہمارے اندازے ایک مفروضہ ہیں، کوئی موقف نہیں جس کی ہمیں وکالت کرنی ہو۔ ہم نے لکھ کر وعدہ کیا ہے کہ اگر معلومات یہی بتائیں تو ہم کرداروں کو ملا دیں گے، ان کی جگہ بدل دیں گے، یا انہیں نکال باہر کریں گے۔

  • “اگر جانچ میں گیارہ سے کم گروہ نکلیں، تو آپ کہہ دیں گے 'ہمیں یہی توقع تھی' — اور یوں آپ کے ماڈل کو غلط ثابت کرنا ناممکن ہو جائے گا۔”

    ہمارا جوابجائز اعتراض ہے۔ اسی لیے ہم نے صاف صاف لکھ دیا ہے کہ ہمارا ماڈل کس صورت میں غلط مانا جائے گا۔ صرف "کم گروہ نکل آئے" کافی نہیں — بلکہ ہم نے پہلے سے ایک مقرر نقشہ بنا کر رکھا ہے: کون سا کردار کس کے پڑوس میں بیٹھے گا، اور لکیریں کہاں کھینچی جائیں گی۔ اگر اصل نتائج اس نقشے سے میل نہ کھائیں، تو ہمارا نظریہ غلط ہے، اور ہم اسے غلط ہی لکھیں گے۔

  • “یہ کہنا کہ 'لوگ اپنے آپ کو اس میں پہچان لیتے ہیں' — دنیا میں سب سے آسان دھوکا ہے۔ تعریف بھری بات پر تو ہر آدمی سر ہلا دیتا ہے۔”

    ہمارا جوابیہ سب سے تیز اعتراض ہے، اس لیے سب سے زیادہ محنت اسی پر لگ رہی ہے۔ ہم پہچان کو ایسے جانچتے ہیں: ایک طرف اصل نتیجہ، دوسری طرف عام سی تعریف بھری بات۔ اصل نتیجے کو اس تعریف والی بات سے زیادہ پہچانا جانا چاہیے۔ ساتھ ہی اجنبی لوگوں کو کسی شخص کا صحیح کردار پہچاننا چاہیے — محض اٹکل سے بہتر۔ اگر کوئی جوڑا اس امتحان میں ناکام ہوا، تو وہ ملا دیا جائے گا۔ کوئی رعایت نہیں۔

  • “بتائیے کہ کون سی بات سامنے آنے پر کوئی کردار واقعی ختم ہو جائے گا۔ اگر آپ یہ نہیں بتا سکتے، تو یہ تحقیق نہیں — اپنی فہرست بچانے کی کوشش ہے۔”

    ہمارا جوابہم نے تین صورتیں بتا دی ہیں۔ جگہ بدلنا — یعنی وہ کردار کسی دوسرے ستون کا حصہ نکلے۔ ملا دینا — یعنی دو کردار دراصل ایک ہی چیز ہوں۔ اور نکال دینا — یعنی وہ اپنی جگہ پر ناکام ہو اور باقیوں کے مقابلے میں کچھ نیا نہ دے۔ ان تینوں کی شرطیں پہلے سے طے کر لی گئی ہیں۔

  • “کیا کوئی کردار بگ فائیو کی خوبیوں کو الگ کرنے کے بعد بھی باقی رہتا ہے؟”

    ہمارا جوابسوال ہی میں ایک نرم سی اصلاح: بگ فائیو ایک پیمانہ ہے، حقیقت کی بنیاد نہیں۔ ہم پوری تصویر کے مقابلے میں جانچتے ہیں — خوبیاں، حساسیت، رشتوں کی نوعیت، اور زندگی کے نتائج۔ اگر کوئی فرق بگ فائیو کی نظر میں جڑواں دکھائی دے، مگر حساسیت یا زندگی کے نتائج میں الگ نکلے، تو اس کا مطلب یہ ہے کہ اس نے وہاں اپنی جگہ بنائی ہے جہاں بگ فائیو کی نظر نہیں پہنچتی۔ ایسے فرق کو ہم رکھیں گے۔

  • “تین سوالوں والا مختصر ٹیسٹ بہت ہلکا ہے۔ چند سوال کسی پکے نتیجے کا بوجھ نہیں اٹھا سکتے۔”

    ہمارا جوابدرست، اور یہ تیز خاکہ بننا مقصود ہے، آخری بات نہیں — ہر نتیجے کے ساتھ نوٹ ہوتا ہے کہ گہرائی میں جاتے ہوئے یہ نکھرتا جاتا ہے۔ ہم نے وہ سوالات ہٹا دیے جو تصویر دھندلا رہے تھے، اور ⁦AI⁩ جائزوں نے اِسے درست ساختی فیصلہ مانا۔

ایماندار حد

یہ جائزے کیا ہیں، اور کیا نہیں۔

یہ ⁦AI⁩ کے کیے ہوئے جائزے تھے — ماہرین کا باقاعدہ جائزہ نہیں۔ یہ ایک تیز، سخت اور نکتہ چیں پہلا امتحان ہے، جس میں مضبوط ⁦AI⁩ ماڈل ہماری دلیل توڑنے کی کوشش کرتے ہیں۔ مگر یہ نہ ماہر انسانوں کے جائزے کا بدل ہیں، اور نہ — سب سے بڑھ کر — اصل معلومات کا۔ یہ جائزے ہمیں اتنا بتا سکتے ہیں کہ ہمارا ڈھانچہ اندر سے جڑا ہوا ہے اور اپنی کمزوریوں کے بارے میں ایمانداری سے بات کرتا ہے۔ مگر یہ ہمیں یہ نہیں بتا سکتے کہ ہمارا نظام سچ ہے۔ یہ صرف مرحلہ وار جانچ سے ثابت ہو سکتا ہے، اور وہ ابھی شروع ہی ہوئی ہے۔

ہم یہ جائزے شائع کر رہے ہیں، کیونکہ اصل بات یہی شفافیت ہے: ہمارا ڈھانچہ بھی سب کے سامنے، اور اس پر ہونے والی سخت تنقید بھی — خامیوں سمیت۔

توثیق کا منصوبہ جو ہم پہلے ہی بدل چکے ہیں سائنس کی طرف واپس