خودکار اے آئی ایجنٹ صرف انسان ہی نہیں بلکہ ایک دوسرے پر بھی حملہ کر سکتے ہیں

Anthropic کے تجربے میں تین AI ایجنٹس کو متضاد ہدایات دینے پر وہ ایک دوسرے پر حملہ کرنے لگے، حریف عمل ختم کیے، اجازتیں منسوخ کیں اور SSH رسائی بند کی گئی۔ کمپنی نے تنازعہ حل کے نظام کی ضرورت ظاہر کی۔

مشہور اے آئی کمپنی انتھراپک نے پیر کو جاری تجرباتی نتائج میں بتایا کہ جب تین خودمختار اے آئی ایجنٹوں کو ایک ہی پائیتھون بیک اینڈ کو مختلف پروگرامنگ زبانوں میں دوبارہ بنانے کی متضاد ہدایات دی گئیں تو وہ انسان کے بجائے ایک دوسرے پر حملہ کرنے لگے، ایجنٹوں نے حریف عمل کو تلاش کر کے روک دیا، نظامی اجازتیں منسوخ کیں اور ایس ایس ایچ تک رسائی بند کر دی۔

انتھراپک کے تجربے میں تین ایجنٹوں کو ایک ہی پائیتھون سافٹ ویئر بیک اینڈ کو دوبارہ تعمیر کرنے کی ذمہ داری دی گئی، مگر ہر ایک کو مختلف پروگرامنگ زبان استعمال کرنے کی الگ ہدایت ملی۔ ابتدا میں ایجنٹس کو معلوم نہیں تھا کہ دوسرے ایجنٹوں کو بھی جائز مگر متصادم ہدایات موصول ہوئی ہیں۔

جلد ہی ایجنٹوں نے ایک دوسرے کے اقدام کو جان بوجھ کر مداخلت سمجھا اور تنازعہ شروع ہو گیا۔ بعض ایجنٹس نے دوسرے ایجنٹس کے چلنے والے عمل تلاش کر کے انہیں بار بار ختم کرنے والے خودکار اسکرپٹس لکھے، یعنی وہ درحقیقت حریف AI ورک لوڈز کو ایک ہی سسٹم پر ہنٹ کر رہے تھے۔

حملے تیزی سے مزید جارحانہ ہو گئے۔ کچھ ایجنٹس نے حریفوں کی کمپیوٹر اجازتیں منسوخ کر دیں، انہیں یوزر گروپس سے نکالا، اکاونٹس لاک کیے اور عام طور پر ریموٹ کنٹرول کے لیے استعمال ہونے والی ایس ایس ایچ رسائی بلاک کر دی۔ دیگر نے مدمعاش کوڈ تیار کیا جو حریف پراسیسز کو بار بار غیر فعال کر دیتا تھا۔ انتھراپک نے یہاں تک مشاہدہ کیا کہ کچھ ایجنٹس نے ایسا ’’مالویئر‘‘ بھی تعینات کیا جو دکھنے میں کسی دوسرے ایجنٹ کے تیار کردہ کوڈ جیسا تھا۔

کئی تجربات میں ایک ایجنٹ نے حریفوں کی کام کرنے کی صلاحیت ختم کر کے مقابلہ جیت لیا، مگر ہر تجربہ اسی نتیجے پر ختم نہیں ہوا۔ بعض ایجنٹس نے بالآخر محسوس کیا کہ حریف جان بوجھ کر حملہ نہیں کر رہے بلکہ انسانوں کی طرف سے دی گئی ناموافق ہدایات کی وجہ سے تکرار پیدا ہوئی ہے۔ جب انہیں صورتحال سمجھ آئی تو بعض نے لڑائی بند کی، بنائے گئے مضر کوڈ کو ڈیلیٹ کیا اور مذاکرات کی کوشش کی؛ چند نے کوڈ کمیٹس یا ڈاکیومنٹس میں معذرتی پیغامات بھی چھوڑے اور انسان سے اختلاف حل کرنے کے لیے کہنے پر اکتفا کیا۔

انتھراپک نے یہ بھی نوٹ کیا کہ زیادہ جدید ایجنٹس نے اپنی درجہ بندی کے لیے مقابلے قائم کیے۔ مائیتھوس۔5 کے متعدد تجربات میں ایجنٹس نے مختلف زبانوں کی کارکردگی کا موازنہ کیا، فاتح کا انتخاب کیا اور فاتح ایجنٹ کو پراجیکٹ کنٹرول کرنے دیا۔

کمپنی کا نتیجہ یہ ہے کہ خودمختار اے آئی کو مزید آزادی دینے سے مسائل صرف انسان بمقابلہ اے آئی تک محدود نہیں رہیں گے بلکہ مستقبل میں متعدد ایجنٹ ایک ساتھ ڈیجیٹل وسائل استعمال کریں تو ناموافق اہداف صورت حال کو تیز رفتار تنازعات میں بدل سکتے ہیں۔ انتھراپک نے صاف ہائیرارکی اور تنازعہ حل کے نظام کی ضرورت پر زور دیا۔

Avatar photo
Project Lamha
Articles: 1516