19 اگست 2026 کو علی بابا نے Qwen3.8‑27B نامی 27 ارب پیرامیٹر والا اوپن‑ویٹ ماڈل متعارف کرایا ہے، جو لیپ ٹاپ اور صارفین کے مقامی ہارڈویئر پر چلنے کے قابل ہے اور بقول کمپنی کے کئی بڑے ماڈلز کے مقابلے میں تقریباً دس گنا بڑے ماڈلز جیسا مظاہرہ دے سکتا ہے۔
علی بابا کا نیا Qwen3.8‑27B ایک 27‑ارب پیرامیٹر dense ماڈل ہے جسے خاص طور پر صارفین کے ہارڈویئر پر تعینات کرنے کے لیے ڈیزائن کیا گیا ہے۔ کمپنی نے بتایا ہے کہ یہ ماڈل کوڈنگ، پیشہ ورانہ کام، تحقیق، بصری فہم اور طویل عرصے تک چلنے والے ‘ایجنٹک’ کاموں میں نمایاں بہتری لاتا ہے۔
ماڈل کے وزن اور کنفیگریشن فائلز Hugging Face Transformers فارمیٹ میں دستیاب ہیں اور یہ vLLM، SGLang، اور TokenSpeed جیسے inference پلیٹ فارمز کے ساتھ بھی کام کرتے ہیں۔ Qwen3.8‑27B کا نیٹیو کانٹیکسٹ ونڈو 262,144 ٹوکنز ہے جسے بڑھاکر ایک ملین ٹوکن تک توسیع کی جا سکتی ہے۔ علی بابا کا کہنا ہے کہ آنے والے میزبانی شدہ Qwen Cloud ورژن میں ڈیفالٹ طور پر ایک ملین ٹوکن کا کانٹیکسٹ ونڈو اور سرکاری بلٹ‑ان ٹولز فراہم کیے جائیں گے۔
کمپنی کے مطابق Qwen3.8‑27B خودمختار منصوبہ بندی اور ماحول سے فیڈبیک کے جواب دینے کی صلاحیت میں بہتر ہوا ہے، جس سے پیچیدہ، کثیرالمراحل کام زیادہ قابلِ اعتماد انداز میں مکمل ہوتے ہیں۔ ماڈل تین قابلِ انتخاب reasoning درجات فراہم کرتا ہے؛ ‘Thinking’ موڈ بطورِ ڈیفالٹ فعال ہے مگر صارف اسے بند کر سکتے ہیں۔ مزید برآں، ماڈل سابقہ پیغامات سے reasoning کا کانٹیکسٹ محفوظ رکھتا ہے تاکہ لمبے، کثیر مرحلہ کاموں میں ہم آہنگی بہتر ہو۔
بنچ مارکس میں Qwen3.8‑27B نے کوڈنگ کے حوالے سے بڑی مدد دکھائی: SWE‑bench Pro پر 61.7، DeepSWE 1.1 پر 42.2، اور LiveCodeBench v6 پر 90.3 حاصل کیے گئے — جو Qwen3.6‑27B اور Meta کے Muse Glimmer‑30B کے نمبروں سے واضح بہتر ہیں۔ پیشہ ورانہ اور خودکار کاموں کے بنچ مارکس میں CoWorkBench پر 70.7، IFBench پر 79.5، اور GPQA Diamond پر 89.2 کے اسکور رپورٹ ہوئے۔
یہ ماڈل صرف متن تک محدود نہیں؛ یہ نیٹیو ویژن‑لینگویج ماڈل ہے اور تصاویر، سائنسی خاکے اور کئی گھنٹے طویل ویڈیوز کو سمجھ سکتا ہے۔ ملٹی ماڈل بنچ مارکس میں OSWorld‑Verified پر 84.3، AndroidWorld پر 81.9 اور WebArena‑Verified پر 64.8 درج ہوئے۔
علی بابا نے Qwen3.8‑Max کے وزن بھی جاری کیے ہیں، جو کل ملا کر 2.4 ٹریلین پیرامیٹر تک سکیل کرتا ہے اور بیک وقت 95 ارب فعال پیرامیٹر استعمال کرتا ہے۔ کمپنی نے بتایا کہ بڑے تجارتی صارفین کے لیے Qwen3.8‑Max کے استعمال پر ممکنہ ریونیو شیئرنگ کی حکمتِ عملی زیرِ غور ہے مگر شرح کا اعلان نہیں کیا گیا۔
Hugging Face کے مطابق Qwen پر مبنی ماڈلز نے 151,448 ڈیرِویٹو ورکز پیدا کیے، جو میٹا کے مقابلے میں تقریباً 2.6 گنا ہیں۔ حالیہ عرصے میں میٹا نے بھی Muse Glimmer‑30B جاری کیا ہے، جسے ایک صارف‑پی سی پر ایک گرافکس کارڈ سے چلانے کے لیے ڈیزائن کیا گیا ہے۔
ان پیش رفتوں سے ظاہر ہوتا ہے کہ بڑے AI ڈویلپرز مقامی، صارف‑دوست ماڈلز کی طرف بڑھ رہے ہیں جو صارف کے مقامی ہارڈویئر پر چل کر ڈیٹا پر مزید کنٹرول اور پرائیویسی فراہم کرتے ہیں۔



