Super Sale WeekClaude Skills — 20% OFF
News

Qwen3.8: ما الجديد، وكيفية تشغيله، والبدائل (2026)

Powerdrill Team·
Qwen3.8: ما الجديد، وكيفية تشغيله، والبدائل (2026)

أصدر فريق Qwen التابع لشركة Alibaba نموذج Qwen3.8-27B في 14 أغسطس 2026، بعد يومين من إطلاق نموذج Qwen3.8-2.4T-A95B الأكبر بكثير. وتتكون ملاحظة الإصدار من جملة واحدة تستحق القراءة مرتين.

"لأول مرة، يجلب Qwen3.8 نموذجًا من فئة Qwen-Max إلى الإصدار المفتوح."

هذا ادعاء يتعلق بالفئة وليس بالحجم. وهو يعني أن الأوزان المفتوحة تقع الآن في المكان الذي كان يحتله النموذج الرائد المستضاف سابقًا.

أما ما إذا كان هذا ينطبق على أعباء العمل الخاصة بك فهذا سؤال منفصل، والأدلة المنشورة تجيب عليه جزئيًا فقط. ويركز الجزء المتبقي من هذا المقال على تحديد أي الأجزاء المعنية.

يغطي هذا المقال ما تم إطلاقه ومواضع الاختلاف بين الوثيقتين الرسميتين. ثم يستعرض ما يقيسه جدول اختبارات الأداء بالفعل. وأخيرًا، يتناول كيفية تشغيل النموذج محليًا، إذا كنت ترغب في إبقاء التحليلات على جهازك الخاص.

ما هو Qwen3.8 في الواقع

يصف ملف README الرسمي هذه العائلة بأنها مبنية "على الأساس المعماري لـ Qwen3.5"، مما يحقق مكاسب "في مجالات البرمجة، والعمل المهني، والبحث، والمهام الوكيلية طويلة المدى."

الجملة التي تهم أي شخص يقوم بعمل متعدد الخطوات هي الجملة التالية. حيث تم تصميم Qwen3.8 "لإنجاز المهام المعقدة ومتعددة الخطوات حتى نهايتها بموثوقية أكبر."

نموذج 27B هو النموذج الذي سيقوم معظم الأشخاص بتشغيله محليًا. وتقدم بطاقة النموذج الأرقام الدقيقة: 27B معلمة، و64 طبقة، وبُعد مخفي قدره 5120، وتصميم هجين من كتل Gated DeltaNet وGated Attention.

يبلغ طول السياق 262,144 رمزًا بشكل أصلي وقابل للتوسيع حتى 1,000,000. الترخيص المسجل في بطاقة النموذج هو apache-2.0.

من الجدير بالذكر التمييز بوضوح بين الإصدارين. فقد تم إطلاق نموذج خليط الخبراء 2.4T-A95B في 2026-08-12، وتبعه النموذج المكثف 27B في 2026-08-14. والنموذج الثاني فقط هو الذي يمكن استضافته ذاتيًا بشكل واقعي.

الحقيقة Qwen3.8-27B
تاريخ الإصدار 2026-08-14
المعلمات 27B مكثف
الطبقات 64
السياق 262,144 أصلي، قابل للتوسيع إلى 1,000,000
الترخيص apache-2.0
المدخلات نصوص، صور، فيديو

مواضع الاختلاف بين الوثيقتين الرسميتين

هذا هو الجزء الذي لا يتحدث عنه أحد تقريبًا، وهو يغير ما يمكنك ادعاؤه بأمان.

ينسب ملف README على GitHub البنية متعددة الوسائط إلى Qwen3.5، وهو الجيل الذي بُني عليه Qwen3.8. وإذا قرأت تلك الصفحة فقط، فستستنتج أن نموذج 27B يدعم النصوص فقط.

لكن بطاقة النموذج تقول غير ذلك، وهي محددة للغاية. فنماذج Qwen3.8-27B هي "نموذج رؤية ولغة أصلي يفهم الصور ومقاطع الفيديو، مع تحكم مرن في التفكير."

عندما يتعارض مصدران رسميان، فإن المصدر الأكثر تحديدًا هو الذي يفوز. تصف بطاقة النموذج نقطة الفحص هذه بدقة، لذا فإن القدرة متعددة الوسائط حقيقية. ومن المفيد معرفة وجود هذا التعارض، لأن نظرة سريعة على المستودع ستخبرك بعكس ذلك.

ما يقيسه جدول اختبارات الأداء، وما يغفله

تنشر بطاقة النموذج مقارنة مع Qwen3.6-27B، وQwen3.7-Plus، وMuse Glimmer-30B، وOpus4.6 Max. وتشهد بعض الأرقام المتعلقة بالمهام الوكيلية قفزات كبيرة.

اختبار الأداء Qwen3.8-27B Qwen3.6-27B
OSWorld-Verified (استخدام الكمبيوتر) 84.3 63.9
WebArena-Verified (استخدام المتصفح) 64.8 48.8
AndroidWorld (استخدام الهاتف المحمول) 81.9 70.3
SWE-bench Pro (البرمجة) 61.7
MathVision (مع مفسر الأكواد) 94.6 90.3
Vision2Web (تطوير الويب المرئي) 62.9 45.0

والآن لنقرأ الأرقام بموضوعية. يغطي هذا الجدول استخدام الكمبيوتر، واستخدام المتصفح، واستخدام الهاتف المحمول، والبرمجة، والرياضيات المرئية، وتطوير الويب.

لا يوجد هنا أي اختبار أداء لقراءة جداول البيانات، أو مطابقة ملفين مصدّرين، أو إنشاء تقرير من بيانات جدولية. تخبرك أرقام OSWorld القوية أن النموذج يمكنه تشغيل سطح المكتب، لكنها لا تخبرك بأنه سينجح في مطابقة إيراداتك بشكل صحيح.

هناك تفصيل يستحق التنويه للقراء الذين يتابعون الإصدارات المفتوحة. يظهر نموذج Muse Glimmer-30B في هذا الجدول كنقطة مقارنة، وكان جدول الإطلاق الخاص به قبل أربعة أيام يقارن نفسه بنموذج Qwen3.6-27B. وقد أشرنا في مقالنا حول Muse Glimmer إلى أن مجموعة النظراء الخاصة به كانت متأخرة بجيل كامل بالفعل عند الإطلاق. وهذا الجدول يمثل النصف الآخر من تلك القصة.

كيفية تشغيله

تتوفر الأوزان على Hugging Face Hub وعلى ModelScope، وفقًا لقسم الأخبار في ملف README. ويعد النموذج المكثف 27B هو الخيار العملي للتشغيل على جهاز واحد.

خطط لذاكرة جهازك بناءً على عدد المعلمات بدلاً من الحد الأقصى للسياق. تتوفر نافذة سياق تبلغ 262,144 رمزًا، ولكن ملأها يستهلك ذاكرة لا تتوفر لدى معظم الأجهزة المحلية.

ابدأ بسياق قصير وملف حقيقي. قم بتحميل ملف مصدّر واحد، واطرح سؤالاً واحدًا تعرف إجابته بالفعل، وتحقق من الإجابة قبل الوثوق بأي شيء أطول.

خطوة التحقق هذه ليست اختيارية عند العمل على البيانات الجدولية. يمكن للنموذج أن يصف جدول بيانات بطلاقة ومع ذلك يخطئ في تحديد العمود الذي يحتوي على الإجماليات. فالإجابات الخاطئة المصاغة بطلاقة يصعب كشفها مقارنة بالأخطاء الواضحة.

إذا كنت بحاجة إلى نافذة المليون رمز، فتعامل مع الأمر كمهمة منفصلة بميزانية عتاد خاصة بها. تختلف التهيئة بين الحالتين بشكل كبير في الممارسة العملية، واختبار أداء إحداهما لا يخبرك بالكثير عن الأخرى.

غيّر جهد التفكير الافتراضي أولاً

إليك الإعداد الذي سيشكل انطباعك الأول، وهو يظهر بوضوح في قالب الدردشة الخاص ببطاقة النموذج نفسه.

يحدد القالب قيمة reasoning_effort إلى xhigh افتراضيًا، مع قبول قيم أخرى مثل medium وlow. كما يمكن إيقاف ميزة التفكير تمامًا.

الوضع الافتراضي xhigh يعني أن النموذج سيستغرق وقتًا طويلاً في التفكير في أسئلة لا تتطلب ذلك. بالنسبة للبحث في سطر واحد داخل ملف CSV صغير، سيظهر لك النموذج بطيئًا بدلاً من كونه حذرًا.

لذا، فإن أول شيء يجب ضبطه ليس الصياغة. بل خفّض الجهد إلى medium أو low للأسئلة الروتينية، واحتفظ بـ xhigh للمهام متعددة الخطوات التي تتحدث عنها ملاحظة الإصدار بالفعل.

موقع هذا النموذج في سير عمل البيانات

يحل النموذج مفتوح الأوزان الذي تستضيفه بنفسك مشكلة محددة، وهي أن البيانات لا تغادر جهازك أبدًا. بالنسبة للملفات الخاضعة للقوانين أو الحساسة، فإن هذا هو المبرر الأساسي، ولا يمكن لأي ميزات استضافة مريحة أن تحل محله.

أما بقية جوانب هذا الخيار فهي عبارة عن مقايضة. فأنت تتحمل مسؤولية العتاد، والتحديثات، وقرارات التكميم مقابل الحصول على هذا الضمان الوحيد.

ولكن ما لا يحله هذا النموذج هو كل ما يحيط به من مهام؛ فتحليل الأعمدة، ودمج ملفين مصدّرين، واكتشاف الحقول المعاد تسميتها، ورسم المخططات البيانية، وإنشاء المستندات، كلها مهام منفصلة تمامًا.

هذه الفجوة هي سبب وجود بروتوكولات وطبقات أدوات مساعدة. يغطي شرحنا حول ما هو MCP المعيار الذي يربط النماذج بالأدوات. وتوضح صفحة موصلات البيانات ما يتوقعه خط معالجة البيانات المعتمد على الملفات كمدخلات.

البدائل

إذا كان المطلوب نموذجًا محليًا ومفتوحًا، فإن Qwen3.8-27B وMuse Glimmer-30B هما المرشحان الحاليان في نفس فئة الحجم. وكلاهما ينشر أوزانه ويمكن تشغيله على جهاز واحد.

أما إذا كان المطلوب هو مخرج نهائي جاهز من ملف بدلاً من نقطة نهاية للنموذج، فإن شكل الأداة يختلف. حيث يأخذ Powerdrill Bloom جدول البيانات، ويحلل الأعمدة، ويعيد لك المخطط البياني، أو التقرير، أو العرض التقديمي.

لا توجد مقارنة أسعار يمكن إجراؤها فيما يتعلق بنماذج Qwen. لم نتمكن من الوصول إلى أي صفحة أسعار رسمية لـ Qwen لهذا النموذج، لذا لا يذكر هذا المقال أي أرقام.

إذا كانت مهمتك الفعلية هي ملف يحتاج إلى تحويله لتقرير، فجرب Powerdrill Bloom عليه مباشرة. راجع أيضًا دليلنا حول تحويل ملف اشتراكات مصدّر إلى تقرير MRR وARR وصفحة مساعد CSV بالذكاء الاصطناعي.

الخاتمة

نموذج Qwen3.8-27B هو نموذج مكثف بحجم 27B مع سياق أصلي يبلغ 262,144 رمزًا، وأوزان مرخصة بموجب apache-2.0، ومدخلات موثقة للصور والفيديو. وتعتبر القفزات في المهام الوكيلية مقارنة بنموذج Qwen3.6-27B قفزات جوهرية.

هناك تحفظان يرافقان هذا النموذج: يتعارض المستودع وبطاقة النموذج حول القدرة متعددة الوسائط، وتغطي اختبارات الأداء المنشورة مهام سطح المكتب، والمتصفح، والبرمجة، والمهام المرئية بدلاً من العمل على البيانات الجدولية.

اضبط إعداد reasoning_effort قبل الحكم عليه. فالوضع الافتراضي هو xhigh، وهذا الوضع الافتراضي يقوم بتفكير أكثر مما تتطلبه معظم الأسئلة.

الأسئلة الشائعة

متى تم إصدار Qwen3.8؟

تسجل إدخالات الأخبار في ملف README إصدار Qwen3.8-27B في 2026-08-14 وإصدار Qwen3.8-2.4T-A95B في 2026-08-12، وكلاهما على Hugging Face Hub وModelScope.

هل نموذج Qwen3.8-27B متعدد الوسائط؟

نعم، وفقًا لبطاقة النموذج الخاصة به، والتي تصفه بأنه نموذج رؤية ولغة أصلي يفهم الصور ومقاطع الفيديو. يرجى ملاحظة أن ملف README على GitHub ينسب البنية متعددة الوسائط إلى Qwen3.5.

ما هو طول السياق الذي يدعمه؟

تشير بطاقة النموذج إلى 262,144 رمزًا بشكل أصلي، قابلة للتوسيع حتى 1,000,000. ويتطلب التشغيل بالقرب من الرقم الأعلى ذاكرة تفوق بكثير ما يتوفر في الأجهزة المحلية المعتادة.

Why does it feel slow on simple questions?

يحدد قالب الدردشة قيمة reasoning_effort افتراضيًا إلى xhigh. خفّضها إلى medium أو low لعمليات البحث الروتينية، واحتفظ بـ xhigh للمهام متعددة الخطوات فعليًا.

هل تذكر اختبارات الأداء أي شيء عن العمل على جداول البيانات؟

لا. يغطي الجدول المنشور استخدام الكمبيوتر، واستخدام المتصفح، واستخدام الهاتف المحمول، والبرمجة، والرياضيات المرئية، وتطوير الويب، دون وجود أي اختبار أداء للتحليل الجدولي أو إنشاء التقارير.