Qwen3.8-Max من Alibaba: تفوق وكيل و $8 لكل مليون توكن

كشفت Alibaba، عبر فريق Qwen للذكاء الاصطناعي، في 3 أغسطس 2026، عن نموذجها اللغوي الكبير متعدد الوسائط (LLM) الرائد Qwen3.8-Max، بـ 2.4 تريليون بارامتر، وبتصميم…
مقدمة تحليلية
كشفت Alibaba، عبر فريق Qwen للذكاء الاصطناعي، في 3 أغسطس 2026، عن نموذجها اللغوي الكبير متعدد الوسائط (LLM) الرائد Qwen3.8-Max، بـ 2.4 تريليون بارامتر، وبتصميم Mixture-of-Experts (MoE) يستهدف سوق الذكاء الاصطناعي المتقدم في مجالات الهندسة البرمجية المستقلة والمهام المؤسسية طويلة الأمد. يدعي النموذج، وفقاً لمعايير الشركة المنشورة، تفوقه على المنافسين الرئيسيين، مسجلاً 86.1 نقطة على معيار OSWorld-Verified لقياس قدرة الوكلاء على استخدام أنظمة تشغيل الكمبيوتر وتطبيقاتها، متقدماً على GPT-5.6 Sol Max (83.2 نقطة) وFable 5 (85.0 نقطة). هذا الإطلاق يصاحبه وعد بإصدار الأوزان المفتوحة للنموذج الأسبوع المقبل، إلى جانب Qwen3.8-27B، في خطوة قد تعيد تشكيل اعتماد الشركات. الأهم اقتصادياً، أُطلق Qwen3.8-Max بسعر 2 دولار للمليون توكن المدخل و 6 دولارات للمليون توكن المخرج، بإجمالي 8 دولارات لكل مليون توكن، مما يضعه بأسعار تنافسية للغاية، أقل من ثلث سعر Claude Opus 5 وربع سعر GPT-5.6 Sol Max، وهو عامل حاسم للأنظمة الوكيلة كثيفة الاستهلاك للتوكنات.
التحليل التقني
يمثل Qwen3.8-Max نموذجاً لغوياً كبيراً متعدد الوسائط يعتمد على بنية Mixture-of-Experts (MoE) بـ 2.4 تريليون بارامتر، ويُعَد تحولاً استراتيجياً نحو التركيز على الاستخدام الوكيلي للكمبيوتر. تُشير Alibaba إلى النموذج كـ "زميل عمل مستقل" قادر على تنفيذ مشاريع تمتد لأيام بدلاً من دقائق، بعيداً عن التركيز التقليدي على الذكاء المحادثاتي. يتضمن ذلك إنجاز مشاريع برمجية مستقلة تتجاوز 10 أيام، وإعادة إنتاج أوراق بحثية تتضمن آلاف الأسطر من التعليمات البرمجية، وتحسين تصميم الشرائح بشكل تكراري، ومراجعة الخطط باستمرار باستخدام حلقات ردود الفعل متعددة الوسائط. هذه الإمكانيات، التي لا تزال تحتاج إلى تحقق مستقل، تعكس اتجاه الصناعة نحو نماذج قادرة على إنجاز مهام سير عمل كاملة.
تدعم هذه القدرات مجموعة من المعايير التي تركز على التنفيذ طويل الأمد:
- OSWorld-Verified: 86.1 نقطة (متفوقاً على GPT-5.6 Sol Max 83.2، Fable 5 85.0، و Gemini 3.1 Pro 76.2). يقيس هذا المعيار قدرة الوكلاء على التفاعل مع بيئات سطح المكتب.
- PaperBench: 93.0 نقطة (الأعلى المبلغ عنه، لقياس إعادة بناء الأوراق البحثية من البيانات التجريبية).
- TerminalBench 2.1: 86.6 نقطة.
- Vision2Web: 69.0 نقطة.
- LVBench: 81.8 نقطة.
- ERQA: 77.8 نقطة.
ورغم تميزه في هذه المجالات، يبقى Qwen3.8-Max متنافساً في فئات أخرى، حيث لا يزال نموذج OpenAI يتصدر معيار SWE-Pro للهندسة البرمجية الاحترافية، ويتقدم Opus 4.8 في تقييمات محددة للهندسة البرمجية وامتحان Agents' Last Exam. يقدم Qwen ملف أداء متوازن واسع النطاق، وهو ما قد يكون أكثر أهمية للمشترين من الشركات من الانتصارات المعيارية المعزولة، نظراً لتركيزهم المتزايد على إنجاز مهام سير العمل المتجانسة.
السياق وتأثير السوق
يأتي إطلاق Qwen3.8-Max في ظل تزايد التخصص في سوق النماذج التأسيسية. بينما تركز سلسلة GPT من OpenAI على التفكير العام والتفاعل متعدد الوسائط وإنتاجية الشركات، وتشدد سلسلة Claude من Anthropic على البرمجة والتفكير الموثوق به ذي السياق الطويل (Claude Opus 5 بسعر 30 دولاراً لكل مليون توكن)، وتدفع Google بنموذج Gemini نحو الإنتاجية متعددة الوسائط وسير العمل الأصلي على الويب (Gemini 3.1 Pro بسعر يصل إلى 22 دولاراً لكل مليون توكن)، يميز Qwen3.8-Max نفسه بتركيزه الصريح على الأتمتة المؤسسية. النموذج لا يُقصد به أن يكون بديلاً شاملاً، بل أداة للشركات التي تُعطي الأولوية للتنفيذ المستقل، وآفاق التخطيط الممتدة، والاقتصاديات المواتية للاستدلال. تُظهر المنافسة الشديدة في الأسعار أهمية بالغة؛ فـ Qwen3.8-Max، بسعر 8 دولارات لكل مليون توكن (2 دولار للمدخل و 6 دولارات للمخرج)، يقلص تكلفة النماذج الأمريكية الرائدة بشكل كبير، حيث يبلغ سعر GPT-5.6 Sol Max في وضع Fast mode حوالي 70 دولاراً لكل مليون توكن وفي وضع Standard mode حوالي 35 دولاراً لكل مليون توكن، بينما يبلغ سعر Claude Opus 5 حوالي 30 دولاراً لكل مليون توكن.
حتى نموذج Moonshot AI Kimi K3، الذي أُطلق بأوزان مفتوحة مع قيود ترخيص، يصل سعره إلى 18 دولاراً لكل مليون توكن. هذه الضغوط السعرية دفعت OpenAI نفسها إلى تخفيض أسعار API لنماذج GPT-5.6 متوسطة ومنخفضة التكلفة (Terra بنسبة 20% و Luna بنسبة 80%) مؤخراً. فالأنظمة الوكيلة تستهلك ملايين التوكنات في مهمة واحدة، مما يجعل تكاليف الاستدلال إحدى أكبر النفقات التشغيلية للشركات، وبالتالي فإن أي تخفيضات صغيرة في الأسعار تؤثر بشكل كبير.
رؤية Glitch4Techs
يمثل إطلاق Qwen3.8-Max دخولاً سوقياً عدوانياً من Alibaba، بوعود تتجاوز الأداء المعياري المثير للإعجاب. تفوقه المعلن بنتيجة 86.1 على OSWorld-Verified، وهو معيار حاسم لوكلاء استخدام الكمبيوتر، مقترناً بسعره البالغ 8 دولارات لكل مليون توكن، يضعه كقوة مؤثرة للمؤسسات التي تسعى إلى التشغيل الآلي المستقل. ومع ذلك، فإن أكبر نقطة ضعف في هذا الإطلاق لا تتعلق بالمعايير، بل بالغموض المحيط بشروط ترخيص الأوزان المفتوحة المرتقبة. عدم إفصاح Alibaba عن ما إذا كان الترخيص سيكون متساهلاً (مثل Apache 2.0) أو مقيداً (كما في Kimi K3 من Moonshot AI الذي فرض شروطاً تجارية لـ "نموذج كخدمة") يُدخل عدم يقين حرجاً.
هذا الغموض، تحديداً في شأن تحديد الترخيص المعلن عنه لـ "الأسبوع المقبل"، يُعيق بشدة إمكانيات اعتماده الواسع للشركات التي تفضل الاستضافة الذاتية والتخصيص، بغض النظر عن أدائه الفني أو كفاءته الاقتصادية. فبدون هذه الشفافية الجوهرية، تظل قيمة Qwen3.8-Max كبديل حقيقي للنماذج الغربية الرائدة موضع شك كبير.
كن أول من يعرف بمستقبل التقنية
أهم الأخبار والتحليلات التقنية مباشرة في بريدك.



