يحقق Qwen 3.6 نفس معدل إنتاج الرموز (token throughput) الذي يحققه Qwen 3.5 على بطاقة RTX 4070 — 38.76 رمزًا في الثانية مقابل 36.7 رمزًا في الثانية — ولكنه يتعامل مع الوكلاء المستقلين (autonomous agents) والمساعدة في البرمجة بشكل أفضل بشكل ملحوظ. وهذا أمر مهم لأي شخص يقوم ببناء أدوات مدعومة بالذكاء الاصطناعي على أجهزة استهلاكية.
لماذا تهم هذه الأرقام
يشترك كلا النموذجين في نفس عدد المعلمات النشطة (active-parameter count)، لذا يجب أن تكون السرعة الخام متشابهة. أظهر اختبار أولي تباطؤًا كبيرًا في الإصدار 3.6، ولكن تبين أن عملية عشوائية كانت تستهلك 11 جيجابايت من ذاكرة VRAM مما أجبر النموذج على استخدام ذاكرة النظام (system RAM). وبعد إيقاف تلك العملية، عاد معدل الإنتاج إلى النطاق المتوقع، مما يؤكد أن الإصدارين يعملان بنفس الوتيرة تقريبًا ضمن ميزانية 12 جيجابايت من ذاكرة VRAM.
ما المختلف فعليًا
يكمن التحديث في القدرات، وليس في توليد الرموز. تشير اختبارات الأداء (benchmarks) الخاصة بالمطورين إلى:
- تحسن مهام توليد الواجهات الأمامية (Front-end) بنسبة 43%
- تحسن مهام عمليات الطرفية (Terminal-operation) بنسبة 27%
- تحسن المهام المتعلقة بالبرمجة بنسبة 11%
تعتمد هذه التحسينات الثلاثة على قدرة النموذج على استدعاء الأدوات، والحفاظ على نوافذ سياق طويلة (long context windows)، وتسلسل خطوات الاستدلال المتعددة. ومن الناحية العملية، يقوم الإصدار 3.6 بإصلاح الأخطاء بشكل أكثر موثوقية، ويتبع التعليمات المعقدة، ويتعامل مع سير العمل متعدد الخطوات الذي يتضمن واجهة سطر أوامر (shell) أو بيئة تطوير متكاملة (IDE).
من المستفيد؟
- المطورون الذين يبنون الوكلاء (agents) – عندما يقوم الذكاء الاصطناعي بتشغيل الأوامر، أو تعديل الملفات، أو تنسيق الخدمات، يقلل النموذج الجديد من المحاولات الفاشلة ويحد من التصحيح اليدوي.
- مساعدو البرمجة – الارتفاع الطفيف في مهام البرمجة يعني مقتطفات برمجية أقل من "الهلوسة" واقتراحات إعادة هيكلة (refactoring) أكثر سلاسة.
- الباحثون ذوو الميزانيات المحدودة – تشغيل النموذج الجديد بنفس السرعة على بطاقة RTX 4070 واحدة يتيح للفرق الترقية دون الحاجة لشراء وحدات معالجة رسومات (GPUs) إضافية.
من لا يحتاج للقلق
إذا كان عبء العمل الخاص بك يقتصر في الغالب على الإجابة على الأسئلة المباشرة أو توليد نصوص قصيرة، فإن فجوة الأداء ستتلاشى. يظل رقم الرموز في الثانية كما هو، ولا يزداد استخدام ذاكرة VRAM، لذا فإن التبديل لن يكلفك شيئًا.
الخلاصة: Qwen 3.6 ليس ترقية للسرعة، بل هو ترقية للقدرات. فباستخدام نفس وحدة معالجة الرسومات (GPU) الاستهلاكية، فإنه يمنح المطورين شريك ذكاء اصطناعي أكثر موثوقية واكتفاءً ذاتيًا مع الحفاظ على ثبات تكاليف الأجهزة.
