Reupload
فحص الجهاز
العودة إلى الصفحة الرئيسية

ذكاء اصطناعي محلي · Hugging Face & Alibaba Qwen Official

Qwen 2.5: الدليل الكامل لنموذج علي بابا اللغوي الكبير المفتوح

Qwen 2.5: الدليل الكامل لنموذج علي بابا اللغوي الكبير المفتوح

الصورة: Bhautik Patel على Unsplash

Qwen2.5 هو أحدث سلسلة من نماذج Qwen اللغوية الكبيرة، متاحة بسبعة أحجام من 0.5B إلى 72B معامل. وقد دُرّبت النماذج على 18 تريليون رمز وتدعم أكثر من 29 لغة، مع ترخيص Apache 2.0 لمعظم الأحجام. ويجلب Qwen2.5 قدرات محسّنة بشكل ملحوظ في البرمجة والرياضيات بفضل نماذج خبراء متخصصة في هذين المجالين.

ما هو Qwen 2.5؟

Qwen2.5 هو أحدث سلسلة من نماذج Qwen اللغوية الكبيرة. بُني على 18 تريليون رمز وتقنيات تدريب لاحق متقدمة تشمل الضبط الدقيق المُوجَّه والتعلم المعزز متعدد المراحل، ويمثل Qwen2.5 دفع علي بابا نحو إنشاء نماذج مفتوحة الأوزان تنافسية تضاهي أنظمة احتكارية أكبر منها.

يجلب Qwen2.5 قدرات محسّنة بشكل ملحوظ في البرمجة والرياضيات بفضل نماذج خبراء متخصصة في هذين المجالين. ويُظهر تقدمًا كبيرًا في اتباع التعليمات، وتوليد النصوص الطويلة (أكثر من 8K رمز)، وفهم البيانات المهيكلة (مثل الجداول)، وتوليد المخرجات المهيكلة، خصوصًا بصيغة JSON.

الأحجام والمتغيرات المتاحة

يقدم Qwen2.5 نماذج مدربة مسبقًا ومضبوطة بالتعليمات بسبعة أحجام: 0.5B و1.5B و3B و7B و14B و32B و72B. وأُتيح أكثر من 100 نموذج في إصدار واحد، بما يشمل نسخًا أساسية ومضبوطة بالتعليمات عبر سبعة أحجام معاملات، إضافة إلى متغيرات Qwen2.5-Coder وQwen2.5-Math المتخصصة، ونسخ مكمَّمة بصيغ GGUF وAWQ وGPTQ.

النماذج الأساسية مقابل المضبوطة بالتعليمات:

  • النماذج الأساسية مدربة مسبقًا ومناسبة للضبط الدقيق المستمر
  • المتغيرات المضبوطة بالتعليمات محسّنة للمحادثة والدردشة (يُنصح بها لمعظم المستخدمين)

المتغيرات المتخصصة:

  • Qwen2.5-Coder مصمم خصيصًا لتطبيقات البرمجة
  • Qwen2.5-Math يقدم ضبطًا دقيقًا متخصصًا في الاستدلال الرياضي مع مسار سلسلة التفكير + الاستدلال المدعوم بالأدوات

الترخيص:

  • معظم النماذج مرخَّصة بموجب Apache 2.0، بينما يخضع Qwen2.5-3B وQwen2.5-72B لترخيص Qwen Research License وترخيص Qwen على الترتيب

متطلبات الأجهزة

النطاق الممتد من 0.5B (حاسوب محمول/هاتف/Raspberry Pi) إلى 72B (طراز رئيسي ببطاقتي 3090) يعني وجود متغير من Qwen 2.5 لكل إعداد. وفي ما يلي متطلبات VRAM النموذجية عند درجات التكميم الشائعة:

النموذجQ4_K_M (موصى به)FP16 (الدقة الكاملة)الحد الأدنى لوحدة الرسومات
0.5B~400 ميجابايت~1 جيجابايتRaspberry Pi 5 / هاتف
1.5B~1.5 جيجابايت~3 جيجابايت4 جيجابايت RAM
3B~2 جيجابايت~6 جيجابايت8 جيجابايت RAM
7B~5.5 جيجابايت~14 جيجابايتRTX 4060 (8 جيجابايت)
14B~8.5 جيجابايت~28 جيجابايتRTX 4070 (12 جيجابايت)
32B~19.5 جيجابايت~64 جيجابايتRTX 4090 (24 جيجابايت)
72B~45 جيجابايت~144 جيجابايتبطاقتا A100 (40 جيجابايت)

تدعم معظم النماذج طول سياق يبلغ 128K (131,072) رمزًا ويمكنها توليد ما يصل إلى 8K رمز، مما يتيح إنتاج مخرجات نصية موسّعة.

نصائح التكميم:

  • Q4_K_M هو الخيار الأمثل الموصى به للموازنة بين الجودة وذاكرة VRAM
  • Q8_0 يحافظ على دقة أكبر لكنه يتطلب ضعف ذاكرة VRAM
  • تكميمات Q3/Q2 خيارات احتياطية طارئة عند ضيق الذاكرة

أبرز نتائج المعايير

يُظهر Qwen2.5 أداءً تنافسيًا في التقييمات القياسية:

  • في معيار MATH، ارتفعت نتائج Qwen2.5-7B/72B-Instruct من 52.9/69.0 إلى 75.5/83.1
  • يتفوق Qwen2.5-72B في المهام العامة مثل MMLU وBBH، محققًا نتائج 79.7 و78.2، ومتفوقًا على منافسين بأحجام أكبر
  • يتفوق Qwen2.5-14B وQwen2.5-32B على النماذج المرجعية المماثلة أو الأكبر حجمًا، ويحققان توازنًا مثاليًا بين حجم النموذج والقدرة

أداء البرمجة:

  • يسجل Qwen 2.5-Coder-32B نسبة 37.2% في LiveCodeBench، متجاوزًا نسبة GPT-4o البالغة 29.2%
  • تتجاوز نتيجة النموذج 72B البالغة 36.5% في SWE-Bench Verified (إصلاح الأخطاء في العالم الحقيقي) نسبة GPT-4o البالغة 23.6% ونسبة Claude 3.5 Sonnet البالغة 33.4%

كيفية تشغيله محليًا

أسرع بداية مع Ollama:

ثبّت وشغّل Qwen2.5-7B بالأمر: ollama pull qwen2.5:7b

حجم 7B هو الخيار الأكثر شيوعًا للأجهزة المحلية - فهو يوازن بين الجودة والسرعة ومتطلبات الأجهزة.

أدوات أخرى: بالإضافة إلى Ollama، توفر LM Studio واجهة شبيهة بـ ChatGPT للنماذج المحلية. وتشمل الخيارات الإضافية:

  • Jan - واجهة سطح مكتب بسيطة
  • GPT4All - إدارة النماذج بنقرة واحدة
  • Msty - بديل خفيف

جميعها تسحب النماذج مباشرة من Hugging Face بمجرد التثبيت.

التكامل المباشر مع Python: لسير العمل المخصص، حمّل أي نموذج عبر Hugging Face Transformers:

from transformers import AutoModelForCausalLM, AutoTokenizer

model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen2.5-7B-Instruct")
tokenizer = AutoTokenizer.from_pretrained("Qwen/Qwen2.5-7B-Instruct")

أفضل حالات الاستخدام

  • الدعم متعدد اللغات (أكثر من 29 لغة): يدعم Qwen2.5 أكثر من 29 لغة، منها الصينية والإنجليزية والفرنسية والإسبانية والبرتغالية والألمانية والإيطالية والروسية واليابانية والكورية والفيتنامية والتايلاندية والعربية. مثالي للفرق الدولية.

  • النشر الطرفي والمحمول: حتى النماذج التي لا تتجاوز 3 مليار معامل تقدم الآن نتائج تنافسية للغاية. يعمل حجما 0.5B و1.5B على الهواتف والأجهزة المدمجة.

  • توليد الشيفرة وإصلاحها: تتفوق متغيرات Qwen2.5-Coder على نماذج مفتوحة أكبر. استخدمها لميزات شبيهة بـ GitHub Copilot دون خدمات سحابية احتكارية.

  • الاسترجاع طويل السياق (RAG): نموذج 3B بطول سياق 128K عرض غير معتاد - فمعظم النماذج دون 5B تتوقف عند سياق 8-32K - مما يجعل Qwen 2.5 3B مرشحًا موثوقًا لسير عمل RAG على الأجهزة حيث قد يكون السياق المسترجع طويلًا.

  • التطبيقات الحساسة للخصوصية: تشغيل Qwen محليًا يضمن الخصوصية ويلغي تكاليف الواجهات البرمجية.

الأسئلة الشائعة

أي حجم من Qwen 2.5 أختار لحاسوبي المحمول؟

يحتاج Qwen2.5-7B إلى نحو 5.5 جيجابايت من VRAM ويعمل بسرعة تقارب 60-75 رمزًا في الثانية على RTX 4060/4070. إذا كانت لديك وحدة رسومات بسعة 8 جيجابايت، فالنموذج 7B مثالي. ولمن لديه 12 جيجابايت أو أكثر، يقدم المتغير 14B جودة أفضل بشكل ملحوظ بسرعة أبطأ قليلًا.

هل Qwen 2.5 مفتوح المصدر حقًا؟

معظم النماذج مرخَّصة بموجب Apache 2.0، بينما يخضع Qwen2.5-3B وQwen2.5-72B لترخيص Qwen Research License وترخيص Qwen على الترتيب. يتيح Apache 2.0 الاستخدام التجاري؛ أما الترخيصان الآخران فيسمحان بالاستخدام البحثي والتجاري مع بعض القيود - راجع شروط الترخيص على Hugging Face قبل النشر التجاري.

كيف يقارَن Qwen 2.5 بـ Llama 3.1؟

يتفوق Qwen 2.5 72B على Llama 3.1 405B في عدة معايير بخُمس المعاملات النشطة. كان نموذج Meta 405B أكبر طراز رئيسي مفتوح عند إطلاقه، لكن Qwen 2.5 يقدم أدلة تُظهر أداءً أفضل في العديد من الاختبارات القياسية.

هل يمكنني تشغيل Qwen 2.5 على جهاز Mac؟

نعم. أي جهاز Mac من سلسلة M بذاكرة موحدة 18 جيجابايت أو أكثر يمكنه تشغيل Qwen2.5-Coder 14B بتكميم Q5_K_M أو أعلى. ويوفر M4 Pro 24GB تجربة قوية عند Q6_K مع مساحة إضافية للسياق. ولنماذج Qwen2.5 الأساسية متطلبات مماثلة أو أقل.

هل تريد معرفة ما إذا كان جهازك يمكنه تشغيل الذكاء الاصطناعي محليًا؟

المصادر والاعتمادات

المصدر الأصلي: Hugging Face & Alibaba Qwen Official