Qwen
عائلة بأوزان مفتوحة تغطي أحجامًا متعددة، مع نسخ متعددة الوسائط
يُعرض النص الكامل باللغة الإنجليزية؛ وقد تمت ترجمة العنوان والملخص.
ما هو
Qwen is a language-model series Alibaba began open-sourcing in August 2023. It spans parameters from 0.5B to 72B and covers both text-only and multimodal versions, with the Qwen-VL line accepting image input. Alibaba releases base models alongside instruction-tuned versions and specialised variants for coding and mathematics. Generations such as Qwen2.5 support a context window in the 128K range, with weights downloadable under a permissive licence. Its complete ladder of sizes makes it a widely used base for secondary development in the open-source community.
لماذا يستحق التذكّر
With a full ladder from 0.5B to 72B plus both text and multimodal lines released openly, it lets researchers always find a size that fits their compute — one of the broadest catalogues in the open-weight ecosystem.
المواصفات الأساسية
- Parameters
- From 0.5B to 72B (Qwen2.5 family)
- Context window
- 128K tokens (Qwen2.5)
- Modality
- Text, image in (Qwen-VL); text out
- Open weights
- Yes
القدرات المرتبطة
المفاهيم ذات الصلة
معمارية Transformer
يستبدل النقل كلمةً بكلمة بغرفة يتحدث فيها الجميع معاً، فتصبح التبعيات البعيدة على مسافة خطوة واحدة
التدريب المسبق والضبط الدقيق
تعلّم اللغة أولاً من نصوص ضخمة بلا وسوم ثم التخصص ببيانات قليلة — أكثر النماذج كفاءةً في البيانات
الترميز إلى رموز (Tokenization)
لا تقرأ النماذج الحروف بل الرموز، وطريقة التقسيم تحدّد القدرة والكلفة بصمت
منتجات منافسة
Llama
2023عائلة النماذج التي جعلت مسار الأوزان المفتوحة سائدًا
DeepSeek-V3
2024نموذج MoE بأوزان مفتوحة بـ 671 مليار معامل، ينشّط 37 مليار لكل رمز
Mistral Large
2024النموذج التجاري الرائد من مختبر أوروبي للأوزان المفتوحة
GLM
2023نموذج عام صيني بدأ بالتدريب المسبق لملء الفراغات ذاتيًا
Phi
2023نماذج صغيرة وفعّالة مبنية على بيانات منتقاة
DeepSeek-R1
2025نموذج استدلال دُرِّب بالتعلم المعزز على سلاسل التفكير، وأوزانه متاحة تحت رخصة MIT
Kimi
2023مساعد محادثة صيني يشتهر بمعالجة السياقات الطويلة
ERNIE
2019نموذج صيني بدأ بالتدريب المسبق المعزّز بالمعرفة، نسخة مبكرة ممثلة
Hunyuan
2023عائلة نماذج تينسنت العامة، مع نسخ بأوزان مفتوحة
MiniMax-M
2025نموذج استدلال بأوزان مفتوحة بانتباه هجين وسياق مليون رمز
Yi
2023نموذج بأوزان مفتوحة ثنائي اللغة صيني-إنجليزي، بنسخ سياق طويلة جدًا
Baichuan
2023نموذج عام بأوزان مفتوحة موجّه للاستخدام بالصينية
DBRX
2024نموذج لغوي مفتوح الأوزان بنمط MoE من Databricks