يُعرض النص الكامل باللغة الإنجليزية؛ وقد تمت ترجمة العنوان والملخص.
ما هو
Mistral Large is the flagship model that France’s Mistral AI released in February 2024, offered under a commercial licence rather than open weights, complementing its open small models. Mistral AI was founded in 2023 in Paris by former DeepMind and Meta researchers. The model targets reasoning, multilingual work and function calling, with a context window in the 128K range. Mistral builds a community with a handful of open models, then serves enterprise needs with commercial ones such as Large.
لماذا يستحق التذكّر
It represents the dual-track strategy of open-sourcing small models to win a community and selling flagship models commercially, letting a non-US lab hold ground on both the open-weight and commercial sides.
المواصفات الأساسية
- Parameters
- 123B (Mistral Large 2)
- Context window
- 128K tokens
- Open weights
- No (commercial licence)
- Released
- 2024-02
القدرات المرتبطة
المفاهيم ذات الصلة
معمارية Transformer
يستبدل النقل كلمةً بكلمة بغرفة يتحدث فيها الجميع معاً، فتصبح التبعيات البعيدة على مسافة خطوة واحدة
آلية الانتباه
يستطيع كل موضع أن ينظر مباشرة إلى جميع المواضع الأخرى ويوزّع الانتباه حسب الصلة
التدريب المسبق والضبط الدقيق
تعلّم اللغة أولاً من نصوص ضخمة بلا وسوم ثم التخصص ببيانات قليلة — أكثر النماذج كفاءةً في البيانات
منتجات منافسة
Llama
2023عائلة النماذج التي جعلت مسار الأوزان المفتوحة سائدًا
GPT-4o
2024نموذج عام متعدد الوسائط بطبيعته، يجمع النص والصورة والصوت في مدخل واحد
Qwen
2023عائلة بأوزان مفتوحة تغطي أحجامًا متعددة، مع نسخ متعددة الوسائط
Command R
2024نموذج تجاري مصمم للاسترجاع المعزّز واستخدام الأدوات
Phi
2023نماذج صغيرة وفعّالة مبنية على بيانات منتقاة
Jamba
2024نموذج بأوزان مفتوحة يمزج نموذج فضاء الحالة مع Transformer
DeepSeek-V3
2024نموذج MoE بأوزان مفتوحة بـ 671 مليار معامل، ينشّط 37 مليار لكل رمز
Yi
2023نموذج بأوزان مفتوحة ثنائي اللغة صيني-إنجليزي، بنسخ سياق طويلة جدًا
DBRX
2024نموذج لغوي مفتوح الأوزان بنمط MoE من Databricks