MiniMax تُطلق M3، نموذج صيني مفتوح الأوزان يدّعي التميّز في البرمجة بعُشر تكلفة الانتباه
نموذج بنافذة سياق مليون رمز وانتباه متفرّق يتصدّر GPT-5.5 في معيار البرمجة الخاص به، لكنه يأتي دون Claude Opus 4.8، فيما لا تزال الأوزان محجوبة
أضف إلى قائمة
لا قوائم بعد.
الملخص
أصدر مختبر الصيني MiniMax نموذج M3، وهو نموذج مفتوح الأوزان يجمع بين نافذة سياق مليون رمز وإدخال متعدد الوسائط أصلي واستخدام وكيلي للحاسوب، وحقّق 59.0% على معيار SWE-Bench Pro للبرمجة، متجاوزاً GPT-5.5 من OpenAI (58.6%) وGemini 3.1 Pro من Google (54.2%) وفق اختبارات المختبر الخاصة. يتخلّف عن Claude Opus 4.8 من Anthropic، الذي صدر قبله بأسبوع، بنسبة مُبلَّغ عنها 69.2%. الادعاء الهندسي الرئيسي هو MiniMax Sparse Attention (MSA)، التي تختار كتل المفاتيح والقيم ذات الصلة فحسب وتخفّض الحساب لكل رمز إلى واحد من عشرين عند السياق الكامل، وقد تحقّق المجتمع من بنيتها باستقلالية حول 18 يونيو. المشكلة: الأوزان المفتوحة الموعودة لم تُنشر عند الإصدار، وكود التدريب ومشغّلات الاستدلال بقيا مغلقَين.
الانقسام
انقسمت الصحافة الأمريكية المتخصصة بالتعلم الآلي بين قصة القدرة والتحفظات. أبرز MarkTechPost كفاءة MSA، فيما أكد Tech Times على أن المعايير صادرة عن المورّد وأن M3 يتراجع عن Opus 4.8. خارج الولايات المتحدة، تحوّل التأطير: تناولت التغطية الإيطالية للمطوّرين وتغطية Open Source For You الهندية أمرَين خفّفت التغطية الأمريكية من شأنهما، وهما أن "مفتوح الأوزان" ليس مفتوح المصدر مع إبقاء الكود مغلقاً، وأن قانون الاستخبارات الوطني الصيني لعام 2017 يُلزم MiniMax بمساعدة الاستخبارات الحكومية على أي طلب يمرّ عبر واجهتها البرمجية. هذا البُعد الحوكمي، لا رقم SWE-Bench، هو ما أغفله ضجيج الإطلاق.
بالأرقام
- 59.0%، نتيجة M3 على SWE-Bench Pro من المورّد (GPT-5.5: 58.6%، Gemini 3.1 Pro: 54.2%).
- 69.2%، نتيجة Claude Opus 4.8 المُبلَّغ عنها على SWE-Bench Pro، متقدّمةً على M3.
- مليون رمز، نافذة سياق M3.
- 1/20، الحساب لكل رمز عند السياق الكامل في ظل MSA مقارنةً بالجيل السابق.
- 9x / 15x، سرعة الملء وفك التشفير المُدّعاة في ظل MSA.
لماذا يهم
البرمجة الرخيصة ذات السياق الطويل من نموذج صيني مفتوح الأوزان تضغط على المختبرات الغربية من حيث السعر وتدفع بمزيد من الاستدلال نحو البنية التحتية الصينية. لكن "مفتوح الأوزان" مع كود مغلق ومعايير من المورّد وواجب قانوني بمساعدة بكين يُعيد صياغة سؤال التبنّي من القدرة إلى الثقة، لا سيما لأي فريق يُمرّر كود المصدر عبر الواجهة البرمجية.