jsonscraper

أصبح Mistral Large 4 متاحًا عبر API — والأوزان المفتوحة لاحقًا

بدأت المعاينة العامة في 6 أكتوبر. نستعرض ما يمكن التحقق منه الآن وأوجه التباين في المواصفات المنشورة.

في 6 أكتوبر، أتاحت Mistral المعاينة العامة عبر API لنموذج Mistral Large 4. ويمكن للمطورين اختبار النموذج بالفعل عبر Mistral Studio، فيما تخطط الشركة لإصدار الأوزان في نهاية أكتوبر. وحتى 7 أكتوبر، يمكن تقييم النموذج عبر API، لكن تنزيل أوزانه غير متاح بعد. ويهم هذا الوضع عند الاختيار بين الاختبار السريع عبر الخدمة والنشر الذاتي.

مبنى شاهق كثير النوافذ بجوار شارع
Shabeeba Ameen · ترخيص Unsplash

ما المتاح للمطورين الآن

يؤكد سجل التغييرات في Mistral بدء المعاينة العامة وخصمًا مؤقتًا بنسبة 50% عند الإطلاق لمدة أسبوعين. وتدرج صفحة النموذج دعم الإدخال متعدد الوسائط، واستدعاء الوظائف، والإخراج المنظم، والمعالجة الدفعية، وأدوات الوكلاء. ويتيح ذلك للمطورين اختبار النموذج على مهامهم الخاصة عبر API قبل اتخاذ قرار بشأن نشره.

تعرض صفحة النموذج، وقت التحقق، أسعارًا تبلغ 0.68 دولار لكل مليون رمز إدخال، و0.07 دولار لكل مليون رمز إدخال مخزّن مؤقتًا، و2.09 دولار لكل مليون رمز إخراج. كما تعرض أسعارًا عادية تبلغ ضعف هذه المبالغ؛ فالخصم مرتبط بالإطلاق ومحدود المدة. وقبل إعداد الميزانية، يجدر التحقق من الأسعار مباشرةً في وثائق Mistral.

تباين في المواصفات

تصف Mistral نموذج Large 4 بأنه بنية متعددة الوسائط قائمة على مزيج الخبراء (Mixture of Experts). وتشير الوثائق إلى 1.05 تريليون معلمة إجمالًا و52 مليار معلمة نشطة؛ أما إعلان الشركة فيذكر تريليون معلمة و49 مليار معلمة نشطة. ولا توضح المصادر سبب اختلاف القيم. لذلك، من الأدق عرض الرقمين مع نسبتهما إلى مصدريهما بدلًا من اختزالهما في رقم واحد.

تذكر الوثائق أن نافذة السياق تبلغ مليون رمز. وللتخطيط للطلبات الطويلة، من المفيد تأكيد هذه المواصفة على إصدار API المستخدم، إذ قد تُحدّث مواصفات المعاينة مع تحديث الوثائق.

كل عمل معماري لا يعبر عن السكينة هو خطأ
Ashish Mehta · ترخيص Unsplash

تقيس المعايير أداء مهام محددة

تذكر Mistral نتائج بلغت 61.7% في DeepSWE v1.1، و28.3% في Terminal-Bench 4، و59.9% في AutomationBench. وهذه نتائج نشرتها الشركة لاختبارات محددة: لمهام التطوير ذات السلوك الوكيلي، وسير العمل عبر الطرفية، وأتمتة العمليات التجارية، على التوالي. ومن المفيد اعتبارها مؤشرات لاختيار الاختبارات، لا مقياسًا موحدًا لجودة النموذج.

لاتخاذ قرار عملي، يُستحسن أن يعيد المطورون اختبار عدد من المهام التمثيلية لمشروعهم، مع تثبيت إصدار النموذج والمطالبات والإعدادات، والتحقق من النتائج بالاختبارات، وأخذ تكلفة المحاولات المتكررة في الحسبان. ويوضح هذا الاختبار مدى انطباق النتائج المنشورة على الشيفرة أو المستندات أو سير عمل الوكلاء في المشروع المعني.

الأوزان المفتوحة هي الخطوة التالية

أعلنت Mistral أنها تخطط لإصدار الأوزان بحلول نهاية أكتوبر، بعد إجراء المزيد من اختبارات الفريق الأحمر. وهذه خطة مستقبلية للشركة؛ أما طريقة الاستخدام المؤكدة في تاريخ النشر فهي المعاينة العامة عبر API. وبالنسبة إلى الفرق التي تحتاج إلى بنية تحتية خاصة وإدارة النموذج بنفسها، فسيكون الحدث الحاسم هو النشر الفعلي للأوزان وشروط الاستخدام المصاحبة لها.

في الوقت الراهن، يستطيع المطورون التحقق من الإتاحة والوظائف والجودة عبر API، وتأجيل قرار نقل النموذج إلى بيئتهم الخاصة حتى صدور الأوزان. وما يفيد أكثر عند الإطلاق هو نتائج اختبار قابل لإعادة الإنتاج على مهام العمل، إلى جانب شروط التسعير السارية، لا الادعاءات المقارنة.

People

No people listed for this article yet.

Keep readingGitHub تطلق ReviewBench لمقارنة مراجعي الذكاء الاصطناعي عبر العيوب التي يكتشفونها
Read the next article

مقالات ذات صلة

Breaking News · الأخبار

GitHub تطلق ReviewBench لمقارنة مراجعي الذكاء الاصطناعي عبر العيوب التي يكتشفونها

في 5 أكتوبر، كشفت GitHub عن ReviewBench، وهو إصدار بحثي أولي لمعيار مخصص لوكلاء مراجعة الشيفرات. تفصل مقاييسه بين المشكلات المكتشفة والمفوّتة والضوضاء الزائدة، بينما تصف نتائج اختبار A/B الداخلي للشركة تجربة بعينها، لا تصنيفًا عامًا للنماذج.

Breaking News · الأخبار

GPT-Rosalind: بدء تطبيق الأسعار دون إتاحة API للجميع

حددت OpenAI أسعار GPT-Rosalind اعتبارًا من 5 أكتوبر 2026، لكنها قصرت استخدام API على مهام البحث الداخلي المعتمدة. وبالنسبة إلى الفرق، فإن التحقق من الأهلية أهم من حساب الميزانية.

حوّل ما تقرأه إلى تكامل عملي

استكشف واجهات API للبيانات الاجتماعية من jsonscraper واختبر الطلبات وأنشئ سير عملك التالي.

استكشف واجهات API