میسترال Large 4 را معرفی کرد؛ مدل تریلیونپارامتری اوپنویت با تمرکز روی کدنویسی و امنیت

میسترال، شرکت فرانسوی هوش مصنوعی، نسخهی پیشنمایش عمومی Mistral Large 4 را معرفی کرد؛ مدلی که خودشان شوخیوار اسمش را «le Chonk» گذاشتهاند. API پیشنمایش از همین حالا روی Mistral Studio در دسترس است و به گفتهی میسترال، وزنهای مدل تا آخر همین ماه بهصورت اوپنویت منتشر میشود.
خلاصه خبر
- مدلی چندوجهی (multimodal) با ۱ تریلیون پارامتر و ۴۹ میلیارد پارامتر فعال؛ بزرگترین و قویترین مدل میسترال تا امروز.
- از صفر روی ۳٬۸۰۰ GPU از نوع NVIDIA Grace Blackwell در دیتاسنترهای خود میسترال در اروپا آموزش دیده و بخش بزرگی از دادهی آموزشیاش چندزبانه بوده (بیش از ۱۶۰ زبان).
- در کدنویسی ایجنتی به گفتهی میسترال ۶۱.۷٪ در DeepSWE v1.1 و ۲۸.۳٪ در Terminal-Bench 4 گرفته و در ارزیابی کور انسانی کیفیت کد، بعد از Claude Opus 5 دوم شده است.
- تأکید اصلی روی امنیت سایبری است: در Cybench ۹۳٪ چالشها را حل کرده و در آزمون بازتولید و پچ آسیبپذیری واقعی ۸۲٪ گرفته؛ میسترال میگوید چند مدل بسته در همین آزمون بهخاطر امتناع از انجام کار نزدیک صفر گرفتهاند.
- تا انتشار وزنها، مدل با شرکای امنیتی و نهادهای دولتی در شرایط واقعی red-team میشود و قرار است جزئیات معماری و روش post-training هم منتشر شود.
نظر من
به نظرم مهمترین بخش این خبر خود بنچمارکها نیست، جملهی «وزنها آخر ماه منتشر میشود» است. یک مدل تریلیونپارامتری اوپنویت که در کدنویسی و امنیت همسطح بهترینهاست یعنی شرکتها میتوانند مدل قوی را روی زیرساخت خودشان اجرا کنند، بدون اینکه وسط کار API قطع شود یا سیاستهای یک شرکت آمریکایی جلویشان را بگیرد؛ چیزی که برای ما توسعهدهندههای ایرانی با مشکل تحریم و دسترسی، کاملاً ملموس است. البته واقعبین باشیم: اجرای مدلی با این اندازه سختافزار جدی میخواهد و برای اکثر تیمهای کوچک، نسخههای کوچکتر و تخصصیای که میسترال قول داده روی همین پایه بسازد کاربردیترند. بنچمارکها را هم فعلاً ادعای خود میسترال بدانید تا وزنها بیاید و جامعهی متنباز خودش تستش کند.