Archive / post

Blog

مایکروسافت Decision-1 را معرفی کرد؛ مدلی کوچک و سریع فقط برای تصمیم‌گیری ایجنت‌ها

Ramin Eslami2 min readUpdated 09/10/2026
هوش مصنوعیمایکروسافتایجنتمدل زبانیMicrosoft Foundry
مایکروسافت Decision-1 را معرفی کرد؛ مدلی کوچک و سریع فقط برای تصمیم‌گیری ایجنت‌ها

مایکروسافت یک مدل تازه به اسم Microsoft-Decision-1 معرفی کرده که کارش نوشتن متن یا استدلال طولانی نیست؛ فقط «تصمیم» می‌گیرد. یعنی به آن یک موقعیت و چند گزینه‌ی ثابت می‌دهید و برای هر گزینه یک احتمال کالیبره‌شده برمی‌گرداند. این مدل الان در Microsoft Foundry در دسترس است و به‌زودی از طریق OpenRouter هم می‌آید.

Microsoft-Decision-1
تصویر رسمی معرفی Microsoft-Decision-1 — منبع: Microsoft Command Line

چه کاری انجام می‌دهد؟

  • کاربردهای اصلی: مسیریابی (routing) درخواست‌ها بین مدل‌ها، دسته‌بندی، اولویت‌بندی، راستی‌آزمایی و کنترل جریان کار ایجنت‌ها.
  • از سؤال‌های بله/خیر، چندگزینه‌ای، امتیازدهی و نمره‌دادن بر اساس روبریک به پاسخ‌ها و اقدام‌های ایجنت پشتیبانی می‌کند؛ همه با یک فراخوانی API ساختاریافته.
  • پایه‌اش Qwen3.5-9B است که برای امتیازدهی تک‌مرحله‌ای پس‌آموزش داده شده؛ مایکروسافت می‌گوید به‌زودی نسخه‌هایی روی مدل‌های MAI و OpenAI هم می‌سازد.

ادعاهای عددی

  • بالاترین دقت در مقایسه‌ای با ۳۶ بنچمارک و نزدیک ۱۵۰ هزار سؤال که از آموزش کنار گذاشته شده بودند.
  • ۴.۵ برابر سریع‌تر از نفر دوم (Quyet-1.0-Large) و حدود ۳۵ برابر سریع‌تر از GPT-6 Sol در تأخیر P50.
  • پایداری: در هشت نوع تغییر ظاهری ورودی (بازنویسی، جابه‌جایی گزینه‌ها و…) به‌طور میانگین فقط ۱.۳٪ تصمیمش عوض شده.
  • در تیم تحقیقات XBOX برای برچسب‌زنی بیش از ۱۰ هزار بازخورد، کیفیتی هم‌سطح GPT-6 Sol داشته، با سرعت بیش از ۱۴ برابر و هزینه‌ی ۲۰۰ برابر کمتر.

نظر من

به نظرم این یکی از کاربردی‌ترین معرفی‌های این مدت است، چون دقیقاً دردی را هدف گرفته که هر کسی ایجنت ساخته حسش کرده: برای یک تصمیم ساده‌ی «ادامه بده یا نه» یا «این درخواست را به کدام مدل بفرستم» یک LLM بزرگ صدا می‌زنیم و هم پول می‌دهیم هم ثانیه‌ها منتظر می‌مانیم. وقتی ۲۰ تصمیم پشت سر هم داری، این تأخیر جمع می‌شود. یک مدل کوچک ۹ میلیاردی که فقط احتمال کالیبره برمی‌گرداند، برای routing و guardrail و LLM-as-judge خیلی منطقی‌تر است.

البته همه‌ی بنچمارک‌ها را خود مایکروسافت اجرا کرده و باید منتظر تست‌های مستقل ماند. اما جهت کلی درست است: آینده‌ی ایجنت‌ها احتمالاً ترکیبی از یک مدل بزرگ برای فکر کردن و چند مدل کوچک و سریع برای تصمیم‌های ریز است.

منبع: Microsoft Command Line — Introducing Microsoft-Decision-1