# Microsoft-Decision-1: швидкість у тестах і спірне порівняння

> Microsoft-Decision-1 оцінює фіксовані варіанти за $0,042 за мільйон вхідних токенів. Заява про швидкість спирається на різні методики вимірювання.

- Опубліковано: 10 жовтня 2026 р. (2026-10-10T07:14:39.811176+00:00)
- Розділ: AI-інструменти
- На основі публікації: [MarkTechPost](https://www.marktechpost.com/2026/10/09/microsoft-ai-releases-microsoft-decision-1-a-qwen3-5-9b-decision-scoring-model/)
- Видання: AiiN (https://aiin.news)
- URL: https://aiin.news/article?slug=microsoft-decision-1-%D1%88%D0%B2%D0%B8%D0%B4%D0%BA%D1%96%D1%81%D1%82%D1%8C-%D1%83-%D1%82%D0%B5%D1%81%D1%82%D0%B0%D1%85-%D1%96-%D1%81%D0%BF%D1%96%D1%80%D0%BD%D0%B5-%D0%BF%D0%BE%D1%80%D1%96%D0%B2%D0%BD%D1%8F%D0%BD%D0%BD%D1%8F

---

Microsoft-Decision-1 повертає калібровані ймовірності для фіксованих варіантів відповіді замість тексту. Microsoft випустила модель на базі Qwen3.5-9B за $0,042 за мільйон вхідних токенів, [за даними MarkTechPost](https://www.marktechpost.com/2026/10/09/microsoft-ai-releases-microsoft-decision-1-a-qwen3-5-9b-decision-scoring-model/).

Для білдера головне питання — чи можна вірити заяві «у 35 разів швидше за GPT-6 Sol». Microsoft виміряла затримку власної моделі через Foundry, а показники конкурентів узяла зі скоригованої медіани JevBench. H2O.ai оскаржує цю методику.

## Що Microsoft-Decision-1 робить на відміну від чат-моделі?

Microsoft-Decision-1 отримує ситуацію, запитання і фіксований набір варіантів, а за один виклик повертає у JSON ймовірність для кожного з них. Модель підтримує відповіді «так/ні», вибір із кількох варіантів, шкали оцінювання, класифікацію та оцінювання за рубриками. Вона також оцінює відповіді AI і запропоновані дії агента, перевіряє відповідність відповіді наданим доказам і підтримує варіант утримання від рішення на кшталт «cannot tell».

Microsoft позиціює модель як дешевий шар керування для агентних систем, [за даними TestingCatalog](https://www.testingcatalog.com/microsoft-launches-decision-1-model-in-foundry/). Оцінки впевненості можуть визначати, чи програма діє, відкладає рішення, повторює спробу або передає роботу моделі, інструменту чи людині. Microsoft додатково навчила Qwen3.5-9B оцінювати варіанти за один прохід. Контекстне вікно становить 32 768 токенів.

## Наскільки точна і швидка Microsoft-Decision-1?

Microsoft-Decision-1 показала найвищу середню точність у власному порівнянні Microsoft: 83,5% на 36 бенчмарках проти 81,9% у Quyet-1.0-Large. Компанія порівняла 9 систем на 147 137 запитаннях, які не використовувала для навчання.

Відрив від другого місця становить 1,6 відсоткового пункта: 83,5 − 81,9 = 1,6. За показником калібрування модель друга: 92,2 проти 93,1 у Quyet-1.0-Large.

Затримка p50 становить 85 мс, p95 — 125 мс. За порівнянням Microsoft, модель у 4,5 раза швидша за Quyet-1.0-Large і у 35 разів швидша за GPT-6 Sol, для якого наведено затримку 3,01 с. Ці співвідношення потребують застереження щодо методики вимірювання.

Microsoft перевірила стабільність вісьмома змінами кожного запиту, зокрема перефразуванням і перемішуванням варіантів. Рішення змінювалося в середньому у 1,3% випадків, а після перефразування описів варіантів, зміни їхнього порядку на зворотний чи перемішування — жодного разу. Для перевірки безпеки Microsoft використала 5 250 запитів на 11 бенчмарках зі шкідливим контентом, джейлбрейками та prompt injection, але підсумкового балу не оприлюднила.

### Чи можна прямо порівнювати ці затримки?

Microsoft використала різні методики: власну модель виміряла через Foundry, а для конкурентів узяла скориговану медіану JevBench v1.6.1.

За переказом MarkTechPost, H2O.ai в описі своєї моделі стверджує, що JevBench подвоює виміряний час і додає 0,15 с. H2O.ai наводить виміряну медіану своєї моделі 29 мс замість скоригованих 210 мс. Microsoft-Decision-1 у таблиці JevBench, за цим джерелом, немає, тож результати цієї платформи не підтверджують заявленої переваги.

### Що показали внутрішні кейси Microsoft?

Microsoft повідомляє про прискорення у внутрішніх сценаріях Xbox Research, Copilot і Microsoft Discovery. Ці цифри походять із випробувань самої компанії.

- Xbox Research розмітила понад 10 000 одиниць фідбеку. MarkTechPost наводить прискорення у 14 разів і зниження вартості у 200 разів порівняно з GPT-6 Sol; TestingCatalog також повідомляє про порівнянну якість.
- Команда Copilot описує якість як порівнянну з GPT-5.6 Luna, а швидкість — як у 100 разів вищу.
- У Microsoft Discovery оцінювання виявилося у 46 разів послідовнішим за LLM-підхід. MarkTechPost повідомляє про оцінювання утричі швидше, а TestingCatalog — про майже вчетверо швидше адаптивне перепланування. Джерела описують різні операції, тому ці показники не слід ототожнювати.

## Як підключити Microsoft-Decision-1 і чого вона не вміє?

Microsoft-Decision-1 доступна в Microsoft Foundry як загальнодоступна модель «Direct from Azure». Щодо OpenRouter джерела розходяться: MarkTechPost пише, що модель уже працює через Decisions API, а TestingCatalog — що вона з'явиться незабаром. За MarkTechPost, для цього API не підійдуть SDK для chat completions.

Модель доступна лише через hosted API. Ваги закриті, відкритих і квантованих версій немає, обладнання не розкрито. Ціна — $0,042 за мільйон вхідних токенів, вихідні безкоштовні. Мільярд вхідних токенів за цим тарифом коштує $42: $0,042 × 1000 = $42. Ендпоінт рішень Luna від OpenAI коштує $0,10 за мільйон вхідних токенів — приблизно у 2,4 раза дорожче: $0,10 / $0,042 ≈ 2,4.

MarkTechPost наводить такі обмеження з картки моделі:

- Модель не призначена для генерації тексту, відкритих запитань, чату, перекладу й підсумовування.
- Вона працює лише з текстом, без зображень, аудіо й відео.
- Відповідь не містить пояснень чи обґрунтувань.
- Рішення моделі не має бути єдиною підставою для автоматичного рішення щодо кредиту, працевлаштування, житла, медичної допомоги чи юридичних прав.

Застосунок має визначати варіанти відповідей, пороги, шляхи ескалації та людський нагляд. OpenRouter також зазначає, що ваги моделі оновлюються безперервно, а формат API залишається незмінним.

---

Теги: AI, Microsoft, Qwen, агенти, AIAgents, маршрутизація

Джерело: AiiN — https://aiin.news/article?slug=microsoft-decision-1-%D1%88%D0%B2%D0%B8%D0%B4%D0%BA%D1%96%D1%81%D1%82%D1%8C-%D1%83-%D1%82%D0%B5%D1%81%D1%82%D0%B0%D1%85-%D1%96-%D1%81%D0%BF%D1%96%D1%80%D0%BD%D0%B5-%D0%BF%D0%BE%D1%80%D1%96%D0%B2%D0%BD%D1%8F%D0%BD%D0%BD%D1%8F. Цитуючи, посилайтесь на канонічний URL.
