Microsoft вышел в сегмент decision-моделей с Decision-1 — моделью для быстрых и структурированных решений внутри ИИ-систем. Компания заявляет о лучшей точности на 36 бенчмарках с почти 150 000 вопросов и скорости в 2,5 раза выше, чем у H2O-Lightning-4B. Для бизнеса это важно, потому что маршрутизация и классификация становятся отдельным платным слоем в агентных архитектурах.

Microsoft выпустил Decision-1 для быстрых структурированных решений

Как Microsoft позиционирует Decision-1

Decision-1 предназначена для классификации, оценки и маршрутизации решений, а не для свободной генерации или диалога. По заявлению Microsoft, она способна направлять агентов и управлять ими в сложных средах, выступая управляющим компонентом в более крупных процессах. Модель построена на базе Qwen3.5-9B, что продолжает подход к созданию decision-моделей на открытых компактных языковых моделях. Доступ уже определен: подключение идет через Microsoft Foundry и OpenRouter.

Ценовая схема выглядит необычно для этого класса моделей. Входные токены стоят $0.042 за миллион, а выходные токены бесплатны, что подходит для коротких структурированных ответов, а не длинных текстов. Заявление о точности опирается на широкий набор из 36 бенчмарков и почти 150 000 вопросов, по данным Microsoft. Разрыв по скорости заявлен большой: в 2,5 раза быстрее H2O-Lightning-4B. Открытые модели Clef от Cloudflare, также построенные на Qwen, в это сравнение не вошли.

Выпуск продолжает быструю серию похожих релизов. Тренд decision-моделей задал стартап Jev в середине сентября, затем появились модели OpenAI и Cloudflare, а теперь и Microsoft. В источнике говорится, что для Jev последние недели, вероятно, были сложными, поскольку идею быстро подхватили и развили другие на открытых компактных языковых моделях. То есть концепция стартапа за несколько недель превратилась в конкурентную категорию с дистрибуцией крупных платформ. Именно поэтому в сравнениях теперь важны бенчмарки, задержка и цена.

Что это меняет в агентных архитектурах

Для компаний, использующих агентов, отдельная decision-модель позволяет вынести рутинную сортировку из дорогого рассуждающего контура. Классификация обращений, оценка качества и маршрутизация к нужному инструменту или агенту становятся дешевой операцией при цене $0.042 за миллион входных токенов и бесплатных выходных. Небольшие компании получают готовый компонент через OpenRouter без собственной инфраструктуры, а крупные могут стандартизировать маршрутизацию внутри Microsoft Foundry. Практический эффект — ниже стоимость каждого решения и более предсказуемое поведение в многошаговых процессах.

Ограничения заслуживают не меньшего внимания, чем заявленные цифры. Лидерство по точности и скорости следует из тестов Microsoft, а Clef в сравнение не вошла, поэтому рейтинг нельзя считать независимым. Результат на 36 бенчмарках не гарантирует такого же качества на собственных категориях компании, порогах и редких случаях. Разумно сравнить Decision-1 с H2O-Lightning-4B, Clef и действующими правилами на своих данных, проверив задержку, типы ошибок и поведение при изменении инструкций.

Признаком закрепления тренда станет превращение Decision-1 в стандартный маршрутизатор для продуктивных агентов через Foundry и OpenRouter. Подтверждением будут широкое внедрение, клиентские кейсы и независимые результаты бенчмарков. Если конкуренты ответят снижением цен или более полными сравнениями, логика решений станет базовой инфраструктурой. Тогда конкуренция сместится с оценок моделей на управление, мониторинг и контроль агентов.