Носимые устройства

Microsoft выпустила ИИ, который выбирает варианты и не разговаривает — в тестах он оказался в 35 раз быстрее GPT-6 Sol

Microsoft представила Microsoft-Decision-1 — специализированную модель искусственного интеллекта, которая оценивает заранее заданные варианты ответа или действия. По данным компании, в тестах на принятие структурированных решений её задержка ответа оказалась в 35 раз меньше, чем у OpenAI GPT-6 Sol. Модель предназначена для классификации информации, проверки результатов и управления рабочими процессами.

Обзор HONOR Pad X9b Max: универсальный большой планшет с антибликовым экраном

Выбираем лучшие игровые ноутбуки на российском рынке (вторая половина 2026 года)

Мастерская локальных ИИ: салат картофельный с Qwen3.8

Лучший процессор под DDR4 в 2026 году: AM4 против LGA 1700

Сравнительный тест камер флагманских смартфонов (2026): итоги

Компьютер месяца, спецвыпуск: выбираем мини-ПК для работы и развлечений в эпоху дефицита чипов памяти

Источник изображений: microsoft.com

Microsoft-Decision-1 не предназначена для свободной генерации текста, как обычный чат-бот. Получив вопрос и набор вариантов, она присваивает каждому вероятностную оценку. Дальнейшие действия определяет приложение: например, оно может разрешить ИИ-агенту выполнить предложенный шаг, потребовать повторной попытки или передать задачу на рассмотрение человеку.

Работа с моделью обходится недорого: $0,042 за 1 млн входных токенов, а выходные данные не тарифицируются. Такая схема особенно выгодна для приложений, которым приходится часто классифицировать запросы или выбирать дальнейшие действия. Microsoft-Decision-1 также можно использовать для направления запросов подходящим моделям, расстановки приоритетов задач и оценки качества ответов других ИИ-систем.

По заявлению Microsoft, новинка показала наибольшую точность среди сравниваемых моделей по совокупности 36 бенчмарков, охватывающих почти 150 000 вопросов. Задания этих тестов не использовались при обучении. Медианная задержка ответа оказалась в 35 раз меньше, чем у GPT-6 Sol, и в 2,5 раза меньше, чем у занявшей второе место по этому показателю H2O-Lightning-4B v1.1. Эти результаты получены в тестах самой Microsoft и относятся к задачам выбора из заданных вариантов.

Компания уже проверила модель в нескольких практических сценариях. Инженеры Xbox Research с её помощью распределили более 10 000 отзывов игроков по заранее определённым темам. По качеству классификации Microsoft-Decision-1 оказалась сопоставима с GPT-6 Sol, но работала более чем в 14 раз быстрее при затратах примерно в 200 раз ниже. В тестах команды Microsoft Copilot на оценку качества ответов она показала результат, сопоставимый с GPT-5.6 Luna, при стократном преимуществе в скорости.

Microsoft-Decision-1 построена на базе Alibaba Qwen3.5-9B, которая прошла дополнительное обучение для оценки вариантов за один проход. В дальнейшем Microsoft намерена создавать версии на базе других моделей, включая собственные MAI и системы OpenAI. Компания также проверяла устойчивость решений к изменениям формулировок и оформления запросов: в этих тестах модель меняла ответ в среднем в 1,3 % случаев, а при перефразировании вариантов или перестановке их порядка изменений не было.

Для оценки безопасности Microsoft использовала 11 бенчмарков с 5250 запросами, включая вредоносный контент, попытки обхода защитных ограничений и внедрения посторонних инструкций. По данным компании, модель отклоняла вредоносные запросы, сохраняя высокую полезность при выполнении допустимых задач. Microsoft-Decision-1 уже доступна на платформе Microsoft Foundry и через OpenRouter.

Было интересно?
Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник

Добавить комментарий

Кнопка «Наверх»