AI for Data
微软发布 Microsoft-Decision-1:基于 Qwen3.5-9B 的决策打分模型
原标题: 微软发布 Microsoft-Decision-1:基于 Qwen3.5-9B 的决策打分模型
📋总体概括
微软发布决策模型 Microsoft-Decision-1,基于阿里巴巴 Qwen3.5-9B 后训练而成,现已在 Microsoft Foundry 和 OpenRouter 上线。该模型不生成文本,而是对每个固定答案选项输出校准概率,用于路由、分类、验证与智能体控制等场景,标志着决策打分类模型作为独立模型类别的兴起。
⚡关键信息
- ▸微软发布决策打分模型 Microsoft-Decision-1,已在 Microsoft Foundry 与 OpenRouter 上线可用
- ▸模型以阿里巴巴开源的 Qwen3.5-9B 为基座进行后训练,而非自研基座
- ▸核心机制是输出校准概率而非生成文本,即对固定选项逐项打分
- ▸适用场景包括路由、分类、验证与智能体控制等低延迟决策任务
🔥犀利点评
微软拿阿里开源的 Qwen 做基座再后训练成决策模型,本身就是开源生态反转的一次示范。更值得注意的是产品逻辑:不生成文本、只对选项输出校准概率,等于把「判断」从生成中剥离出来单独定价——路由、验证、Agent 控制恰恰是大模型应用里最高频、最在乎延迟和确定性的环节。与其用大模型瞎生成再解析,不如一个小模型直接打分,这条路子比堆参数务实得多。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 MarkTechPost 阅读全文 →