比特网10月10日消息,微软日前推出专门面向结构化决策任务的AI模型Microsoft‑Decision‑1,该模型主打低延迟、高可靠的决策打分能力,性能同时超越通用大模型与同类决策模型,现已在Microsoft Foundry开放使用,后续将登陆OpenRouter平台。
不同于大语言模型侧重文本生成、复杂逻辑推理,Microsoft‑Decision‑1面向路由分发、分类、优先级判定、校验、工作流控制等场景,输出软件可直接调用的结构化结果,支持是 / 否判断、多选、打分,还可依据评分标准对AI输出、智能体动作进行评级,通过简单API即可调用。该模型基于Qwen3.5‑9B做后训练优化,未来还计划迁移至微软MAI、OpenAI基座之上。
微软在36套未参与训练的盲测基准、近15万道题目开展测评,该模型取得最高准确率。性能数据显示,它的运行速度为第二名Quyet‑1.0‑Large的4.5倍,更是GPT‑6 Sol的35倍。在鲁棒性测试中,对相同请求做8种形式扰动,模型平均决策翻转率仅1.3%;选项改写、打乱顺序时不会出现决策变化。安全维度,通过11套基准合计5250条请求测试,可以拦截有害请求与提示注入,同时保障正常业务可用性。
微软多个业务部门已经完成内部试点。Xbox团队用它处理上万条玩家反馈,质量对标GPT‑6 Sol,速度提升14 倍,成本仅为后者的1/200;Copilot团队用于回答质量质检,速度较GPT5.6 Luna快100倍;该模型还应用在故障响应、科学实验自适应重规划场景,显著提升一致性与执行效率。
应用场景覆盖AI智能体控制、模型路由、数据标注、AI裁判、意图识别、代码扫描、机器人动作选择等。定价方面,输入token为每百万0.042美元,输出token免费,适合高频大规模决策业务。微软表示,随着AI智能体落地,专用决策模型能够承担大量轻量判断任务,降低整体算力开销,后续会持续迭代优化模型的准确率、置信度与成本表现。
微博认证登陆
QQ账号登陆
微信账号登陆