Liquid AI 发布自家第一个决策模型 d1,官方称它是首个在 HuggingFace 决策指数上超过 Jev 的模型,控制台开在 console.liquid.ai ,OpenRouter 随后接入。优势点写得很具体:多语言评测更稳、对提示注入更抗打、能吃更长的输入、为软件环境里的快速结构化决策而生。
一个月之内,"决策模型"这个品类从一家创业公司的独门生意变成三方角力:Jev 靠"不生成文字、一次性给选项打分"定义了品类,大厂把同类能力做成带毫秒级延迟的官方接口,如今又有一家小模型厂商拿着公开基准宣布反超。品类成熟的速度本身比任何单点成绩都更说明问题——当评测、接口、竞品在三十天里齐活,采购方的谈判筹码也在同步变多。
d1 列出的四项优势,正好可以当决策模型的通用评估清单。多语言决定它能不能接跨国业务;抗提示注入决定它敢不敢放进无人值守的自动流程;输入长度决定它能不能带着完整上下文做判断;延迟决定它能不能嵌在实时链路里。四项里任何一项不过关,模型再快也只是实验室里的快。
选型时把这四项对着自己的场景过一遍:要接多语言流量就先跑多语言集,要放进自动流程就必须做注入攻击测试,输入超过单屏就实测长文准确率。清单跑完,答案基本唯一,不必等下一份榜单。
话题来源 @liquidai
824.4K阅读 ❤️1870 x.com/…↗ 已改写,非原文转载
25 浏览 0 评论
0 反应











