Liquid AI 开放 d1 决策模型:d1-3B 一次前向给出判断,RTX 4090 上单题 8 毫秒
不生成文字、只回答结构化判断题的小模型,面向端侧和边缘设备。
// 要点
- 两个开放权重模型:d1-3B 基于 LFM2.5-VL-3B,输入文本和图片;d1-omni-600M 输入文本加图片或音频,官方标注为实验性研究版本。
- Decision Index 0.2.1 上 d1-3B 得 48.57,是 10B 以下最高,高于 Decider 35B-A3B 的 47.11;七个公开数据集均分 d1-3B 82.9、d1-omni-600M 78.4。
- d1-3B 单题延迟:RTX 4090 8 毫秒、Apple M5 Pro 30 毫秒、Jetson Orin Nano 50 毫秒。
- 需要 transformers 5.14 及以上并开启 trust_remote_code;文中未写明许可证。
开发者视角内容审核、路由、是否需要转人工这类「是或否」的判断,没必要每次都调生成式大模型。我会把 PandaClaws 里的发布前合规判断拿来试 d1-3B,但许可证没写清之前只做评估、不上线。