AI 与科技 / 模型卡代读
公开权重的 d1,做决策而不是写回答
Gorden Sun 介绍 Liquid AI 的 d1 系列。本期补读 d1-3B 模型卡:它以文本、JSON 或图像状态及指定问题作为输入,一次前向计算返回结构化决策与置信信息,不逐 token 生成聊天文本。把它理解为“又一个聊天小模型”会错过产品用途。
公开模型约31.2亿参数,上下文长度32,768 token,适用路由、分流、分类、重排和视觉检查等任务。例如,输出类别和判断可以交给业务流程处理,但它不自行写解释长文;所谓零输出 token 说明计算方式,不等于运行免费。
模型卡在 RTX 4090 上给出单问题热运行中位数8毫秒,在 Jetson Orin Nano 上为50毫秒。测试使用特定精度、编译和预热条件;同一张卡中,较长3.4K token 状态在两设备分别为102毫秒和1,640毫秒,因此8毫秒并不是任意输入的保证。
这些是发布者的性能记录,没有在本报设备上重测。权重按 LFM Open License 1.0 发布,不能仅因可下载就称作无约束开源;同系列另一个多模态模型的能力也不能直接套给这份3B模型。
出处与继续阅读
主编加工
取材线索来自已核对关注账号:@Gorden_Sun。