AI 與科技 / 模型卡代讀
公開權重的 d1,做決策而不是寫回答
Gorden Sun 介紹 Liquid AI 的 d1 系列。本期補讀 d1-3B 模型卡:它以文本、JSON 或圖像狀態及指定問題作為輸入,一次前向計算返回結構化決策與置信信息,不逐 token 生成聊天文本。把它理解為“又一個聊天小模型”會錯過產品用途。
公開模型約31.2億參數,上下文長度32,768 token,適用路由、分流、分類、重排和視覺檢查等任務。例如,輸出類別和判斷可以交給業務流程處理,但它不自行寫解釋長文;所謂零輸出 token 說明計算方式,不等於運行免費。
模型卡在 RTX 4090 上給出單問題熱運行中位數8毫秒,在 Jetson Orin Nano 上為50毫秒。測試使用特定精度、編譯和預熱條件;同一張卡中,較長3.4K token 狀態在兩設備分別為102毫秒和1,640毫秒,因此8毫秒並不是任意輸入的保證。
這些是發佈者的性能記錄,沒有在本報設備上重測。權重按 LFM Open License 1.0 發佈,不能僅因可下載就稱作無約束開源;同系列另一個多模態模型的能力也不能直接套給這份3B模型。
出處與繼續閱讀
主編加工
取材線索來自已核對關注賬號:@Gorden_Sun。