Jeff 开源发布:22 毫秒出一次决策的小模型,0.8B 微调在 benchmark 上逼近 Jev
开源项目 Jeff 发布,定位为零样本分类器,基于 Qwen3.5 和 Gemma 4 微调,一次前向计算即返回每个选项的校准概率,不生成文本、无需解析。在 RTX PRO 6000 上约 22 毫秒出一次决策,0.8B 微调版本在 benchmark 上逼近 Jev。
开源项目 Jeff 发布,定位为零样本分类器,基于 Qwen3.5 和 Gemma 4 微调,一次前向计算即返回每个选项的校准概率,不生成文本、无需解析。在 RTX PRO 6000 上约 22 毫秒出一次决策,0.8B 微调版本在 benchmark 上逼近 Jev。
Liquid AI 发布实验性草稿模型 LFM2.5-VL-DSpark,为视觉语言模型 LFM2.5-VL-3B 加入投机解码路径,端侧解码最高提速 3.13x、H100 上最高 2.66x,端到端最高提升 2.62x 和 2.27x。