Liquid AI开源d1系列决策模型 单次判断8毫秒
IT时代网10月9日消息,Liquid AI发布博文,宣布推出d1系列两款开放权重决策模型:d1-3B支持31.2亿参数的文本与图像判断,d1-omni-600M以5.87亿参数支持文本、图像及语音输入。
在9月Jev模型推出引发关注后,OpenAI等公司也相继推出类似的决策模型,Liquid AI是加入这一战局的新成员。本次推出的两款模型已在Hugging Face公开,用户可下载、微调并部署。
d1-3B拥有31.2亿参数,基于视觉语言模型LFM2.5-VL-3B训练,支持文本与图像输入,在Decision Index v0.2.1公开测试集获得48.57分,官方称其领先所有100亿参数以下模型。
d1-omni-600M拥有5.87亿参数,基于双向编码器LFM2.5-Encoder-350M训练,支持文本与图像、或文本与语音的组合输入,是Liquid AI首个实验性多模态决策模型检查点。
推理速度方面,d1-3B在NVIDIA RTX 4090上回答单个问题耗时8毫秒,处理384像素图像耗时102毫秒;在Jetson AGX Thor上单问耗时16毫秒。

注:本文综合自IT之家等,文中包含AI辅助创作的内容。
编辑:林一舟
THE END