Liquid AI 开源 d1 系列决策模型:单次判断仅 8 毫秒,支持图像输入

2026-10-09 15:58:09   |   唐微   |   2181

10月9日,Liquid AI 推出 d1 系列两款开放权重决策模型,已在 Hugging Face 公开,用户可下载、微调并部署。其中 d1-3B 拥有 31.2 亿参数,基于视觉语言模型训练,支持文本与图像输入,在 Decision Index v0.2.1 公开测试集获得 48.57 分,Liquid AI 称其领先所有 10B 以下模型。d1-omni-600M 拥有 5.87 亿参数,支持文本与图像或文本与语音组合输入,是 Liquid AI 首个实验性多模态决策模型检查点。

在推理速度上,d1-3B 在 NVIDIA RTX 4090 上回答单个问题耗时 8 毫秒,处理 384 像素图像耗时 102 毫秒;在 Jetson AGX Thor 上单问耗时 16 毫秒,Jetson Orin Nano 上为 50 毫秒,可在边缘设备实现实时判断。

特别提醒:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字、图片等内容的真实性、完整性、及时性本站不作任何保证或承诺,请自行核实相关内容。本站不承担此类作品侵权行为的直接责任及连带责任。如若本网有任何内容侵犯您的权益,请及时发送相关信息至bireading@163.com,本站将会在48小时内处理完毕。

Liquid AI 开源 d1 系列决策模型:单次判断仅 8 毫秒,支持图像输入

2026-10-09 15:58:09 浏览量: 2181 作者: 唐微

10月9日,Liquid AI 推出 d1 系列两款开放权重决策模型,已在 Hugging Face 公开,用户可下载、微调并部署。其中 d1-3B 拥有 31.2 亿参数,基于视觉语言模型训练,支持文本与图像输入,在 Decision Index v0.2.1 公开测试集获得 48.57 分,Liquid AI 称其领先所有 10B 以下模型。d1-omni-600M 拥有 5.87 亿参数,支持文本与图像或文本与语音组合输入,是 Liquid AI 首个实验性多模态决策模型检查点。

在推理速度上,d1-3B 在 NVIDIA RTX 4090 上回答单个问题耗时 8 毫秒,处理 384 像素图像耗时 102 毫秒;在 Jetson AGX Thor 上单问耗时 16 毫秒,Jetson Orin Nano 上为 50 毫秒,可在边缘设备实现实时判断。

,

Copyright ©2018 铋读网 All Rights Reserved.

京ICP备18051707号

京公网安备 11011302001633号