Aivora

#mlx

MLX

1 篇文章

LFM2.5-VL-DSpark:以超低開銷將多模態模型推論速度提升達 3 倍
Hugging Face大型語言模型

LFM2.5-VL-DSpark:以超低開銷將多模態模型推論速度提升達 3 倍

LFM2.5-VL-DSpark: Accelerating Vision-Language Models with Minimal Overhead

Liquid AI 針對 LFM2.5-VL-3B 模型推出僅 2.8 億參數的 DSpark 草稿模型,可在不犧牲準確度的前提下,將邊緣裝置與 GPU 的解碼速度提升高達 3.13 倍。

2 分鐘閱讀