Slot-VLM:视频 - 语言建模的 SlowFast 插槽

💡 原文中文,约400字,阅读约需1分钟。
📝

内容提要

MobileVLM是专为移动设备设计的多模式视觉语言模型,性能与更大模型相当。在高通骁龙888 CPU和NVIDIA Jeston Orin GPU上的推断速度分别为21.5个token和65.3个token每秒。

🏷️

标签

➡️

继续阅读