Hugging Face Blog·· 2025-02-20精选AI 评分62
Hugging Face 发布 SmolVLM2:把视频理解带到每台设备
SmolVLM2: Bringing Video Understanding to Every Device
AI 导读
Hugging Face 发布 SmolVLM2 系列视频理解模型,包含 2.2B、500M 和 256M 三种参数规模,官方称 500M 与 256M 是目前最小的视频语言模型。
推荐理由
Hugging Face 官方发布三档小尺寸视频理解模型,并给出 MLX 与 iPhone 本地运行方案,可据此判断端侧视频理解的可行边界。
来源:Hugging Face Blog · huggingface.co