SmolVLM2发布:让每台设备都能理解视频
SmolVLM2:让每台设备都能理解视频
Hugging Face 发布 SmolVLM2,一个轻量级多模态模型,旨在让视频理解能力普及到各类设备。该模型在保持小参数量的同时,实现了对视频内容的有效理解,可运行于手机、边缘设备等资源受限环境。SmolVLM2 基于之前的 SmolVLM 改进,支持视频输入并输出文本描述,适用于视频摘要、问答等任务。模型权重已开源,开发者可下载使用。
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力