精选70Hugging Face 博客(RSS)论文研究
TimeScope基准测试:视频大模型能看多长视频?
TimeScope:视频大模型能看多长视频?
Hugging Face 发布 TimeScope 基准测试,用于评估视频大语言模型(Video LMM)处理长视频的能力。该基准包含多个时长从30秒到数小时的视频片段,测试模型在理解长视频内容、时间定位、事件推理等方面的表现。初步结果显示,当前主流视频模型在长视频理解上存在明显短板,尤其是超过10分钟的视频,模型性能显著下降。TimeScope 旨在推动视频模型向更长时间上下文理解发展,为研究者提供标准化评估工具。
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力