PulseAugur
实时 12:48:56
English(EN) CLIP-CC-Bench: Evaluating Paragraph-Level Video Descriptions in Video-Language Models

新基准评估语言模型中的段落级视频描述

研究人员推出了CLIP-CC-Bench,这是一个新的评估套件,旨在评估视频语言模型生成详细的段落级描述的能力。该基准源自电影内容,弥补了当前评估通常侧重于短片段和单句指标的不足。CLIP-CC-Bench 利用基于 LLM 的嵌入模型集合,并采用粗粒度和细粒度语义匹配来比较生成的描述与专家参考,旨在为模型性能提供更可靠、更全面的评估。 AI

影响 为长篇视频描述生成提供了更强大的评估框架,推动了更先进的视频语言模型的发展。

排序理由 该集群描述了一篇介绍视频语言模型评估基准的新学术论文。

在 arXiv cs.IR (Information Retrieval) 阅读 →

AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →

新基准评估语言模型中的段落级视频描述

报道来源 [2]

  1. arXiv cs.IR (Information Retrieval) TIER_1 English(EN) · Chulwoo Pack ·

    CLIP-CC-Bench:评估视频语言模型中的段落级视频描述

    Benchmarking video-language models has largely focused on short clips and single-sentence metrics, leaving open whether current systems can generate accurate long-form, paragraph-level descriptions. We introduce CLIP-CC-Bench, an evaluation suite for long-form video description b…

  2. arXiv cs.CV TIER_1 English(EN) · Mukhtiar Ali, Harsh Dubey, Sugam Mishra, Chulwoo Pack ·

    CLIP-CC-Bench:评估视频语言模型中的段落级视频描述

    arXiv:2608.04302v1 Announce Type: new Abstract: Benchmarking video-language models has largely focused on short clips and single-sentence metrics, leaving open whether current systems can generate accurate long-form, paragraph-level descriptions. We introduce CLIP-CC-Bench, an ev…