AI圈报
论文研究普通

VTR-Bench:评估视频生成中视觉文本渲染的系统性基准

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:VTR-Bench: A Systematic Benchmark for Evaluating Visual Text Rendering in Video Generation

内容摘要

VTR-Bench 是用于评估视频生成模型视觉文本渲染能力的系统性基准,包含覆盖广告、科学视频等五类场景的 300 条提示词,并配套自动化评估流程。在 11 个 SOTA 模型上的实验显示,场景文本渲染普遍存在困难,表现最好的模型整体词错误率(WER)为 0.250。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-0eafcd38f2da09ef9548197b