Showing cs.CVShow all
3 papers · 1 filter
cs.CV2025
Understanding Virality: A Rubric based Vision-Language Model Framework for Short-Form Edutainment Evaluation
Arnav Gupta, Gurekas Singh Sahney, Hardik Rathi +4
Evaluating short-form video content requires moving beyond surface-level quality metrics toward human-aligned, multimodal reasoning. While existing frameworks like VideoScore-2 ass…
cs.CV2025
Investigating Spatial Attention Bias in Vision-Language Models
Aryan Chaudhary, Sanchit Goyal, Pratik Narang +1
Vision-Language Models have demonstrated remarkable capabilities in understanding visual content, yet systematic biases in their spatial processing remain largely unexplored. This…
cs.CV2025
Lights, Camera, Consistency: A Multistage Pipeline for Character-Stable AI Video Stories
Chayan Jain, Rishant Sharma, Archit Garg +3
Generating long, cohesive video stories with consistent characters is a significant challenge for current text-to-video AI. We introduce a method that approaches video generation i…