1 paper
Debjyoti Das Adhikary, Aritra Hazra, Partha Pratim Chakrabarti
Improving video captioning quality typically demands retraining large vision-language models, an expensive and often impractical requirement. Existing training-free alternatives in…