2 papers
cs.CV2020
ViNet: Pushing the limits of Visual Modality for Audio-Visual Saliency Prediction
Samyak Jain, Pradeep Yarlagadda, Shreyank Jyoti +3
We propose the ViNet architecture for audio-visual saliency prediction. ViNet is a fully convolutional encoder-decoder architecture. The encoder uses visual features from a network…
cs.CV2020
Tidying Deep Saliency Prediction Architectures
Navyasri Reddy, Samyak Jain, Pradeep Yarlagadda +1
Learning computational models for visual attention (saliency estimation) is an effort to inch machines/robots closer to human visual cognitive abilities. Data-driven efforts have d…