1 paper · 1 filter
Shruti Palaskar, Oggi Rudovic, Sameer Dharur +7
Although Large Language Models (LLMs) have shown promise for human-like conversations, they are primarily pre-trained on text data. Incorporating audio or video improves performanc…