1 paper · 1 filter
Suah Choi, Tae-Young Lee, Gyeong-Moon Park
Recent text-to-audio-video (T2AV) models jointly generate video, speech, sound effects, and ambience from a single text prompt. This capability poses new challenges for safety eval…