EchoInk
EchoInk-R1: Exploring Audio-Visual Reasoning in Multimodal LLMs via Reinforcement Learning (π₯The Exploration of R1 for General Audio-Visual Reasoning with Qwen2.5-Omni)
// repository documentation
Was this content helpful?
(0 ratings)