ResearchHub Endowment
Earn daily Funding Credits to fund science
Paper
Paper
Search
Log in
Sign up
Sign up
Publish
Home
My Funding
Peer Review
Journal
Endowment
Help & resources
JavisGPT: A Unified Multi-modal LLM for Sounding-Video Co... | ResearchHub
ResearchHub Endowment
Earn daily Funding Credits to fund science
Paper
Paper
Search
Log in
Sign up
Sign up
Publish
Home
My Funding
Peer Review
Journal
Endowment
Help & resources
JavisGPT: A Unified Multi-modal LLM for Sounding-Video Comprehension and Generation
By
Sun, Yuchong
2 more
Sun, Yuchong
·
Wu, Shengqiong
·
Zhang, Daoan
January 2, 2026
33
Paper
Reviews
0
Conversation
0
Bounties
0
Loading PDF viewer…
Preprint Server
Topics
#computer-science
#computer-vision
#music-and-audio-processing
#multimodal-machine-learning-applications
#speech-recognition-and-synthesis
DOI
10.48550/arXiv.2512.22905
License
CC-BY
Other Formats
PDF