大模型研究协同创新中心
Open Menu
Close Menu
主页
新闻
研究小组
出版物
中文 (简体)
English
Yali Wang
InternVideo-Next: Towards World-Understanding Video Models
2026年5月5日
VideoChat-Flash: Hierarchical Compression for Long-Context Video Modeling
2026年4月24日
UniFlow: A Unified Pixel Flow Tokenizer for Visual Understanding and Generation
2026年4月24日
VideoChat-r1.5: visual test-time scaling to reinforce multimodal reasoning by iterative perception
2025年10月11日
VRBench: a benchmark for multi-step reasoning in long narrative videos
2025年8月12日
Task preference optimization: improving multimodal large language models with vision task alignment
2025年4月20日
TimeSuite: Improving MLLMs for Long Video Understanding via Grounded Tuning
2025年4月15日
CG-Bench: Clue-grounded Question Answering Benchmark for Long Video Understanding
2025年4月15日