大模型研究协同创新中心
Open Menu
Close Menu
主页
新闻
研究小组
出版物
中文 (简体)
English
Paper-Conference
VMonarch: Efficient Video Diffusion Transformers with Structured Attention
2026年5月5日
VideoRealBench: A Chain-of-Thought Realism Evaluation Benchmark for Generated Human-Centric Videos
2026年5月5日
UniAVGen: Unified Audio and Video Generation with Asymmetric Cross-Modal Interactions
2026年5月5日
TimeLens: Rethinking Video Temporal Grounding with Multimodal LLMs
2026年5月5日
TempR1: Improving Temporal Understanding of MLLMs via Temporal-Aware Multi-Task Reinforcement Learning
2026年5月5日
Rethinking BCE Loss for Multi-Label Image Recognition with Fine-Tuning
2026年5月5日
InternVideo-Next: Towards World-Understanding Video Models
2026年5月5日
DDT: Decoupled Diffusion Transformer
2026年5月5日
CoMo: Learning Continuous Latent Motion from Internet Videos for Scalable Robot Learning
2026年5月5日
Bayesian Decomposition and Semantic Completion for Few-shot Semantic Segmentation
2026年5月5日
« 上一页
下一页 »