Picture for Li Yuan

Li Yuan

UniWorld-View: Large-Baseline View Synthesis via Video Diffusion Models

Add code
Aug 05, 2026
Viaarxiv icon

UniWorld-Design: From Pixel Generation to Layer-Native Design

Add code
Aug 04, 2026
Viaarxiv icon

Relax Within, Balance Across: Geometry-Guided Load Balancing for Vision-Language Mixture-of-Experts

Add code
Aug 01, 2026
Viaarxiv icon

Divergence Decoding: Training-Free Capability Fusion

Add code
Jul 28, 2026
Viaarxiv icon

MSVS-VAE: Multi-Scale Anchored VecSet for High-Fidelity 3D Reconstruction

Add code
Jul 27, 2026
Viaarxiv icon

Hypothesis-and-Refinement Learning of Organic Structures from Multimodal Spectroscopic Data

Add code
Jul 22, 2026
Viaarxiv icon

GEAR: Guided End-to-End AutoRegression for Image Synthesis

Add code
Jun 30, 2026
Viaarxiv icon

Truth or Sophistry? LoFa: A Benchmark for LLM Robustness Against Logical Fallacies

Add code
Jun 30, 2026
Viaarxiv icon

SyncCache: Exploiting Asymmetric Dynamics for Fast Audio-Driven Portrait Animation

Add code
Jun 29, 2026
Viaarxiv icon

From Structure to Synergy: A Survey of Vision-Language Perception Paradigm Evolution in Multimodal Large Language Models

Add code
Jun 24, 2026
Viaarxiv icon