Picture for Xuri Ge

Xuri Ge

Do We Really Need Multimodal Emotion Language Models Larger Than 1B Parameters?

Add code
Jul 14, 2026
Viaarxiv icon

Stream-aware Side Adaptation for Large Pre-trained Multimodal Embedding Models in Sequential Recommendation

Add code
Jul 12, 2026
Viaarxiv icon

DRIVE: Distributional and Retrieval-Augmented Bidding with Value Evaluation

Add code
Jun 12, 2026
Viaarxiv icon

The 2nd EReL@MIR Workshop on Efficient Representation Learning for Multimodal Information Retrieval

Add code
May 26, 2026
Viaarxiv icon

Validating Computational Markers of Depressive Behavior: Cross-Linguistic Speech-Based Depression Detection with Neurophysiological Validation

Add code
Apr 02, 2026
Viaarxiv icon

MCoT-MVS: Multi-level Vision Selection by Multi-modal Chain-of-Thought Reasoning for Composed Image Retrieval

Add code
Mar 18, 2026
Viaarxiv icon

Hierarchical Dual-Change Collaborative Learning for UAV Scene Change Captioning

Add code
Mar 13, 2026
Viaarxiv icon

Benchmarking Multimodal Large Language Models for Missing Modality Completion in Product Catalogues

Add code
Jan 28, 2026
Viaarxiv icon

Identifying and Transferring Reasoning-Critical Neurons: Improving LLM Inference Reliability via Activation Steering

Add code
Jan 27, 2026
Viaarxiv icon

Differentiable Semantic ID for Generative Recommendation

Add code
Jan 27, 2026
Viaarxiv icon