Picture for Deqing Yang

Deqing Yang

When RAG Meets Query Planning: Logical Query Trees for Resolving Exploratory Reasoning Problems

Add code
Jul 01, 2026
Viaarxiv icon

When Calibration Rankings Reverse: Accuracy-Controlled Evaluation for Fair Comparison of LLMs

Add code
Jun 29, 2026
Viaarxiv icon

Deep Research as Rubric for Reinforcement Learning

Add code
May 31, 2026
Viaarxiv icon

ProRL: Effective Reinforcement Learning for Proactive Recommendation via Rectified Policy Gradient Estimation

Add code
May 28, 2026
Viaarxiv icon

M3D-Stereo: A Multiple-Medium and Multiple-Degradation Dataset for Stereo Image Restoration

Add code
Apr 14, 2026
Viaarxiv icon

Good Reasoning Makes Good Demonstrations: Implicit Reasoning Quality Supervision via In-Context Reinforcement Learning

Add code
Mar 10, 2026
Viaarxiv icon

Think Fast and Slow: Step-Level Cognitive Depth Adaptation for LLM Agents

Add code
Feb 13, 2026
Viaarxiv icon

Outcome-Grounded Advantage Reshaping for Fine-Grained Credit Assignment in Mathematical Reasoning

Add code
Jan 12, 2026
Viaarxiv icon

Confidence Estimation for LLMs in Multi-turn Interactions

Add code
Jan 05, 2026
Viaarxiv icon

ComLQ: Benchmarking Complex Logical Queries in Information Retrieval

Add code
Nov 15, 2025
Figure 1 for ComLQ: Benchmarking Complex Logical Queries in Information Retrieval
Figure 2 for ComLQ: Benchmarking Complex Logical Queries in Information Retrieval
Figure 3 for ComLQ: Benchmarking Complex Logical Queries in Information Retrieval
Figure 4 for ComLQ: Benchmarking Complex Logical Queries in Information Retrieval
Viaarxiv icon