Picture for Cheston Tan

Cheston Tan

FedPref: Federated Preference Learning for Structured Radiology Report Extraction

Add code
Aug 17, 2026
Viaarxiv icon

StatePlay: State-Aware Game World Models for Mechanics-Consistent Generation

Add code
Jul 29, 2026
Viaarxiv icon

MINDGAMES: A Live Arena for Evaluating Social and Strategic Reasoning in Multi-Agent LLMs

Add code
May 28, 2026
Viaarxiv icon

CoMMET: To What Extent Can LLMs Perform Theory of Mind Tasks?

Add code
Mar 12, 2026
Viaarxiv icon

MEMO: Memory-Augmented Model Context Optimization for Robust Multi-Turn Multi-Agent LLM Games

Add code
Mar 09, 2026
Viaarxiv icon

Information Fidelity in Tool-Using LLM Agents: A Martingale Analysis of the Model Context Protocol

Add code
Feb 10, 2026
Viaarxiv icon

TangramSR: Can Vision-Language Models Reason in Continuous Geometric Space?

Add code
Feb 05, 2026
Viaarxiv icon

10 Open Challenges Steering the Future of Vision-Language-Action Models

Add code
Nov 08, 2025
Viaarxiv icon

FailSafe: Reasoning and Recovery from Failures in Vision-Language-Action Models

Add code
Oct 02, 2025
Viaarxiv icon

The Singapore Consensus on Global AI Safety Research Priorities

Add code
Jun 25, 2025
Figure 1 for The Singapore Consensus on Global AI Safety Research Priorities
Figure 2 for The Singapore Consensus on Global AI Safety Research Priorities
Figure 3 for The Singapore Consensus on Global AI Safety Research Priorities
Viaarxiv icon