Simulate to Generalize: Scaling Stateful Supervision for API-calling Agents using LLM World ModelsResearchSep 23, 2026
VeriSimpl: Robust Optimization Modeling from Natural Language using Simplification-based VerificationResearchSep 23, 2026
Discrete vs. Continuous: A Comprehensive Study of Unified Audio Understanding in LALMsResearchSep 23, 2026
Relative Wasserstein Angle and the Problem of the $W_2$-Nearest Gaussian DistributionResearchSep 23, 2026
Communication-Efficient Byzantine-Robust Federated Conformal Prediction via Partial SharingResearchSep 23, 2026
GRPO-QPS: Target-Preserving Reinforcement Learning for Quantum Posterior SamplingResearchSep 23, 2026
Not All Objectives Are Born Equal: Priority-Constrained Descent for Hierarchical Multi-Objective OptimizationResearchSep 23, 2026