Thinking Leakage: A Causal Audit of NoThink Post-Training in Hybrid Reasoning ModelsResearchSep 25, 2026
ViRDM: Taming Representation Distribution Matching for Few-Step Causal Video GenerationResearchSep 25, 2026
Direction-Scale Decomposition in Action Representation: Rethinking What to Tokenize for Vision-Language-Action ModelsResearchSep 25, 2026
Can Classical Semantic-Extractive Summarization Be Evaluated in Hindi? A Replication StudyResearchSep 25, 2026
From Self-Distillation to Self-Practice: Privileged Information for Multi-Turn AgentsResearchSep 25, 2026
Back to the Definition: Estimating Step-Level Advantages via Trajectory Graphs for Agentic Reinforcement LearningResearchSep 25, 2026
Beyond Static Graph World Models: Learning Stochastic Latent Dynamics over Evolving TopologiesResearchSep 25, 2026
RLVR landscapes for iterated multiplications can be benign: Insights from spin-glass theoryResearchSep 25, 2026
fable.intermittent: benchmarking probabilistic forecasting methods for intermittent time seriesResearchSep 25, 2026