How Many Labels Does a Language Need? Annotation Budgets and Cross-Lingual Pooling for African-Language Text ClassificationResearchOct 1, 2026
Scoring Higher, Answering Worse: Mitigating Reward Hacking in Rubric-Based RL via Protocol-Level RubricsResearchOct 1, 2026
Can Vision-Language Models Stay Helpful When Facing Implicit Risks? Intent-Privilege OPSD for Efficient Safety-Helpfulness AlignmentResearchOct 1, 2026
ReSCENE: Server-Side Replay for Structural Mitigation of Catastrophic Forgetting in Federated Continual LearningResearchOct 1, 2026
Beyond the Shadows of Plato's Cave: Evaluating False Memory in Autonomous Agents via Counterfactual ReasoningResearchOct 1, 2026
MotionWeave: Learning Motion-Centered Future Dynamics for Vision-Language-Action PoliciesResearchOct 1, 2026
PARK: Accurate Block Retrieval for Sparse Attention in Video Diffusion TransformersResearchOct 1, 2026