Exploiting Vulnerabilities: Universal Adversarial Attacks on Vision-Language-Action Models in RoboticsResearchOct 1, 2026
ArgGYM: A Procedural, Engine-Verified Benchmark for Structured Defeasible ReasoningResearchOct 1, 2026
HeurEvo: Agentic Evolution of Hybrid Solver-Augmented Heuristics for Time-Critical Mathematical OptimizationResearchOct 1, 2026
DeepRewind: Predicting and Repairing Premature Commitments in Deep Research AgentsResearchOct 1, 2026
MemFold: Learning Compact Soft Memory for Long-Context Personalization via On-Policy OptimizationResearchOct 1, 2026
Grounded Revision vs. Prior Injection: Probing Retrieval-Augmented Patent Claim AmendmentResearchOct 1, 2026
FinRT: Distilling Adaptive Red-Teaming Strategies into Reusable Adversarial Generators in Consumer FinanceResearchOct 1, 2026