Similar Items: Driver Behavior Modeling with Subjective Risk‐Driven Inverse Reinforcement Learning
- Inverse Meets Distillation: Heterogeneous Teacher–Assistant Dual-Path Learning for Unsupervised Defect Detection
- Extending Environments to Measure Self-reflection in Reinforcement Learning
- Feature Reinforcement Learning: Part II. Structured MDPs
- Towards Generalisable and Explainable Traffic Signal Control via Deep Reinforcement Learning and Large Language Models
- A Survey for Deep Reinforcement Learning Based Network Intrusion Detection
- The Archimedean trap: Why traditional reinforcement learning will probably not yield AGI