Detailed Schedule | Oral Online | Slot 4 | Online Room B
Evening July 25 19:00-23:00 北京 CST | July 25 07:00-11:00 Toronto EDT
Online Room B | Evening July 25 19:00-23:00
Topic: Reinforcement Learning
Chair: Yaozeng Huang / Md Rakib Hossain
Session 1
Chair: Yaozeng Huang
Online Room B
Paper 262
19:00-19:15
Reinforcement Learning
Efficient Solution for Collaborative Dynamic Optimization of Maintenance-Scheduling in EMU Depots Based on Hierarchical Reinforcement Learning
Meng Li, Bofei Pei, Ting Ke, Zelong Sun, and Zegao Cheng
Paper 299
19:15-19:30
Reinforcement Learning
Proactive Caching Strategy for Heterogeneous Industrial Edge Networks: A Deep Reinforcement Learning Approach Based on Cognitive Entropy-Driven Attention Mechanism
Fang Liu, Yang Li, Jiaxing Luo, Ningyuan Yu, Wei Jin, Wei Hu
Paper 546
19:30-19:45
Reinforcement Learning
Online Locality-Aware Conditional Sequence Modeling
Wensong Bai, Yichao Fu, Chao Zhang, Qihang Xu
Paper 2436
19:45-20:00
Reinforcement Learning
Attention-Based Multi-Agent Reinforcement Learning with Dual Experience Replay Buffers
Yinuo Yin, Yiyang Liu
Paper 3089
20:00-20:15
Reinforcement Learning
Policy Extraction-Based Adversarial Attack in Multi-Agent Reinforcement Learning
Bang Zhang, Wenjian Luo, Kesheng Chen, Yujiang Liu, Shuhan Qi, Xuan Wang
Paper 3586
20:15-20:30
Reinforcement Learning
A Hypergraph network dismantling model based on bipartite graph perspective and reinforcement learning
Jie Cheng, Yutong Lu, Li Zeng, Changjun Fan
Paper 4190
20:30-20:45
Reinforcement Learning
Subgoal-Induced Reinforcement Learning for Cross-Scene Generalization
Hanqi Li, Huaijun Qiu, Cuiwei Liu
Paper 4513
20:45-21:00
Reinforcement Learning
Transformer and Hypernetwork Enhanced Multi-Agent Reinforcement Learning for Multi-Depot Vehicle Routing
Xianglong Shen, Tianliang Gao, Chenyang Dong, Zhipeng Xia, Chaochao Li, Hongzhao Li, Chendi Ning, Shupan Li
Paper 4561
21:00-21:15
Reinforcement Learning
AdaInertia: Dynamic Tool Usage Inertia Control via Deep Q-Learning for Efficient LLM Agent Reasoning
Yanxi Hu, Yanjie Zhao, Yiwen Huang, Guangqi Dong, Baoming Zhang, Mingyu Di, Chongjun Wang
Paper 4810
21:15-21:30
Reinforcement Learning
Heterogeneous Graph-Enhanced MADDPG for UAV Swarm Formation Control
Xiaolong Lv, Buyun Xu
Paper 4815
21:30-21:45
Reinforcement Learning
SafeRecovery: A Safety-Recovery Benchmark with Four-Axis Evaluation for Quadruped Locomotion
Yaozeng Huang, Ziyi Zhang, Shuhao Jiang, Jingjie Li, Yifan Wang, Yanyun Zhou, Fei Shi
Session 2
Chair: Md Rakib Hossain
Online Room B
Paper 5096
21:45-22:00
Reinforcement Learning
Task-driven State Representation for Long-horizon World Model
Tingting Zhao, Jiaxin Huang, Zeyan He, Huijuan Zhang, Jianzheng Liu, Yuan Wang
Paper 5244
22:00-22:15
Reinforcement Learning
Transferring FX Features and WDLP Heads to Accelerate AlphaZero for Gomoku
Md Rakib Hossain, Xingyu Liu, Chuan Li