Detailed Schedule | Oral Online | Slot 4 | Online Room B
Evening July 25 19:00-23:00 北京 CST | July 25 07:00-11:00 Toronto EDT
Online Room B | Evening July 25 19:00-23:00
Session 1
Chair: Yaozeng Huang
Online Room B
Reinforcement Learning
Efficient Solution for Collaborative Dynamic Optimization of Maintenance-Scheduling in EMU Depots Based on Hierarchical Reinforcement Learning
Meng Li, Bofei Pei, Ting Ke, Zelong Sun, and Zegao Cheng
Reinforcement Learning
Proactive Caching Strategy for Heterogeneous Industrial Edge Networks: A Deep Reinforcement Learning Approach Based on Cognitive Entropy-Driven Attention Mechanism
Fang Liu, Yang Li, Jiaxing Luo, Ningyuan Yu, Wei Jin, Wei Hu
Reinforcement Learning
Online Locality-Aware Conditional Sequence Modeling
Wensong Bai, Yichao Fu, Chao Zhang, Qihang Xu
Reinforcement Learning
Attention-Based Multi-Agent Reinforcement Learning with Dual Experience Replay Buffers
Yinuo Yin, Yiyang Liu
Reinforcement Learning
Policy Extraction-Based Adversarial Attack in Multi-Agent Reinforcement Learning
Bang Zhang, Wenjian Luo, Kesheng Chen, Yujiang Liu, Shuhan Qi, Xuan Wang
Reinforcement Learning
A Hypergraph network dismantling model based on bipartite graph perspective and reinforcement learning
Jie Cheng, Yutong Lu, Li Zeng, Changjun Fan
Reinforcement Learning
Subgoal-Induced Reinforcement Learning for Cross-Scene Generalization
Hanqi Li, Huaijun Qiu, Cuiwei Liu
Reinforcement Learning
Transformer and Hypernetwork Enhanced Multi-Agent Reinforcement Learning for Multi-Depot Vehicle Routing
Xianglong Shen, Tianliang Gao, Chenyang Dong, Zhipeng Xia, Chaochao Li, Hongzhao Li, Chendi Ning, Shupan Li
Reinforcement Learning
AdaInertia: Dynamic Tool Usage Inertia Control via Deep Q-Learning for Efficient LLM Agent Reasoning
Yanxi Hu, Yanjie Zhao, Yiwen Huang, Guangqi Dong, Baoming Zhang, Mingyu Di, Chongjun Wang
Reinforcement Learning
Heterogeneous Graph-Enhanced MADDPG for UAV Swarm Formation Control
Xiaolong Lv, Buyun Xu
Reinforcement Learning
SafeRecovery: A Safety-Recovery Benchmark with Four-Axis Evaluation for Quadruped Locomotion
Yaozeng Huang, Ziyi Zhang, Shuhao Jiang, Jingjie Li, Yifan Wang, Yanyun Zhou, Fei Shi
Session 2
Chair: Md Rakib Hossain
Online Room B
Reinforcement Learning
Task-driven State Representation for Long-horizon World Model
Tingting Zhao, Jiaxin Huang, Zeyan He, Huijuan Zhang, Jianzheng Liu, Yuan Wang
Reinforcement Learning
Transferring FX Features and WDLP Heads to Accelerate AlphaZero for Gomoku
Md Rakib Hossain, Xingyu Liu, Chuan Li