ViSA: Visited-State Augmentation for Generalized Goal-Space Contrastive Reinforcement Learning
ViSA:基于已访问状态的通用目标空间对比强化学习增强
Issa Nakamura, Tomoya Yamanokuchi, Yuki Kadokawa, Jia Qu, Shun Otsub, Ken Miyamoto, Shotaro Miwa, Takamitsu Matsubara
机构
*
Graduate School of Information Science, Nara Institute of Science and Technology (NAIST)(信息科学研究生院,奈良科学与技术研究所)
;
Advanced Technology R&D Center, Mitsubishi Electric Corporation(三菱电机先进技术研发中心)
System Design of the Ultra Mobility Vehicle: A Driving, Balancing, and Jumping Bicycle Robot
超机动车辆的系统设计:一种能骑行、平衡和跳跃的自行车机器人
Benjamin Bokser, Daniel Gonzalez, Aaron Preston, Alex Bahner, Annika Wollschläger, Arianna Ilvonen, Asa Eckert-Erdheim, Ashwin Khadke, Bilal Hammoud, Dean Molinaro, Fabian Jenelten, Henry Mayne, Howie Choset, Igor Bogoslavskyi, Itic Tinman, James Tigue, Jan Preisig, Kaiyu Zheng, Kenny Sharma, Kim Ang, Laura Lee, Liana Margolese, Nicole Lin, Oscar Frias, Paul Drews, Ravi Boggavarapu, Rick Burnham, Samuel Zapolsky, Sangbae Kim, Scott Biddlestone, Sean Mayorga, Shamel Fahmi, Surya Singh, Tyler McCollum, Velin Dimitrov, William Moyne, Yu-Ming Chen, Farbod Farshidian, Marco Hutter, David Perry, Al Rizzi, Gabe Nelson
机构
*
Robotics and AI Institute (RAI)(机器人与人工智能研究所)
;
Robotics Institute(机器人研究所)
;
Carnegie Mellon University(卡内基梅隆大学)
Actor-Accelerated Policy Dual Averaging for Reinforcement Learning in Continuous Action Spaces
策略双平均加速器在连续动作空间强化学习中的应用
Ji Gao, Caleb Ju, Guanghui Lan, Zhaohui Tong
机构
*
School of Chemical and Biomolecular Engineering, Georgia Institute of Technology, GA, USA(化学与生物分子工程学院,佐治亚理工学院,美国加利福尼亚州)
;
H. Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Technology, GA, USA(H.米尔顿·斯图尔特工业与系统工程学院,佐治亚理工学院,美国加利福尼亚州)
CDE: Concept-Driven Exploration for Reinforcement Learning
CDE:基于概念的强化学习探索
Le Mao, Andrew H. Liu, Renos Zabounidis, Yanan Niu, Zachary Kingston, Joseph Campbell
机构
*
Department of Electrical and Computer Engineering, Purdue University(电子工程系,普渡大学)
;
Department of Computer Science, Purdue University(计算机科学系,普渡大学)
;
Robotics Institute, Carnegie Mellon University(机器人研究所,卡内基梅隆大学)
;
Department of Management of Technology, EPFL(技术管理系,瑞士联邦理工学院)
Open-World Reinforcement Learning over Long Short-Term Imagination
开放世界长期短期想象强化学习
Jiajian Li, Qi Wang, Yunbo Wang, Xin Jin, Yang Li, Wenjun Zeng, Xiaokang Yang
机构
*
MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(人工智能大模型关键实验室、人工智能研究院、上海交通大学)
;
Ningbo Institute of Digital Twin, Eastern Institute of Technology(宁波数字孪生研究院、技术东院)
;
School of Computer Science and Technology, East China Normal University(计算机科学与技术学院、华东师范大学)
Imagine a City: CityGenAgent for Procedural 3D City Generation
想象一座城市:CityGenAgent用于程序化3D城市生成
Zishan Liu, Zecong Tang, RuoCheng Wu, Xinzhe Zheng, Jingyu Hu, Ka-Hei Hui, Haoran Xie, Bo Dai, Zhengzhe Liu
机构
*
Lingnan University, Hong Kong SAR, China(岭南大学)
;
Zhejiang University, Hangzhou, China(浙江大学)
;
The Chinese University of Hong Kong, Hong Kong SAR, China(香港中文大学)
;
Autodesk AI Lab, Canada(Autodesk AI实验室)
;
The University of Hong Kong, Hong Kong SAR, China(香港大学)
Hannes Homburger, Katrin Baumgärtner, Moritz Diehl, Johannes Reuter
机构
*
Institute of System Dynamics, HTWG Konstanz - University of Applied Sciences(系统动力学研究所,霍特廷根应用科学大学)
;
Department of Microsystems Engineering (IMTEK), University of Freiburg(微系统工程系(IMTEK),弗赖堡大学)
;
Department of Microsystems Engineering (IMTEK)(微系统工程系(IMTEK))
;
Department of Mathematics, University of Freiburg(数学系,弗赖堡大学)
Comments6 pages, 3 figures, submitted to the IFAC World Congress 2026, parts of this preprint are directly taken from Chapter 3 of the main author's PhD thesis with title "Optimal Control for Efficient Vessel Operation: From Theory to Real-World Applications"
机构
*
School of Data Science, The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)数据科学学院)
;
Graduate School of Engineering Science, Osaka University, Japan(大阪大学工学研究科)
;
Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences, China(中国科学院深圳先进技术研究院)
;
Department of Electrical and Electronic Engineering, The Hong Kong Polytechnic University, Hong Kong SAR, China(香港理工大学电子与电气工程系)
;
School of Transportation, Southeast University, China(东南大学交通运输学院)
Towards Bridging the Gap between Large-Scale Pretraining and Efficient Finetuning for Humanoid Control
迈向大规模预训练与高效微调之间的人形机器人控制的桥梁
Weidong Huang, Zhehan Li, Hangxin Liu, Biao Hou, Yao Su, Jingwen Zhang
机构
*
State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI)
;
School of Artificial Intelligence, Xidian University(人工智能学院,西安电子科技大学)
How Swarms Differ: Challenges in Collective Behaviour Comparison
群集行为的差异:集体行为比较中的挑战
André Fialho Jesus, Jonas Kuckling
机构
*
Department of Computer and Information Science(计算机与信息科学系)
;
Centre for the Advanced Study of Collective Behaviour(集体行为高级研究中心)
;
Zukunftskolleg(未来学院)