AnyTask: an Automated Task and Data Generation Framework for Advancing Sim-to-Real Policy Learning
AnyTask: 一种用于推进仿真到现实策略学习的任务和数据生成框架
Ran Gong, Xiaohan Zhang, Jinghuan Shang, Maria Vittoria Minniti, Jigarkumar Patel, Valerio Pepe, Riedana Yan, Ahmet Gundogdu, Ivan Kapelyukh, Ali Abbas, Xiaoqiang Yan, Harsh Patel, Laura Herlant, Karl Schmeckpeper
机构
*
School of Integrated Circuits, Zhejiang University(浙江大学集成电路学院)
;
Shanghai Innovation Institute(上海创新研究院)
;
School of Electrical and Electronic Engineering (EEE), Nanyang Technological University(南洋理工大学电子与电气工程学院)
;
School of Data Science, Fudan University(复旦大学数据科学学院)
机构
*
School of Biomedical Engineering, Southern Medical University(生物医学工程学院,南方医科大学)
;
School of Biomedical Engineering, Shanghai Jiaotong University(生物医学工程学院,上海交通大学)
;
Department of Electronic Engineering, Chinese University of Hong Kong(电子工程系,中国香港大学)
;
Faculty of Dentistry, The University of Hong Kong(牙科学院,香港大学)
;
Department of Nuclear Medicine, The Second Affiliated Hospital of Guangzhou University of Chinese Medicine(核医学科,广州中医药大学第二附属医院)
;
PET Center, Department of Nuclear Medicine, Guangdong Provincial People’s Hospital, Southern Medical University(PET中心,核医学科,广东省人民医院,南方医科大学)
;
Department of Nuclear Medicine, Nanfang Hospital, Southern Medical University(核医学科,南芳医院,南方医科大学)
;
Division of Nuclear Medicine and Molecular Imaging, Geneva University Hospitals(核医学与分子影像学部,日内瓦大学医院)
;
Departments of Radiology, Physics, and Biomedical Engineering, The University of British Columbia(放射学、物理和生物医学工程系,不列颠哥伦比亚大学)
;
Medical Artificial Intelligence Laboratory, Westlake University(医学人工智能实验室,西湖大学)
专题命中
VLM训练与架构
:multimodal large language model(abstract);分类 cs.CV
机构
*
School of Data Science, The Chinese University of Hong Kong, Shenzhen(数据科学学院,香港中文大学(深圳))
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Department of Dermatology, The First Affiliated Hospital, Shantou University Medical College(皮肤科,汕头大学医学院第一附属医院)
专题命中
VLM训练与架构
:multimodal large language model(abstract);分类 cs.CV
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
Tencent Hunyuan(腾讯文元)
;
Huazhong University of Science and Technology(华中科技大学)
;
Peking University(北京大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Tsinghua University(清华大学)
;
Nanjing University(南京大学)
Adapting Vision-Language Foundation Model for Next Generation Medical Ultrasound Image Analysis
为下一代医学超声图像分析适应视觉-语言基础模型
Jingguo Qu, Xinyang Han, Jia Ai, Juan Wu, Tong Zhao, Tonghuan Xiao, Sheng Ning, Yuqi Yang, Jing Qin, Ann Dorothy King, Winnie Chiu-Wing Chu, Jing Cai, Michael Tin-Cheung Ying
机构
*
Department of Health Technology and Informatics, The Hong Kong Polytechnic University(健康科技与信息学系,香港理工大学)
;
Centre for Smart Health and School of Nursing, The Hong Kong Polytechnic University(智能健康中心及护理学院,香港理工大学)
;
Department of Imaging and Interventional Radiology, The Chinese University of Hong Kong(影像与介入放射学系,香港中文大学)
;
Suzhou Hospital of Traditional Chinese Medicine Affiliated to Nanjing University of Chinese Medicine(南京中医药大学附属苏州中医医院)
;
Department of Ultrasound, The Affiliated Changzhou No. 2 People's Hospital of Nanjing Medical University(南京医科大学附属常州第二人民医院超声科)
Ander Alvarez, Alessandro Genuardi, Nilotpal Sinha, Antonio Tiene, Mikail Okyay, Bakbergen Ryskulov, David Montero, Samuel Mugel, Román Orús
机构
*
Multiverse Computing
;
Donostia International Physics Center
;
Ikerbasque Foundation for Science
;
Multiverse Computing, Centre for Social Innovation
Lessons from Neuroscience for AI: How integrating Actions, Compositional Structure and Episodic Memory could enable Safe, Interpretable and Human-Like AI
从神经科学中汲取教训:如何通过整合动作、组合结构和事件记忆来实现安全、可解释和类人的人工智能
Rajesh P. N. Rao, Vishwas Sathish, Linxing Preston Jiang, Matthew Bryan, Prashant Rangarajan
Fixed-Budget Parameter-Efficient Training with Frozen Encoders Improves Multimodal Chest X-Ray Classification
固定预算参数高效训练结合冻结编码器提升多模态胸片分类
Md Ashik Khan, Md Nahid Siddique
机构
*
Department of Computer Science and Engineering, Indian Institute of Technology Kharagpur, India(计算机科学与工程系,印度理工学院Kharagpur分校)
;
Knight Foundation School of Computing and Information Sciences, Florida International University, Florida, USA(骑士基金会计算与信息科学学院,佛罗里达国际大学)
RLLaVA: An RL-central Framework for Language and Vision Assistants
RLLaVA: 一种面向语言和视觉助手的强化学习中心框架
Lei Zhao, Zihao Ma, Boyu Lin, Yuhe Liu, Wenjun Wu, Lei Huang
机构
*
SKLCCSE, Institute of Artificial Intelligence, Beihang University, Beijing, China(信息与电子技术学院,人工智能研究院,北京航空航天大学,北京,中国)
;
Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, Beihang University(未来区块链与隐私计算先进创新中心,北京航空航天大学)
;
Hangzhou International Innovation Institute, Beihang University, Hangzhou, China(杭州国际创新研究院,北京航空航天大学,杭州,中国)
机构
*
School of Electronic Engineering, Xidian University(电子科技大学电子工程学院)
;
School of Computer Science and Technology, Xidian University(电子科技大学计算机科学与技术学院)
;
Hohai university(河海大学)
;
Institute for Infocomm Research (I 2 R), A*STAR(信息通信研究所(I2R))
;
School of Foreign Languages, Xidian University(电子科技大学外国语言学院)
Robotic VLA Benefits from Joint Learning with Motion Image Diffusion
机器人VLA通过与运动图像扩散的联合学习获益
Yu Fang, Kanchana Ranasinghe, Le Xue, Honglu Zhou, Juntao Tan, Ran Xu, Shelby Heinecke, Caiming Xiong, Silvio Savarese, Daniel Szafir, Mingyu Ding, Michael S. Ryoo, Juan Carlos Niebles