Improving the Physics of Video Generation with VJEPA-2 Reward Signal
Jianhao Yuan, Xiaofeng Zhang, Felix Friedrich, Nicolas Beltran-Velez, Melissa Hall, Reyhane Askari-Hemmat, Xiaochuang Han, Nicolas Ballas, Michal Drozdzal, Adriana Romero-Soriano
机构
*
FAIR, Meta Superintelligence Labs(FAIR、Meta超智能实验室)
;
University of Oxford(牛津大学)
;
Mila - Québec AI Institute(魁北克人工智能研究所)
;
Université de Montréal(蒙特利尔大学)
;
Columbia University(哥伦比亚大学)
;
McGill University(麦吉尔大学)
;
Canada CIFAR AI Chair(加拿大CIFAR人工智能 chair)
专题命中
预训练与数据
:pretraining(abstract)
Comments2 pages
Journal refWinning entry of the ICCV 2025 Physics IQ Challenge
机构
*
Department of Computer Engineering and Digital Technology, Faculty of Engineering, Chulalongkorn University(朱拉隆梭大学工程学院计算机工程与数字技术系)
;
Faculty of Engineering, Thammasat School of Engineering, Thammasat University(泰国 Thammasat 大学工程学院)
;
Artificial Intelligence Association of Thailand(泰国人工智能协会)
;
School of Biomedical Engineering & Imaging Sciences, King’s College London(伦敦国王学院生物医学工程与成像科学学院)
;
Siriraj Informatics and Data Innovation Center (SIData+), Faculty of Medicine, Siriraj Hospital, Mahidol University(玛希诺大学医学学院西里拉医院信息与数据创新中心(SIData+))
专题命中
指令微调
:LLM(title);large language model(abstract);language model(abstract);SFT(abstract)
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心)
;
Chinese Academy of Sciences(中国科学院)
;
BOSS Zhipin Career Science Lab(BOSS智联招聘科研实验室)
专题命中
指令微调
:prompting(title);LLM(abstract);large language model(abstract);language model(abstract)
ENTP: Enhancing Low-Quality SFT Data via Neural-Symbolic Text Purge-Mix
Zile Yang, Ling Li, Na Di, Jinlong Pang, Yao Zhou, Hao Cheng, Bo Han, Jiaheng Wei
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
;
University of California, Santa Cruz(加州大学圣克鲁兹分校)
;
Hong Kong Baptist University(香港 Baptist 大学)
专题命中
指令微调
:SFT(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL
Less is More: Local Intrinsic Dimensions of Contextual Language Models
Benjamin Matthias Ruppik, Julius von Rohrscheidt, Carel van Niekerk, Michael Heck, Renato Vukovic, Shutong Feng, Hsien-chin Lin, Nurul Lubis, Bastian Rieck, Marcus Zibrowius, Milica Gašić
机构
*
Faculty of Mathematics and Natural Sciences, Heinrich Heine University Düsseldorf(明斯特大学数学与自然科学学院)
;
Institute of AI for Health, Helmholtz Munich(健康人工智能研究所)
;
Technical University of Munich(慕尼黑技术大学)
;
University of Fribourg(弗里堡大学)
专题命中
指令微调
:language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG;LLM(comments)
AnyECG-Lab: An Exploration Study of Fine-tuning an ECG Foundation Model to Estimate Laboratory Values from Single-Lead ECG Signals
Yujie Xiao, Gongzhen Tang, Wenhui Liu, Jun Li, Guangkun Nie, Zhuoran Kan, Deyun Zhang, Qinghao Zhao, Shenda Hong
机构
*
Institute of Medical Technology, Peking University Health Science Center(北京大学人民医院医学技术研究所)
;
National Institute of Health Data Science, Peking University(北京大学国家健康数据科学研究院)
;
School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院)
;
HeartVoice Medical Technology(心声医疗技术)
;
Department of Cardiology, Peking University People’s Hospital(北京大学人民医院心内科)
;
Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)
;
State Key Laboratory of Vascular Homeostasis and Remodeling, NHC Key Laboratory of Cardiovascular Molecular Biology and Regulatory Peptides, Peking University(国家心血管病分子生物学与调节肽重点实验室,北京大学)
Self-Calibrated Consistency can Fight Back for Adversarial Robustness in Vision-Language Models
Jiaxiang Liu, Jiawei Du, Xiao Liu, Prayag Tiwari, Mingkun Xu
机构
*
Guangdong Institute of Intelligence Science and Technology(广东智能科学与技术研究院)
;
Agency for Science, Technology and Research(科技研究局)
;
School of Information Technology(信息技术学院)
VideoTG-R1: Boosting Video Temporal Grounding via Curriculum Reinforcement Learning on Reflected Boundary Annotations
Lu Dong, Haiyu Zhang, Han Lin, Ziang Yan, Xiangyu Zeng, Hongjie Zhang, Yifei Huang, Yi Wang, Zhen-Hua Ling, Limin Wang, Yali Wang
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Beihang University(北京航空航天大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Zhejiang University(浙江大学)
;
State Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室)
;
Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所)
专题命中
指令微调
:large language model(abstract);language model(abstract);SFT(abstract)
专题命中
指令微调
:large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
CommentsPresented at the Workshop on Preparing Good Data for Generative AI: Challenges and Approaches (Good-Data) in conjunction with AAAI 2025. The authors retain the copyright
Journal refWorkshop on Preparing Good Data for Generative AI: Challenges and Approaches, 2025
EndoSfM3D: Learning to 3D Reconstruct Any Endoscopic Surgery Scene using Self-supervised Foundation Model
Changhao Zhang, Matthew J. Clarkson, Mobarak I. Hoque
机构
*
UCL Hawkes Institute(UCL哈维斯研究所)
;
Department of Medical Physics(医学物理系)
;
Biomedical Engineering, University College London, UK(生物医学工程,伦敦大学学院,英国)
;
Division of Informatics, Imaging and Data Sciences, The University of Manchester, Manchester, UK(信息学、成像与数据科学部门,曼彻斯特大学,曼彻斯特,英国)
A Guardrail for Safety Preservation: When Safety-Sensitive Subspace Meets Harmful-Resistant Null-Space
Bingjie Zhang, Yibo Yang, Zhe Ren, Dandan Guo, Jindong Gu, Philip Torr, Bernard Ghanem
机构
*
School of Artificial Intelligence, Jilin University(吉林大学人工智能学院)
;
King Abdullah University of Science and Technology(卡塔尔国王大学科学与技术研究院)
;
University of Oxford(牛津大学)
专题命中
指令微调
:large language model(abstract);language model(abstract);分类 cs.AI