CheXPO-v2: Preference Optimization for Chest X-ray VLMs with Knowledge Graph Consistency
CheXPO-v2:基于知识图谱一致性的胸片视觉-语言模型偏好优化
Xiao Liang, Yuxuan An, Di Wang, Jiawei Hu, Zhicheng Jiao, Bin Jing, Quan Wang
机构
*
School of Computer Science and Technology, Xidian University(西安电子科技大学计算机科学与技术学院)
;
Warren Alpert Medical School of Brown University(布朗大学沃伦·阿尔珀特医学学院)
;
School of Biomedical Engineering, Capital Medical University(首都医科大学生物医学工程学院)
Comments6 pages, 3 figures, Accepted for publication in Control System Letters (L-CSS) with the possibility of presenting at the American Control Conference (ACC) 2026
LookAhead Tuning: Safer Language Models via Partial Answer Previews
LookAhead Tuning: 通过部分答案预览实现更安全的语言模型
Kangwei Liu, Mengru Wang, Yujie Luo, Lin Yuan, Mengshu Sun, Lei Liang, Zhiqiang Zhang, Jun Zhou, Bryan Hooi, Shumin Deng
机构
*
Zhejiang University(浙江大学)
;
Zhejiang University - Ant Group Joint Laboratory of Knowledge Graph(浙江大学-蚂蚁集团知识图谱联合实验室)
;
Ant Group(蚂蚁集团)
;
National University of Singapore(新加坡国立大学)
SpecCLIP: Aligning and Translating Spectroscopic Measurements for Stars
SpecCLIP:对齐和翻译恒星光谱测量
Xiaosheng Zhao, Yang Huang, Guirong Xue, Xiao Kong, Jifeng Liu, Xiaoyu Tang, Timothy C. Beers, Yuan-Sen Ting, A-Li Luo
机构
*
School of Astronomy
;
Space Science, University of Chinese Academy of Sciences, Beijing 100049, People's Republic of China
;
National Astronomical Observatories, Chinese Academy of Sciences, Beijing 100012, People's Republic of China
;
Department of Physics \& Astronomy, The Johns Hopkins University, Baltimore, MD 21218, USA
;
Zhejiang Laboratory, Hangzhou 311121, People's Republic of China
;
Research Center for Astronomical Computing, Zhejiang Laboratory, Hangzhou 311121, People's Republic of China
;
Department of Physics
;
Astronomy, University of Notre Dame, Notre Dame, IN 46556, USA
;
Joint Institute for Nuclear Astrophysics -- Center for the Evolution of the Elements (JINA-CEE), USA
;
Department of Astronomy, The Ohio State University, 140 West 18th Avenue, Columbus, OH 43210, USA
;
Center for Cosmology
;
AstroParticle Physics (CCAPP), The Ohio State University, Columbus, OH 43210, USA
专题命中
幻觉与事实性
:alignment(abstract);分类 cs.AI、cs.LG
AI总结
SpecCLIP通过对比学习和光谱意识解码器提升恒星光谱分析的精度和应用灵活性。
Comments29 pages, 8 figures, 6 tables. Accepted for publication in ApJ. Comments welcome
On the dynamic evolution of CLIP texture-shape bias and its relationship to human alignment and model robustness
CLIP纹理-形状偏倚的动态演变及其与人类对齐和模型鲁棒性的关系
Pablo Hernández-Cámara, Jose Manuel Jaén-Lorites, Alexandra Gómez-Villa, Jorge Vila-Tomás, Valero Laparra, Jesus Malo
机构
*
Image Processing Lab, Universitat de Valencia, Spain(瓦伦西亚大学图像处理实验室)
;
Centro de Biomateriales e Ingenieria Tisular, Universitat Politecnica de Valencia, Spain(瓦伦西亚理工大学生物材料与组织工程中心)
;
Computer Vision Center, Spain(西班牙计算机视觉中心)
;
Universitat Autònoma de Barcelona, Spain(巴塞罗那自治大学)
An Anatomy of Vision-Language-Action Models: From Modules to Milestones and Challenges
视觉-语言-动作模型的解剖:从模块到里程碑与挑战
Chao Xu, Suyu Zhang, Yang Liu, Baigui Sun, Weihong Chen, Bo Xu, Qi Liu, Juncheng Wang, Shujun Wang, Shan Luo, Jan Peters, Athanasios V. Vasilakos, Stefanos Zafeiriou, Jiankang Deng
机构
*
IROOTECH TECHNOLOGY(IROOTECH技术公司)
;
Wolf 1069 b Lab, Sany Group(Sany集团沃尔夫1069b实验室)
;
Department of Engineering, King’s College London(伦敦国王学院工程系)
;
Hong Kong Polytechnic University(香港理工大学)
;
Computer Science Department of the Technische Universität Darmstadt(德累斯顿技术大学计算机科学系)
;
Department of ICT and Center for AI Research, University of Agder (UiA)(阿格德大学信息与通信技术系及人工智能研究中心)
;
Department of Computing, Imperial College London(伦敦帝国理工学院计算系)
EDVD-LLaMA: Explainable Deepfake Video Detection via Multimodal Large Language Model Reasoning
EDVD-LLaMA: 通过多模态大语言模型推理进行可解释的深度伪造视频检测
Haoran Sun, Chen Cai, Huiping Zhuang, Kong Aik Lee, Lap-Pui Chau, Yi Wang
机构
*
Department of Electrical and Electronic Engineering, The Hong Kong Polytechnic University(电子与电气工程系,香港理工大学)
;
School of Electrical and Electronic Engineering, Nanyang Technological University(电子与电气工程学院,南洋理工大学)
;
Shien-Ming Wu School of Intelligent Engineering, South China University of Technology(智能工程学院,华南理工大学)
MolMark: Safeguarding Molecular Structures through Learnable Atom-Level Watermarking
MolMark:通过可学习的原子级水印保障分子结构
Runwen Hu, Peilin Chen, Keyan Ding, Shiqi Wang
机构
*
Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系)
;
ZJU-Hangzhou Global Scientific and Technological Innovation Center, Zhejiang University(浙江大学杭州全球科技创新中心)
机构
*
AI Agent Lab, Vokram Group, United Kingdom(AI代理实验室,Vokram集团,英国)
;
University of Bologna, Italy(博洛尼亚大学,意大利)
;
University of Minnesota, United States(明尼苏达大学,美国)
;
Singapore General Hospital, Singapore(新加坡中央医院,新加坡)
;
Emory University, United States(埃默里大学,美国)
Designing an LLM-Based Behavioral Activation Chatbot for Young People with Depression: Insights from an Evaluation with Artificial Users and Clinical Experts
设计一个基于LLM的行为激活聊天机器人以帮助有抑郁症的青少年:基于人工用户和临床专家评估的见解
Florian Onur Kuhlmeier, Leon Hanschmann, Melina Rabe, Stefan Luettke, Eva-Lotta Brakemeier, Alexander Maedche
Deadlock-Free Hybrid RL-MAPF Framework for Zero-Shot Multi-Robot Navigation
无死锁的混合式RL-MAPF框架用于零样本多机器人导航
Haoyi Wang, Licheng Luo, Yiannis Kantaros, Bruno Sinopoli, Mingyu Cai
机构
*
Department of Mechanical Engineering University of California Riverside CA USA(加州大学河滨分校机械工程系)
;
Department of Electrical and Systems Engineering Washington University in St. Louis MO USA(华盛顿大学圣路易斯分校电气与系统工程系)