arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-08-25 至 2026-08-25 共收录 22
2608.23353 2026-08-25 cs.CL cs.NE 新提交

FormuEvo: LLM-Guided Evolution for Discovering Solver-Efficient Mixed-Integer Programming Formulations

FormuEvo:大语言模型引导的进化算法用于发现求解器高效的混合整数规划模型

Haofeng Yuan, Jianing Peng, Jieyi Bi, Ni Zhang, Shiji Song, Zhiguang Cao

机构 * College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) School of Computing and Information Systems, Singapore Management University(新加坡管理大学计算与信息系统学院) Tsinghua University(清华大学)

AI总结 FormuEvo是LLM引导的进化框架,将MIP模型设计转化为符号空间的进化优化,结合求解器感知诊断与结构化内存,发现的MIP模型性能远超专家设计及现有LLM方法,求解加速最高达5.5倍且知识可跨场景迁移。

Comments 27 pages, 6 figures, and 9 tables. To appear in the Proceedings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23329 2026-08-25 cs.CV cs.AI 新提交

Thinking Beyond Videos: Unifying Video Reasoning and Deep Research for Open-World Video Agents

超越视频:统一视频推理与深度研究的开放世界视频智能体

Wenqi Liu, Shijie Ma, Yunxiao Wang, Meng Liu, Qile Su, Han Liu, Bohan Hou, Xuanyu Zheng, Changyi Liu, Tianke Zhang, Haonan Fan, Kaiyu Jiang, Yingxin Li, Jiankang Chen, Xu Wang, Bin Wen, Tingting Gao, Han Li, Jianhua Yin, Yinwei Wei, Xuemeng Song

机构 * Shandong University(山东大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beihang University(北京航空航天大学) City University of Hong Kong(香港城市大学) Nanyang Technological University(南洋理工大学) Kuaishou Technology(快手科技) Southern University of Science and Technology(南方科技大学)

AI总结 本研究提出统一视频推理与深度研究的VideoRover框架,构建相关数据集与基准,其8B-RL模型在无工具直接回答场景性能接近专有模型,优于同工具套件的更大开源模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23253 2026-08-25 cs.CV cs.AI 新提交

E2S-Pruner: Progressive Two-Stage Evidence Fusion for Visual Token Pruning in Vision-Language Models

E2S-Pruner:用于视觉-语言模型中视觉令牌剪枝的渐进式两阶段证据融合方法

Taoyu Qian, Qi Wang, Daqian Shi, Yuanhao Jiang, Shang Gao, Hualong Yu

机构 * Digital Environment Research Institute (DERI), Queen Mary University of London(伦敦大学玛丽女王学院数字环境研究所(DERI)) Shanghai Institute of Artificial Intelligence for Education, East China Normal University(华东师范大学上海人工智能教育研究院) National Institute of Education, Nanyang Technological University(南洋理工大学国家教育学院) School of Computer Science and Engineering, Jiangsu University of Science and Technology(江苏科技大学计算机科学与工程学院)

AI总结 本文提出无需额外参数或微调的E2S-Pruner,通过两阶段证据融合实现视觉-语言模型的视觉令牌剪枝,在LLaVA-1.5-7B上显著提升吞吐量并保留性能,且具跨模型泛化性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22804 2026-08-25 cs.LG 新提交

Contrastive Representation-Guided Genetic Minority Oversampling for Imbalanced Time-Series Classification

用于不平衡时间序列分类的对比表示引导遗传少数类过采样

Wenbin Pei, Yunrong Hao, Zhen Liu, Guan Wang, Bing Xue, Yiu-Ming Cheung, Qiang Zhang

机构 * Dalian University of Technology(大连理工大学) Nanyang Technological University(南洋理工大学)

AI总结 针对不平衡时间序列分类中现有过采样方法泛化与多样性不足的问题,提出FreMGP方法,结合对比学习的频域判别表示引导多树遗传规划,实验证明其性能优于现有方法并提升各类分类器表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22701 2026-08-25 cs.RO 新提交

Physics Filtering Favors the Generalization of Robot Learning

物理滤波有利于机器人学习的泛化

Jindou Jia, Shixuan Han, Meng Wang, Gen Li, Zihan Yang, Sicheng Zhou, Kexin Guo, Jianfei Yang, Xiang Yu, Wei Wang, Lei Guo

机构 * Nanyang Technological University(南洋理工大学) Beihang University(北京航空航天大学) National University of Singapore(新加坡国立大学) Beijing Aerospace Control Instrument Research Institute(北京航天测控仪器研究所)

AI总结 该研究提出轻量、模型无关的 PhyFilter 反馈机制,无需海量训练数据,即可提升机器人在动态不确定性下的泛化能力,在四类机器人系统上验证了其有效性。

Comments Accepted by npj Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22368 2026-08-25 cs.CV 新提交

DiD It in 87 Minutes: A Label-Free Softmax-to-Linear Adaptation of Vision Transformers for Object Detection

87分钟完成:一种用于目标检测的无标签Vision Transformer从Softmax到线性注意力的适配方法

Huaiyuan Qin, Gabriel James Goenawan, Zihang Lin, Muli Yang, Hongyuan Zhu

机构 * Institute of Advanced Intelligence and Computing (IAIC), A*STAR(先进智能与计算研究所(IAIC),新加坡科技研究局) Nanyang Technological University(南洋理工大学)

AI总结 本研究提出无标签的DiD方法,通过对齐检测器接口张量,将Softmax注意力ViT主干转换为线性注意力主干,在DOTA-v1.5上性能优异且耗时短,能大幅降低检测的推理延迟与内存占用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22326 2026-08-25 cs.RO 新提交

GCS-Bridging: Restoring Connectivity of Disconnected Convex Sets for Graph-of-Convex-Sets Motion Planning

GCS-Bridging:恢复凸集图运动规划中断开凸集的连通性

Xiaokai Zhou, Baoshi Cao, Yang Liu, Kui Sun, Boyu Ma, Zhengpu Wang, Zongwu Xie

机构 * State Key Laboratory of Robotics and Systems, Harbin Institute of Technology(哈尔滨工业大学机器人技术与系统国家重点实验室) School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与航天工程学院)

AI总结 针对凸集图(GCS)规划中起始与目标区域断开的问题,提出GCS-Bridging方法,通过无碰撞点路径与凸集膨胀恢复连通性,模拟与硬件实验验证其高成功率与实用性。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22238 2026-08-25 cs.CV 新提交

Hyper^2: Unleashing Hyperbolic Geometry's Full Potential via Dual-Space Consistency

Hyper^2:通过双空间一致性释放双曲几何的全部潜力

Guantian Zheng, Haiyang Xu, Tianyu Gao

机构 * Nanyang Technological University(南洋理工大学) Harbin Institute of Technology(哈尔滨工业大学) Sichuan University(四川大学)

AI总结 本文针对点云补全中双曲几何应用的跨几何不匹配问题,提出双空间一致性框架Hyper^2,在SVDFormer上实现显著的Chamfer距离降低,验证了编码器与损失几何一致性的重要性。

Comments 18 pages, 5 figures, 5 tables. Accepted to BMVC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22217 2026-08-25 cs.CV 新提交

UR$^{2}$-MLLM: Uncertainty-aware Revisit Reasoning in Multimodal Large Language Models for Radiology Report Generation

UR²-MLLM:面向放射科报告生成的多模态大语言模型中基于不确定性感知的重访推理

Yucheng Chen, Yang Yu, Jiazhou Zhou, Yufei Shi, Yongying Lan, Yichi Zhang, Liyi Li, Si Yong Yeo

机构 * MedVisAI Lab(MedVisAI实验室) Lee Kong Chian School of Medicine, Nanyang Technological University(南洋理工大学李光前医学院) Centre of AI in Medicine, Singapore(新加坡医学人工智能中心) AI Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)AI方向) Ruijin Hospital, Shanghai Jiao Tong University School of Medicine(上海交通大学医学院附属瑞金医院)

AI总结 该研究针对放射科报告生成任务,提出UR²-MLLM框架,通过动态重访不确定区域的机制实现最优性能,提升报告的可靠性与临床适配性。

Comments EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22003 2026-08-25 cs.CV 新提交

Close Shortcut Wins Long: Seeking Diverse and Stable Generators for Data-Free Knowledge Distillation

短捷径胜长方法:为无数据知识蒸馏寻求多样且稳定的生成器

Kailin Lyu, Zherui Zhang, Junhao Dong, Kexue Fu, Weiguang Pang, Rongtao Xu, Qizheng Wang, Di Wu, Chee-Keong Kwoh, Longxiang Gao, Shibiao Xu, Changwei Wang, Ce Hao, Yu Zhang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Zhongguancun Academy(中关村学院) School of Artificial Intelligence, Beijing University of Posts and Telecommunications(北京邮电大学人工智能学院) School of Computer Science and Engineering, Nanyang Technological University(南洋理工大学计算机科学与工程学院) Shandong Computer Science Center(山东省计算机科学中心) Spatialtemporal AI(时空人工智能公司) Tongji University(同济大学)

AI总结 针对无数据知识蒸馏中生成器的频域捷径学习与训练不稳定问题,提出CSWL框架,通过特征级频域增强和CSFR辅助任务提升生成器多样性与稳定性,经多类图像数据集验证有效。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21815 2026-08-25 cs.LG 新提交

Resilient Concurrent Causal Discovery for Topological Event Sequences

面向拓扑事件序列的鲁棒并发因果发现

Jiyu Tian, Junhao Dong, Mingchu Li, Lingling Fang, Liming Chen, Andreas Holzinger, Zheng Yan, Yew Soon Ong

机构 * School of Software Technology, Dalian University of Technology(大连理工大学软件学院) School of Computer and Information Engineering, Jiangxi Normal University(江西师范大学计算机与信息工程学院) School of Computer Science and Technology, Dalian University of Technology(大连理工大学计算机科学与技术学院) School of Computer Science and Artificial Intelligence, Liaoning Normal University(辽宁师范大学计算机科学与人工智能学院) University of Natural Resources and Life Sciences (BOKU)(自然资源与生命科学大学(BOKU)) Hangzhou Institute of Technology, Xidian University(西安电子科技大学杭州研究院) College of Computing & Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

AI总结 针对拓扑事件序列因果发现中并发事件因果关系难捕捉、对不完整序列鲁棒性差的问题,提出RCCD方法,经实验验证其在电信网络数据集上优于现有SOTA方法。

Comments 16 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22453 2026-08-25 cs.LG math.DG 新提交

Geometric Structures on Graphs: a Holonomy-Based Discretization of Curvature

图上的几何结构:基于和乐的曲率离散化方法

Hao Li, Yuhan Peng, Junwen Dong

机构 * National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Nankai University(南开大学)

AI总结 该研究提出基于和乐的图曲率离散化框架,引入两种聚合机制实现曲率相关响应的规范等变更新,经单位球校准验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14935 2026-08-25 cs.CV 版本更新

VideoChat3: Fully Open Video MLLM for Efficient and Generalist Video Understanding

VideoChat3:用于高效通用视频理解的全开放视频多模态语言模型

Xinhao Li, Yuhan Zhu, Xiangyu Zeng, Yuhao Dong, Haoning Wu, Zhiqiu Zhang, Yuandong Yang, Changlian Ma, Qingyu Zhang, Yansong Shi, Xinyu Chen, Haoran Chen, Zizheng Huang, Jun Zhang, Kun Ouyang, Lin Sui, Ziang Yan, Yicheng Xu, Chenting Wang, Yinan He, Hongjie Zhang, Yi Wang, Yu Qiao, Yali Wang, Ziwei Liu, Kai Chen, Limin Wang

机构 * Nanjing University(南京大学) Shanghai AI Laboratory(上海人工智能实验室) Nanyang Technological University(南洋理工大学) Peking University(北京大学)

AI总结 研究针对视频理解开源模型局限,提出VideoChat3。通过I3D-ViT等提升效率,利用可扩展视频数据合成管道生成训练数据集提升泛化性,以4B参数在多基准测试中超越同等或更多参数的开源模型,实现泛化与计算效率平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16151 2026-08-25 cs.CL 版本更新

GRACE: Step-Level Benchmark for Faithful Reasoning over Context

GRACE:基于上下文忠实推理的步骤级基准

Hoang Pham, Dong Le, Anh Tuan Luu

机构 * Nanyang Technological University(南洋理工大学) VinUniversity

AI总结 提出GRACE,首个带人工标注的步骤级忠实性基准,通过数据驱动错误分类法评估上下文推理中的链式思维步骤,并证明步骤级忠实信号可提升下游准确性和推理可靠性。

Comments Accepted at EMNLP Main 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29708 2026-08-25 cs.CL 版本更新

RASET: Router-Agnostic Safety-Critical Expert Tuning Exposes Localized Safety Enforcement Failures in Mixture-of-Experts LLMs

理解混合专家大语言模型中的安全敏感专家行为

Zhibo Zhang, Yuxi Li, Zhen Ouyang, Ling Shi, Kailong Wang

机构 * Huazhong University of Science and Technology, Wuhan, China(华中科技大学,武汉,中国) Nanyang Technological University, Singapore(南洋理工大学,新加坡)

AI总结 通过提出RASET框架,研究混合专家大语言模型中安全对齐与路由专家专业化之间的关系,发现路由模式主要由主题驱动,而安全行为可通过调整少数专家改变而不影响路由路径。

Comments 20 pages, 4 figures. Accepted by EMNLP 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07008 2026-08-25 cs.CV cs.LG 版本更新

Where Not to Learn: Prior-Aligned Training with Subset-based Attribution Constraints

不应学习的地方:基于子集归因约束的先验对齐训练以实现可靠的决策制定

Ruoyu Chen, Shangquan Sun, Xiaoqing Guo, Kangwei Liu, Sanyi Zhang, Zhangcheng Wang, Shiming Liu, Qunli Zhang, Wei Wang, Hua Zhang, Xiaochun Cao

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) University of Chinese Academy of Sciences(中国科学院大学) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) Department of Computer Science, Hong Kong Baptist University(香港 Baptist 大学计算机科学系) Communication University of China(中国传媒大学) Imperial College London(伦敦帝国学院) School of Cyber Science and Technology, Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区网络科学与技术学院)

AI总结 本文提出了一种基于归因的先验对齐方法,通过子集选择归因技术约束模型依赖于人类先验区域,从而提升决策的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00794 2026-08-25 cs.RO 版本更新

Detecting Heel Strike and toe off Events Using Kinematic Methods and LSTM Models

利用运动学方法和LSTM模型检测脚跟触地和脚尖离地事件

Longbin Zhang, Zhizhang Li, Xinyi Fu, Yi Xie, Zekun Liu, Xiaoyue Yan, Suiyuan Wang, Te Zhang, Hui Zhang, Kailun Yang, Tsung-Lin Wu, Prayook Jatesiktat, Ananda Sidarta, Wei Tech Ang

机构 * School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院) School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与航空航天工程学院) Fourth Hospital of Changsha, Hunan Normal University(长沙第四医院,湖南师范大学) Department of Stomatology, Hunan Provincial People’s Hospital, Hunan Normal University(湖南省级人民医院口腔科,湖南师范大学) Rehabilitation Research Institute of Singapore, Lee Kong Chian School of Medicine, Nanyang Technological University(新加坡康复研究中心,李光前医学院,南洋理工大学)

AI总结 本文评估了七种运动学方法和LSTM模型在检测脚跟触地和脚尖离地事件中的性能,发现Zeni等方法在运动学方法中准确率最高,而LSTM模型提供了无系统偏差的数据驱动替代方案。

Comments Accepted to the IEEE International Conference on Advanced Robotics and Mechatronics (ICARM), 2026. Best Presentation Award

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24357 2026-08-25 cs.LG cs.AI 版本更新

DPRM: A Plug-in Doob h transform-induced Token-Ordering Module for Discrete Diffusion Models

DPRM: 一种用于扩散语言模型的即插即用Doob h变换诱导的令牌排序模块

Dake Bu, Wei Huang, Andi Han, Si Wu, Hau-San Wong, Qingfu Zhang, Taiji Suzuki, Atsushi Nitanda

机构 * City University of Hong Kong(香港城市大学) The Institute of Statistical Mathematics(统计数学研究所) University of Sydney(悉尼大学) Nanyang Technological University(南洋理工大学) The University of Tokyo(东京大学)

AI总结 提出DPRM模块,通过在线估计从置信度驱动排序逐步过渡到过程奖励引导排序,改进扩散语言模型的令牌排序策略,在九种任务中提升性能。

Comments Extended Version of ICML 2026 Fogen (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20719 2026-08-25 cs.SD cs.AI cs.MM eess.AS 版本更新

ONOTE: Hypergraph-Grounded Omnimodal Reasoning for Computational Music Science

ONOTE:面向专家级音乐智能的多模态记谱处理基准测试

Menghe Ma, Siqing Wei, Yuecheng Xing, Ziyue Zhu, Zhenghong Lin, Yaheng Wang, Fanhong Meng, Peijun Han, Luu Anh Tuan, Haoran Luo

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出ONOTE基准测试,通过确定性流程消除记谱系统偏差,揭示多模态模型在感知准确性和音乐理论理解间的根本分歧。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16459 2026-08-25 cs.CL 版本更新

DynHD: Hallucination Detection for Diffusion Large Language Models via Denoising Dynamics Deviation Learning

DynHD: 通过去噪动态偏差学习检测扩散大语言模型的幻觉

Yanyu Qian, Yue Tan, Yixin Liu, Wang Yu, Shirui Pan

机构 * Nanyang Technological University, Singapore(新加坡南洋理工大学) Griffith University, Australia(澳大利亚格里菲斯大学)

AI总结 本文提出DynHD,通过空间和时间视角解决扩散大语言模型幻觉检测中的信息密度不均和去噪动态建模问题,采用语义感知证据构造模块和偏差检测器提升检测性能。

Comments Accepted by EMNLP 2026 Findings. 16 pages, 8 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04448 2026-08-25 cs.AI cs.CL cs.CV cs.LG cs.MA 版本更新

SkillNet: Create, Evaluate, and Connect AI Skills

SkillNet: 创建、评估和连接AI技能

Yuan Liang, Ruobin Zhong, Haoming Xu, Chen Jiang, Yi Zhong, Runnan Fang, Jia-Chen Gu, Shumin Deng, Yunzhi Yao, Mengru Wang, Shuofei Qiao, Yida Xue, Xin Xu, Tongtong Wu, Kun Wang, Yang Liu, Zhen Bi, Jungang Lou, Yuchen Eleanor Jiang, Hangcheng Zhu, Gang Yu, Haiwen Hong, Longtao Huang, Hui Xue, Chenxi Wang, Yijun Wang, Zifei Shan, Xi Chen, Zhaopeng Tu, Feiyu Xiong, Xin Xie, Peng Zhang, Zhengke Gui, Lei Liang, Jun Zhou, Chiyu Wu, Jin Shang, Yu Gong, Junyu Lin, Changliang Xu, Hongjie Deng, Wen Zhang, Keyan Ding, Qiang Zhang, Fei Huang, Ningyu Zhang, Jeff Z. Pan, Guilin Qi, Haofen Wang, Huajun Chen

机构 * Zhejiang University(浙江大学) Tongji University(同济大学) Southeast University(东南大学) Alibaba Group(阿里巴巴集团) Tencent(腾讯) Fudan University(复旦大学) The University of Edinburgh(爱丁堡大学) Monash University(墨尔本大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Huzhou University(湖州大学) Hornor Device Co., Ltd(Hornor设备有限公司) Hangzhou Institute for Advanced Study, UCAS(杭州先进研究所,UCAS)

AI总结 SkillNet通过统一的本体和多维评估机制,大规模创建、评估和连接AI技能,提升代理性能并促进技能的持久掌握。

Comments this http URL (http://skillnet.openkg.cn/;) add SkillNet-Gym, a benchmark for evaluating skill retrieval, utilization, composition, and SkillNet-Fabric for task-specific skill routing through lightweight Wikis

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20073 2026-08-25 cs.CL cs.AI cs.LG 版本更新

A Modular Multitask Reasoning Framework Integrating Spatio-temporal Models and LLMs

整合时空模型与大语言模型(LLMs)的模块化多任务推理框架

Kethmi Hirushini Hettige, Jiahao Ji, Cheng Long, Shili Xiang, Gao Cong, Jingyuan Wang

机构 * College of Computing and Data Science, Nanyang Technological University, Singapore(南洋理工大学计算机与数据科学学院) Institute for Infocomm Research, A*STAR, Singapore(资讯通信研究院) School of Computer Science and Engineering, Beihang University, China(北京航空航天大学计算机科学与工程学院)

AI总结 本研究提出整合时空模型与LLMs的STReason框架,通过上下文学习分解查询生成解释,在时空推理任务中显著优于LLM基线,可抑制幻觉并减少专家工作量。

详情

展开后加载摘要…

URL PDF HTML 收藏