arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

National University of Singapore(新加坡国立大学)

2026-02-04 至 2026-02-04 共收录 12
2602.03645 2026-02-04 cs.LG

Reinforcement Fine-Tuning for History-Aware Dense Retriever in RAG

强化微调用于历史感知密集检索器在RAG中

Yicheng Zhang, Zhen Qin, Zhaomin Wu, Wenqi Zhang, Shuiguang Deng

机构 * College of Computer Science and Technology, Zhejiang University, Hangzhou, China(浙江大学计算机科学与技术学院) Ningbo Global Innovation Center, Zhejiang University, Ningbo, China(浙江大学宁波全球创新中心) Department of Computer Science, National University of Singapore, Singapore(新加坡国立大学计算机科学系)

AI总结 本文提出通过强化学习优化RAG中的检索器,通过引入随机采样和历史状态缓解状态别名问题,提升检索性能。

Comments On going work. Codes are released at https://github.com/zyc140345/HARR

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03496 2026-02-04 cs.LG

Lookahead Path Likelihood Optimization for Diffusion LLMs

前瞻路径似然优化用于扩散大语言模型

Xuejie Liu, Yap Vit Chun, Yitao Liang, Anji Liu

机构 * Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学) School of Computing, National University of Singapore(计算学院,新加坡国立大学) School of Intelligence Science and Technology, Peking University(智能科学与技术学院,北京大学)

AI总结 本文提出POKE-SMC方法,通过优化路径似然提升扩散大语言模型的解屏蔽路径准确性,实验表明在同等计算开销下,平均提升2%-3%的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03333 2026-02-04 cs.CV

PWAVEP: Purifying Imperceptible Adversarial Perturbations in 3D Point Clouds via Spectral Graph Wavelets

PWAVEP: 通过频谱图小波净化3D点云中的不可察觉对抗扰动

Haoran Li, Renyang Liu, Hongjia Liu, Chen Wang, Long Yin, Jian Xu

机构 * Software College, Northeastern University(东北大学软件学院) Institute of Data Science, National University of Singapore(新加坡国立大学数据科学研究所) Software College, Shenyang University of Technology(沈阳理工大学软件学院)

AI总结 PWAVEP通过频谱图小波技术净化3D点云中的不可察觉对抗扰动,提升准确性和鲁棒性。

Comments Accepted by WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03100 2026-02-04 cs.AI

Risky-Bench: Probing Agentic Safety Risks under Real-World Deployment

Risky-Bench: 探索现实部署中智能体安全风险

Jingnan Zheng, Yanzhen Luo, Jingjun Xu, Bingnan Liu, Yuxin Chen, Chenhang Cui, Gelei Deng, Chaochao Lu, Xiang Wang, An Zhang, Tat-Seng Chua

机构 * National University of Singapore(国立新加坡大学) University of Science and Technology of China(中国科学技术大学) Southern University of Science and Technology(南方科技大学) University of Electronic Science and Technology of China(电子科技大学) Nanyang Technological University(南洋理工大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 Risky-Bench通过基于现实部署的安全原则,系统评估智能体在复杂任务中的安全风险,适用于多种部署场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02696 2026-02-04 cs.NI cs.LG

NSC-SL: A Bandwidth-Aware Neural Subspace Compression for Communication-Efficient Split Learning

NSC-SL:一种带宽感知的神经子空间压缩用于通信高效的分裂学习

Zhen Fang, Miao Yang, Zehang Lin, Zheng Lin, Zihan Fang, Zongyuan Zhang, Tianyang Duan, Dong Huang, Shunzhi Zhu

机构 * School of Computer and Information Engineering, Xiamen University of Technology, Xiamen, China(厦门理工学院计算机与信息工程学院) Department of Electrical and Electronic Engineering, The University of Hong Kong, Hong Kong, China(香港大学电子与电气工程系) Department of Computer Science, City University of Hong Kong, Hong Kong, China(香港城市大学计算机科学系) Department of Computer Science, The University of Hong Kong, Hong Kong, China(香港大学计算机科学系) School of Computing, National University of Singapore, Singapore(新加坡国立大学计算机学院)

AI总结 NSC-SL通过带宽感知的自适应压缩算法,实现通信高效的分裂学习,有效减少通信开销并保持模型收敛所需的语义信息。

Comments 5 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02595 2026-02-04 cs.CR cs.AI cs.CY

To Defend Against Cyber Attacks, We Must Teach AI Agents to Hack

为抵御网络攻击,我们必须教AI代理黑客

Terry Yue Zhuo, Yangruibo Ding, Wenbo Guo, Ruijie Meng

机构 * Monash University(墨尔本大学) University of California, Los Angeles(加州大学洛杉矶分校) University of California, Santa Barbara(加州大学圣巴巴拉分校) National University of Singapore(新加坡国立大学)

AI总结 本文主张AI代理驱动的网络攻击不可避免,需转变防御策略,提出构建全面基准、发展训练代理发现漏洞及实施治理限制进攻性AI能力,以负责任地掌握进攻性AI能力作为防御基础设施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02548 2026-02-04 cs.LG cs.AI cs.CV cs.MA

ToolTok: Tool Tokenization for Efficient and Generalizable GUI Agents

ToolTok: 为高效且通用的GUI代理的工具标记化

Xiaoce Wang, Guibin Zhang, Junzhe Li, Jinzhe Tu, Chun Li, Ming Li

机构 * Department of Computer Science, Tsinghua University, Beijing, China(清华大学计算机科学系) Guangming Laboratory, Shenzhen, China(光明实验室) National University of Singapore, Singapore(新加坡国立大学) Peking University, Beijing, China(北京大学) MSU-BIT-SMBU Joint Research Center of Applied Mathematics, Shenzhen MSU–BIT University(MSU-BIT-SMBU应用数学联合研究中心)

AI总结 ToolTok通过多步路径寻找范式,利用语义锚定机制和易到难课程,实现高效且通用的GUI代理,以较少数据获得优异性能。

Comments 8 pages main paper, 18 pages total, 8 figures, 5 tables, code at https://github.com/ZephinueCode/ToolTok

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02196 2026-02-04 cs.AI

TIDE: Trajectory-based Diagnostic Evaluation of Test-Time Improvement in LLM Agents

基于轨迹的测试时改进诊断评估:LLM代理中的测试时改进

Hang Yan, Xinyu Che, Fangzhi Xu, Qiushi Sun, Zichen Ding, Kanzhi Cheng, Jian Zhang, Tao Qin, Jun Liu, Qika Lin

机构 * Xi’an Jiaotong University(西安交通大学) The University of Hong Kong(香港大学) Shanghai AI Laboratory(上海人工智能实验室) Nanjing University(南京大学) National University of Singapore(新加坡国立大学)

AI总结 TIDE提出了一种评估框架,用于诊断LLM代理在测试时改进中的性能瓶颈,通过分析任务完成的时间动态、递归循环行为和记忆负担,优化代理与环境的交互。

Comments 29pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00514 2026-02-04 cs.RO

A Low-Cost Vision-Based Tactile Gripper with Pretraining Learning for Contact-Rich Manipulation

一种低成本的基于视觉的触觉夹具,用于接触丰富的操作

Yaohua Liu, Binkai Ou, Zicheng Qiu, Ce Hao, Hengjun Zhang

机构 * Guangdong Institute of Intelligence Science and Technology(广东智能科学与技术研究院) Innovation and Research and Development Department, BoardWare Information System Company Ltd.(创新与研发部,BoardWare信息系统有限公司) School of Artificial Intelligence, Nanjing Agricultural University(人工智能学院,南京农业大学) School of Computing, National University of Singapore(计算机学院,新加坡国立大学) School of Electronic Engineering and Automation, Guilin University of Electronic Technology(电子工程与自动化学院,桂林电子科技大学)

AI总结 本研究提出了一种低成本的视觉-触觉夹具,通过融合视觉和触觉反馈,提升接触丰富环境中的操作性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02280 2026-02-04 cs.CV cs.CL

SAIL-RL: Guiding MLLMs in When and How to Think via Dual-Reward RL Tuning

SAIL-RL: 通过双奖励强化学习调优引导MLLM在何时以及如何思考

Fangxun Shu, Yongjie Ye, Yue Liao, Zijian Kang, Weijie Yin, Jiacong Wang, Xiao Liang, Shuicheng Yan, Chao Feng

机构 * National University of Singapore(新加坡国立大学)

AI总结 SAIL-RL通过双奖励强化学习调优,提升多模态大语言模型的推理能力和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00457 2026-02-04 cs.LG cs.AI cs.CE

UrbanGraph: Physics-Informed Spatio-Temporal Dynamic Heterogeneous Graphs for Urban Microclimate Prediction

UrbanGraph: 基于物理的时空动态异质图用于城市微气候预测

Weilin Xin, Chenyu Huang, Peilin Li, Jing Zhong, Jiawei Yao

机构 * National University of Singapore(新加坡国立大学) Tongji University(同济大学) Tsinghua University(清华大学)

AI总结 UrbanGraph通过显式编码物理因果关系,提升城市微气候预测的物理一致性和效率,实现高性能和高精度的时空动态异质图建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04136 2026-02-04 cs.CV cs.AI

UniFGVC: Universal Training-Free Few-Shot Fine-Grained Vision Classification via Attribute-Aware Multimodal Retrieval

UniFGVC: 一种通用无训练少样本细粒度视觉分类方法通过属性感知多模态检索

Hongyu Guo, Xiangzhao Hao, Jiarui Guo, Haiyun Guo, Jinqiao Wang, Tat-Seng Chua

机构 * School of Traffic and Transportation, Beijing Jiaotong University(交通与运输学院,北京交通大学) Foundation Modal Research Center, Institute of Automation, Chinese Academy of Sciences(基础模态研究中心,自动化研究所) Queen Mary School Hainan, Beijing University of Posts and Telecommunications(海南女王学院,北京邮电大学) Department of Computer Science, NUS School of Computing(计算机科学系,国立大学计算机学院)

AI总结 UniFGVC通过属性感知多模态检索方法,实现无训练少样本细粒度视觉分类,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏