arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

National University of Singapore(新加坡国立大学)

2026-02-03 至 2026-02-03 共收录 20
2602.02266 2026-02-03 cs.CL cs.AI

OpenSeal: Good, Fast, and Cheap Construction of an Open-Source Southeast Asian LLM via Parallel Data

OpenSeal: 通过并行数据高效构建开源东南亚LLM

Tan Sang Nguyen, Muhammad Reza Qorib, Hwee Tou Ng

机构 * Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系)

AI总结 OpenSeal通过并行数据高效构建了首个开源东南亚LLM,实现了与现有模型相当的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01982 2026-02-03 cs.CL

S3-CoT: Self-Sampled Succinct Reasoning Enables Efficient Chain-of-Thought LLMs

S3-CoT:自采样简洁推理实现高效链式推理LLM

Yanrui Du, Sendong Zhao, Yibo Gao, Danyang Zhao, Qika Lin, Ming Ma, Jiayun Li, Yi Jiang, Kai He, Qianyi Xu, Bing Qin, Mengling Feng

机构 * Harbin Institute of Technology(哈尔滨工业大学) National University of Singapore(新加坡国立大学)

AI总结 S3-CoT通过自采样简洁推理实现高效链式推理LLM,解决冗余推理问题,提升模型性能与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01826 2026-02-03 cs.LG cs.AI

Beyond Precision: Training-Inference Mismatch is an Optimization Problem and Simple LR Scheduling Fixes It

超越精度:训练-推理不匹配是一个优化问题,简单的学习率调度器可以解决它

Yaxiang Zhang, Yingru Li, Jiacai Liu, Jiawei Xu, Ziniu Li, Qian Liu, Haoyuan Li

机构 * National University of Singapore(新加坡国立大学) Fudan University(复旦大学) CHUK-Shenzhen(CHUK-深圳) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出通过动态学习率调度器解决强化学习中训练-推理不匹配问题,通过减少学习率来抑制梯度噪声,从而稳定训练过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01825 2026-02-03 stat.ME cs.LG math.OC stat.ML

Learning Sequential Decisions from Multiple Sources via Group-Robust Markov Decision Processes

通过群鲁棒马尔可夫决策过程从多个来源学习顺序决策

Mingyuan Xu, Zongqi Xia, Tianxi Cai, Doudou Zhou, Nian Si

机构 * Department of Statistics and Data Science, National University of Singapore(新加坡国立大学统计与数据科学系) Department of Neurology, University of Pittsburgh(匹兹堡大学神经病学系) Department of Biostatistics, Harvard T.H. Chan School of Public Health(哈佛大学T.H. Chan公共卫生学院生物统计学系) Department of Biomedical Informatics, Harvard Medical School(哈佛医学院生物医学信息学系) Department of Industrial Engineering and Decision Analytics, Hong Kong University of Science and Technology(香港科学与技术大学工业工程与决策分析系)

AI总结 本文提出了一种群鲁棒马尔可夫决策过程框架,通过特征层面的不确定性集和悲观价值迭代算法,从多地点异质数据中学习鲁棒的顺序决策策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01734 2026-02-03 cs.LG

MSign: An Optimizer Preventing Training Instability in Large Language Models via Stable Rank Restoration

MSign: 通过稳定秩恢复防止大语言模型训练不稳定

Lianhai Ren, Yucheng Ding, Xiao Liu, Qianxiao Li, Peng Cheng, Yeyun Gong

机构 * National University of Singapore(新加坡国立大学) Microsoft Research(微软研究院)

AI总结 MSign通过稳定秩恢复机制防止大语言模型训练不稳定,有效减少训练失败并降低计算开销

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01708 2026-02-03 cs.CL cs.AI cs.GT

Game of Thought: Robust Information Seeking with Large Language Models Using Game Theory

思维博弈:利用博弈论的大型语言模型鲁棒信息检索

Langyuan Cui, Chun Kai Ling, Hwee Tou Ng

机构 * Department of Computer Science, National University of Singapore, 13 Computing Drive, Singapore 117417(新加坡国立大学计算机科学系)

AI总结 本文提出Game of Thought框架,通过博弈论技术提升大型语言模型在信息检索中的鲁棒性,实验证明其在最坏情况下的性能优于传统方法。

Comments 23 pages, 10 figures, under review at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01532 2026-02-03 cs.AI cs.HC

PRISM: Festina Lente Proactivity -- Risk-Sensitive, Uncertainty-Aware Deliberation for Proactive Agents

PRISM:Festina Lente主动性——面向风险敏感和不确定性意识的主动代理 deliberation

Yuxuan Fu, Xiaoyu Tan, Teqi Hao, Chen Zhan, Xihe Qiu

机构 * Shanghai University of Engineering Science(上海工程技术大学) National University of Singapore(新加坡国立大学)

AI总结 PRISM通过决策理论门控与选择性慢速推理,提升主动代理的精确性和可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02589 2026-02-03 cs.AI cs.SE

PaperDebugger: A Plugin-Based Multi-Agent System for In-Editor Academic Writing, Review, and Editing

PaperDebugger:一种基于插件的多智能体系统用于编辑器中的学术写作、审阅和编辑

Junyi Hou, Andre Lin Huikai, Nuo Chen, Yiwei Gong, Bingsheng He

机构 * National University of Singapore(新加坡国立大学)

AI总结 PaperDebugger是一种在编辑器内集成多智能体系统和插件的学术写作助手,通过Chrome扩展、Kubernetes编排层和MCP工具链实现LLM驱动的写作、审阅和编辑功能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04217 2026-02-03 cs.LG cs.AI

MLLMEraser: Achieving Test-Time Unlearning in Multimodal Large Language Models through Activation Steering

MLLMEraser: 通过激活引导在多模态大语言模型中实现测试时遗忘

Chenlu Ding, Jiancan Wu, Leheng Sheng, Fan Zhang, Yancheng Yuan, Xiang Wang, Xiangnan He

机构 * University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学) The Hong Kong Polytechnic University(香港理工大学) Huawei(华为)

AI总结 MLLMEraser通过激活引导实现多模态大语言模型的测试时遗忘,无需训练且有效降低计算成本,同时保持保留知识的效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18561 2026-02-03 cs.CV

CoT-RVS: Zero-Shot Chain-of-Thought Reasoning Segmentation for Videos

CoT-RVS:零样本链式推理视频对象分割

Shiu-hong Kao, Yu-Wing Tai, Chi-Keung Tang

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) National University of Singapore(新加坡国立大学) Dartmouth College(达特茅斯学院)

AI总结 CoT-RVS通过零样本链式推理能力,实现了对视频对象的高效分割,无需训练即可处理复杂查询和在线视频流。

Comments Accepted to ICLR 2026. Project page: https://danielshkao.github.io/cot-rvs.html. Code: https://github.com/DanielSHKao/CoT-RVS

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05064 2026-02-03 cs.LG

WaterDrum: Watermarking for Data-centric Unlearning Metric

WaterDrum:面向数据导向的去学习度量水印

Xinyang Lu, Xinyuan Niu, Gregory Kang Ruey Lau, Bui Thi Cam Nhung, Rachael Hwee Ling Sim, John Russell Himawan, Fanyu Wen, Chuan-Sheng Foo, See-Kiong Ng, Bryan Kian Hsiang Low

机构 * Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系) Centre for Frontier AI Research, A*STAR(A*STAR前沿人工智能研究中心)

AI总结 WaterDrum提出了一种数据导向的LLM去学习度量,通过鲁棒文本水印技术解决现有度量在数据相似性和重训练不可行时的不足,并引入了新的基准数据集进行评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01331 2026-02-03 cs.MA cs.CL

A-MapReduce: Executing Wide Search via Agentic MapReduce

A-MapReduce:通过代理MapReduce执行广泛搜索

Mingju Chen, Guibin Zhang, Heng Chang, Yuchen Guo, Shiji Zhou

机构 * Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, School of Artificial Intelligence, Beihang University(北京未来区块链与隐私计算创新中心,人工智能学院,北京航空航天大学) National University of Singapore(新加坡国立大学) Tsinghua University(清华大学) BNRist, Tsinghua University(BNRist,清华大学)

AI总结 A-MapReduce通过引入MapReduce范式,提出一种多代理框架,将广泛搜索转化为水平结构的检索问题,实现高效且低成本的广泛搜索执行。

Comments 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01283 2026-02-03 cs.CV

Who Transfers Safety? Identifying and Targeting Cross-Lingual Shared Safety Neurons

谁负责安全转移?识别和定位跨语言共享安全神经元

Xianhui Zhang, Chengyu Xie, Linxia Zhu, Yonghui Yang, Weixiang Zhao, Zifeng Cheng, Cong Wang, Fei Shen, Tat-Seng Chua

机构 * Nanjing University of Science and Technology(南京理工大学) National University of Singapore(新加坡国立大学) Harbin Institute of Technology(哈尔滨工业大学) Nanjing University(南京大学)

AI总结 本文提出通过识别和定位跨语言共享安全神经元,提升非高资源语言的安全性,采用神经元导向的训练策略增强模型跨语言防御一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00717 2026-02-03 cs.LG cs.AI

Deep Time-series Forecasting Needs Kernelized Moment Balancing

深度时间序列预测需要核化矩平衡

Licheng Pan, Hao Wang, Haocheng Yang, Yuqi Li, Qingsong Wen, Xiaoxi Li, Zhichao Chen, Haoxuan Li, Zhixuan Chu, Yuan Lu

机构 * Xiaohongshu Inc.(小红书公司) National University of Singapore(新加坡国立大学) The City University of New York, CUNY(纽约市立大学,CUNY) State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(人工智能国家重点实验室,北京大学) Center for Data Science, Peking University(北京大学数据科学中心) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

AI总结 本文提出KMB-DF方法,通过核化矩平衡提升深度时间序列预测的准确性,实现更全面的分布平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00707 2026-02-03 cs.AI

Self-Guard: Defending Large Reasoning Models via enhanced self-reflection

Self-Guard:通过增强的自我反思防御大型推理模型

Jingnan Zheng, Jingjun Xu, Yanzhen Luo, Chenhang Cui, Gelei Deng, Zhenkai Liang, Xiang Wang, An Zhang, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) Southern University of Science and Technology(南方科技大学) University of Science and Technology of China(中国科学技术大学) Nanyang Technological University(南洋理工大学)

AI总结 Self-Guard通过增强的自我反思机制,有效解决大型推理模型的安全合规问题,实现安全与实用性的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00551 2026-02-03 cs.RO cs.CV

APEX: A Decoupled Memory-based Explorer for Asynchronous Aerial Object Goal Navigation

APEX:一种解耦的记忆型探索者用于异步空中目标导航

Daoxuan Zhang, Ping Chen, Xiaobo Xia, Xiu Su, Ruichen Zhen, Jianqiang Xiao, Shuo Yang

机构 * Harbin Institute of Technology(哈尔滨工业大学) National University of Singapore(新加坡国立大学) Central South University(中南大学) Meituan Academy of Robotics(美团机器人研究院)

AI总结 APEX通过分层异步架构实现高效空中目标导航,提升探索效率与目标识别精度。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00500 2026-02-03 cs.RO

Inject Once Survive Later: Backdooring Vision-Language-Action Models to Persist Through Downstream Fine-tuning

一次注入,后期存活:向视觉-语言-动作模型注入后门以在下游微调中持续存在

Jianyi Zhou, Yujie Wei, Ruichen Zhen, Bo Zhao, Xiaobo Xia, Rui Shao, Xiu Su, Shuo Yang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Harbin Institute of Technology(哈尔滨工业大学) Meituan Academy of Robotics Shenzhen, Meituan(美团机器人深圳研究院) Shanghai Jiaotong University(上海交通大学) National University of Singapore(新加坡国立大学) Central South University(中南大学)

AI总结 本文提出INFUSE框架,首次实现对VLA模型的后门攻击,使其在用户微调后仍能保持有效性,显著提升攻击成功率并保持任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03708 2026-02-03 cs.PL cs.AI

MHRC-Bench: A Multilingual Hardware Repository-Level Code Completion benchmark

MHRC-Bench: 一个多语言硬件仓库级代码补全基准

Qingyun Zou, Jiahao Cui, Nuo Chen, Bingsheng He, Weng-Fai Wong

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院)

AI总结 MHRC-Bench是首个多语言硬件仓库级代码补全基准,涵盖三种硬件设计编码风格,通过代码结构和硬件导向语义标签进行补全任务评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20198 2026-02-03 cs.CV

A Survey of Token Compression for Efficient Multimodal Large Language Models

多模态大语言模型高效性中的标记压缩综述

Kele Shao, Keda Tao, Kejia Zhang, Sicheng Feng, Mu Cai, Yuzhang Shang, Haoxuan You, Can Qin, Yang Sui, Huan Wang

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Xiamen University(厦门大学) National University of Singapore(新加坡国立大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) University of Central Florida(佛罗里达大学) Salesforce AI Research(Salesforce AI研究) Rice University(德克萨斯大学)

AI总结 本文综述了多模态大语言模型中标记压缩技术,分类讨论了图像、视频和音频三种模态的压缩方法及其机制,旨在推动该领域的发展。

Comments For ongoing updates and to track the latest advances in this promising area, we maintain a public repository: https://github.com/cokeshao/Awesome-Multimodal-Token-Compression

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21900 2026-02-03 cs.CV cs.AI cs.CY cs.MM

TraceRouter: Robust Safety for Large Foundation Models via Path-Level Intervention

TraceRouter: 通过路径级干预实现大型基础模型的鲁棒安全性

Chuancheng Shi, Shangze Li, Wenjun Lu, Wenhua Wu, Cong Wang, Zifeng Cheng, Fei Shen, Tat-Seng Chua

机构 * The University of Sydney, Sydney, Australia(悉尼大学) Nanjing University of Science(南京理工大学) Nanjing University, Nanjing, China(南京大学) National University of Singapore, Singapore, Singapore(新加坡国立大学)

AI总结 TraceRouter通过路径级干预有效切断有害语义的因果传播,提升大型基础模型的对抗鲁棒性与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏