arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-02-02 至 2026-02-02 共收录 16
2601.23081 2026-02-02 cs.CL cs.AI cs.CR

Character as a Latent Variable in Large Language Models: A Mechanistic Account of Emergent Misalignment and Conditional Safety Failures

字符作为大语言模型中的潜在变量:对涌现偏差和条件安全失败的机制解释

Yanghao Su, Wenbo Zhou, Tianwei Zhang, Qiu Han, Weiming Zhang, Nenghai Yu, Jie Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Nanyang Technological University(南洋理工大学) Tsinghua University(清华大学)

AI总结 本研究揭示了大语言模型中字符层面倾向对齐风险的核心机制,指出行为倾向的稳定转变是导致涌现偏差和安全失败的关键因素,而非单纯的能力退化或提示防御。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22790 2026-02-02 cs.AI math.ST stat.TH

Conditional Performance Guarantee for Large Reasoning Models

基于条件的大型推理模型性能保证

Jianguo Huang, Hao Zeng, Bingyi Jing, Hongxin Wei, Bo An

机构 * Nanyang Technological University, Singapore(南洋理工大学) Southern University of Science(南方科技大学) The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳))

AI总结 本文提出G-PAC和C-PAC推理框架,通过分组策略实现组条件风险控制,提升异质环境下推理效率并降低计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22738 2026-02-02 cs.CV

StreamSense: Streaming Social Task Detection with Selective Vision-Language Model Routing

StreamSense: 基于选择性视觉-语言模型路由的流式社交任务检测

Han Wang, Deyi Ji, Lanyun Zhu, Jiebo Luo, Roy Ka-Wei Lee

机构 * Singapore University of Technology and Design(新加坡科技设计大学) University of Science and Technology of China(中国科学技术大学) Nanyang Technological University(南洋理工大学) University of Rochester(罗切斯特大学)

AI总结 StreamSense通过轻量级编码器与选择性路由结合VLM专家,提升流式社交任务检测的准确性和效率。

Comments 10 pages, 4 figures, The Web Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09133 2026-02-02 cs.AI cs.LG math.ST stat.TH

On the Provable Performance Guarantee of Efficient Reasoning Models

关于高效推理模型的可证明性能保证

Hao Zeng, Jianguo Huang, Bingyi Jing, Hongxin Wei, Bo An

机构 * Nanyang Technological University, Singapore(新加坡南洋理工大学) Southern University of Science(南方科技大学) The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳))

AI总结 本文提出PAC推理方法,通过动态切换思考与非思考模式,在用户指定容忍度下控制性能损失,实现高效推理与性能保障。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04347 2026-02-02 cs.CL cs.LG

Unmasking Backdoors: An Explainable Defense via Gradient-Attention Anomaly Scoring for Pre-trained Language Models

揭示后门:通过梯度-注意力异常评分对预训练语言模型进行可解释防御

Anindya Sundar Das, Kangjie Chen, Monowar Bhuyan

机构 * Umeå University(乌梅学院) Nanyang Technological University(南洋理工大学)

AI总结 本文提出通过梯度-注意力异常评分对预训练语言模型进行可解释防御,有效降低后门攻击成功率。

Comments 17 pages total (9 pages main text + 6 pages appendix + references), 16 figures. Preprint version; the final camera-ready version may differ. Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04825 2026-02-02 cs.LG cs.AI

Graph Mining under Data scarcity

图数据稀少下的图挖掘

Appan Rakaraddi, Lam Siew-Kei, Mahardhika Pratama, Marcus de Carvalho

机构 * Nanyang Technological University Singapore(南洋理工大学新加坡) University of South Australia Australia(澳大利亚南澳大利亚大学)

AI总结 本文提出一种适用于通用GNN框架的不确定性估计器,通过端到端训练提升少样本图节点分类性能,无需元学习架构。

Comments 7 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12683 2026-02-02 cs.LG cs.CV math.ST stat.TH

TorchCP: A Python Library for Conformal Prediction

TorchCP: 一个用于置信预测的 Python 库

Jianguo Huang, Jianqing Song, Xuanning Zhou, Bingyi Jing, Hongxin Wei

机构 * Southern University of Science and Technology(南方科技大学) Nanyang Technological University(南洋理工大学) Nanjing University(南京大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

AI总结 TorchCP 是一个基于 PyTorch 的库,旨在将先进的置信预测算法集成到深度学习技术中,提升大规模数据中的不确定性量化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22718 2026-02-02 cs.AI cs.LG

A Step Back: Prefix Importance Ratio Stabilizes Policy Optimization

后退一步:前缀重要性比率稳定了策略优化

Shiye Lei, Zhihao Cheng, Dacheng Tao

机构 * The University of Sydney(悉尼大学) ByteDance(字节跳动) Nanyang Technological University(南洋理工大学)

AI总结 本文提出MinPRO目标,通过使用非累积的最小token级比率替代累积前缀比率,以稳定LLM在非策略性条件下的训练和优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22675 2026-02-02 cs.CV cs.AI

Fire on Motion: Optimizing Video Pass-bands for Efficient Spiking Action Recognition

运动中的火焰:为高效脉冲动作识别优化视频通过带

Shuhan Ye, Yuanbin Qian, Yi Yu, Chong Wang, Yuqi Xie, Jiazhen Xu, Kun Wang, Xudong Jiang

机构 * Ningbo University(宁波大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出PBO模块,通过优化时间通过带以提升动态视频中脉冲神经网络的动作识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22491 2026-02-02 cs.CL

SSL: Sweet Spot Learning for Differentiated Guidance in Agentic Optimization

SSL:在代理优化中差异化引导的甜蜜点学习

Jinyang Wu, Changpeng Yang, Yuhao Shen, Fangzhi Xu, Bolin Ni, Chonghua Liao, Yuchen Liu, Hongzhen Wang, Shuai Nie, Shuai Zhang, Haoran Luo, Jiaming Xu

机构 * Tsinghua University(清华大学) Xiaomi Corporation(小米公司) Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

AI总结 SSL通过分层奖励引导代理优化,提升解空间中的方向性优化,实现样本效率提升和跨任务迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21969 2026-02-02 cs.CL cs.AI

Token-Guard: Towards Token-Level Hallucination Control via Self-Checking Decoding

Token-Guard: 通过自检解码实现token级幻觉控制

Yifan Zhu, Huiqiang Rong, Haoran Luo

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Nanyang Technological University(南洋理工大学)

AI总结 Token-Guard通过自检解码技术,实现对大型语言模型中token级幻觉的有效控制,提升生成准确性与输出可靠性。

Comments Accepted by ICLR 2026 main conference

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18220 2026-02-02 cs.SD eess.AS

LLM-ForcedAligner: A Non-Autoregressive and Accurate LLM-Based Forced Aligner for Multilingual and Long-Form Speech

LLM-ForcedAligner: 一种非自回归且准确的基于大语言模型的强制对齐器,适用于多语言和长文本语音

Bingshen Mu, Xian Shi, Xiong Wang, Hexin Liu, Jin Xu, Lei Xie

机构 * College of Computing and Data Science, Nanyang Technological University, Singapore(计算与数据科学学院,南洋理工大学,新加坡)

AI总结 LLM-ForcedAligner通过非自回归方法实现多语言和长文本语音的准确强制对齐,显著减少时间偏移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11914 2026-02-02 cs.AI

EgoMem: Lifelong Memory Agent for Full-duplex Omnimodal Models

EgoMem:全双工多模态模型的终身记忆代理

Yiqun Yao, Naitong Yu, Xiang Li, Xin Jiang, Xuezhi Fang, Wenjia Ma, Xuying Meng, Jing Li, Aixin Sun, Yequan Wang

机构 * Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院) Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China(中国科学院计算技术研究所) Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳学院) Nanyang Technological University, Singapore(南洋理工大学)

AI总结 EgoMem是一种专为全双工多模态模型设计的终身记忆代理,通过异步过程实现用户识别、个性化响应和长期记忆管理,实验显示其在准确性和一致性方面表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02521 2026-02-02 cs.SD cs.AI cs.CL

FLM-Audio: Natural Monologues Improves Native Full-Duplex Chatbots via Dual Training

FLM-Audio: 自然独白提升原生全双工聊天机器人通过双训练

Yiqun Yao, Xiang Li, Xin Jiang, Xuezhi Fang, Naitong Yu, Wenjia Ma, Aixin Sun, Yequan Wang

机构 * Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院) Nanyang Technological University, Singapore(南洋理工大学)

AI总结 FLM-Audio通过双训练策略和连续独白提升全双工聊天机器人的响应质量和体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06258 2026-02-02 cs.CR cs.AI cs.DC cs.IR

Spattack: Subgroup Poisoning Attacks on Federated Recommender Systems

Spattack:联邦推荐系统中的子群污染攻击

Bo Yan, Yurong Hao, Dingqi Liu, Huabin Sun, Pengpeng Qiao, Wei Yang Bryan Lim, Yang Cao, Chuan Shi

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Nanyang Technological University(南洋理工大学) Institute of Science Tokyo(东京科学研究所)

AI总结 Spattack是一种针对联邦推荐系统中特定用户子群的污染攻击,通过近似和推广策略实现高效推荐操纵,同时保持隐蔽性和低检测风险。

Comments Accepted by WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03846 2026-02-02 cs.LG

Can Distillation Mitigate Backdoor Attacks in Pre-trained Encoders?

知识蒸馏能否缓解预训练编码器中的后门攻击?

TIngxu Han, Wei Song, Weisong Sun, Ziqi Ding, Yebo Feng, Chunrong Fang, Jun Li, Hanwei Qian, Zhenyu Chen, Yang Liu

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) Shenzhen Research Institute of Nanjing University(南京大学深圳研究院) School of Computer Science and Engineering, University of New South Wales(新南威尔士大学计算机科学与工程学院) School of Computer Science and Engineering, Nanyang Technological University(南洋理工大学计算机科学与工程学院)

AI总结 本文提出利用知识蒸馏技术缓解预训练编码器中的后门攻击,通过提取良性知识并去除后门,显著降低攻击成功率,同时保持模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏