arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-01-06 至 2026-01-06 共收录 11
2601.02170 2026-01-06 cs.AI

Streaming Hallucination Detection in Long Chain-of-Thought Reasoning

流式长推理链中的幻觉检测

Haolang Lu, Minghui Pan, Ripeng Li, Guoshun Nan, Jialin Zhuang, Zijie Zhao, Zhongxiang Sun, Kun Wang, Yang Liu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Nanyang Technological University(南洋理工大学) Southwest Jiaotong University(西南交通大学) Renmin University of China(中国人民大学)

AI总结 本研究提出通过跟踪推理状态演变来检测长推理链中的幻觉,提供实时可解释的检测证据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02115 2026-01-06 cs.CR cs.AI

Coward: Collision-based Watermark for Proactive Federated Backdoor Detection

Coward: 基于碰撞的水印用于主动联邦后门检测

Wenjie Li, Siying Gu, Yiming Li, Kangjie Chen, Zhili Chen, Tianwei Zhang, Shu-Tao Xia, Dacheng Tao

机构 * Tsinghua University(清华大学) East China Normal University(华东师范大学) Nanyang Technological University(南洋理工大学)

AI总结 Coward通过多后门碰撞效应提出主动检测方法,利用分布外数据的双映射学习注入水印,有效缓解OOD偏见并提升检测性能。

Comments 13-page main body and 4-page appendix. Currently under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01535 2026-01-06 cs.CV

Improving Flexible Image Tokenizers for Autoregressive Image Generation

改进灵活的图像标记器以用于自回归图像生成

Zixuan Fu, Lanqing Guo, Chong Wang, Binbin Song, Ding Liu, Bihan Wen

机构 * Nanyang Technological University(南洋理工大学) The University of Texas at Austin(德克萨斯大学奥斯汀分校) Harbin Institute of Technology(哈尔滨工业大学) Meta AI

AI总结 ReToK通过冗余标记填充和层次语义正则化改进灵活图像标记器,提升自回归图像生成效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01501 2026-01-06 cs.LG

Advanced Global Wildfire Activity Modeling with Hierarchical Graph ODE

基于分层图微分方程的先进全球野火活动建模

Fan Xu, Wei Gong, Hao Wu, Lilan Peng, Nan Wang, Qingsong Wen, Xian Wu, Kun Wang, Xibin Zhao

机构 * University of Science and Technology of China(中国科学技术大学) Tsinghua University(清华大学) Southwest Jiaotong University(西南交通大学) Beijing Jiaotong University(北京交通大学) Tencent(腾讯) Nanyang Technological University(南洋理工大学)

AI总结 本文提出分层图微分方程框架HiGO,用于建模全球野火活动的多尺度连续动态,通过多级图结构和自适应信息传递机制提升预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01037 2026-01-06 cs.CL cs.AI

Multi-Dimensional Prompt Chaining to Improve Open-Domain Dialogue Generation

多维提示链以提升开放域对话生成

Livia Leong Hui Teng

机构 * Nanyang Technological University(南洋理工大学)

AI总结 本文提出多维提示链框架,通过提升自然性、连贯性和吸引力,使小型模型在开放域对话生成中达到与大模型相当的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00935 2026-01-06 eess.AS cs.AI

Improving Code-Switching Speech Recognition with TTS Data Augmentation

通过TTS数据增强改进代码切换语音识别

Yue Heng Yeo, Yuchen Hu, Shreyas Gopal, Yizhou Peng, Hexin Liu, Eng Siong Chng

机构 * Institute for Infocomm Research (I 2 R), A*STAR, Singapore(信息通信研究所(I 2 R),A*STAR,新加坡) College of Computing and Data Science, Nanyang Technological University, Singapore(计算与数据科学学院,南洋理工大学,新加坡)

AI总结 利用多语言TTS模型生成合成语音数据,有效提升代码切换语音识别的准确率和鲁棒性。

Comments This paper was accepted by APSIPA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00588 2026-01-06 cs.CL

CSSBench: Evaluating the Safety of Lightweight LLMs against Chinese-Specific Adversarial Patterns

CSSBench: 评估轻量级大语言模型对中文特定对抗模式的安全性

Zhenhong Zhou, Shilinlu Yan, Chuanpu Liu, Qiankun Li, Kun Wang, Zhigang Zeng

机构 * Nanyang Technological University(南洋理工大学) Beijing University of Posts and Telecommunications(北京邮电大学) Huazhong University of Science and Technology(华中科技大学)

AI总结 CSSBench通过评估中文特定对抗模式,揭示轻量级大语言模型在中文环境下的安全挑战,为实际应用提供安全评估框架。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16760 2026-01-06 cs.RO

Vision-Language-Action Models for Autonomous Driving: Past, Present, and Future

面向自动驾驶的视觉-语言-动作模型:过去、现在与未来

Tianshuai Hu, Xiaolu Liu, Song Wang, Yiyao Zhu, Ao Liang, Lingdong Kong, Guoyang Zhao, Zeying Gong, Jun Cen, Zhiyu Huang, Xiaoshuai Hao, Linfeng Li, Hang Song, Xiangtai Li, Jun Ma, Shaojie Shen, Jianke Zhu, Dacheng Tao, Ziwei Liu, Junwei Liang

机构 * HKUST(香港科技大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) HKUST(GZ)(香港科技大学(广州)) DAMO Academy, Alibaba(阿里巴巴达摩院) University of California, Los Angeles(加州大学洛杉矶分校) Xiaomi EV(小米电动车) Xi'an Jiaotong University(西安交通大学) Nanyang Technological University, Singapore(新加坡南洋理工大学)

AI总结 本文探讨了自动驾驶中视觉-语言-动作模型的发展历程,提出两种主要范式并分析其挑战与未来方向。

Comments Survey; 47 pages, 7 figures, 9 tables; GitHub Repo at https://github.com/worldbench/awesome-vla-for-ad

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22425 2026-01-06 cs.CV

Wukong's 72 Transformations: High-fidelity Textured 3D Morphing via Flow Models

悟空的72变:通过流模型实现高保真的纹理3D变形

Minghao Yin, Yukang Cao, Kai Han

机构 * Visual AI Lab, The University of Hong Kong(香港大学视觉人工智能实验室) S-Lab, Nanyang Technological University(南洋理工大学S实验室)

AI总结 WUKONG通过流模型实现高保真的纹理3D变形,无需训练,支持全局纹理过渡和身份保持的变形,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05797 2026-01-06 eess.SY cs.AI cs.SY

A Multi-Scale Attention-Based Attack Diagnosis Mechanism for Parallel Cyber-Physical Attacks in Power Grids

一种基于多尺度注意力的并行网络物理攻击诊断机制

Junhao Ren, Kai Zhao, Guangxiao Zhang, Xinghua Liu, Chao Zhai, Gaoxi Xiao

机构 * School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院) Institute of Catastrophe Risk Management, Nanyang Technological University(南洋理工大学灾难风险管理研究所) School of Electrical Engineering, Xi’an University of Technology(西安理工大学电气工程学院) School of Automation, China University of Geosciences (Wuhan)(中国地质大学(武汉)自动化学院)

AI总结 本文提出一种基于多尺度注意力机制的攻击诊断框架,用于检测并行网络物理攻击,通过元混合整数规划优化攻击位置和规模估计。

Comments 10 pages, 3 figures, 5 tables, journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00900 2026-01-06 cs.CR cs.CV cs.LG

Noise-Aware and Dynamically Adaptive Federated Defense Framework for SAR Image Target Recognition

具有噪声意识和动态适应的联邦防御框架用于SAR图像目标识别

Yuchao Hou, Zixuan Zhang, Jie Wang, Wenke Huang, Lianhui Liang, Di Wu, Zhiquan Liu, Youliang Tian, Jianming Zhu, Jisheng Dang, Junhao Dong, Zhongliang Guo

机构 * Shanxi Key Laboratory of Cryptography and Data Security, School of Computer Science and Artificial Intelligence, Shanxi Normal University(山西密码与数据安全重点实验室,计算机科学与人工智能学院,山西师范大学) School of Computer Science and Technology, Guizhou University(贵州大学计算机科学与技术学院) School of Computer Science and Engineering, Nanyang Technological University(南洋理工大学计算机科学与工程学院) School of Electrical Engineering, Guangxi University(广西大学电气工程学院) School of Computing, Engineering and Mathematical Science, La Trobe University(拉筹伯大学计算、工程与数学科学学院) College of Cyber Security, Jinan University(济南大学网络安全学院)

AI总结 NADAFD通过整合频域、空域和客户端行为分析,提升SAR图像目标识别在对抗攻击下的鲁棒性。

Comments This work was supported in part by the National Key Research and Development Program of China under Grant 2021YFB3101100, in part by the National Natural Science Foundation of China under Grant 62272123, 42371470, and 42461057, in part by the Fundamental Research Program of Shanxi Province under Grant 202303021212164. Corresponding authors: Zhongliang Guo and Junhao Dong

详情

展开后加载摘要…

URL PDF HTML 收藏