arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-01-21 至 2026-01-21 共收录 19
2601.14041 2026-01-21 cs.CL cs.AI

Top 10 Open Challenges Steering the Future of Diffusion Language Model and Its Variants

推动扩散语言模型及其变体未来发展的十大开放挑战

Yunhe Wang, Kai Han, Huiling Zhen, Yuchuan Tian, Hanting Chen, Yongbing Huang, Yufei Cui, Yingte Shu, Shan Gao, Ismail Elezi, Roy Vaughan Miles, Songcen Xu, Feng Wen, Chao Xu, Sinan Zeng, Dacheng Tao

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) Peking University(北京大学) Huawei Technologies(华为技术有限公司) Nanyang Technological University(南洋理工大学)

AI总结 本文提出推动扩散语言模型及其变体发展的十大挑战,并提出以多尺度标记化、主动遮罩和潜在思考为核心的四支柱战略路线图,旨在突破因果瓶颈,实现复杂结构推理和多模态整合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13876 2026-01-21 cs.CL

Pedagogical Alignment for Vision-Language-Action Models: A Comprehensive Framework for Data, Architecture, and Evaluation in Education

为视觉-语言-动作模型的教育对齐:一个全面的框架,用于数据、架构和教育中的评估

Unggi Lee, Jahyun Jeong, Sunyoung Shin, Haeun Park, Jeongsu Moon, Youngchang Song, Jaechang Shim, JaeHwan Lee, Yunju Noh, Seungwon Choi, Ahhyun Kim, TaeHyeon Kim, Kyungtae Joo, Taeyeong Kim, Gyeonggeon Lee

机构 * Chosun University(全州大学) Seoul National University(首尔国立大学) Korea Institute for Curriculum and Evaluation(韩国课程评价院) Nanyang Technological University(南洋理工大学)

AI总结 本文提出教育VLA框架,通过四个组件实现轻量级模型的教育对齐,提升科学教育中的任务表现和解释生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13600 2026-01-21 cs.AI

Foundations of Global Consistency Checking with Noisy LLM Oracles

基于噪声LLM预言机的全局一致性基础

Paul He, Elke Kirschbaum, Shiva Kasiviswanathan

机构 * Nanyang Technological University(南洋理工大学) Amazon Web Services(亚马逊网络服务)

AI总结 本文提出一种基于LLM的自适应分治算法,用于高效检测和定位自然语言事实集合的全局不一致问题,具有低次多项式查询复杂度。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00256 2026-01-21 cs.NI cs.AI

Large AI Model-Enabled Secure Communications in Low-Altitude Wireless Networks: Concepts, Perspectives and Case Study

大AI模型赋能的低空无线网络安全通信:概念、视角与案例研究

Chuang Zhang, Geng Sun, Yijing Lin, Weijie Yuan, Sinem Coleri, Dusit Niyato

机构 * College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院) Singapore University of Technology and Design(新加坡科技设计大学) College of Computer Science and Technology, Key Laboratory of Symbolic Computation and Knowledge Engineering of Ministry of Education, Jilin University(吉林大学计算机科学与技术学院、教育部符号计算与知识工程重点实验室) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机与数据科学学院)

AI总结 本文提出基于大AI模型的优化框架,利用大语言模型提升低空无线网络安全通信的性能。

Comments This paper has been accepted to IEEE Communications Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12921 2026-01-21 cs.CL

Injecting Knowledge from Social Science Journals to Improve Indonesian Cultural Understanding by LLMs

通过社会科学期刊注入知识以提升LLMs对印度尼西亚文化的理解

Adimulya Kartiyasa, Bao Gia Cao, Boyang Li

机构 * Nanyang Technological University(南洋理工大学)

AI总结 本研究通过构建IndoSoSci数据集,利用检索增强生成方法将印度尼西亚文化知识注入LLMs,提升其对印度尼西亚文化的理解能力,并在基准测试中取得显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12863 2026-01-21 cs.CV

FGTBT: Frequency-Guided Task-Balancing Transformer for Unified Facial Landmark Detection

FGTBT: 频率引导的任务平衡变换器用于统一面部地标检测

Jun Wan, Xinyu Xiong, Ning Chen, Zhihui Lai, Jie Zhou, Wenwen Min

机构 * School of Information Engineering, Zhongnan University of Economics(经济法律大学信息工程学院) School of Computer Science and Engineering, Nanyang Technological University, Singapore(南洋理工大学计算机科学与工程学院) College of Computer Science and Software Engineering, Shenzhen University, Shenzhen, China(深圳大学计算机科学与软件工程学院) School of Information Science and Engineering, Yunnan University, Kunming, Yunnan, China(云南大学信息科学与工程学院)

AI总结 FGTBT通过频率引导的任务平衡变换器和细粒度多任务平衡损失,提升面部地标检测的统一训练与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12798 2026-01-21 cs.CV

PhyG-MoE: A Physics-Guided Mixture-of-Experts Framework for Energy-Efficient GNSS Interference Recognition

PhyG-MoE:一种基于物理指导的专家混合框架用于高效GNSS干扰识别

Zhihan Zeng, Yang Zhao, Kaihe Wang, Dusit Niyato, Yue Xiu, Lu Chen, Zhongpei Zhang, Ning Wei

机构 * National Key Laboratory of Wireless Communications, University of Electronic Science and Technology of China(中国电子科学与技术大学无线通信国家重点实验室) University of Electronic Science and Technology of China(中国电子科学与技术大学) Nanyang Technological University(南洋理工大学) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机与数据科学学院) Anhui Science and Technology University(安徽科学技术大学)

AI总结 PhyG-MoE通过动态对齐模型容量与信号复杂性,提升GNSS干扰识别的能效与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12791 2026-01-21 cs.CV

SKANet: A Cognitive Dual-Stream Framework with Adaptive Modality Fusion for Robust Compound GNSS Interference Classification

SKANet:一种具有自适应模态融合的认知双流框架,用于鲁棒的复合GNSS干扰分类

Zhihan Zeng, Yang Zhao, Kaihe Wang, Dusit Niyato, Hongyuan Shu, Junchu Zhao, Yanjun Huang, Yue Xiu, Zhongpei Zhang, Ning Wei

机构 * National Key Laboratory of Wireless Communications, University of Electronic Science and Technology of China(国家无线通信重点实验室,电子科技大学) Nanyang Technological University(南洋理工大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) University of Electronic Science and Technology of China(电子科技大学) Shanghai Aerospace Electronic Technology Institute(上海航天电子技术研究所) Shanghai Key Laboratory of Collaborative Computing in Spacial Heterogeneous Networks (CCSN)(上海空间异构网络协同计算重点实验室(CCSN)) Shanghai Xiaoyuan Innovation center(上海小元创新中心)

AI总结 SKANet通过双流架构和自适应模态融合,实现对复合GNSS干扰的高效鲁棒分类。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12637 2026-01-21 cs.LG cs.AI q-bio.QM

Topology-Aware Multiscale Mixture of Experts for Efficient Molecular Property Prediction

基于拓扑的多尺度专家混合方法用于高效分子性质预测

Long D. Nguyen, Kelin Xia, Binh P. Nguyen

机构 * School of Mathematics and Statistics(数学与统计学学院) Victoria University of Wellington(威灵顿维多利亚大学) School of Physical and Mathematical Sciences(物理与数学科学学院) Nanyang Technological University(南洋理工大学)

AI总结 本文提出基于拓扑的多尺度专家混合方法,通过多尺度交互建模提升3D分子性质预测的效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12460 2026-01-21 cs.CR cs.LG

TrojanPraise: Jailbreak LLMs via Benign Fine-Tuning

TrojanPraise: 通过良性微调劫持LLM

Zhixin Xie, Xurui Song, Jun Luo

机构 * Nanyang Technological University(南洋理工大学)

AI总结 TrojanPraise通过良性微调利用过滤通过的数据,使LLM在无意识中顺从有害概念,成功率达95.88%

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12432 2026-01-21 cs.CV cs.MM

SkeFi: Cross-Modal Knowledge Transfer for Wireless Skeleton-Based Action Recognition

SkeFi: 无线传感器跨模态知识转移用于基于骨骼的动作识别

Shunyu Huang, Yunjiao Zhou, Jianfei Yang

机构 * School of Electrical and Electronics Engineering, Nanyang Technological University, Singapore(南洋理工大学电子与电气工程学院)

AI总结 SkeFi通过跨模态知识转移方法,利用无线传感器提升基于骨骼的动作识别性能,实现毫米波和LiDAR上的先进表现。

Comments Published in IEEE Internet of Things Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12331 2026-01-21 cs.CR cs.AI

Efficient Privacy-Preserving Retrieval Augmented Generation with Distance-Preserving Encryption

高效隐私保护检索增强生成与距离保持加密

Huanyi Ye, Jiale Guo, Ziyao Liu, Kwok-Yan Lam

机构 * College of Computing and Data Science(计算与数据科学学院) Nanyang Technological University(南洋理工大学)

AI总结 ppRAG通过CAPRISE加密技术,在不可信云环境中实现高效隐私保护的检索增强生成,提升隐私和效率,适用于资源受限用户。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09469 2026-01-21 cs.LG cs.AI

FairGU: Fairness-aware Graph Unlearning in Social Networks

FairGU: 社交网络中具有公平性的图去学习

Renqiang Luo, Yongshuai Yang, Huafei Huang, Qing Qing, Mingliang Hou, Ziqi Xu, Yi Yu, Jingjing Zhou, Feng Xia

机构 * Jilin University Changchun China Zhejiang Gongshang University Hangzhou China Adelaide University Adelaide Australia Jinan University \& TAL Education Group Guangzhou China RMIT University Melbourne Australia Nanyang Technological University Singapore Jilin University Zhejiang Gongshang University Adelaide University Jinan University \& TAL Education Group RMIT University Nanyang Technological University

AI总结 FairGU通过整合公平性模块和数据保护策略,提升社交网络中图去学习的公平性和实用性。

Comments 9 pages, 2 figs, WWW 2026 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00591 2026-01-21 cs.CV cs.AI cs.CR

Wukong Framework for Not Safe For Work Detection in Text-to-Image systems

Wukong框架用于文本到图像系统中的不安全内容检测

Mingrui Liu, Sixiao Zhang, Cheng Long

机构 * Nanyang Technological University(南洋理工大学)

AI总结 Wukong通过利用扩散过程早期的去噪步骤和U-Net的预训练交叉注意力参数,实现高效的不安全内容检测,优于传统文本和图像过滤方法。

Comments Accepted by KDD'26 (round 1)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09929 2026-01-21 eess.AS cs.AI cs.LG

Aligning Generative Speech Enhancement with Perceptual Feedback

将生成式语音增强与感知反馈对齐

Haoyang Li, Nana Hou, Yuchen Hu, Jixun Yao, Sabato Marco Siniscalchi, Xuyi Zhuang, Deheng Ye, Wei Yang, Eng Siong Chng

机构 * Nanyang Technological University, Singapore(南洋理工大学) Independent Researcher(独立研究者) Northwestern Polytechnical University, China(西北工业大学) University of Palermo, Italy(巴勒莫大学) Tencent(腾讯)

AI总结 本文提出了一种基于语言模型的语音增强方法,通过引入感知反馈和直接偏好优化,提升语音质量并建立新的感知对齐增强范式。

Comments Accepted to ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12286 2026-01-21 cs.CL cs.AI cs.CR

Conversational Context Classification: A Representation Engineering Approach

对话上下文分类:一种表示工程方法

Jonathan Pan

机构 * Nanyang Technological University Singapore(南洋理工大学新加坡)

AI总结 本文提出利用表示工程和一类支持向量机识别LLM内部状态中的上下文子空间,以提高对话上下文检测的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11990 2026-01-21 cs.CV

DAOS: A Multimodal In-cabin Behavior Monitoring with Driver Action-Object Synergy Dataset

DAOS: 一种基于驾驶员行为与物体协同的多模态舱内行为监测数据集

Yiming Li, Chen Cai, Tianyi Liu, Dan Lin, Wenqian Wang, Wenfei Liang, Bingbing Li, Kim-Hui Yap

机构 * School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(南洋理工大学电子与电气工程学院) College of Computer Science and Technology, Harbin Engineering University(哈尔滨工程大学计算机科学与技术学院) Singapore University of Technology and Design (SUTD), Singapore(新加坡科技设计大学) Continental Automotive Singapore Pte. Ltd.

AI总结 DAOS数据集通过多模态数据和动作-物体关系网络提升驾驶员行为识别的准确性与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11974 2026-01-21 cs.AI

Learn Like Humans: Use Meta-cognitive Reflection for Efficient Self-Improvement

像人类学习:利用元认知反思实现高效的自我改进

Xinmeng Hou, Peiliang Gong, Bohao Qu, Wuqi Wang, Qing Guo, Yang Liu

机构 * Nanyang Technological University(南洋理工大学) A*STAR Chang’an University(长安大学) Nankai University(南开大学)

AI总结 MARS通过整合基于原则和程序性的反思,实现高效自我改进,优于现有系统并降低计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11968 2026-01-21 cs.MM cs.SD eess.AS

MuseAgent-1: Interactive Grounded Multimodal Understanding of Music Scores and Performance Audio

MuseAgent-1: 交互式 grounded 多模态理解音乐谱面与表演音频

Qihao Zhao, Yunqi Cao, Yangyu Huang, Hui Yi Leong, Fan Zhang, Kim-Hui Yap, Wei Hu

机构 * Nanyang Technological University(南洋理工大学) Beijing University of Chemical Technology(北京化工大学) Microsoft(微软公司) University of Chicago(芝加哥大学)

AI总结 MuseAgent-1 是一个专注于音乐的多模态代理,通过结构化符号表示和多步骤推理,提升对音乐谱面和表演音频的交互式理解能力。

Comments Tech Report

详情

展开后加载摘要…

URL PDF HTML 收藏