arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-02-17 至 2026-02-17 共收录 17
2602.14941 2026-02-17 cs.CV cs.AI

AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories

AnchorWeave: 通过检索的局部空间记忆实现世界一致的视频生成

Zun Wang, Han Lin, Jaehong Yoon, Jaemin Cho, Yue Zhang, Mohit Bansal

机构 * Department of Computer Science, University of North Carolina, Chapel Hill(北卡罗来纳大学教堂山分校计算机科学系) Nanyang Technological University, Singapore(新加坡南洋理工大学)

AI总结 AnchorWeave通过检索局部空间记忆提升视频生成的长期场景一致性与视觉质量。

Comments Project website: https://zunwang1.github.io/AnchorWeave

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14534 2026-02-17 cs.CV

MoRL: Reinforced Reasoning for Unified Motion Understanding and Generation

MoRL: 用于统一运动理解与生成的强化推理

Hongpeng Wang, Zeyu Zhang, Wenhao Li, Hao Tang

机构 * The University of Sydney(悉尼大学) Peking University(北京大学) Nanyang Technological University(南洋理工大学)

AI总结 MoRL通过结合监督微调和强化学习,提升运动理解与生成的推理能力和现实感,并引入链式运动方法和大规模CoT数据集以增强推理效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14529 2026-02-17 cs.AI

Disentangling Deception and Hallucination Failures in LLMs

解构大语言模型中的欺骗与幻觉故障

Haolang Lu, Hongrui Peng, WeiYe Fu, Guoshun Nan, Xinye Cao, Xingrui Li, Hongcan Guo, Kun Wang

机构 * Beijing University of Posts(北京邮电大学) Nanyang Technological University(南洋理工大学)

AI总结 本研究提出一种机制导向的视角,解构大语言模型中幻觉与欺骗的不同故障机制,通过受控环境分析四种行为案例,揭示知识存在与行为表达的分离。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14518 2026-02-17 cs.AI

Diagnosing Knowledge Conflict in Multimodal Long-Chain Reasoning

多模态长链推理中的知识冲突诊断

Jing Tang, Kun Wang, Haolang Lu, Hongjin Chen, KaiTao Chen, Zhongxiang Sun, Qiankun Li, Lingjuan Lyu, Guoshun Nan, Zhigang Zeng

机构 * Huazhong University of Science and Technology(华中科技大学) Nanyang Technological University(南洋理工大学) Beijing University of Posts and Telecommunications(北京邮电大学) Renmin University of China(中国人民大学)

AI总结 本研究提出了一种统一的知识冲突概念,揭示了多模态长链推理中不同冲突类型的特征和处理机制,为诊断和控制推理失败提供了原理性方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14425 2026-02-17 cs.CV

Hierarchical Vision-Language Interaction for Facial Action Unit Detection

层次化视觉-语言交互用于面部动作单元检测

Yong Li, Yi Ren, Yizhe Zhang, Wenhua Zhang, Tianyi Zhang, Muyun Jiang, Guo-Sen Xie, Cuntai Guan

机构 * Key Laboratory of Child Development and Learning Science (Ministry of Education), School of Biological Sciences and Medical Engineering, Southeast University(儿童发展与学习科学重点实验室(教育部),生物科学与医学工程学院,东南大学) School of Computer Science and Engineering, Nanjing University of Science and Technology(计算机科学与工程学院,南京理工大学) School of Computer Science and Engineering, Nanyang Technological University(计算机科学与工程学院,南洋理工大学)

AI总结 HiVA通过层次化视觉-语言交互方法,利用文本描述和多模态注意力机制提升面部动作单元检测的鲁棒性和语义丰富性。

Comments Accepted to IEEE Transaction on Affective Computing 2026

Journal ref IEEE Transaction on Affective Computing 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14224 2026-02-17 cs.SD cs.CL cs.MM

The Interspeech 2026 Audio Reasoning Challenge: Evaluating Reasoning Process Quality for Audio Reasoning Models and Agents

Interspeech 2026音频推理挑战:评估音频推理模型和代理的推理过程质量

Ziyang Ma, Ruiyang Xu, Yinghao Ma, Chao-Han Huck Yang, Bohan Li, Jaeyeon Kim, Jin Xu, Jinyu Li, Carlos Busso, Kai Yu, Eng Siong Chng, Xie Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学) Queen Mary University of London(伦敦大学Queen Mary) NVIDIA(NVIDIA公司) Carnegie Mellon University(卡内基梅隆大学) Qwen Team, Alibaba Group(通义实验室,阿里巴巴集团) Microsoft Corporation(微软公司)

AI总结 Interspeech 2026音频推理挑战通过评估推理过程质量,探讨了音频推理模型和代理在事实性和逻辑性方面的表现及改进方向。

Comments The official website of the Audio Reasoning Challenge: https://audio-reasoning-challenge.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13801 2026-02-17 cs.CV

Joint Orientation and Weight Optimization for Robust Watertight Surface Reconstruction via Dirichlet-Regularized Winding Fields

联合方向与权重优化用于通过狄利克雷正则化缠绕场实现稳健的紧致表面重建

Jiaze Li, Daisheng Jin, Fei Hou, Junhui Hou, Zheng Liu, Shiqing Xin, Wenping Wang, Ying He

机构 * Nanyang Technological University(南洋理工大学) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学) City University of Hong Kong(香港城市大学) China University of Geosciences (Wuhan)(中国地质大学(武汉)) Shandong University(山东大学) Texas A&M University(德克萨斯大学)

AI总结 DiWR通过联合优化点方向、权重和置信系数,实现从非均匀采样点云中稳健重建紧致表面。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13778 2026-02-17 cs.CV

Skeleton2Stage: Reward-Guided Fine-Tuning for Physically Plausible Dance Generation

Skeleton2Stage: 基于奖励的微调以生成物理合理的舞蹈生成

Jidong Jia, Youjian Zhang, Huan Fu, Dacheng Tao

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Bosch(博世) Youku, Alibaba(优酷、阿里巴巴) Nanyang Technological University(南洋理工大学)

AI总结 Skeleton2Stage通过物理奖励引导微调,提升舞蹈生成的物理合理性与真实感。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07139 2026-02-17 cs.CV cs.CR cs.LG

Image Can Bring Your Memory Back: A Novel Multi-Modal Guided Attack against Image Generation Model Unlearning

图像能帮你找回记忆:一种新颖的多模态引导攻击对抗图像生成模型去学习

Renyang Liu, Guanlin Li, Tianwei Zhang, See-Kiong Ng

机构 * Institute of Data Science, National University of Singapore(数据科学研究所,新加坡国立大学) S-Lab, Nanyang Technological University(南洋理工大学S实验室) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

AI总结 Recall提出一种新颖的多模态引导攻击框架,针对图像生成模型去学习的鲁棒性进行攻击,展示其在对抗有效性、计算效率和语义保真度上的优势。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00527 2026-02-17 cs.RO

DeCo: Task Decomposition and Skill Composition for Zero-Shot Generalization in Long-Horizon 3D Manipulation

DeCo:用于长周期3D操作零样本泛化任务分解与技能组合

Zixuan Chen, Junhui Yin, Yangtao Chen, Jing Huo, Pinzhuo Tian, Jieqi Shi, Yiwen Hou, Yinchuan Li, Yang Gao

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院) School of Computing, National University of Singapore(新加坡国立大学计算机学院) Huawei Noah’s Ark Lab (AI Lab), China(华为诺亚实验室(AI实验室))

AI总结 DeCo通过任务分解与技能组合提升长周期3D操作任务的零样本泛化能力,显著提高多个模型在新任务上的成功率。

Comments RAL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13640 2026-02-17 cs.RO cs.AI

Hierarchical Audio-Visual-Proprioceptive Fusion for Precise Robotic Manipulation

层次化音频-视觉-本体感知融合用于精确机器人操作

Siyuan Li, Jiani Lu, Yu Song, Xianren Li, Bo An, Peng Liu

机构 * Harbin Institute of Technology, China(哈尔滨工业大学) Nanyang Technological University, Singapore(南洋理工大学)

AI总结 本文提出层次化多模态融合框架,通过整合音频、视觉和本体感知信息,提升机器人精确操作性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13313 2026-02-17 cs.CV cs.AI

Agentic Spatio-Temporal Grounding via Collaborative Reasoning

基于协作推理的代理时空 grounding

Heng Zhao, Yew-Soon Ong, Joey Tianyi Zhou

机构 * CFAR, IHPC, Agency for Science, Technology and Research(A*STAR)(CFAR、IHPC、新加坡科技研究局) CCDS, Nanyang Technological University(CCDS、南洋理工大学)

AI总结 本文提出ASTG框架,通过协作推理实现开放世界下的时空视频grounding,提升检索效率并优于现有弱监督和零样本方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13227 2026-02-17 cs.NI cs.AI

An Agentic AI Control Plane for 6G Network Slice Orchestration, Monitoring, and Trading

面向6G网络切片编排、监控与交易的代理式AI控制平面

Eranga Bandara, Ross Gore, Sachin Shetty, Ravi Mukkamala, Tharaka Hewa, Abdul Rahman, Xueping Liang, Safdar H. Bouk, Amin Hass, Peter Foytik, Ng Wee Keong, Kasun De Zoysa

机构 * Florida International University, USA(佛罗里达国际大学) Center for Wireless Communications, University of Oulu, Finland(无线通信中心,奥卢大学) Accenture Technology Labs, Arlington, VA, USA(埃森哲技术实验室) Nanyang Technological University, Singapore(南洋理工大学)

AI总结 本文提出面向6G网络切片编排、监控与交易的代理式AI控制平面,通过市场感知编排和自然语言接口实现经济导向的智能控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13210 2026-02-17 cs.NI cs.AI cs.LG

Large Language Model (LLM)-enabled Reinforcement Learning for Wireless Network Optimization

基于大语言模型的强化学习用于无线网络优化

Jie Zheng, Ruichen Zhang, Dusit Niyato, Haijun Zhang, Jiacheng Wang, Hongyang Du, Jiawen Kang, Zehui Xiong

机构 * State-Province Joint Engineering and Research Center of Advanced Networking and Intelligent Information Services, College of Computer Science, Northwest University(高级网络与智能信息服务省-市联合工程与研究中心,计算机科学学院,西北大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) Institute of Artificial Intelligence, University of Science and Technology Beijing(人工智能研究院,北京科技大学) Department of Electrical and Electronic Engineering, the University of Hong Kong(电子与电气工程系,香港大学) Automation of School, Guangdong University of Technology(自动化学院,广东工业大学) Queen’s University Belfast(贝尔法斯特女王大学)

AI总结 本文提出利用大语言模型增强强化学习,以优化6G无线网络,通过多智能体强化学习框架提升网络性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07506 2026-02-17 cs.RO cs.AI cs.HC

VividFace: Real-Time and Realistic Facial Expression Shadowing for Humanoid Robots

VividFace: 人形机器人实时逼真面部表情阴影生成

Peizhen Li, Longbing Cao, Xiao-Ming Wu, Yang Zhang

机构 * School of Computing, Macquarie University(麦考瑞大学计算机学院) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机与数据科学学院) Anuradha and Vikas Sinha Department of Data Science, University of North Texas(北卡罗来纳州立大学数据科学系)

AI总结 VividFace通过优化的模仿框架和实时推理管道,实现人形机器人逼真面部表情阴影生成,提升人机交互的真实感和实用性。

Comments Accepted to the 2026 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09407 2026-02-17 cs.CV

Geometry-to-Image Synthesis-Driven Generative Point Cloud Registration

基于几何到图像合成的生成式点云配准

Haobo Jiang, Jin Xie, Jian Yang, Liang Yu, Jianmin Zheng

机构 * ANGEL CorpLab and College of Computing and Data Science, Nanyang Technological University, Singapore(ANGEL CorpLab和计算与数据科学学院,南洋理工大学,新加坡) Alibaba Cloud, Alibaba Group, China(阿里巴巴云,阿里巴巴集团,中国) PCA Lab, VCIP, College of Computer Science, Nankai University, China(PCA实验室,VCIP,计算机科学学院,南开大学,中国) State Key Laboratory for Novel Software Technology & Schoolof Intelligence Science and Technology, Nanjing University, China(新型软件技术国家重点实验室与智能科学与技术学校,南京大学,中国)

AI总结 本文提出生成式点云配准方法,通过生成跨视角一致的图像对,结合几何与颜色特征融合,提升3D配准性能。

Comments Journal extension of the ICML 2025 paper "Generative Point Cloud Registration". This version adopts a new title, and includes substantial methodological improvements, additional experiments, and extended analysis. Under review at IEEE TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16701 2026-02-17 cs.AI

An Agentic Framework with LLMs for Solving Complex Vehicle Routing Problems

基于大语言模型的代理框架用于解决复杂车辆路径问题

Ni Zhang, Zhiguang Cao, Jianan Zhou, Cong Zhang, Yew-Soon Ong

机构 * School of Computing and Information Systems, Singapore Management University(计算与信息系统学院,新加坡管理大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

AI总结 本文提出基于大语言模型的代理框架AFL,实现复杂车辆路径问题的完全自动化,通过分解任务和协调代理提升解决方案的可靠性和可行性。

Comments Accepted by iclr2026

详情

展开后加载摘要…

URL PDF HTML 收藏